Current AI 构建开放离线 AI 基础设施

TechCrunch AI··作者 Kate Park

关键信息

Current AI 由 Martin Tisne 于 2025 年 2 月创立,并表示其以公私合作伙伴关系运作,资金来自政府、企业和慈善机构,而不是投资者。报道提到其已承诺资金总额达到 4 亿美元,其中包括法国政府提供的 1 亿美元种子资金,以及 Ford Foundation、MacArthur Foundation、DeepMind 和 Salesforce 的支持。

资讯摘要

TechCrunch 表示,Current AI 试图解决一个简单但影响深远的问题:如今的 AI 系统掌握在私营公司手中,而许多社区又因为语言、网络连接和数据所有权等障碍被排除在外。该组织最显眼的项目之一是 Suno Sutra,这是一款与印度政府 AI 语言部门 Bhashini 合作打造的口袋大小离线设备,并在 India AI Summit 上亮相。这个设备可以在没有互联网连接的情况下运行 22 种印度语言的 AI,而且已经开源,方便开发者社区在其基础上继续开发。Current AI 首席执行官 Ayah Bdeir 表示,他们希望打造一种类似早期万维网的公共 AI 层,做到任何人都能免费使用。Bdeir 于 1 月加入该组织,此前她负责 Mozilla 的 AI 战略,还曾创办 littleBits。

她认为,英语主导的大模型正在让世界上大量语言和文化被边缘化。她还批评大科技公司的多语言布局更多是为了扩张市场,而不是出于社区授权和语境尊重,尤其在原住民语言场景中,早期传教士圣经翻译甚至会先于社区规则成为训练数据。报道还提到,Current AI 已向肯尼亚、黎巴嫩和巴西亚马逊地区的项目发放了 320 万美元资助,覆盖语言数据集、文化数字化、面向原住民社区的离线 AI 工具,以及用于 AI 监督问责的审计工具。TechCrunch 还指出,该非营利组织由 Martin Tisne 于 2025 年 2 月创立,并在政府、基金会和科技公司支持下,定位为公共利益 AI 平台。

Current AI 构建开放离线 AI 基础设施

资讯正文

印度农村的一位农民正在拍摄一株濒死植物的照片。她想上网研究它,但她不会说英语。她本不必如此。

这正是名为 Current AI 的非营利组织试图通过建设开放、公共的 AI 基础设施来解决的问题。今年 2 月,在 India AI Summit 上,它与印度政府的 AI 语言部门 Bhashini 合作。由此诞生了 Suno Sutra,印地语意为“聆听纪事”,这是一款口袋大小、可离线运行的设备,能够在 22 种印度语言中运行 AI,无需互联网。“在印度,有数百种不同的语言和方言,而现在 AI 并没有代表它们,”Current AI CEO Ayah Bdeir 在接受 TechCrunch 采访时说。该设备已开源,开发者社区可以基于它进行构建。

这个非营利组织由 Martin Tisne 于 2025 年 2 月创立,动作很快。上个月,它向四家组织中的多个项目拨付了 320 万美元的资助;最近,它又在日内瓦举行的 AI for Good Summit 上发布了一款开源 AI 聊天机器人。

Bdeir 于 1 月加入,之前她领导 Mozilla 的 AI 战略。她此前创立了 littleBits,这家 STEM 教育公司在 2019 年出售给 Sphero 之前,曾覆盖数百万儿童。

Bdeir 告诉 TechCrunch,Current AI 以一种“公私合作伙伴关系”的方式运作,把政府、企业和慈善机构聚集起来,为公共利益技术提供资金。法国政府向 Current AI 注资 1 亿美元,Ford Foundation、MacArthur Foundation、DeepMind 和 Salesforce 随后加入,使已承诺的总资金达到 4 亿美元。“他们不是投资者;他们是资助者,”Bdeir 说。

它试图解决的问题很直接:如今每一个主要 AI 系统,从 OpenAI 到 Google 再到 Anthropic,都属于私营公司。“如果 AI 真的是一种变革性技术,如果它将改变每个人生活的方方面面,那么就必须有一个公共替代方案,”Bdeir 说。“就像 World Wide Web 一样,任何人都可以免费使用。”

世界上一半的口语语言正面临消失。“而随着英语推动最大的语言模型和 AI 系统,世界上大量语言,以及由此延伸出的文化和社区,都被落在了后面,”Bdeir 说。

当被问及大型科技公司的多语言推进时,Bdeir 划出了鲜明的界限。“大型科技公司构建多语言模型是为了扩大市场,”她说,“无论是否获得同意、无论语境如何。”其后果是具体的。“对于原住民语言而言,传教士的《圣经》翻译会在社区尚未制定任何规则之前,先一步成为训练数据,”她说。

不仅仅是语言

AI 能否说一种语言,只是它需要学习内容的一部分。“语言是知识、传统、记忆和身份从一代传到下一代的方式。所以,当一项技术不会说你的语言时,它也就无法承载你的文化,”她说。

她对 Current AI 的设想,是一个以早期网络为蓝本的开放系统:改进惠及所有人,没有人被拒之门外,社区则保留对自身数据的控制权。

上个月公布的 Current 首轮资助,涉及向肯尼亚、黎巴嫩以及巴西亚马孙地区的四个组织投入 320 万美元。

其中,位于肯尼亚 Masakhane 的项目正在构建覆盖 50 多种非洲语言的 AI 数据集,应用于医疗、农业和教育;黎巴嫩的 Institute for Worldmaking 正在把阿拉伯文化历史和当代实践数字化为可机器读取、由社区而非科技公司控制的数据库。巴西的 Portal sem Porteiras 正在与亚马孙原住民社区一起打造离线 AI 工具,并将数据保留在当地。与此同时,肯尼亚的 African Internet Rights Alliance 正在开发审计工具,以在整个非洲大陆对 AI 系统进行问责。

谁拥有这些数据?

谈到数据所有权问题时,Bdeir 直言不讳。她告诉 TechCrunch:“关于在不同社区中谁拥有数据,有不同的模式和提议,但有一点是肯定的:绝不应该由硅谷的一家公司试图让少数几千人变得更富有。”

这个非营利组织的做法是将模型和数据本地存储,在任何事情开始构建之前就引入社区专家,或者把同意协议写入流程,让社区可以在任何时点叫停这一过程。

Current AI 的受资助者目前还没有完全解决这个问题。但 Bdeir 认为,这正是重点所在。她说:“他们每一个都把这个问题纳入了自己的工作之中,”而不是接受通常的默认做法——把复杂性当成借口,任由政府或科技公司替所有人做决定。

至于在 320 万美元预算分给四个组织的情况下能取得多大进展,Bdeir 说:“规模并不总是衡量标准。这是 Big Tech 的范式,”她说。“这也许会表现为:巴西亚马孙地区的一位原住民长者,使用一款在肯尼亚打造的工具,用自己的语言传承生态知识。”

构建技术栈

本月早些时候在日内瓦,Current 推出了 Alpha Chat,这是一款开源聊天机器人,由包括 Hugging Face、Mozilla 和 MIT Media Lab 在内的 10 个组织联盟在 7 周内组装完成。每个贡献者都提供了技术栈的一部分,包括语言模型、安全工具和算力。

Current AI 还与总部位于东京的初创公司 Sakana AI 达成了一项合作协议,后者因其所谓的 Sovereign AI 相关工作而闻名。这两个组织计划共同构建一套共享的开源 AI 技术栈,其设计目标是支持日语和日本文化,同时也服务于全球南方那些长期被主流 AI 系统忽视的社区。

来源与参考

  1. 原始链接
  2. Nonprofit Current AI is racing to build the World Wide Web of AI, free for all | TechCrunch

收录于 2026-07-20