新闻 > 军政 > 正文

比芯片封锁更要命 中共面临新瓶颈

 

阿波罗网王笃若报导/继芯片之后,中共AI又撞上另一堵墙!

尽管美国封锁先进运算芯片占据了新闻头条,但中共AI专家却日益警告,事实恐怕会证明,优质数据枯竭,可能成为国家科技雄心的下一个主要瓶颈,而这可能是无法轻易靠硬件替代方案来解决的问题。

在打造下一代人工智能模型的高风险竞赛中,中共正进入一个关键新阶段——一个较不显眼、但远远更具存亡意义的威胁正逐渐浮现,那就是高质量训练数据严重短缺。

据中共大外宣《南华早报》8日报道,这挑战正同时冲击太平洋两岸的AI巨头,部分美国企业已采取积极手段以保持领先。美国研究机构Epoch AI表示,全球高质量、公开可用的人类生成文本供应,可能会在未来6年内耗尽;OpenAI共同创办人卡帕西也警告,2030年结束前将出现"数据墙",若没有新鲜可靠的资讯喂养,模型能力可能陷入停滞。美国顶尖实验室正大手笔投资挖掘线下的人类知识,引发了激烈的伦理争论——今年1月《华盛顿邮报》报道的法庭文件显示,Anthropic在亚马逊支持下启动"巴拿马计划",斥资数千万美元收购数百万本实体书,拆除装订、扫描每一页后再加以丢弃,此举引发作家、档案管理员及文化资产保存者的强烈谴责,指控科技公司把人类遗产当成可抛弃的原料;Anthropic一名代表则回应,其数据获取计划"从未购买并销毁'稀有'或'古董'书"。

而对中共来说,即将到来的"数据墙"构成了更独特的威胁。中国信息通信研究院院长余晓晖指出:"人工智能创新的竞争,不仅是模型和算力的竞争,更是高质量数据供给体系的竞争。"网络追踪机构W3Techs本月数据显示,英文占全球网络内容近一半,中文却仅占1.3%,远远落后西班牙文的6%、德文的5.9%与日文的5%。

北京正积极将数据视为核心战略资产——中共国家数据局6月公布一项全面的全国性计划,目标是提升高质量AI训练数据的供应、流通与商业化。中共电脑科学家指出,国家不能只依赖标准网络爬取,而必须系统性推动数字化庞大、尚未开发的离线资产。清华大学人工智能研究院常务副院长孙茂松上个月在《光明日报》撰文强调:"语料库在大语言模型发展中扮演关键角色,已演变成支撑AI能力迭代的核心要素。没有语料库,就没有语言大模型。"

阿波罗网评论员王笃然指出:"中文网络内容占比不到2%,这个数字戳破了一个假象——中共这些年拼命封锁、审查、删帖,砍掉的不只是言论自由,也顺手砍断了自己AI崛起最需要的原材料。""审查删掉的每一条帖子,都是喂不进AI模型的一粒沙。"

阿波罗网责任编辑:zhongkang

来源:阿波罗网王笃若报导

转载请注明作者、出处並保持完整。

家在美国 放眼世界 魂系中华
Copyright © 2006 - 2026 by Aboluowang

免翻墙 免翻墙链接