今年以来我的一个体验:当我用中文向AI提问的时候,发现大AI给出的回答,大量直接取材于简中圈的资源,在时事新闻这个领域,就是直接从中国大陆的网络内容中去找答案,造成得到的回答非常“亲共”,也就是说:在信息源头上高度被污染。
这方面谷歌的gimini被污染得最为严重,有时候我感到它和中国的Deepseek,豆包差别也不大。经常给出的回答是:“根据我国的什么什么法规...”,感觉Google Gemini已经移民中国了。
毕竟互联网上中文的内容,来自中国大陆的占了90%以上。海外的几大模型,为了追求用户体验的流畅度,增加了直接从中国大陆抓取数据的权重;而不是从全球范围内抓取,再自动翻译成英文,那要耗费更多算力,用户等待时间也过长。
有一种未经证实的猜想是,中共那边搞了些针对性的手腕,用自己的AI工具,向Gemini等对话模型诱导性地提问,训练它们给出与中共官宣接近的回答。用AI训练AI,去把国外的AI模型给洗脑了,给PUA了。😅这叫“模型对齐污染”,在理论上是完全可行的。
我日常要用到AI工具,做新闻辅助研究,从这个角度的体验看,这个变化今年尤其明显。以至于我在用Gemini之后,经常要回一句:“你的回答太接近中共官宣了,请更多取材独立的消息来源,平衡作答”。然后Gemini说:“你说得很对,我会调整自己的回答方式...”然后才叭拉叭拉找出另一堆消息来源。
对于我们这些自媒体创作者来讲,一个很现实的压力就是,YouTube以AI来管理内容,对我们这类对中共持鲜明批判态度的博主,变得非常不友好。搞得AI被训练得很仇视我们了。😅视频动辄被限流、减少推荐。尤其是2026年以来,这种状况正以每个月都在变得更糟糕的速度恶化。