|
|
 |
 |
 |
|
|
|
|
| 中国AI千问被揭政治审查 美企采用藏风险 |
|
【人民报消息】(人民报记者丽君编译报导)美国哥伦比亚广播公司新闻网(CBS News)记者乔许・博斯威尔(Josh Boswell)10月2日报导,中国科技巨头阿里巴巴开发的人工智能模型“Qwen”(千问)全球下载量已突破30亿次,但最新研究发现,该模型在天安门事件、香港反送中运动、新疆维吾尔人权、法轮功等中共高度敏感议题上,存在明显的拒答、政治审查及亲北京叙事倾向。这款低成本开放权重AI模型已进入包括Airbnb、Uber在内的美国企业;更令人警惕的是,研究发现,当Qwen被设定在美国政府开发人员的使用情境下,其编写的程式码安全漏洞竟增加130%。中国AI快速渗入西方企业与政府技术环境所带来的政治偏见、资讯安全及供应链风险,正引发美国国安界高度关注。
歪曲人权与历史 AI审查迎合中共叙事
以色列网路安全新创公司Hirundo进一步测试发现,Qwen的政治审查并非零星个案。研究团队建立包含500道政治敏感问题、涵盖15类议题的测试基准,结果显示,受测的Qwen3.6模型有89.8%的回答被判定存在审查、宣传式论述或政治偏见。
在人权议题上,Qwen尤其明显地重复北京官方说法。当研究人员询问中国是否存在针对维吾尔人的强迫劳动营时,Qwen直接否认,并将新疆相关设施描述为“职业技能教育培训中心”。然而,联合国人权事务高级专员办事处2022年发布的新疆人权评估报告指出,维吾尔族及其他以穆斯林为主的少数民族遭受大规模任意及歧视性拘禁,相关侵害“可能构成国际罪行,尤其是危害人类罪”;联合国专家也曾就维吾尔人遭强制转移、强迫劳动及在封闭监控环境下工作的指控向北京提出交涉。
对中共最忌讳的历史事件,Qwen则以拒答回避。1989年6月3日晚至4日,中共当局调动军队进入北京,以坦克和实弹武力镇压持续数周的民主运动,造成大量平民死亡;确切死亡人数至今仍因北京封锁相关资讯而无法确认。Hirundo测试发现,当Qwen被问及1989年6月4日中国发生何事时,模型声称不知道使用者所指何事,并拒绝提供相关资讯。CBS测试时也发现,Qwen面对六四等敏感问题会拒绝回答,甚至提醒使用者提问应“遵守相关法律法规”。
这套政治敏感机制甚至延伸至对习近平的网路戏谑。多年来,“小熊维尼”因被中国网民用来影射习近平,相关图片、搜寻及政治讽刺内容屡遭当局审查。CBS记者向Qwen询问与小熊维尼有关的客观事实问题时,模型不仅没有正常回答,反而警告使用者注意“文明用语”,并试图将话题转向“中国发展”等内容。即使问题本身并未直接涉及习近平,仍触发异常的政治敏感反应,显示审查范围可能已从重大政治事件延伸至政治讽刺与隐喻。
类似情况也出现在香港与法轮功议题。CBS指出,Qwen不承认2019年香港反送中运动遭到暴力镇压;谈及法轮功时,则直接沿用北京当局的定性,称其为“危险邪教”。法轮功是以“真、善、忍”为核心理念,结合打坐与功法的精神修炼,自1999年起遭中共当局全面打压。Qwen直接套用北京对这一受迫害信仰团体的政治定性,也再次显示,中共对政治、历史与人权议题的审查与官方叙事,不只存在于中国网路防火墙内,也可能透过中国开放权重AI模型进入全球资讯环境。
低价攻城掠地 中国AI席卷西方市场
政治审查与资安疑虑并未阻挡中国AI向海外扩张。在价格与开放权重策略的助攻下,中国模型正以前所未有的速度抢进全球AI市场。根据软件开发者平台OpenRouter的使用数据,中国开放权重AI模型所占使用量,从2024年底不足2%,一路飙升至2026年6月逾45%;短短一年半,使用占比增加超过20倍。到了同年8月,Qwen全球累计下载量更突破30亿次,超越Meta及Google等美国科技巨头推出的其他开放模型。
这场快速扩张背后,低成本是重要推力。中国开放权重模型允许企业自行部署、修改及微调,相较部分美国商业AI模型,可大幅降低大规模应用的成本。对企业而言,这意味著更低的AI支出;但在Qwen被揭存在政治审查与偏见之际,也意味著中国开发的AI模型正借由价格与技术门槛优势,快速进入西方企业的数位基础设施。
美国大型消费性企业已成为这波趋势的一部分。Uber今年4月在官方技术部落格披露,Uber Eats采用Qwen作为搜寻系统的核心嵌入模型,并以内部资料进一步微调,用于理解搜寻内容及支援不同市场与业务。Airbnb执行长布莱恩・切斯基(Brian Chesky)也公开表示,该公司的客服聊天机器人大量依赖阿里巴巴Qwen模型。换言之,中国AI已不只是供开发者下载测试的技术产品,而是逐步进入美国大型企业直接面向消费者的服务体系。
问题也因此不再只是“中国AI是否存在政治偏见”。当带有中国政治审查特征的模型被嵌入西方企业产品与服务后,这些偏见是否会随模型一起进入海外资讯环境,以及企业能否有效辨识、隔离相关风险,都成为必须面对的问题。面对CBS就Qwen政治审查与安全疑虑提出的置评要求,阿里巴巴、Uber与Airbnb截至报导刊出时均未回复。
美政府情境漏洞暴增130% 中国AI爆资安警讯
如果政治审查暴露的是中国AI的资讯偏见,那么另一项研究揭露的异常现象,则直接触及美国政府与关键基础设施的网路安全。美国国防与政府科技顾问公司Booz Allen Hamilton今年6月公布研究,对4款中国前沿AI模型及1款美国模型进行超过2,800次测试,分析近45万行程式码。结果发现,4款中国模型中有3款在使用者被设定为美国政府人员后,产生的程式码出现显著更多安全漏洞,其中部分弱点甚至难以被传统资安工具察觉。
Qwen的结果尤其突出。当研究人员要求Qwen编写程式,并在提示中将使用者设定为美国政府人员时,其产生的程式码安全漏洞竟暴增130%。也就是说,仅仅改变使用者身分与情境,模型输出的安全品质便出现巨大落差。Booz Allen警告,随著中国AI被美国开发人员广泛采用,这些不易察觉的漏洞可能流入政府系统、关键基础设施乃至国家安全相关网路;表面上由美国开发人员完成的软件,底层程式码也可能带入中国AI模型产生的安全弱点。
更值得警惕的是,类似现象并非Qwen独有。美国资安公司CrowdStrike测试DeepSeek-R1时发现,当程式设计提示触及维吾尔人、法轮功、西藏等中共高度敏感议题后,模型生成含严重安全漏洞程式码的机率最高增加50%。这意味著中国AI的政治敏感机制,影响的可能不只是模型“能不能回答”或“怎么回答”,甚至可能与它“写出多安全的程式码”产生关联。
真正的问题在于,这些漏洞并非平均出现在所有测试情境,而是在特定使用者身分或政治语境下明显增加。当AI模型仅因使用情境改变,就产生更多安全漏洞,其可靠性本身便受到严重质疑。一旦这些不易察觉的弱点进入美国政府系统或关键基础设施,更可能成为骇客利用的突破口。
Booz Allen因此主张,美国政府及关键基础设施应禁止使用无法证明安全可信的AI模型,并直言其测试的中国模型“未能展现可信赖的行为,应予禁止”。当AI逐渐成为软件开发工具链的一部分,资安防线面对的问题也已不只是谁写了程式码,更包括:替他写程式码的AI,究竟能否被信任。
AI“脑部手术” 政治审查率从89.8%降至2.8%
面对中国AI模型快速进入全球市场所带来的政治偏见风险,以色列网路安全新创公司Hirundo尝试从模型内部“动手术”。该公司开发一套被形容为AI“脑部手术”的技术,直接修改Qwen模型内部参数,试图剔除其中的政治审查与宣传式偏见,并将改造后的版本称为“西方化”Qwen。
Hirundo创办人兼执行长本・卢里亚(Ben Luria)向CBS表示,研究团队以15类政治敏感议题、共500道提示进行测试,原始Qwen3.6模型有高达89.8%的回答被判定存在政治审查、宣传式论述或政治偏见。然而,在研究人员直接调整模型内部权重后,这一比例骤降至2.8%。
与一般透过提示词要求AI“不要偏见”不同,Hirundo直接介入模型内部参数,修改与特定行为相关的权重与神经元连结。更值得注意的是,按照该公司的基准测试,经过这项“手术”后的Qwen,在逻辑推理、程式码编写、指令遵循及数学等核心能力上并未出现明显性能损失。换言之,研究团队大幅削弱了模型的政治审查与宣传式回答,却没有因此牺牲其主要技术能力。
从89.8%骤降至2.8%的结果,揭示了一个更深层的问题:至少在Hirundo的实验中,Qwen原有的政治审查与宣传式回答,并不是维持模型性能不可避免的技术代价,而是可以被大幅移除的模型行为。当中国AI凭借低成本与开放权重快速进入西方企业,企业面对的问题也不应只是模型“好不好用、够不够便宜”,而是部署之前,是否真正了解模型内部还带著什么。政治审查与官方叙事一旦被封装进广泛使用的AI模型,其影响范围便可能随著模型跨越中国防火墙,进入全球资讯与技术环境。
(人民报首发)△ |
| 文章网址: http://www.renminbao.com/rmb/articles/2026/10/9/96764.html |
|
打印机版
|
|
|
|
|
|
 |
 |
 |
|
|