仅仅两天后,巴西里约热内卢市政府全资拥有的一家IT公司,在著名的AI开源社区Hugging Face上公开发布了一个拥有3970亿参数的超大模型,以极其宽松的MIT许可证向全球任何人免费提供下载和使用权限 。
这个模型名为 Rio 3.5 Open 397B。它的发布,瞬间成为全球在人工智能的技术获取、主权归属和尖端能力去中心化等议题上的一个标志性事件。然而,我们需要将这一事件背后的政治象征意义与技术事实区分开来审视。
首先,我们需要澄清它的“出身”。这并非一个由某个草根政府IT团队从零开始训练的全新模型。该模型由里约热内卢市政府的市政技术公司IplanRIO开发,其基础是阿里巴巴通义千问团队的Qwen 3.5-397B-A17B,一个性能强大的开源基础模型 。开发团队描述其过程为:先进行模型融合,然后使用一个更强的模型进行在策略蒸馏 。
随后的社区分析表明,这次融合是一个简单的权重组合:由大约 0.6 的开源模型 Nex N2 Pro 和 0.4 的 Qwen 3.5 组成 。实际上,与其说Rio 3.5是一个全新的架构,不如说它是一个极为有效的“重新组合”版本,但最终的测试成绩才是让全球震惊的原因。
尽管如此,从官方模型卡中提取的技术规格仍然是令人印象深刻的 :
IplanRIO在Hugging Face上的模型卡中,列出了大量惊人的基准测试成绩,显示其性能大幅超越基础模型Qwen 3.5,并能与全球顶尖的开源及闭源系统一较高下 。其中被最广泛引用和讨论的几项包括:
该模型卡还声称,Rio 3.5在五项直接的性能对比中,有四项击败了阿里巴巴自家后来更新的Qwen 3.7 Plus 。如果这些成绩能够得到独立验证,那么一个市政府旗下团队的微调版本,就足以跻身全球最具竞争力的开源模型第一梯队,尤其在智能体编程与推理任务上。
尽管宣传声势浩大,但这一发布行为也伴随着一些不容忽视的严重疑点,足以给任何过度的乐观情绪降温。
1. 文件上传出了严重纰漏。 Hugging Face页面上的说明文档本身,就给出了一个严重的自我检讨。该团队承认,他们最初上传的是错误的版本——一个基础的融合模型而非最终蒸馏后的版本——并不得不重新上传正确的权重。“对于造成的混淆,我们深表歉意并诚恳致歉,”模型卡中如此写道 。任何关于性能的声明,都应基于一个事实:在某个时间段内,可供公开下载的模型文件,可能并非那个在基准测试中大杀四方的版本。
2. 缺乏独立的第三方验证。 所有让人眼前一亮的性能数据,都是该团队在模型卡中自行报告的第一手数据。截至发布之日,没有任何第三方机构对这些结果进行了复现 。若无外部验证,我们无法确定蒸馏过程是否真的带来了如在Terminal-Bench上暴涨20个点的巨大提升,抑或这些数字存在虚高。
3. 这是一次新颖的“重混”,而非全新的模型。 其所报告的训练方法——对现有模型进行融合和蒸馏——在技术上,与那些定义前沿实验室真正水平的、从零开始的巨量训练有着本质区别 。社区的探索者们很快识别出此模型是Nex N2 Pro和Qwen 3.5的权重融合体,这促使Nex团队评价道:“反转来了?它本质上就是我们的开源模型Nex N2 Pro,只是换了顶帽子而已。” 这个版本的成就更多在于整合与对齐,而非基础科学上的突破。
只有将其置于此前48小时的历史性背景下,才能完全理解Rio 3.5 Open 397B的真正分量。
在2026年6月12日晚,Anthropic公司收到了美国商务部的指令,要求其以国家安全关切为由,阻止所有外国公民访问其两款最强大的模型——Claude Fable 5和Mythos 5。原因据称是担忧一个潜在的“越狱”漏洞 。由于Anthropic无法在技术上实时区分其用户中的美国人和外国人,它被迫将这两款模型面向全世界所有用户彻底下线 。
美国此举是历史性的:这是第一次,一个政府直接并成功地下令召回一批已经投入商业使用、特定的AI模型 。此举立即引发了关于AI出口管控及欧洲对美国技术过度依赖的热烈讨论 。
而填补这一真空的,是来自巴西的一家市政IT机构。全球AI治理的两种主导路线,在一个新闻周期内上演了最极致的对比:
这个故事,简直是人工智能地缘政治变迁的一个近乎完美的案例研究。它表明,尖端的AI能力,如今不仅可以由超级大国和身价亿万的初创公司构建和分发,也可以由一个坚定决心、善用全球开源供应链的地方市政IT部门来实现 。即使Rio 3.5最后被证明更像是一次聪明的工程壮举和政治秀,而非纯粹的研究突破,它出现的时机也确保了其将被铭记为对AI保护主义的一记标志性反击。