這個舉動,猶如在 AI 權力遊戲的棋盤上,投下了一枚象徵意味濃厚的棋子。它讓 AI 的「可及性」、「主權」與「去中心化」辯論,瞬間進入了全新的層次。但在此之前,我們必須把政治象徵意義和技術現實分開來看。
首先要釐清它的血統。這不是一個由一群克難的政府 IT 團隊從零打造的原創模型。它是由里約熱內盧市政府的市政科技公司 IplanRIO,以阿里巴巴的開源權重基礎模型 Qwen 3.5-397B-A17B 為基礎,進行「後訓練」所創造出來的 。開發團隊描述其過程為:先進行模型合併,再以一個更強大的模型為師,進行「在策略蒸餾」。
後續的社群分析更進一步指出,這個合併的配方相當單純:大約是 0.6 的「Nex N2 Pro」加上 0.4 的「Qwen 3.5」權重混合而成 。換句話說,Rio 3.5 本質上是一個非常高明的「混音」作品,而非全新的基礎科學突破。但真正讓全球目光聚焦的,是它宣稱的效能表現。
儘管如此,其官方模型卡上所載明的技術規格依然令人印象深刻 :
IplanRIO 在 Hugging Face 上的模型卡中,展示了一系列驚人的數據,不僅相較其基底模型 Qwen 3.5 有巨幅提升,甚至足以與全球最頂尖的開放及封閉原始碼系統一較高下 。最常被引用的比較如下:
更驚人的是,模型卡宣稱 Rio 3.5 在五項一對一的跑分評比中,有四項擊敗了阿里巴巴自家更新、更強大的 Qwen 3.7 Plus 。如果這些數據能經得起獨立驗證,這將意味著一個市政府級別的微調模型,已躋身全球頂尖開放權重模型之林,特別是在代理式編碼和推理任務上。
在所有的炒作背後,Rio 3.5 的釋出伴隨著幾個巨大的星號,我們不該太快為它戴上桂冠。
1. 上傳過程出了烏龍。 Hugging Face 上的 README 檔案罕見地坦承了錯誤。團隊承認最初上傳了錯誤的版本——只是一個合併後的基底模型,而非蒸餾完的最終版——因此必須重新上傳正確的權重。模型卡上寫著:「我們為造成的混亂致上最深的歉意。」 因此,任何關於其效能的宣稱,都必須考量到,現在公開下載的檔案,可能(至少在初期)並非那個在跑分上大殺四方的版本。
2. 缺乏獨立驗證。 所有吸睛的跑分成績,都是模型卡上的第一方自報數據。截至發稿時,尚未有公正的第三方重現這些結果 。少了外部驗證,我們無從得知其蒸餾過程是否真能在 Terminal-Bench 上創造 20 分的驚人跳躍,還是數字本身過於樂觀。
3. 是創新的混音,不是全新的交響樂。 其報告的訓練方法——以既有模型進行合併與蒸餾——在技術上與那些前沿實驗室從無到有、砸下數億美元的訓練方式截然不同 。社群偵探們很快就發現這是一個權重合併的產物,Nex 團隊甚至打趣地說:「劇情大反轉?這基本上就是我們的開源模型 Nex N2 Pro,只是戴上了另一頂帽子。」 這裡的成就是在整合與對齊,而非基礎科學。
Rio 3.5 Open 397B 的真正份量,只有在觀察它釋出前 48 小時發生的事時,才能完整掌握。
2026 年 6 月 12 日晚間,Anthropic 接到美國商務部的指令,要求其禁止所有外國籍人士存取其最強大的兩款模型,理由是擔憂其安全機制可能被「越獄」,構成國安威脅 。由於 Anthropic 無法在即時分辨使用者國籍,它被迫將兩款模型對「全世界」完全下線 。
這個美國政府的強制舉措堪稱驚天動地:這是史上首次有政府直接下令,強制召回已商業釋出的特定 AI 模型 。它立刻引發了關於 AI 出口管制,以及歐洲對美國技術依賴問題的激烈辯論 。
就在這個真空狀態下,巴西的一個市級 IT 機構華麗登場。在短短一個新聞週期內,世界兩大 AI 治理路線的對比一覽無遺:
這個故事幾乎是 AI 地緣政治變遷的一個完美縮影。它暗示著,如今要建立並散佈尖端技術能力,不再只有超級大國和身價數十億的新創公司能辦到,一個意志堅定的市政 IT 部門,透過槓桿操作全球的開源供應鏈,同樣可以創造驚奇 。即使 Rio 3.5 最終被證明更多是一場巧妙的工程技術展示和政治劇場,而非純粹的研究突破,它選擇釋出的時間點,也足以讓它被歷史銘記為對 AI 保護主義的一記象徵性重拳。