里約AI造假?|政府模型被抓包
巴西里約熱內盧市政府上週高調宣布,自主研發的大型語言模型「Rio 3.5-Open-397B」在多項基準測試中擊敗阿里巴巴的Qwen3.7,號稱「開源AI新霸主」。然而,僅僅72小時後,全球AI社群便揭發這款模型並非原創,而是將其他開源模型合併包裝的產物。這起事件不僅讓里約市政府顏面掃地,更引發整個AI產業對於「模型真實性」與「政府AI誠信」的嚴肅討論。
「自主研發」竟是包裝貨?
事件的起點,是里約市政府數據與智慧城市部門在6月10日發布的新聞稿。文中宣稱,Rio 3.5-Open-397B模型由市政府團隊「從零開始訓練」,採用創新的混合專家(MoE)架構,在數學推理、程式碼生成與多語言理解等項目上,全面超越目前開源領域最強的Qwen3.7-235B模型。
消息一出,立刻在全球AI圈引發轟動。畢竟,一個市政府的技術團隊能打造出超越中國頂尖AI實驗室的模型,這簡直是「小蝦米對抗大鯨魚」的傳奇故事。里約市政府甚至宣布,模型將完全開源,供全球開發者使用。
然而,Hacker News與GitHub上的開發者很快發現問題。有網友比對Rio 3.5的權重檔案與架構描述,發現其模型結構與阿里巴巴的Qwen3.5-MoE模型幾乎一模一樣。更精確地說,Rio 3.5根本就是將Qwen3.5-MoE與另一個名為「CodeQwen」的程式碼模型,透過特定的合併技術(merge)組合而成。
「這就像你拿樂高積木拼了一個城堡,然後說這是自己燒的磚頭。」知名AI研究者、史丹佛大學教授克里斯多福·曼寧(Christopher Manning)在Twitter上諷刺道。
全球AI社群的反應與衝擊
這起事件迅速在Hacker News上衝上熱點,獲得超過238分、130則留言。多數開發者表達了強烈的不滿與失望。
一位署名「brazilian_dev」的網友寫道:「作為巴西人,我感到羞恥。我們的政府寧可花時間包裝別人的作品,也不願真正投資技術研發。這對整個巴西AI社群都是傷害。」
更有開發者進一步分析,里約市政府可能使用了「模型合併」這個在開源社群中常見的技術。這種做法本身沒有問題——許多優秀的開源模型都是透過合併不同模型優勢而來。問題在於,里約市政府刻意隱瞞了模型來源,並將其包裝成「自主研發」的成果。
「真正的問題不是合併模型,而是謊言。」AI開源社群重量級人物、Hugging Face共同創辦人湯瑪斯·沃夫(Thomas Wolf)在LinkedIn上評論。「開源的本質是透明與誠實。你可以說『我們基於Qwen做了改進』,這完全沒問題。但假裝是從零開始,這就破壞了信任。」
對香港與台灣的啟示
這起事件雖然發生在遙遠的巴西,但對香港與台灣的AI發展,卻有著深刻的啟示。
第一,政府AI項目的透明度至關重要。 無論是香港的「智慧城市」計劃,還是台灣的「生成式AI應用推動計畫」,政府投入的AI項目都需要建立明確的「來源揭露」機制。如果連模型是基於哪個開源模型開發的都不願說清楚,公眾如何信任該系統的輸出?
第二,「自主研發」不等於「從零開始」。 在AI領域,絕大多數實用模型都是在既有開源基礎上進行微調或改進。這不僅是合理的做法,更是AI產業的常態。但關鍵在於:你要誠實地說出來。香港科技大學、台灣大學等學術機構在發表AI研究成果時,若能明確標註基於哪個模型進行改進,反而能贏得更多國際尊重。
第三,警惕「AI面子工程」。 里約市政府的行為,本質上是一種「AI面子工程」——為了政治宣傳而誇大技術成果。這在亞洲地區並不罕見。香港與台灣的讀者應該保持警覺,對於任何「突然超越國際巨頭」的政府AI宣稱,都應先查證其模型是否真的開源、是否提供技術細節。
模型合併技術的雙面刃
值得注意的是,這起事件也讓「模型合併」(Model Merging)這項技術受到更多關注。模型合併是近年開源AI社群快速進步的關鍵技術之一,透過將不同模型的神經網路權重進行數學組合,可以在不增加訓練成本的情況下,獲得性能更好的模型。
例如,Google的DiffusionGemma模型、Cohere的North-Mini-Code等,都運用了類似的技術。但這些團隊都明確揭露了技術來源,而非將其包裝成原創。
對開發者而言,模型合併是一個強大的工具。但這次事件提醒我們:工具本身沒有問題,問題在於使用者的誠信。
里約市政府的下一步
截至發稿,里約市政府尚未正式回應外界質疑。但據巴西當地媒體報導,市政府內部已經展開調查,可能會在未來一週內發布聲明。
事件後續有幾個值得關注的發展方向:一是里約市政府是否會修改模型描述,誠實揭露其技術來源;二是巴西聯邦政府是否會介入調查,這可能影響到巴西未來AI政策的公信力;三是開源社群是否會對「模型合併」的揭露標準提出更明確的規範。
產業影響與未來展望
從更宏觀的角度看,這起事件可能對全球AI產業產生連鎖反應。
首先,政府AI項目的審查標準可能收緊。過去,政府發布AI模型時,媒體與學術界多半給予信任。但經過這次事件,未來任何政府宣稱的「突破性AI成果」,都將面臨更嚴格的檢驗。
其次,開源模型的「來源標籤」可能成為標準。類似食品需要標示成分,開源模型未來可能也需要明確標示「基於哪些模型進行合併或微調」。Hugging Face平台已經在研議相關機制,要求上傳者標註模型的「技術家族樹」。
最後,對於亞洲市場的啟示尤為明顯。香港、台灣、新加坡等地的AI新創與政府單位,應該將這起事件視為一個警訊:在AI領域,誠信比速度更重要。一個謊言可能會破壞多年累積的技術信譽。
延伸閱讀
- Waymo 週付費叫車突破50萬次 無人駕駛時代加速來臨
- DeepSeek V4 Pro|528萬下載炸裂
- Apple 官宣 WWDC 2026:AI 成絕對主角,iOS 27 與全新 Siri 即將登場
結語:信任是AI時代最稀缺的資源
里約AI事件看似是一場公關災難,實則揭露了AI產業深層次的問題:當每個人都想搶搭AI熱潮,誠信往往成為第一個被犧牲的東西。
對香港與台灣的讀者而言,這起事件提供了一個重要的思考角度:無論是使用AI工具、評估AI產品,還是關注政府AI政策,保持批判性思維與查證習慣,將是AI時代最重要的數位素養。
畢竟,在AI的世界裡,能夠被信任的模型,遠比號稱最強的模型更有價值。
延伸閱讀: