月之暗面
」
阿里巴巴推出Qwen3.8-Max!挑戰全球頂尖AI模型
中國大陸科技巨頭「阿里巴巴集團」(Alibaba Group)今(3日)發表旗下功能最強大的人工智慧模型「通義千問3.8-Max」(Qwen3.8-Max),其參數(Parameters)規模與國內競爭對手「月之暗面」(Moonshot AI)上個月推出的產品不相上下。據《路透社》報導,中國科技企業如今已成為全球「開放權重」(Open-Weight)人工智慧模型的重要力量,各家公司正陷入1場激烈且快速演變的競賽,致力於打造功能更強大的人工智慧系統,同時避免讓模型的運行成本高到難以負擔。Qwen3.8-Max擁有2.4兆個參數。參數是模型從資料中學習得到的數值設定,用來辨識模式、生成答案並執行各種任務。相較之下,大陸人工智慧公司月之暗面的旗艦級大型語言開源模型「Kimi K3」擁有2.8兆個參數。《路透社》指出,參數數量較高並不代表模型一定更優秀,但它已成為衡量先進人工智慧系統背後運算能力與資料規模的重要指標之一,因此備受市場關注。為此中國科技企業也積極公布模型的參數數量,希望能讓自家模型在開發者社群中獲得更多採用與支持。這些模型多半採用開放權重模式,也就是允許開發者下載模型所學習到的核心權重設定,進而執行、修改或延伸應用該系統。相較之下,美國人工智慧公司「OpenAI」、「Anthropic」以及「谷歌」(Google)則不會公開其封閉原始碼(Closed-Source)模型的參數數量。Qwen3.8-Max今在線上AI模型評測與盲測對戰平台「Arena.AI」上正式亮相,並立即成為該平台文字模型排行榜中排名最高的中國模型,但整體表現仍落後於Anthropic的「Claude Fable 5」及另外3個Opus系列變體模型。不過,在Arena.AI的影像及其他視覺內容分析模型排行榜中,Qwen3.8-Max則排名全球第2,僅次於 Claude Fable 5的其中1個版本。Qwen3.8-Max與Kimi K3均可同時處理文字、圖片與影片,並1次處理最高達100萬個「詞元」(Token)。詞元是AI處理文字時的最小基本單位(1個字、1個詞或字根)。詞元數量越大,代表模型能1次讀取更多資訊,例如冗長的法律文件、大型軟體程式碼庫,或數百頁的文件資料。對此,阿里巴巴表示,Qwen3.8-Max採用了「混合專家模型」(Mixture-of-Experts,MoE)架構,透過將工作分配給不同的專業模組,而非每次請求都啟動整個模型來完成運算。在實際運作時,每次僅會啟用約950億個參數,因此能有效降低運算成本與回應延遲。這家科技巨擘指出,該模型曾在16天內完成1項軟體工程專案。而Qwen3.8-Max也預計將在下週透過「阿里雲」(Alibaba Cloud)的「Model Studio」平台正式發布。
路透:中國軍方藉「美國AI模型」訓練國防系統
《路透社》(Reuters)宣稱,在他們檢視超過80篇中國學術論文及專利後發現,中國軍方研究人員已利用美國領先人工智慧公司「OpenAI」與「Anthropic」開發的大型人工智慧模型輸出內容,訓練中國本土人工智慧系統,以提升中國的國防能力。據《路透社》的獨家報導,這項此前未曾曝光的發現,罕見揭示了中國軍方及與國家安全相關機構如何利用美國最先進的人工智慧模型,作為開發自身專業化系統的捷徑,即使華府持續限制北京取得先進晶片及其他戰略技術。相關文件顯示,中國廣泛採用1種稱為「模型蒸餾」(Model Distillation)的技術,也就是利用功能強大的人工智慧系統所產生的輸出內容,訓練規模較小且更具專業性的模型,使其能夠在本地部署,而無須承擔從零打造前沿人工智慧系統所需的龐大運算成本。《路透社》檢視的研究資料,包括華府智庫「詹姆斯敦基金會」(Jamestown Foundation)彙整並獨家提供給《路透社》的研究內容,顯示模型蒸餾已被與中國人民解放軍及其他軍事機構有關的研究人員廣泛使用。這些論文顯示,中國國防機構將美國領先的人工智慧模型視為技術知識的重要來源,也是縮小與美國競爭對手差距的方法。目前爭議的核心並非模型蒸餾技術本身,因為這原本就是業界廣泛採用的做法,而是在於是否未經授權擷取相關模型能力。隨著美中即將就人工智慧治理與安全展開會談,這項議題已成為雙方的重要爭端。美國官員指控,部分中國機構利用模型蒸餾,從美國人工智慧模型擷取能力,可能削弱美國出口管制措施,並侵犯智慧財產權。中國則駁斥相關指控,稱華府正推行人工智慧「霸權主義」,並主張美國企業也曾採取類似做法。中國人工智慧開發商同樣反駁外界宣稱其技術進步依賴外國模型的說法。人工智慧新創公司「月之暗面」上週否認川普政府指控其「Kimi K3」模型是透過模型蒸餾技術建立,並表示其技術突破主要來自創新。分析超過60篇相關論文的詹姆斯敦基金會研究員Sunny Cheung宣稱,中國軍方科學家正有系統地擷取西方人工智慧模型的推理過程,並加以改造,用於監控、網路戰及戰術決策,「教會一個模型正確答案是一回事,但教會它得出答案背後的推理過程則困難得多。這些論文顯示,與中國軍方有關的研究人員正試圖將西方模型昂貴且屬於專有技術的推理能力,轉移到規模較小、能夠由他們自行控制並部署於本地的系統。」《路透社》核實了這些學術文獻,並另外辨識出約24個與軍方有關的案例研究。其中1篇於去年發表的論文,由中國人民解放軍軍事情報與網路作戰單位「96941部隊」的研究人員撰寫。論文指出,研究人員利用OpenAI的GPT-3.5處理敏感的軍事原始程式碼。研究人員稱,第三方模型並不適合處理機密資訊。為克服這項限制,他們先利用GPT-3.5整理軟體程式碼摘要,再以這些摘要訓練中國本土模型,使其能完全在中國軍方內部網路中運作。
陸強化科技出口管制!迫使Meta拆解20億美元Manus收購案
《彭博社》11日引述知情人士的說法稱,美國科技巨頭Meta正遵從北京的命令,開始拆解價值20億美元的Manus收購案。該公司目前已完成營運層面的拆分,要求員工停止在內部專案中使用Manus的工具,同時自本月起阻止這家總部位於新加坡的公司員工,存取Facebook母公司Meta的內部資料系統。據美國財經媒體《CNBC》報導,這場拆分行動發生之際,Manus與Meta正試圖遵循北京的要求,撤銷這筆交易。外界將此視為北京在保護其戰略科技與人才方面的關鍵舉措。根據總部位於北京的中倫律師事務所的說法,中國監管機構於4月下令撤銷該交易,這是中國外國投資安全審查機制下前所未有的舉措,也啟動了將已完成交易拆解的複雜程序。北京此後進一步收緊科技出口管制,特別針對涉及戰略性資產的跨境交易,以在人才、硬體與資料等美中科技競爭的領域,強化對關鍵技術流動的掌控。1位新加坡全球AI企業顧問Matthias Hendrichs表示,對美國科技公司而言,「中國來源的AI如今帶有1種可逆風險,任何精巧的交易結構都無法完全消除。」Hendrichs補充稱,對Manus而言,北京反對的核心問題可能無法解決,「一旦其他公司的工程師進入你的技術架構,你可以刪除程式庫,但無法讓他們忘記曾經看過的內容。」Manus曾被視為中國AI新創挑戰美國競爭對手的突破案例,如今卻提醒著試圖透過遷移至新加坡等地以淡化中國背景的新創企業,其策略可能面臨限制。總部位於華府的美國策略顧問公司「亞洲集團」(The Asia Group)中國區董事總經理Han Shen Lin表示,「這次拆解可能會很混亂。」北京已向科技業釋出訊號,所謂「新加坡洗國籍」(Singapore washing)策略存在界線,同時也向華盛頓(Washington)傳遞1項訊息:揭露所有權結構可能與直接禁止同樣有效。Manus原本根植於中國,去年將總部與核心團隊遷至新加坡,而Meta則於去年12月宣布以20億美元收購這家代理式AI新創公司(agentic AI startup),並觸發為期數月的審查程序,涉及科技出口管制。本月稍早,北京發布更廣泛的新規,強化對涉及中國投資者、技術與資料的海外交易管控,並以國家安全為核心理由。這些規範推出之際,北京與華盛頓正加速在AI領域的控制權競賽。據報導,中國監管機構已指示包括月之暗面(Moonshot AI)、階躍星辰(StepFun)與字節跳動(ByteDance)等企業,若未經政府明確批准,必須拒絕美國投資。同時,美國近期也擴大AI晶片出口管制,涵蓋全球所有與中國總部相關企業。新規還將北京的監管範圍擴展至包括台灣在內的海外市場交易,並賦予其權力,對限制中國投資的外國企業施加懲罰。根據顧問公司「龍州經訊」(Gavekal Dragonomics)產業政策分析師Tilly Zhang的觀點,北京的新出境投資指令特別針對Manus這類交易,因其象徵中國領先AI企業試圖脫離本土市場,而這正是北京不希望其他企業效仿的方向。亞洲集團的Han Shen Lin也指出,北京的新框架實質上賦予國家1種「既有追溯力又有前瞻性的控制權」。他表示:「只要中國資金曾經觸及某筆交易,北京現在就能對退出、重組或再投資主張管轄權。」該框架將於7月1日生效,首次建立全面且制度化的法律基礎,使中國能夠強制撤銷已完成的海外交易,並明確禁止在未經批准的情況下於敏感領域進行跨境人才轉移。