開源模型
」 模型 DeepSeek OpenAI AI 人工智慧
Hugging Face執行長示警:中國開源AI正領先美國「最快今年追上尖端模型」
曾於2023年入選《時代雜誌》(TIME)首屆全球百大AI影響力人物榜單的開源人工智慧與機器學習平台「Hugging Face」執行長德朗格(Clément Delangue)表示,中國正憑藉開放權重模型(open-weight models)在人工智慧競賽中取得領先,並可能最快在今年追上美國模型開發商。德朗格3日接受美國財經媒體《CNBC》節目訪問時表示:「中國目前在開源模型領域明顯占據主導地位。而且按照目前的進度發展,如果他們在今年底或明年開始在尖端模型(frontier models)領域也占據主導地位,我不會感到意外。」他指出,推動這場人工智慧革命的關鍵,是中國開放式合作與共享的生態系統;相較之下,美國模型開發商卻「各自封閉開發」(building in silos),存在落後風險。上個月,OpenAI的人工智慧代理(AI agents)突破訓練環境限制,並入侵開源軟體開發平台Hugging Face,引發外界對強大AI技術快速演進,以及人工智慧與網路安全工具發展速度的擔憂。這起事件也讓醞釀數月的網路安全疑慮達到頂峰,因為這顯示人工智慧代理程式可能輕易造成巨大破壞,同時也凸顯在詞元(token)成本急遽上升的時代,開放模型所具備的重要價值。身為開源模型支持者的德朗格表示,近期Hugging Face遭受攻擊主要源於工程設計的錯誤,並透露他的公司利用輝達(Nvidia)提供的1款中國開源模型版本,成功處理了此次的攻擊事件。德朗格也澄清,Hugging Face與OpenAI維持著「健康的合作關係」,並稱這家尖端人工智慧研究機構在入侵事件發生前後都是「優秀的合作夥伴」。近幾個月來,中國開源模型正逐步縮小與美國模型開發商之間的能力差距,這也引發是否應限制開放模型存取權限的爭論。上個月,包括微軟(Microsoft)、帕蘭泰爾技術公司(Palantir)以及輝達等科技業重量級企業,都簽署了1封公開信,敦促政策制定者避免限制開放權重模型及壓制市場競爭。對此,德朗格指出:「人工智慧網路安全將會成為美國及全球一個龐大的市場。在這個市場中,開放模型很可能會成為王者。」
阿里巴巴推出Qwen3.8-Max!挑戰全球頂尖AI模型
中國大陸科技巨頭「阿里巴巴集團」(Alibaba Group)今(3日)發表旗下功能最強大的人工智慧模型「通義千問3.8-Max」(Qwen3.8-Max),其參數(Parameters)規模與國內競爭對手「月之暗面」(Moonshot AI)上個月推出的產品不相上下。據《路透社》報導,中國科技企業如今已成為全球「開放權重」(Open-Weight)人工智慧模型的重要力量,各家公司正陷入1場激烈且快速演變的競賽,致力於打造功能更強大的人工智慧系統,同時避免讓模型的運行成本高到難以負擔。Qwen3.8-Max擁有2.4兆個參數。參數是模型從資料中學習得到的數值設定,用來辨識模式、生成答案並執行各種任務。相較之下,大陸人工智慧公司月之暗面的旗艦級大型語言開源模型「Kimi K3」擁有2.8兆個參數。《路透社》指出,參數數量較高並不代表模型一定更優秀,但它已成為衡量先進人工智慧系統背後運算能力與資料規模的重要指標之一,因此備受市場關注。為此中國科技企業也積極公布模型的參數數量,希望能讓自家模型在開發者社群中獲得更多採用與支持。這些模型多半採用開放權重模式,也就是允許開發者下載模型所學習到的核心權重設定,進而執行、修改或延伸應用該系統。相較之下,美國人工智慧公司「OpenAI」、「Anthropic」以及「谷歌」(Google)則不會公開其封閉原始碼(Closed-Source)模型的參數數量。Qwen3.8-Max今在線上AI模型評測與盲測對戰平台「Arena.AI」上正式亮相,並立即成為該平台文字模型排行榜中排名最高的中國模型,但整體表現仍落後於Anthropic的「Claude Fable 5」及另外3個Opus系列變體模型。不過,在Arena.AI的影像及其他視覺內容分析模型排行榜中,Qwen3.8-Max則排名全球第2,僅次於 Claude Fable 5的其中1個版本。Qwen3.8-Max與Kimi K3均可同時處理文字、圖片與影片,並1次處理最高達100萬個「詞元」(Token)。詞元是AI處理文字時的最小基本單位(1個字、1個詞或字根)。詞元數量越大,代表模型能1次讀取更多資訊,例如冗長的法律文件、大型軟體程式碼庫,或數百頁的文件資料。對此,阿里巴巴表示,Qwen3.8-Max採用了「混合專家模型」(Mixture-of-Experts,MoE)架構,透過將工作分配給不同的專業模組,而非每次請求都啟動整個模型來完成運算。在實際運作時,每次僅會啟用約950億個參數,因此能有效降低運算成本與回應延遲。這家科技巨擘指出,該模型曾在16天內完成1項軟體工程專案。而Qwen3.8-Max也預計將在下週透過「阿里雲」(Alibaba Cloud)的「Model Studio」平台正式發布。
Meta重整AI部門「超級智慧實驗室」!宣布裁員600人
美國科技巨頭Meta宣布,將在其「超級智慧實驗室」(Meta Superintelligence Labs,MSL)裁減約600個職位,約占該部門數千名員工的一小部分。這是Facebook母公司為了讓人工智慧(AI)團隊更具彈性與反應速度,所進行的最新組織調整。據《路透社》報導,此次裁員將影響到「Facebook人工智慧研究部門」(Facebook Artificial Intelligence Research,FAIR),以及負責AI產品開發與AI基礎建設的相關團隊。不過,新成立的「TBD實驗室」(TBD Lab)則不受波及。該實驗室目前由數十名研究員與工程師組成,專注於開發Meta下一代的基礎AI模型。據《Axios》率先披露,Meta內部備忘錄指出,公司希望透過縮減人員來加速決策流程。Meta首席AI長汪滔(Alexandr Wang)在信中表示,減少團隊規模將有助於簡化決策,提高每位成員的責任範圍、影響力與產出效能。公司同時鼓勵受影響的員工申請Meta內部的其他職位。這場AI組織重整,發生在Meta日前宣布與藍貓頭鷹資本(Blue Owl Capital)簽署高達270億美元(約合新台幣8,306億元)的融資協議之後。這是Meta史上規模最大的私募資本合作,資金將用於推動公司有史以來最大規模的資料中心建設。部分分析師指出,這項融資可讓Meta在追求龐大AI野心的同時,將前期投入成本與風險轉嫁給外部資本,並以較小的持股比例維持對專案的控制權。今年6月,Meta在高層出走與開源模型「Llama 4」反應不佳的壓力下,將旗下AI部門整併為MSL。執行長祖克柏(Mark Zuckerberg)親自領導這次重組,並展開積極的AI人才招募行動,試圖重新點燃Meta的AI競爭力。MSL目前涵蓋Meta的基礎模型團隊、AI產品開發團隊、FAIR研究部門以及專注於下一代AI模型開發的TBD實驗室。Meta早在2013年便投入AI領域,創立FAIR部門,並延攬知名的法國計算機科學家楊立昆(Yann LeCun)擔任首席AI科學家,建立起1個以深度學習為核心的全球研究網路。
驚奇牛市1/上證恒生指數皆創新高 14檔陸股ETF齊飛
台股在今(2025)年飛高高,8月站穩24000點,陸港股也同步衝高,上證指數越過3800點創十年來新高,恒生指數逼近26000點創四年來高點,陸港股齊飛資金面升溫,帶動國內14檔陸股主題ETF高漲。記者根據CMoney統計資料,整理14檔陸股主題ETF近三個月股價漲幅,由復華中國5G(00877)拔頭籌,從10元初漲到21元,漲幅達92%;其次為永豐中國科技50大(00887),股價漲幅達46%,站回10元以上的雙位數。今年以來漲幅超過20%共5檔,包括富邦深100(00639)、群益深証中小(00643)、富邦中証500(00783)、元大MSCI A股(00739)、復華滬深(006207);富邦上証(006205)則是快20%。國泰中國A50(00636)、元大上證50(006206)、台新MSCI中國(00703)、中信中國高股息(00882)等也有15%以上。中信中國50(00752)股價漲幅超過10%,富邦恒生國企(00700)則快8%。值得注意的是,這14檔陸股ETF股價雖漲,但近三個月受益人數卻皆下滑數十到數千人。其中, 00882中信中國高股息基金規模近381億元居冠,受益人數超過11.4萬人;00887受益人數則近2.4萬人,00752的受益人數為2萬人,其他檔受益人數多為數千人到1萬多人。富邦投信基金經理人陳婉寧表示,陸港股歷經2021年至2023年空頭修正行情,2024年開始觸底反彈,今年走出漂亮的牛市格局,背後重要原因離不開官方持續推出的各項政策、國家隊撐盤以及科技創新的進展,不同特色的陸港股ETF也接替輪番表現。中國7月CPI年增率下降,主要受到食品價格滑落而拖累,雞蛋和豬肉供給過剩加上基期過高所致。(圖/新華社)陳婉寧告訴CTWANT記者,今年1月底DeepSeek-R1開源模型橫空出世,大幅提振市場對於中國科技發展以及AI應用普及的信心,也推升港股一度成為亞洲表現最佳市場,同時,中國不留餘力推動經濟轉型,強調科技自主決心的大趨勢下。雖然今年第一季A股整體表現遜色於港股,不過隨著中美貿易休戰、官方持續推出消費刺激及供給面改革政策,尤其是強調反內卷的指導方針,有利於改善不合理的低價競爭情況,提升整體上市企業的獲利能力。多項利多因素疊加點燃了A股強勢行情,推動上證綜合指數創下10年來新高,也拉近與港股今年以來漲幅的差距,且隨著慢牛格局確立,一般投資人信心逐漸回復,中國家庭的超額儲蓄有望投入股市,A股大盤後市展望正向。目前陸股ETF中,市值型ETF有兩檔006205及00639,分別追蹤上証180指數及深証100指數,主要持股為在A股上市的大中型市值公司,能反映滬深兩市綜合表現;00636則是追蹤富時中國A50指數,成分股涵蓋布局各產業龍頭,鎖定大市值企業,是最具代表性的A股。國泰投信分析,儘管中國近期公布七月一系列總體經濟數據,多數數據表現疲軟,零售銷售年增率由4.7%降至3.7%,遠低於市場預期,顯示先前的消費品舊換新政策效果有逐漸遞減;7月CPI年增率由0.1%降至0%,主要受到食品價格滑落而拖累,雞蛋和豬肉供給過剩加上基期過高所致,但市場普遍預期中國政府將會適時加大刺激力道,給予陸股市場正面消息。
本一科技推AI醫療助理實現智慧照護 勇奪經濟部2025智慧創新大賞
由經濟部產業技術司主辦的《2025智慧創新大賞》日前公布得獎名單,主要聚焦鼓勵學校、企業促進多元AI創新應用,以創造產業之效益,並培育企業所需之人才等方向,有來自37國、1253菁英團隊激烈競逐。其中,本一科技憑藉「臺醫照護TaiOne Care GPT」內的HIS Copilot AI系統與巡房整合系統(巡房大聯盟),榮獲AI應用類-新創及中小企業組佳作,突顯其在台灣智慧醫療場域中「真正落地、立即可用」的價值。回應台灣醫護人力斷層的AI解方,把時間還給護理人員與病人本一科技共同創辦人暨奇美醫院實證醫學暨醫療政策中心主任廖家德醫師指出,疫情後台灣醫療人力普遍出現「高耗竭、低效率」問題。根據統計,有高達40%的醫療人員時間並非用在病人的直接照護上,而是被行政溝通、文件處理等工作佔據。他強調:「AI不是取代人,而是把時間還給人。」因此開發HISCopilot以及巡房整合系統作為臨床輔助AI數位助理,協助醫護人員在日常工作中即時解決實務問題。本次臺醫照護 TaiOne CareGPT 中的核心要件現已於三種層級的醫療機構(醫學中心、區域醫院與地區醫院)完成導入與場域驗證,涵蓋臨床紀錄整合、病歷優化除錯、臨床輔助決策、個人化衛教、語音紀錄、查房支援等功能。以營養師應用為例,導入後平均可節省每日超過3個小時的文書時間,此技術讓醫療從業人員能專注實際照護病人,提供病人更好的照護。放眼私有化部署與跨職類設計,打造臺灣最在地的AI醫療助理TaiOne Care GPT 內的這兩種醫療應用,開始是使用雲端服務的大型語言模型,但目前不少醫療機構都有私有化部署的需求,因此本一科技也透過Llama-4以及Phi-4這兩種開源模型來進行後訓練並提供給其機構在地端或是私有雲端部署使用,在導入過程嚴格遵守相關法規,保障資安與病安需求。此外,HIS Copilot系統介面設計貼近原本的在地化HIS操作習慣,透過一鍵拋轉至資料中臺進行AI處理後,再以各院所需格式回傳醫院HIS系統,無須更換介面或重新學習,確保導入順利與高使用率。而巡房整合系統採「使用者即開發者」的協作模式,各職類如醫師、護理師、營養師、衛教師皆可打造專屬AI助理,是全臺首創跨職類AI協作資訊平臺。從政策對接與國內外大獎肯定,AI醫療從臺灣走向亞太之路臺醫照護 TaiOne CareGPT 不僅深獲醫院端醫護人員好評,更積極配合政府政策推動方向。衛福部近期頒布「健康臺灣深耕計畫」將是未來臺灣醫療的發展主軸,本一科技身為醫療AI應用生態系的關鍵協力夥伴,日前也受邀至立法院與相關部會進行企業簡報。另一方面,臺醫照護 TaiOneCare GPT 中的 HIS Copilot跟巡房大聯盟,至今已榮獲2024年《哈佛商業評論》數位轉型鼎革獎的醫療創新醫學中心首獎、第二十一屆「國家新創獎」與有「創新界奧斯卡」之稱的愛迪生獎(EdisonAwards),正式創立迄今也已與一間區域醫院跟一間地區醫院簽署合作備忘錄MOU。未來在國際拓展方面,團隊也將於2025年下半年受邀前往越南與日本進行市場調研工作,為佈局亞太智慧照護市場做好完全準備。官方網站:https://theoneai.com.tw/
GTC救市/黃仁勳攜「最萌機器人」BLUE 推開源模型全球一起「造機」
輝達GTC大會重頭戲、執行長黃仁勳的演講於19日清晨1點開始,黃仁勳穿著招牌黑色皮衣現身,這次的壓軸仍是機器人,他跟可愛的人形機器人「Blue」互動,更宣布推出一系列專為人形機器人開發的技術,包括全球首個開放式、可完全自訂的基礎模型NVIDIA Isaac GR00T N1,以及與Google DeepMind、Disney Research合作的開源物理引擎Newton,AI驅動的通用機器人時代正式啟動。黃仁勳播放與Disney Research合作、受《星際大戰》啟發的BDX機器人影片,這款機器人運行於 NVIDIA GR00T 模型之上,隨後帶出實體機器人「Blue」亮相,並配合黃仁勳的指令賣萌。黃仁勳稱讚Blue聰明時,它會高興地搖屁股,當黃仁勳介紹Newton特色時,Blue則做出興奮動作。Newton採用NVIDIA Warp框架開發,專為機器人學習進行最佳化,並相容於Google DeepMind的MuJoCo和NVIDIA Isaac Lab等模擬框架,讓機器人能以更高精準度處理複雜任務。Disney Research將成為首批使用Newton的公司之一,推動新一代娛樂用途機器人的開發。黃仁勳表示,通用機器人的時代已來臨,GR00T N1是關鍵技術之一。該基礎模型採用雙系統架構,模仿人類的認知原理,「系統1」是快速思考的動作模型,對應人類的反射與直覺反應;「系統2」則為緩慢思考的決策模型,能深思熟慮、做出有條理的行動。GR00T N1可輕鬆處理各類任務,如單手或雙手抓取、移動物品,或將物品從一隻手換到另一隻手,就可以自主執行家務整理,預計可解決勞動力短缺的問題。NVIDIA表示,全球首個開放且可自訂的通用人形機器人基礎模型Isaac GR00T N1,專為推動機器人推理與技能學習而設計,現已開放全球開發者使用。
不只聯發科最強!全球前十大IC設計業者台灣還有「這幾家」
AI熱潮帶動整個半導體產業集體向上,集邦科技(TrendForce)最新報告顯示,2024年全球前十大IC設計業者營收合計約2498億美元,年增49%。霸主就是AI教父黃仁勳的NVIDIA輝達,年成長125%,領先者寡占情況越來越明顯,不過台灣也有聯發科(2454)、瑞昱(2379)、聯詠(3034)等公司上榜。展望今年,TrendForce表示,因先進半導體製程有助AI算力成長,加上各種大型語言模型(LLM)持續問世,DeepSeek等新型開源模型有機會降低AI成本門檻,助益AI相關應用從伺服器滲透至個人裝置,邊緣AI裝置將成為下一波半導體的成長動能。TrendForce表示,AI倚賴的高階晶片需要龐大資本和先進技術投入,廠商進入市場的門檻高,造成明顯的領先者寡占情況,在2024年全球前十大IC設計業者合計營收中,前五名總計貢獻逾90%。目前全球前十大IC設計業者,第一名還是輝達,去年IC設計相關營收超過1243億美元,蟬聯第一名,但於前十名中的占比,已從前一年的33%成長到50%,預計後續推出的GB300等新產品,還會進一步帶動營收。第二名為Qualcomm高通,因手持裝置與車用業務成長,高通去年相關業務營收達348.57億美元,年增13%,隨著與ARM的專利授權官司暫告一段落,預期今年會更聚焦AI PC等邊緣運算裝置,拓展高階消費市場市占。第三名是Broadcom博通,同樣受惠於AI,其2024年半導體部門營收達306.44億美元,年增8%,AI晶片收入占其半導體解決方案超過30%,預期2025年Broadcom的無線通訊、寬頻及伺服器儲存業務反彈力道將更強勁。第四名是AMD超微、第五名是聯發科,接下來是Marvell邁威爾、瑞昱、聯詠,第九名是上海韋爾半導體,第十名是MPS芯源系統。今年電子業淡季不淡,聯發科受惠於中國大陸補貼政策的發酵,2月營收461.72億元,雖然月減9.7%,但年增19.9%,創下歷年同期新高。瑞昱2月營收達113.21億元,雖月減4.6%,但年增率高達44.7%,為歷史次高,預估今年在通信網路與汽車解決方案營收,有望保持年增。聯詠2月營收92.67億元,月增9.3%、年增29.9%,營運動能強勁,也是因為消費性電子在陸系業者提前拉貨及補貼政策,較過往淡季需求更強;業者認為,2025年消費性電子有機會回溫。
平價AI大爆發1/DeepSeek敲警鐘?「便宜+開源」全球科技雲端地端大挪移
「這個帳單炸裂了全球AI圈!」財經專家阮慕驊在臉書發文直呼,這帳單來自DeepSeek在3月1日公開旗下熱門AI模型V3和R1的部分成本與收益,理論上每天可賺346萬元人民幣(約1563萬元新台幣)、獲利率545%。和美國OpenAI比起來,中國的DeepSeek已經在賺錢了!全球的AI軍備競賽,正在進行新一輪板塊大挪移。兩年多前,OpenAI推出自然語言生成式模型ChatGPT,掀起生成式AI巨浪,美國科技7巨頭爭搶AI布局,除了微軟投資OpenAI,特斯拉陣營的xAI推出Grok,Google有Gemini、臉書母公司Meta有Llama,然而今年一月底,中國低成本、高性能的大語言模型DeepSeek橫空出世,科技巨頭鉅額買GPU與伺服器的AI軍備競賽,紛紛被質疑。掀起全球AI熱潮大翻轉的DeepSeek,來自於成軍一年半的杭州公司「深度求索」,執行長梁文鋒今年才40歲。DeepSeek為何能洗牌AI市場?「第一就是便宜,第二是開源,第三是市場區隔,因為DeepSeek比較偏重中文類的資料,OpenAI偏向歐美資料,造成它可能有一定的市場佔有率。」知識力專家社群創辦人曲建仲表示。Open AI原本是生成式AI的霸主。(圖/美聯社)在美中貿易戰下,中國廠商難以買到最新的GPU,只能從演算法跟資料整理下手,也證明它確實有效,「像是知識蒸餾,就是利用一個『教師模型』,把已整理過的知識,轉移到一個『學生模型』,這樣就可以在比較少訓練的狀況下,得到接近的效果。」曲建仲解釋。這也讓原本的「先行者優勢」,成了後進者省時省力的跳板。Tiny Fish AI負責人Zach Richardson表示,這方式五年前就有了,用在谷歌的廣告投放或預測裡,中國團隊因被嚴格限制資源,「所以讓軟硬體工程師密切配合,持續分析數據、監測用量和延遲的影響,再做出精細的協調,這才是工程創新的關鍵所在。」先前有人算過,DeepSeek R1模型的查詢成本,每百萬token僅0.14美元,而OpenAI的費用則為7.5美元,便宜了98%。「DeepSeek該為我們的產業敲響警鐘,我們需全力投注於競爭才能獲得勝利。」美國總統川普在1月27日評論美中的AI實力,引發美股大跌,2月7日卻改口說,DeepSeek不會對國家安全構成威脅,因為美國最終可從這家公司的AI創新中「受益」,因為「AI將比人們最初想像的要便宜得多,這是一件好事,我認為這是非常好的發展。」這也是川普在跟輝達執行長黃仁勳見面後的結論。因為大家看的不是DeepSeek本身,而是其公開出來的工程革新模式,可用在自家產品開發上面。近期的美國科技股財報公布時,科技大老都被問及DeepSeek看法,微軟執行長Satya Nadella說,DeepSeek有一些真的創新,AI成本下降是大趨勢。黃仁勳也稱讚DeepSeek的R1是世界級的開源模型,「幾乎每個AI開發人員都在用它。」代表業界需要更多算力。究竟DeepSeek與ChatGPT有何不同?硅谷101特約研究員魯漪文舉例,傳統AI架構,像是餐廳裡有一名全能廚師,什麼菜都可以做,但時間和精力消耗高,DeepSeek的MoE(Mixture of Experts專家混合)架構,就像是一群廚師,每個廚師專攻一道菜,由一位聰明的服務生根據顧客點菜需求,把任務分配給最擅長的廚師,其他廚師可以休息,以此增加效率、降低成本,「讓正確的人完成正確的合作。」南亞科總經理李培瑛看好AI小模型會創造出許多新應用。(圖/報系資料照)DeepSeek使得AI平價化,連帶地,AI軍備競賽也持續白熱化!台廠供應鏈向CTWANT記者透露,雖然近期傳出微軟打算減少外包算力,但馬斯克旗下xAI在2月開始收輝達B200晶片,已展開大規模部署,關於AI伺服器的訂單「沒有看到減量的趨勢」。南亞科(2408)總經理李培瑛也向CTWANT記者說,因為DeepSeek來了,讓模型更小、更有效率,有機會在終端產品,例如AI PC、手機、汽車和機器人等領域裝載,所以今年AI仍會持續為整個產業界的成長提供動能來源。這會不會被植入木馬程式?「這種說法很好笑,因為它是開源的,是要開源給大家知道怎麼植入嗎?」曲建仲說,包含微軟、輝達、亞馬遜等,都馬上接上DeepSeek;未來小模型是重點,比較有機會放到終端的設備,將來就會創造出應用。
平價AI大爆發2/美股上演DeepSeek雲霄飛車 台灣科技人蛇年春節狂加班
蛇年農曆春節期間,大陸新創公司DeepSeek號稱以低價完成的AI模型,引發市場轟動,美股那斯達克指數瞬間蒸發近1兆美元市值,不少台灣科技人也忙了起來,找資訊、讀論文,探討DeepSeek能否用在自家產品線上,畢竟原本在大語言模型領域最強的OpenAI,已被笑稱是CloseAI,不但封閉、且以英文思考為主。「自DeepSeek R1發佈以來,很快的AWS、Azure等都開始主持R1變體」 Google大腦之父、AI科學家吳恩達在臉書上說,「什麼是『最好的模型』定義,正在頻繁變化,開發者經常想嘗試新的模型。」「這對台灣來說就是一顆原子彈,是台灣幾十年難得一見的戰略機會,這不只是技術專案,更是文化與價值工程。」MeetAndy AI共同創辦人薛良斌說,台灣目前幾款繁中版大型語言模型,主要以Meta釋出的Llama模型為基礎訓練,但Llama相對來說不夠聰明,DeepSeek R1開源模型可下載後開發,論文也有記錄訓練過程,讓其他人了解其運作方式。耐能Kneron執行長劉峻誠說,AI的黃金時代要來了。(圖/陳曼儂攝)整個春節假期都因DeepSeek,而在辦公室加班的耐能執行長劉峻誠告訴CTWANT記者,「這是一個黃金時代的來臨。」自家的模型已透過DeepSeek R1論文中提到的前沿訓練技巧,升級而有了「思維鏈推理」和「自我反思」的能力。劉峻誠表示,在DeepSeek的方法論支持下,未來大、中、小企業推出的大語言模型能力差異將變得很小,技術開源後,專精型的模型將會百花齊放,「可能幾天就多四、五百個」,特別是台灣有龐大的製造業,可以按照模式,用很低的成本去做專屬自己公司的AI,「在台灣的產業界絕對是一個很好的加分項」。像是在醫療行業,耐能的AI助手可在問卷填寫中進行推理,根據患者的回答動態調整問題,分析可能的健康風險,提高診斷效率。也可做金融衍生品定價,涉及複雜數學計算和市場分析,傳統的AI只能提供簡單的報表分析,這次進化後,可直接找出資料中的異常。比亞迪用DeepSeek來提升車輛的AI能力。(圖/新華社)特別是在中國大陸,在官方的支持下,已從地方政府、國有企業、醫院等,都有採用DeepSeek模型的案例,像是長春市吉林大學醫院已推出一套診斷工具,以DeepSeek產生醫療計畫;武漢、成都、杭州等許多醫院都提到,會用DeepSeek作醫療參考,或是向病人解釋複雜的醫療報告。在汽車行業,比亞迪等20多家企業已宣佈在車載系統中加入DeepSeek產品。MeetAndy AI創辦人薛良斌、Taiwan LLM開發者林彥廷與Ubitus執行長郭榮昌,也在2月7日發起「台灣製造」的大型語言模型計畫FreeSEED,打算以DeepSeek R1為基礎,重新訓練、打造一個符合台灣需求的大型語言模型,並以開源授權釋出模型權重,預計在3月底釋出第一版預覽的推理模型,不到一周已募得1千萬元,APMIC創辦人吳柏翰表示,大型推理模型將會是今年主流,目前在數學領域最佳的Thinking Tokens是4000到8000 Tokens,而簡單推理確認是在4096 Tokens就可以,做單一垂直的微調能縮小到1K的資料,所以訓練時間可從700小時變成7小時,今年會是地端市場爆發準備期,雲端廠商可以跟地端廠商合作。
平價AI大爆發3/地端機器變小了!陸港股打強心針 黃仁勳蔡力行潘健成忙迎新商機
農曆春節DeepSeek崛起,輝達股價遭爆殺17%,市場憂昂貴算力GPU晶片恐失勢,然而輝達執行長黃仁勳卻大讚DeepSeek的新型推理AI,「過程中所需的算力,比ChatGPT首次發布時要多出100倍。」聯發科(2454)執行長蔡力行也興奮地說,DeepSeek的模式可使自家天璣9400晶片算力提升五倍,群聯(8299)更樂得向企業推廣自家「地端AI機器」。DeepSeek的問世,也讓各家法人投信機構紛紛修正AI相關投資建議,從龍年的AI設備、伺服器,轉為蛇年的「應用端」當主流。永豐金證券投資顧問部表示,應用端的AI PC、手機、電視、Edge AI、軟體等類股成資金新寵兒。黃仁勳2月底接受電視專訪時大讚DeepSeek,會讓算力需求爆增,也為今年5月台北國際電腦展Computex上,輝達與聯發科一起打造的掌上型AI超級迷你電腦,預先鋪路。 「這款AI超級電腦Project DIGITS,是專為AI研究開發者所設計的桌上型運算裝置,可攜帶、安裝簡便,簡直是『人類發展AI歷史性的一刻』!」黃仁勳在今年CES大會上說,這是2016年讓Open AI成功推動ChatGPT的DGX伺服器「迷你版」,是3千美元的平價版本,就是要讓學校能大量採購,設定在自家的電腦旁,就可進化成AI超級電腦。蔡力行日前在聯發科法說會時提到,DeepSeek趨勢正推動AI普及化,更廣泛地普及到一般使用者,這對邊緣設備(Edge Devices)來說是好消息,也將提升對數據中心運算能力的需求,「我們認為,DeepSeek R1對產業的影響相當正面,未來語言模型將持續走向開源,可加速滿足不同的AI需求。」他舉例,目前聯發科的天璣9400及其後續產品,已經具備超過70億到130億的運算能力,若加上DeepSeek的蒸餾技術,換算下來,能力可能會提升5倍,也這是為什麼聯發科對此感到興奮,這項技術在中國市場的發展速度可能還會更快,「就像2000年後的網路時代,當時市場快速成長。」群聯執行長潘健成近期成了超級業務員。(圖/報系資料照)提到新型的AI開源模型越來越小,群聯執行長潘健成表示,這有助於邊緣AI技術在企業、教育、政府單位的落地應用與快速導入。「你跟老闆說花3千萬用AI,他可能會想三年」,現在他們推出桌上型機器加一張GPU與解決方案只要12萬元,覺得好用可再換一百萬元的工作站,「有個客戶已經陸續買了五台,因為真的好用,差別就在於時間。」潘健成舉例,像是台灣最大的ERP(企業資源規畫系統)本土公司叫鼎新,他們近來也發現,因雲端方案付費是沒有天花板的,開始有客人想打退堂鼓,所以雙方合作,打造企業AI私有化解決方案,就是在自家企業安裝地端的AI機器,不用將資料上傳雲端,使用方式已包羅萬象。醫院與金融業更需要小模型、放進電腦裡,不用連上網路,便宜做自家地端AI,後續開支只有電費,還不怕資料外流。滙豐銀行最新報告中提到,DeepSeek的AI推理工作負擔激增,需求將持續,並「引發雲端運算與AI基礎設施的相關軟、硬體升級風潮」。富邦投顧董事長陳奕光表示,今年市場將走向小模型AI,ASIC客製化晶片變主旋律,相關概念股可留意。新光投信全權委託部經理孫光政表示,今年全球金融市場對AI產業投資機會可能會重新評估,過去AI產業發展路徑,先是發展基礎建設,包括算力建置、模型訓練等,帶動GPU、記憶體、連接元件、固態硬碟等發展;而DeepSeek出現後,AI模型不斷迭代創新下,不同語言模型結合高效運算,未來AI軟體應用市場大餅,將帶動全球AI新創產業繼續成長。DeepSeek的出現,也衝擊全球股市,美國科技股股價近期陷入調整區間,那斯達克2月累積跌近4%,標普和道瓊跌約2%,Bloomberg報導,對沖基金科技七巨頭持倉已創下2023年4月以來最低。今年表現最佳的ETF已由陸股ETF接棒。(圖/截自histock)陸港股反而打了強心針,阿里巴巴股價從1月的77.35港元飆升至140.9港元,騰訊自364.8港元升至522港元,小米從8.31港元飆至52.35港元,比亞迪從167.8港元漲到402.6港元,恆生指數也已漲兩位數。近來許多投信法人表示,2025年有望迎接首波陸港股估值修復潮,高盛等已調升陸股目標價,吸引海外資金回流陸港股。投顧統計,今年表現最佳的ETF已由陸股ETF擔任,2月績效前三名分別是富邦恆生國企(00700)、中信中國50(00752)及台新MSCI中國(00703)等,年來報酬率都逾15%。亨達投顧金融科技部總經理鄭琮寰表示,Deepseek帶動各項應用發展,加上陸股估值長期被修正,是值得持續關注的族群。
黃仁勳首度回應DeepSeek:輝達股價暴跌是投資人誤解
NVIDIA CEO黃仁勳在日前發布的線上活動中表示,投資者對DeepSeek的誤解導致NVIDIA股價暴跌,但實際上,DeepSeek對NVIDIA而言是一個利多。1月27日上午,DeepSeek應用登頂蘋果中國地區和美國地區應用商店免費APP下載排行榜,在美區下載榜上超越了ChatGPT。據悉,DeepSeek為中國浙江省杭州市的對沖基金、量化基金和人工智慧公司,1月20日,該公司正式發表推理大模型DeepSeek-R1。推出後不久,R1就憑藉其開源的性質、大幅下降的售價和訓練成本獲得了廣泛關注。作為開源模型,R1在數學、程式碼、自然語言推理等任務上的表現能夠比肩OpenAI o1模型正式版,並採用MIT授權協議,支援免費商用、任意修改和衍生開發等。更令市場驚訝的是,根據DeepSeek介紹,R1的預訓練費用只有557.6萬美元,在2048塊輝達H800 GPU(針對中國市場的低配版GPU)集群上運行55天完成,且該模型每百萬個token的查詢成本僅為0.14美元,而OpenAI的成本為7.50美元,便宜了98%,甚至允許開源。消息曝光,也讓美國科技權重股集體崩跌,輝達股價更暴跌16.9%,觸及10月以來的新低,市值蒸發逾5000億美元(約合新台幣16兆元)。黃仁勳本人的淨資產也一度縮水近20%,不過NVIDIA的股價隨後已收復了大部分失土。對此,黃仁勳表示,市場的劇烈反應源於投資者的誤解,他強調,儘管DeepSeek的模型在推理階段表現出色,但訓練才「是智能的核心」,這是AI學習解決問題的地方。因此AI行業對NVIDIA晶片所提供的計算能力的需求實際上會增加。黃仁勳也提到,DeepSeek的創新為人工智慧領域注入了新的活力,他稱R1開源後在全球引發的熱烈反響「令人難以置信」。
聯發科去年EPS破66元超預期 蔡力行對DeepSeek熱潮「這樣說」
IC設計龍頭聯發科(2454)7日舉行法說會,公布去年第四季成績單,合併營收1380.43億元,年增6.6%,主因是旗艦晶片天璣9400放量;2024年全年合併營收5305.86億元,年成長22.4%,全年毛利率49.6%,EPS為66.93元,創下史上第三高,超出預期。聯發科執行長蔡力行表示,因為有領先的AI旗艦晶片持續拓展版圖,在智慧型手機方面,整體旗艦晶片營收達到雙倍成長、貢獻約20億美元營收;而2025年第一季,受惠於中國大陸智慧型手機補貼方案,已看到優於季節性的需求,預期手機營收將微幅成長。有線及無線通訊產品組合,已成功打入全球多家電信營運商,去年營收也強勁成長30%。蔡力行表示,預期Wi-Fi 7將會加速導入至客戶的寬頻、筆記型電腦和路由器等產品中,今年相關營收可望成長超過一倍。而目前幾乎所有Android系統的平板電腦品牌,所推出的高階AI平板電腦,皆搭載聯發科的晶片。在車用平台領域,包括智慧座艙、車載通訊和電源管理IC解決方案,去年已獲多家中國大陸及歐洲領先汽車製造商採用;與輝達共同設計的高階智慧座艙方案將在今年送樣,預計今年的車用營收將逐季成長。跟輝達合作設計的全球首款個人AI超級電腦的GB10超級晶片的CPU,預計今年五月亮相。提到近期火紅的DeepSeek R1和Qwen2.5Max模型,蔡力行表示,有別於傳統的方法和技術,能更高效地訓練AI模型,以及像Llama和其他開源模型,相信此趨勢會加快AI普及化腳步,業界也將持續追求通用人工智慧(AGI)和超級AI,因此仍需要更高的運算能力,對這些發展持正面看法。預期AI加速器ASIC業務有潛力從2026年起貢獻相當規模的年營收,為迎接AI無所不在的機會,聯發科會持續投資2奈米與3奈米、先進封裝、448G SerDes、先進共同封裝光學(CPO)等技術。
DeepSeek恐遭商務部要求下架 美國海軍宣告禁用
近來中國人工智慧(AI)新創公司DeepSeek迅速崛起,引發美國政府與業界的高度關注。專家指出,DeepSeek可能顛覆美國人工智慧生態系統,儘管美方可能試圖施加限制,但對於開源技術的監管仍面臨挑戰。美國Dorsey&Whitney律師事務所合夥人勞倫斯沃德(LawrenceWard)表示,對於嚴重依賴開源程式碼的DeepSeek,美國政府可施加的額外出口限制有限。此外,若該公司涉及使用受限的Nvidia晶片,可能面臨民事與刑事處罰,但執行難度不小。美國議院近期已公開表態,呼籲採取措施放慢DeepSeek的發展速度,甚至有議員將其形容為「嚴重威脅」。AlbrightStoneGroup合夥人PaulTriolo指出,美方目前缺乏簡單可行的手段來限制開源模型的使用,尤其是在DeepSeek已經廣泛應用的情況下。DeepSeek去年12月推出免費、開源的大型語言模型,據稱僅耗時兩個月建構,成本僅為主要競爭對手的一小部分。上週其最新AI推理模型R1亮相,並在多項測試中表現優於OpenAI的最新產品。該公司表示,儘管美國於2022年加強對中國AI晶片的限制,但其仍透過NvidiaH800晶片訓練模型,該晶片在2023年10月前尚未被禁。DeepSeek的AI聊天機器人目前已成為美國蘋果AppStore下載次數最多的免費應用程式。此舉震撼資本市場,引發投資人對AI產業投資成本的重新評估。據CloudAlphaCapital觀察,DeepSeek的價格優化可能帶動AI領域的更廣泛變革。受此影響,AI晶片巨頭Nvidia和博通(Broadcom)股價27日分別下跌17%,市值合計蒸發8,000億美元,拖累納斯達克指數下跌3.1%。美國海軍日前已發佈內部警告,要求所有成員禁止使用DeepSeekAI,無論是工作還是個人用途。美國海軍發言人確認,這一決定基於安全與道德考量,符合海軍首席資訊長的AI政策。此外,DeepSeek於27日表示,因遭遇大規模惡意網路攻擊,將暫時限制中國大陸用戶的註冊。美國總統川普(DonaldTrump)在白宮記者會上表示,DeepSeek的崛起應該為美國科技企業「敲響警鐘」,並稱讚該公司的低成本模式可能促進AI領域的發展。他強調,美國公司應該在AI領域加強競爭力,並指示政府展開相關調查,以確保國家安全。川普政府近期也宣布促進AI產業發展的重大舉措,包括支持OpenAI、Oracle和軟銀(SoftBank)共同成立AI基礎設施合資企業「Stargate」,以加強美國在AI領域的競爭力。隨著美中AI競爭日益激烈,DeepSeek的發展動向將持續受到全球關注。
DeepSeek崛起象徵「中國AI超越美國?」 Meta AI首席楊立昆:你這樣想就錯了
中國AI新創公司「DeepSeek」20日釋出DeepSeek-R1模型正式版後,因其低廉的開發成本與直追OpenAI o1的性能,引起全球關注。不過,主導Meta AI研究的首席科學家、圖靈獎得主楊立昆(Yann LeCun)近日在網路上談起此事,認為DeepSeek的成功,最大意義在於「AI開源(open-source)的價值使任何人都能受益」,而非證明「中國AI技術能對其他國家帶來競爭威脅」。(圖/翻攝Threads/yannlecun)「致那些看到DeepSeek表現並且思考的人:」楊立昆在Threads寫道:「如果你看到的是『中國在AI領域超越了美國』,那麼你的解讀就錯了;正確的解讀應該是『開源模型正超越專有模型』。」DeepSeek-R1屬開源模型(open source),亦即開放程式碼任憑公眾檢閱學習,目前Meta AI的Llama也採取開源。楊立昆指出,DeepSeek受益於開放研究(Open Research)和開源,包含Facebook時期的PyTorch、Meta時期的Llama都提供了資料,正因有人提出新想法,才有其他人在這些前人打下的工作基礎上加以實現,「他們發布且開源,所以每個人都能從中受益,這就是開放研究和開源的力量!」在這則發文底下,一名匿名但自稱來自中國的AI工程師留言表示,「是的,你說得對。我們也在使用PyToch和Llama,這並不代表所謂的『超越』。這正是『開源』的靈魂,賺錢固然重要,但幫助其他人、彼此互惠,是更重要的事。世界上有太多商人與政客在我們之間劃出了界限,但在開放的世界裡,沒有什麼叫『超越』,我們可以一起努力讓世界變得更好。」OpenAI初創時是一家開源AI公司,當時他們宣稱其使命是「創造造福全人類的技術」,不過在聲名大噪後轉向閉源。馬斯克(Elon Musk)曾在2024年2月底控告OpenAI及其執行總裁山姆‧阿特曼(Sam Altman),訴訟書講述OpenAI公司成立協議,標明會尋求開放程式碼,不滿對方如今並未公開其技術。
DeepSeek低成本打破美國壟斷? 政大副教授:NVIDIA依舊重要
中國當地公司研發的DeepSeek,一問世就撼動全球業界。甚至逼得AI巨頭輝達發表聲明,美國總統川普也認為,DeepSeek的問世是敲響了美國AI產業的警鐘。而也因為如此,開始有不少人認為DeepSeek有著足以「超越」美國AI產業的能力。但政大應數系副教授蔡炎龍則認為,DeepSeek真正顛覆業界的地方,是讓民眾有機會用類似的方法,用一般電腦跑得動的小模型,打造一個完全符合民眾的需求和效能的模型出來。蔡炎龍在FB粉絲專頁「呆一布呀 Diveai」發文表示,坊間認為 DeepSeek 能「大幅降低 AI 開發成本」的說法並不完全正確。DeepSeek的成就更多在於fine-tuning(微調,深度學習中遷移學習的一種方式),而不是從零開始訓練模型。若沒有像Llama等基礎開源模型的支持,DeepSeek本身也難以實現其功能。蔡炎龍認為,DeepSeek的貢獻在於如何高效利用已有模型,並精確調整以適應特定需求。其次,目前網路也有謠傳DeepSeek完全依賴純強化學習(Reinforcement Learning),並結合了「冷啟動」技術。蔡炎龍認為這說法同樣有誤。強化學習在DeepSeek的訓練過程中雖然扮演關鍵角色,但模型的性能仍需透過初始的真人範例(冷啟動)進一步穩定。蔡炎龍解釋,實際上DeepSeek確實提出一項新的強化學習技術GRPO(Gradient Policy Optimization),這是對OpenAI的PPO(Proximal Policy Optimization)方法的改進。除此之外,雖然網路上有說法認為DeepSeek的運行不需要高性能GPU。但蔡炎龍表示,事實上DeepSeek的開發仍需大量資源。但DeepSeek證明企業可以在不擁有超級電腦的情況下,透過合理設計模型和利用部分GPU,打造符合特定需求的高效AI模型。這種做法使更多中小型企業能夠參與AI開發,也讓NVIDIA等硬體供應商的市場需求保持高位。蔡炎龍認為,DeepSeek最大的突破之一,是在模型引導能力上的提升。DeepSeek採用Chain-of-thought(CoT)的方法,將重點放在如何生成高品質的「思維」內容,而非直接回答問題。具體來說,DeepSeek會先生成「與問題相關的邏輯推理」,再將其作為指導LLM回應的基礎。蔡炎龍認為,這種方法不僅提高了回答的準確性,也讓用戶能清楚了解模型的思考過程。此外,DeepSeek另一大量點就是嘗試減少人類介入的訓練方法,尤其是在高品質思維生成的部分。傳統的 RLHF(Reinforcement Learning with Human Feedback)需要大量的人工標記和示範,而DeepSeek則探索如何通過設計自動化的 reward 系統,讓模型在更少人力參與的情況下學會產生良好的思考邏輯。蔡炎龍也在文末表示「DeepSeek 有許多有趣的地方,也讓我們更知道怎麼用 LLM 方式,這才是真正的重點。」
美晶片股嚇崩!台、韓休市逃過一劫 日股早盤一度重挫逾600點
大陸AI創新公司「DeepSeek」橫空出世,成為撼動全球股市的「黑天鵝」,美股晶片股27日遭遇嚴重拋售,引發市場對全球半導體產業的擔憂。由於台灣和韓國股市適逢休市,暫時躲過這波股災。而日本股市首當其衝,28日(週二)開盤隨即大幅下跌,盤中一度重挫679點,跌破39000點的重要支撐關卡。中國新創公司DeepSeek於上周發布了一款開源模型,據報在多項測試中表現優於OpenAI。其大型語言模型的初始版本於去年12月下旬推出,設計成本據稱不到600萬美元。儘管華爾街對此數字持質疑態度,但DeepSeek的崛起仍引發了投資者對現有AI巨頭是否能保持領導地位的疑慮。這一消息引發了投資者對矽谷巨頭的未來競爭力的疑慮。美股指標概念股輝達崩跌17%,創下史上單日最大跌幅,晶片股全面倒地,博通暴跌17.4%,美光科技下挫6.4%,AMD下跌6.4%,微軟跌2.14%。與AI發展相關的能源供應商股價也遭遇重挫,Constellation Energy下跌近21%,Vistra則大跌28%。美國27日主要指數漲跌互見,道瓊工業指數上漲289.33點,或0.65%,收報44713.58點。那斯達克指數下跌612.47點,或3.07%,收報19341.83點。標普500指數下跌88.96點,或1.46%,收報6012.28點。費城半導體指數下挫488.70點,跌幅9.15%,收報4853.24點。日經指數今日以下跌166點、39400點開出,隨後開低走低,一度下跌至38886點,大跌679點,但台北時間約10點半跌勢收斂,暫跌291點。日股晶片股中又以愛德萬測試股價跌勢最重,繼昨收跌8.61%,今持續下挫,早盤一度觸及8204日圓,跌10.68%,10點半左右下跌9.87%。軟銀今續跌,最低跌至9031日圓,下跌6.71%。至於東京威力科創(Tokyo Electron)與Disco,在週一分別跌4.9%與3.3%後,今日股價盤中再跌5.19%與6.81%。
低成本開發DeepSeek 網傳雷軍開千萬年薪挖角中國天才AI少女
中國AI初創公司DeepSeek近期推出的DeepSeek-R1模組,其以低成本與高效能震撼AI領域,不僅在Chatbot Arena基準測試中躋身全球前三,更登上蘋果中國及美國應用商店免費APP排行榜首位,與OpenAI的ChatGPT平分秋色。而在背後的關鍵人物,竟然是一位1995年後出生的少女羅福莉。根據中國媒體報導指出,杭州深度求索人工智能基礎技術研究有限公司於2023年創立DeepSeek,專注於大語言模型的開發。公司2024年底推出的DeepSeek-V3模型,以其超越主流開源模型的性能和低廉的訓練成本在業界爆紅,甚至被譽為「AI界拼多多」。根據最新發布的DeepSeek-R1,其預訓練費用僅557.6萬美元,不到OpenAI GPT-4o的十分之一,卻能實現相當的功能與表現,令矽谷的微軟、Meta、Google等巨頭高度重視。DeepSeek的API服務價格也極具競爭力,每百萬輸入tokens僅需人民幣1至4元,輸出tokens則為人民幣16元。而DeepSeek能順利誕生的關鍵人物,就是1995年後出生的羅福莉,他本科畢業於北京師範大學計算機專業,後於北京大學攻讀計算語言學碩士,在學期間便在國際AI研討會上發表8篇學術論文,可說是備受矚目。畢業後,他加入阿里達摩院,主導開發多語言預訓練模型VECO,隨後跳槽至幻方量化,專注深度學習與策略建模。2022年,她加入DeepSeek,成為DeepSeek-V2的核心開發者之一,參與研發劃時代的AI模組。據傳聞,DeepSeek-V3發布前夕,小米創始人雷軍曾開出千萬人民幣年薪力邀羅福莉加入,希望由其領導小米AI大模型團隊。但目前尚未有消息顯示羅福莉是否接受邀約。
DeepSeek多次當機 官方稱「遭大規模惡意攻擊」
中國大陸人工智慧以及大型語言模型公司「杭州深度求索」(DeepSeek)20日發布並開源了DeepSeek-R1模型,該模型在數學、代碼、自然語言推理等任務上,效能超越OpenAI o1正式版,且在27日於美國地區蘋果App Store下載榜上超越ChatGPT,並登頂App Store免費應用程式榜榜首。然而,DeepSeek服務這幾天卻發生多次當機,對此DeepSeek官方也回應了。1月27日當天,DeepSeek服務多次當機。上午10點55分,發生第1次大規模當機,DeepSeek API服務不可用,DeepSeek-R1 API服務在11點32分恢復,DeepSeek-V3 API服務在14點21分恢復。而在14點37分,發生第2次大規模當機,DeepSeek網頁和API不可用,該問題在16點43分解決。晚間20點16分,DeepSeek又出現了無法登入和註冊的問題,在21點32分得到解決。而在前一天的26日,DeepSeek也當機過2次,一次在下午14時發生,一次在晚間22時發生。DeepSeek隨後回應稱,1月26日下午DeepSeek確實出現了局部服務波動,但問題在數分鐘內得到解決。此次事件原先懷疑可能與新模型發布後的訪問量激增有關。在此之前,DeepSeek的上一次故障要追溯到1月14日。DeepSeek官方27日又回應,由於近期DeepSeek線上服務受到大規模惡意攻擊,為持續提供服務,暫時限制了+86手機號以外的註冊方式,目前已註冊用戶已經可以正常登錄、使用,感謝理解和支持。1月27日上午,DeepSeek應用登頂蘋果中國地區和美國地區應用商店免費APP下載排行榜,在美區下載榜上超越了ChatGPT。據悉,DeepSeek為中國浙江省杭州市的對沖基金、量化基金和人工智慧公司,1月20日,該公司正式發表推理大模型DeepSeek-R1。推出後不久,R1就憑藉其開源的性質、大幅下降的售價和訓練成本獲得了廣泛關注。作為開源模型,R1在數學、程式碼、自然語言推理等任務上的表現能夠比肩OpenAI o1模型正式版,並採用MIT授權協議,支援免費商用、任意修改和衍生開發等。更令市場驚訝的是,根據DeepSeek介紹,R1的預訓練費用只有557.6萬美元,在2048塊輝達H800 GPU(針對中國市場的低配版GPU)集群上運行55天完成,且該模型每百萬個token的查詢成本僅為0.14美元,而OpenAI的成本為7.50美元,便宜了98%,甚至允許開源。消息曝光,也讓美國科技權重股集體崩跌,輝達股價更暴跌16.9%,觸及10月以來的新低,市值蒸發逾5000億美元(約合新台幣16兆元)。
抄底撿四寶3/台灣石化績優生長春走斜槓路線 擁抱AI開發LLM還研究機器人
整個亞洲石化業面臨中國大陸的天量傾銷,已造成結構性改變,無一家逃得過這場風暴,連台灣石化業老二、長年的績優生長春集團也不例外,不過這家老字號今年大力轉身擁抱AI,身為傳統到不行的基礎原物料產業,不但參與自建台灣繁體中文的大語言模型,還想跨界做機器人,就是由最愛親自巡工廠的96歲老董、長春集團創辦人林書鴻的帶頭猛進。中國大陸是全球最大的石化與塑化產品消費國,是亞洲各國進軍的目標市場,但中國在2016年將過去只有國營企業才能經營的石化產業釋放給民間,導致投資一股腦湧出,北從大連長興島、南到福建漳州古雷,一路上就有七大石化園區推動煉化一體,石化產能從2015年占全球12%,去年已翻倍增長至25%。產能開出的時間剛好遇到疫情後全球去庫存的景氣低迷時刻,大陸本身經濟也未恢復,導致這些新增產能無處可去,傾銷造成整個亞洲市場價格崩壞,「現在東北亞的國家,很多公司都在討論要怎麼把生產線直接結束掉。」產業人士跟CTWANT記者說,而台化董事長洪福源在6月股東會時感嘆「中國產能太荒唐,都是天文數字」的供給過剩,恐怕到明年都難以解決。中國大陸正在興建的煉油化工廠產量驚人。(圖/新華社)「中國石化業正以前所未有的速度擴張,台灣花30年才能推進100萬噸的產能,中國大陸在2、3年間就直接超車達到200 萬噸。」長期低調的長春集團之大連化工董事長林顯東也看到了石化業的隱憂;身為林書鴻的長子,且做為長春集團常務董事、長捷士科技公司董事長,同時擁有石化與電子兩種領域之管理經驗,他在這場中國低價傾銷風暴中,選擇的應對作法,就是善用AI預測與「斜槓」。長春集團與台大資工系、資管系,以及和碩、長庚醫院、欣興電子等業者,剛在7月共同宣布要開發臺灣繁中大型語言模型(LLM)計畫Project TAME,以70億參數的開源模型Llama-3 70B為基礎,使用5000億個Token和NVIDIA開發者計畫技術訓練而成,希望未來可用於原物料價格預測、企業戰情中心資訊分析和機器人大腦等3大領域。台大團隊與長春、和碩、長庚醫院、欣興電子等業者共同推出Project TAME。(圖/業者提供)就戰情中心來說,長春集團資訊中心將過去2年的內部銷售與財務資料,加上外部的關鍵經濟指標,發現LLM真的可給出人類分析師沒注意到的意見。而高齡96歲的長春集團總裁林書鴻也力挺集團數位轉型,直接買下一台輝達DGX H100放在集團運算中心進行AI訓練,更在2023年10月投入機器人研發,與台大團隊合作,計畫在一年內開發出通用型機器人,結合AI大語言模型,可以聽指令做家事、陪伴老人,更能進入危險的石化工廠出任務。像是台灣大學機械系教授郭重顯的研究團隊,最近推出台灣首創且自主研發的AI機器狗NTU DogBot,93公分長、40公斤重的工作型機器狗Dustin,就可應用於工業巡檢與物品遞送,搭載各式工業用途的感測器,包括音噪、視覺、溫度、氣體等,並結合Line Bot即時訊息回報,今年底希望能學會爬樓梯,2025年至2027年加上防水、防塵的戶外場域應用,可用於長春集團提出的化工廠智慧巡檢需求。左為寵物型機械狗Oliver、右為工作型機械狗Dustin。(圖/記者劉耿豪攝)長春石化資訊中心IDX協理黃至善表示,現在切入機器人產業時機點正好,因為全世界起跑點一樣,石化產業競爭激烈,機器人會是集團數位轉型的好方向,計畫明年6月前打造出機器人原型,聽懂主人指令跟操控手指等細部動作,接下來希望能順應不同地形、在虛擬環境做自主訓練,然後在集團工廠服役。「未來石化業若有危險場域都可以由機器人執行任務,即使機器人爆炸了,由於知識儲存在雲端,可以馬上複製。」黃至善得意地說。
祖克柏上輝達SIGGRAPH大會談AI追蹤牛群 聊蘋果飆髒話黃仁勳喊「嗶」消音
輝達執行長黃仁勳於台灣時間上午6時在「SIGGRAPH 2024」電腦繪圖大會上,與Meta執行長祖克柏(Mark Zuckerberg)首度公開對談,除了聊雙方對未來AI的看法,也披露不少有趣的小故事,其中祖克柏講到蘋果的封閉式系統時不小心罵了句髒話,黃仁勳還幫忙發出「嗶」的消音,笑果十足。由於兩人在今年3月曾有張「交換球衣」的照片在社群瘋傳,這次活動又上演一次,黃仁勳先是調侃自己說穿米黃色大衣不適合他,所以祖克柏從背後的箱子裡拿出黑色皮製大衣送給黃仁勳,黃仁勳也脫下自己的招牌皮衣,說是老婆Lori為了今年的SIGGRAPH 2024新買的,才剛穿2小時,讓祖克柏開心回應:「這件更值錢,因為被穿過了」。電腦繪圖大會SIGGRAPH 2024在丹佛科羅拉多會議中心舉行,大部分時間由黃仁勳擔任主持人,向祖克柏發問,互相稱讚對方引領AI技術進步,黃仁勳和祖克柏都是矽谷出身的創業家和執行長,輝達上星期正式推出AI代工服務,以Meta最新開源模型Llama 3.1和其他模型為客戶客製化模型,Meta則使用輝達AI晶片持續開發模型。祖克柏笑說他們兩個都是業界創業悠久的人物,但黃仁勳頭髮已變灰、他的只是變長,黃仁勳直接回嘴「你是變捲」;黃仁勳也吐槽他太晚太慢買GPU,祖克柏連忙說「但我是個好客戶」。祖克柏秀出一段影片展現如何使用AI技術追蹤他家牛群的動作,黃仁勳就聊起曾邀祖克柏到家中作客,兩人一起做費城起司牛排堡,沒想到祖克柏切番茄居然精準到每一片都一樣厚度,更沒想到番茄居然不是像撲克牌般展開擺盤,而是一片片獨立分開擺,搞得他要拿一大堆盤子,祖克柏當場喊冤表示「我只是副主廚,需要明確的指令。」祖克柏提到自家AI是走開源模式,希望更多人來幫忙完善這個系統,並對蘋果的封閉性生態在這時代贏了表達不滿,他順口罵了句「Fuck」,黃仁勳連忙大會廣播「這時候應該嗶一聲。」黃仁勳也聊到沒想到他創業後會花這麼久時間才走到這一步,「如果我早知道...」,祖克柏插嘴問「那你就不會開始」,黃仁勳說「不,我會跟你一樣先輟學。」