AI幻覺
」 AI 人工智慧 ChatGPT
AI風暴3/美國民眾花錢請律師讓AI對罵! 上訴審不准AI寫判決
AI生成判決及訴狀問題逐漸在世界各國的司法界蔓延,不但發生兩造律師利用AI寫訴狀在法院攻防對罵的荒謬現象,連法院裁判也遭AI「淪陷」!路透社等外電報導,美國密西西比的聯邦地方法院亨利.溫蓋特法官(Henry Wingate)的助理因使用Perplexity AI工具撰寫暫時限制令,導致裁定書出現虛構人名與錯誤當事人,法官未核實審查便簽署發布,引發重大司法爭議。美國第五巡迴上訴法院今年8月擬將本案重新分案和移轉管轄其他法院。另一名犯下類似錯誤的法官是新澤西州聯邦地方法院法官尼爾斯,他在2025年6月公布的一宗判決被發現錯漏百出,甚至引述並不存在的案例。尼爾斯承認一名法學院實習生在未經授權和沒有披露下,利用人工智能聊天機器人ChatGPT蒐集法律資料。他說現已制定人工智能使用政策,加強審核程序。其實類似案例在美國恐怕只是冰山一角,不只是法官,有律師也犯下類似離譜的錯誤,同樣在密西西比,兩造律師被發現利用AI引用虛擬案例,法官沙里昂·艾科克(Sharion Aycock)決定取消審訊,並對涉案律師進行制裁。艾科克法官發現,兩造律師均使用生成式AI準備法律文件,且雙方律師在訴狀中均引用了由AI「幻覺」產生的不存在案例,形成AI工具互相辯論的謊謬場景,氣壞的艾科克法官做出裁決:取消審訊、撤銷所有四名涉案律師的資格,且對其中兩名律師被禁止在該法庭執業兩年,所有涉案律師被處以1000至3500美元不等的罰款。對此,美國參議院司法委員會主席格拉斯利曾表示,聯邦法官及司法機構都有義務確保使用人工智能不侵犯當事人的權利。美國聯邦最高法院院長約翰.羅伯茲(John Roberts)2023年12月31日公布的年終報告指出:AI顯然具有巨大的潛力,讓人們更容易獲取關鍵信息。但它有可能侵犯隱私利益,使法律失去人性。他表示,AI有潛力增加貧困訴訟當事人訴諸司法的機會,徹底改變法律研究,並協助法院更快、更便宜地解決案件。但羅伯茲強調,AI可能虛構事實,也無法複製人類法官的自由裁量權。羅伯茲也認為,上訴法官不會很快被取代,因為許多上訴裁決取決於下級法院是否濫用自由裁量權,這本質上涉及特定事實的灰色地帶,「通常涉及灰色地帶仍然需要人類判斷。他認為人工智慧主要基於現有資訊,它可以提供資訊,但不能做出此類決策。美國第五巡迴上訴法院指正下級審不該用AI生成裁判。(圖/翻攝維基百科)
獨、AI風暴1/最高法院首件對決AI上訴狀! 不反對、但亂寫就駁回
最高法院首件直球對決AI上訴狀出爐!最高法院刑七庭今年九月承審一件詐騙集團案時,發現李姓車手疑似以AI生成工具撰寫上訴書,刑七庭除了駁回上訴,還在判決揭示對於生成式AI上訴書狀的原則,刑七庭明確指出,上訴書狀及上訴理由書如全部或部分使用生成式AI工具撰寫,不構成駁回上訴理由,但若未具體指摘原判決違背法令之處,將不構成合法上訴第三審理由,法院應予駁回。刑七庭指出,上訴第三審應以原判決違背法令為法定要件,至於上訴理由書狀是上訴人親自撰寫、或委由他人代擬、甚至是全部或部分使用生成式人工智慧(Generative Artificial Intelligence,簡稱生成式AI)工具協助製作,在所不論,只要該書狀是由上訴人依法提出並簽名或蓋章,足認其已採納書狀內容而為上訴意思之表示,就符合上訴的形式要件,不能僅因使用生成式AI工具,即認其上訴不合法。反之,最高法院也不會因為上訴狀的文字形式完整、法律用語繁複或大量引用法條、裁判,即認定當然符合上訴第三審之法定要件。刑七庭提醒,生成式AI可以生成文字,但未必寫得出一個合法的第三審上訴理由;可以協助撰稿,但不能取代當事人承擔訴訟行為。第三審所審查者,係原判決有無具體違背法令之情事,而非法律名詞的數量,亦非文字表面的專業法律用語。刑七庭強調,法院固應辨識當事人之法律主張,惟無替當事人代為修正因使用生成式AI所產生之錯誤內容(例如虛構或錯誤引用事實、法源、裁判或卷證資料等AI幻覺)、補足欠缺卷證資料、或重構上訴理由之照料義務。從而,上訴書狀及上訴理由書縱疑似全部或部分使用生成式AI工具撰寫,仍不構成駁回上訴之理由,但若其未具體指摘原判決究有何違背法令之情事,致不足認已合法表明第三審上訴理由,法院應認其上訴不合法律上之程式,予以駁回。李姓車手所屬詐騙集團113年10月起,透過line散布投資股票獲利訊息,被害人洪姓民眾信以為真,114年4月1日匯款12萬元到國泰世華銀行帳戶,李姓車手接獲詐團成員「牛哥」指示,當天到高雄九如交流道領取「牛哥」提供的提款卡和密碼後,前往台南的萊爾富超商的ATM領出12萬元,李姓車手藉以抵銷積欠「牛哥」1200元債務,被害人察覺有異後報案,全案經台南市警局第三分局報告台南地檢署偵查起訴李姓車手。一、二審時,台南地院和台南高分院皆依共同詐欺取財罪判處李姓車手1年2月,李姓車手上訴最高法院,遭最高法院第七庭打臉,合議庭駁回上訴,並告誡以生成式AI寫上訴書,需具體指摘原判決有何違反法令之處,否則最高法院還是會以上訴不合法而駁回,全案定讞,李姓車手須入獄服刑1年2月。本案承審的最高法院第七庭審判長梁宏哲,受命法官鄭富城,陪席法官楊力進、陳德民、游士珺。最高法院刑七庭在駁回判決中提醒,生成式AI可以生成文字,但未必寫得出一個合法的第三審上訴理由。(圖/翻攝司法院法學資料查詢系統)
黃豪平靠AI安排行程 抵達日本超傻眼:那些店根本不存在
小公視人氣節目《少年願望事務所》第二季強勢回歸,第一季累積總觀看數突破600萬次,話題熱度不減。第二季全面升級,以「脆民調」為節目主軸,把網路留言、青少年心聲搬進棚內真實開講,更加入網紅「銘銘就」帶領的街訪單元,讓青少年卸下心防、暢聊最真實的煩惱。最新一集主題探討「AI是青少年的新閨蜜?」現場揭曉脆民調結果:高達53%的青少年用AI寫作業,其次是「陪聊取暖」,第三名竟是「心理諮商」,連「查颱風路徑看能不能放假」都榜上有名。作家陳栢青也在節目中大方分享「AI中毒」日常。他笑說:「我一開始超興奮,因為AI跟作家一樣——都是用語言創造世界。」甚至自曝曾「召喚」AI海明威:「我把海明威的作品和生平全餵進去,對它說你就是海明威,它居然回我:嘿,兄弟!」讓全場笑翻。陳栢青訓練AI變成海明威。(圖/小公視提供)不過AI也不是人人好運氣。黃豪平則自嘲是「AI詐欺受害者」,透露曾請AI幫忙安排行程:「結果到了日本才發現,AI推薦的那些店根本不存在!」他笑說那時才知道什麼是「AI幻覺」,「它一本正經地給假地址、假評價,全是幻覺!」還語出驚人地開玩笑:「現在AI都能寫程式,以後工程師可能要去宜蘭傳藝中心工作,『親手寫Code』都快變傳統手工藝了!」。鄧惠文醫師分享曾訪問未來趨勢專家時對方的警告,AI公司正逐步培養人們對軟體的依賴,萬一哪天它能模擬重現往生親人陪你聊天,卻要你買東西、不從就刪掉「親人」,那就是第二次失去。她提醒,這不僅是科技議題,更是心理議題。鄧醫師說:「AI不一定會取代人,但會讓不懂AI的人被淘汰。」她強調,學會「問好問題」是人類永遠的優勢,「懂得問問題,就是認識自己。」
AI減重爆紅! 營養師示警「專業監督」不可少:5大危險原因難忽視
AI人工智慧新時代來臨,衝擊已經漸入人們生活的方方面面。此前,不少媒體曾報導網友分享自己透過向ChatGPT尋求減重建議,在短時間內大幅度「甩肉」數公斤乃至於十多公斤的消息。然而有專業營養師示警,AI的強項在於提供「24小時不下線」的諮詢服務卻並非萬能,尤其對於糖尿病或代謝症候群患者,AI更有可能忽略血糖波動與藥物安全等關鍵因素,因此提倡「AI紀錄+醫師、營養師把關」,才能讓減重有效又安全。近日,營養師薛曉晶在粉絲專頁「營養師媽媽曉晶的生活筆記」發文分享,透過網紅實測與媒體報導,讓「AI指導減重」一事爆紅。不過根據科學研究,透過依賴AI聊天機器人來帶領減重的成效其實有限,而且在安全性上也有顧慮,若想真正達到健康、持久的瘦身效果,仍需更全面的專業指導與個人行為的積極轉變。薛曉晶指出,透過研究,ChatGPT這樣的AI,在減重方面的核心價值在於「陪伴你養成好習慣」,而不是「取代專業人士」。當過度依賴 GPT 擔任減重教練時,其實潛藏著許多不容忽視的危險信號:一、資訊可能錯誤。已有研究指出,大型語言模型(LLM)容易產生「AI幻覺」(hallucination),包括訓練資料不足、模型假設有誤,或是用來訓練模型的資料存在偏誤,導致它可能提供錯誤的飲食或用藥建議,對健康構成威脅。二、忽略個人病史。GPT 無法自動考量你的腎臟疾病、糖尿病史或目前用藥狀況。若直接套用其建議,恐增加低血糖或加重腎臟負擔的風險。三、存在族群偏見。系統性回顧研究顯示,LLM 在性別、種族與年齡層面上都可能存在偏見,這可能導致不同群體獲得不一致或不適用的建議。四、 過度聚焦體重數字。特別是對於青少年族群,若每天過於專注體重數字,可能引發飲食焦慮,甚至產生負面情緒,適得其反。五、 缺乏持續動力。研究分析發現,單純依賴AI提醒,目前尚無任何研究能證實可達到臨床上顯著的5%減重目標。這凸顯了人性互動在維持動機上的重要性。薛曉晶提醒,綜合目前的研究與實務案例,可以得知就目前而言,AI始終是輔助工具,其獨立減重效果仍有限。真正能達到顯著減重成效的,往往是「AI輔助+專業教練」的混合模式。此外,對於糖尿病或代謝症候群患者,使用AI減重需格外謹慎,因為AI可能忽略血糖波動與藥物安全等關鍵因素。一旦 GPT 提供了「極端飲食」建議(如斷食、極低醣、高蛋白等),務必立即暫停使用並尋求專業醫師或營養師的求證與建議。
阿特曼自誇「口袋博士」 GPT-5上線狂出錯「幻覺超嚴重」
OpenAI於7日發表最新一代人工智慧模型GPT-5,執行長阿特曼(Sam Altman)形容它是「口袋裡的博士級專家」,並將其與歷代版本比較,稱GPT-4相當於大學生,而更早期的版本則像高中生。官方宣稱,這款模型在錯誤率與「AI幻覺」方面都有顯著改善,但一上線便被使用者抓包出現多起基本拼字與地理常識錯誤,引發討論。根據《衛報》報導,社群平台上已出現多起離譜案例。一名Bluesky使用者多次詢問GPT-5「blueberry」的字母數量,卻反覆得到「含有三個字母B」的錯誤答案,系統甚至幽默補充,稱這讓單詞「更有彈性」。另一名使用者測試它辨識美國州名時,結果AI將Arizona寫成「Krizona」、Vermont變成「Vermoni」,還重複列出California,並憑空創造出「New Jefst」與「Mitroinia」等不存在的州。在《衛報》進行的測試中,GPT-5雖能正確列出澳洲各州與領地中包含字母R的名稱,但在計算北領地(Northern Territory)時卻錯將字母R的數量判為3個,而非正確的5個,並在地圖上將其拼為「Northan Territor」。OpenAI在發表時強調,新系統內建「即時路由器」(real-time router),可根據不同對話需求切換最適合的子模型;當使用者要求「認真思考」時,會導向最新的推理模型,且系統會依真實使用情況持續優化。不過,媒體與AI新創公司Every執行長希珀(Dan Shipper)指出,即使在理應啟用推理模型的情境下,GPT-5仍可能出現「幻覺」錯誤,例如解讀小說段落時憑空添加情節,必須在被提醒「多想一點」後才會修正答案。阿特曼坦言,系統在發佈初期確實發生異常,特別是在上線當天,「自動切換器」曾短暫故障,導致GPT-5表現「明顯變笨」。目前該問題已修復並調整模型選擇機制,以提升正確命中率。阿特曼同時宣布,將把ChatGPT Plus用戶的GPT-5速率限制加倍,並提供保留舊版4o的選項;介面上也會新增更明顯的「深度思考」啟動按鈕,並顯示每次回覆所使用的模型版本。GPT-5現已向全球每週約7億名使用者開放。阿特曼強調,這款產品尚未達到人工通用智慧(AGI)層級,只是「通往AGI的重要一步」。他也承認,因同時釋出大量新功能,系統穩定性波動超出預期,OpenAI將持續觀察並調整更新節奏,以確保使用者體驗。
印度工程師偽裝AI工作!微軟青睞新創公司「Builder.ai」宣布破產
2016年成立的英國人工智慧(AI)新創公司「Builder.ai」曾在過去8年間募資超過4.45億美元,並獲得微軟(Microsoft)與卡達主權基金「卡達投資局」(Qatar Investment Authority)的背書,估值在最高峰時更突破13億美元,然而就在這個月,它破產了。當人工智慧產業正苦於飆升的運算成本與層出不窮的「幻覺」(hallucinations,AI給出含有貌似事實的虛假或誤導性資訊 )問題時,投資人的耐心已瀕臨極限。2025年5月,曾被視為「AI民主化」標竿的英國新創Builder.ai宣告破產,其帳戶遭主要債權方維奧拉信貸(Viola Credit)扣押3700萬美元後,僅剩500萬美元現金。執行長拉提亞(Manpreet Ratia)在接管公司2個月後,被迫關閉營運並申請破產保護。 這家標榜「讓開發軟體像點披薩一樣簡單」的公司,曾擁有令人艷羨的資本光環:8年間募資超過4.45億美元,獲微軟與卡達投資局背書,2023年估值更衝上13億美元高峰。然而,光鮮亮麗的表層底下,卻是長期依賴誇大敘事與財務操作的危樓。 Builder.ai的崛起始於2016年,共同創辦人杜加爾(Sachin Dev Duggal)以「AI驅動模組化開發」為號召,推出平台「Builder Studio」與數位助理「娜塔莎」(Natasha),宣稱能讓非工程師輕鬆打造複雜的應用程式。但《華爾街日報》(The Wall Street Journal)2019年調查揭露,其核心技術實為印度工程師團隊的手動開發,AI僅是行銷話術,「全是工程師,沒有AI」的真相,加速了其後續的崩壞。 危機在2024年全面爆發:客戶投訴開發延宕、員工指控杜加爾管理混亂,而杜加爾本人更捲入印度當局的洗錢調查,雖然他否認涉案,聲稱自己僅為證人。英國《金融時報》(Financial Times)還披露,Builder.ai長期聘用與杜加爾有私人關係的審計機構,財務透明度備受質疑。 拉提亞於2024年3月接任執行長時,公司英美帳戶中的資金已近乎歸零。他坦承:「歷史決策造成的財務壓力已無法挽回」,並將2024年營收預測從1.4億美元腰斬至7000萬美元。維奧拉信貸的抽銀根行動,最終觸發了違約的連鎖反應。 內部文件顯示,Builder.ai長期以「漂AI」(AI washing,指企業誇大宣傳其產品或服務中應用AI技術的程度)策略吸引投資,包括將傳統外包開發,包裝為AI自動化;虛報東南亞與中東市場的擴張效益;隱瞞對廉價印度工程師的依賴。破產後,其全球團隊遭大規模裁撤,其大多數為新創及中小企業的客戶,被迫緊急遷移應用程式,暴露當代依賴新興AI平台的高風險。 Builder.ai的殞落並非唯一的例子。儘管AI公司占據2024年美國新創募資額40%,多數仍無法盈利。產業目前正面臨殘酷的優勝劣汰,許多企業遭遇技術瓶頸,如「AI幻覺」問題推高維護成本;或是商業模式缺陷,也就是過度依賴風投,缺乏真實變現能力;最後則是監管風險,其誇大的行銷手法往往遊走法律邊緣。美國高德納諮詢公司(Gartner)預測,低程式碼/無程式碼(low-code/no-code)市場規模將在2024年底達260億美元,但Builder.ai案例證明,若無法兌現「AI變革」的承諾,再華麗的敘事終將坍塌。 從微軟戰略合作到美國商業月刊《快公司》(Fast Company)評選的創新企業,Builder.ai曾完美演繹AI時代的造神戲碼。但其結局揭示更深層的教訓:當「規模」被誤認為「永續」、「能見度」被錯當「競爭力」,魔法消散後,留下的只有一片狼藉與投資人無法追回的13億美元估值泡沫。
AI也有幻覺!檢測各家AI模型「幻覺度」 ChatGPT「3%錯誤」…這家巨頭竟然墊底
隨著生成式聊天機器人CahtGPT在全球的爆火,AI機器人可以說是開始逐步進入人們的日常生活中,不少人都會開始使用AI機器人來輔助自己的工作。但現在就有公司發明檢測AI,專門針對各家廠商的AI機器人進行內容「正確性」上的檢測,並且將各家機器人「幻覺度」進行排名,其中冠軍就是大家所熟知的ChatGPT,而排名最末的竟然是Google所推出的PalM 2。根據《toms hardware》報導指出,先前就有第三方研究機構在研究各家AI機器人之後,確定了AI機器人會有「幻覺(hallucinations)」的產生,AI機器人會憑空編造一些不存在的資訊來回答。先前其實就有傳出類似的案例,美國紐約律師事務所「Levidow, Levidow & Oberman」施瓦茨(Steven A Schwartz)就在一次訴訟中,提出由ChatGPT所撰寫的文件,而其中引用了6起步存在的案件當作判例,結果遭到對手公司法律團隊識破,更被法院要求解釋。而且根據研究人員的研究,他們發現短時間內似乎無法解決AI機器人產生幻覺的問題。研究AI科技的布朗大學教授文卡達蘇巴馬尼安(Suresh Venkatasubramanian)也表示,與其說AI機器人會虛構不存在的事情,還不如說,AI機器人所產生的回答比較像是小孩子隨口說出的故事,因為不懂得事情的真偽。為了釐清AI幻覺度的問題,新創公司Vectara就進行了一項研究,以各家廠商推出的AI機器人進行法律方面的測試,Vectara提供了800多份文件給AI,接著要求這些AI依照要求來進行文件的內容摘要,最後將AI生成的結果輸入到自己研發的檢測AI中。Vectara驗證各家AI準確度的排名。(圖/翻攝自Vectara GitHub)其中,GTP 4與GTP 4 Turbo的正確性為97%、幻覺度3%;GPT 3.5 Turbo的正確性為96.5%、幻覺度3.5%;Meta推出的Llama 2 70B正確性為94.9%、幻覺度5.1%;Llama 2 7B正確性為94.4%、幻覺度5.6%。其餘各家的AI機器人正確度均有90%以上,幻覺率也是10%以下。但在其中,Google所推出的PalM 2,其正確率為87.9%,幻覺率為12.1%;而PalM 2 Chat的正確率為72.8%,幻覺率為27.2%。