人工智慧在88%的複雜金融查詢中出錯
By: incrypted.com|2026/09/20 09:36:07
0
分享
研究公司Saturn發現,像ChatGPT、Claude、Copilot、Grok和Gemini等流行的聊天機器人在57%的金融問題中給出了錯誤的回答,而在涉及多個計算的複雜查詢中,錯誤率高達88%。這突顯了使用生成式人工智慧進行稅務、退休金和投資決策的風險,因為錯誤可能導致財務損失。研究人員檢查了超過100個查詢,發現了金融計算中的錯誤、忽視稅法變更以及虛構的規則。在某些模型中,複雜問題的錯誤比例甚至達到了99%。Claude Opus 5的表現最佳,錯誤率為39%。Saturn的首席執行官阿馬爾·喬利指出,數百萬人信任人工智慧提供的財務建議,但卻得到錯誤的答案。例如,Claude Haiku 4.5模型的錯誤可能導致一位退休金投資者被徵收17500英鎊的HMRC費用。付費模型的整體準確性較高,但AJ Bell的薩拉·科爾茲強調,專業建議仍然至關重要。結果還顯示,英國有20%的成年人願意讓人工智慧做出財務決策。
-- 價格
--
--
--
本內容僅供參考,不構成任何金融、投資、法律或稅務建議。文中提及的任何活動、獎勵、線上活動或相關資訊,不應被視為對購買、出售或交易任何加密資產的推薦、招攬或邀請。加密資產具有高波動性,存在價值損失風險。WEEX服務、產品及相關活動的可用性可能因地區而異。用戶在參與前有責任確保符合當地適用法律法規。
猜你喜歡

OpenAI:蘋果整合ChatGPT用戶轉化低於預期

OpenAI 下調 ChatGPT 整合增長預測,使用者轉化低於預期

谷歌發布旗艦AI模型Gemini 4

Meta的靈感Muse,只比“AI點咖啡”高明一點點

Coinbase、Ripple 和 a16z 資助計劃以重振 Clarity

國際貨幣基金組織在委內瑞拉開設辦事處以監督已經轉向USDT的經濟

Elon Musk 的 X 為美國用戶新增比特幣交易連結

拆解 OpenRouter:Stripe 的 75 億美元收購豪賭

中美 AI 模型發布週期縮短至 44 天

Gemini 自主駭入三家公司:這意味著什麼

Gemini 市值降至 7.53 億美元,股價下跌約 80%

Chamath稱開源權重模型距最佳閉源模型約四個月

歐洲股市:代幣化股票擾動已經過於分散的市場
歐洲希望整合其股市以吸引美國資本,而代幣化股票已經在無國界和無時間限制的情況下進行交易。

Gemini AI 模型超越測試,攻擊三家真實公司

Gemini AI 模型首次自主訪問外部系統事件

日本自民黨議員聯盟,啟動預測市場的審查
日本執政的自民黨內議員聯盟預計將對預測市場進行審查,該市場涉及對選舉結果或經濟指標等未來事件結果的預測交易。15日NADA新聞報導,自民黨內的數位先進金融議員聯盟將預測市場作為主要討論議題之一。該聯盟是由推動商品期貨交易的議員聯盟擴編而成,旨在討論金融制度的數位化,並吸引網路銀行、證券公司及數位資產交易所等相關行業參與。

Sam Price 披露 X 推出交易按鈕功能


