每小時提供數千萬個錯誤答案,基於Gemini 3的谷歌搜索「AI概述」準確率僅為91%

区块律动

BlockBeats 消息,5 月 5 日,据《纽约时报》报道,AI 初创公司 Oumi 针对谷歌搜索「AI 概述」功能分析显示,该功能的准确率大概为 90%,由于谷歌每年处理超过 5 万亿次搜索,这意味着它每小时会提供数千万个错误答案(或者说每分钟数十万条不准确信息)。

Oumi 使用 SimpleQA 基准测试分析谷歌搜索「AI 概述」结果显示,使用 Gemini 2 时,85% 的结果是准确的;使用 Gemini 3 时,这一比例升至 91%。

在分析过程中谷歌 AI 概述所引用的 5380 个来源中,Oumi 发现 Facebook 和 Reddit 分别是第二和第四常引用的来源。当谷歌 AI 概述准确时,5% 的情况引用了 Facebook;不准确时,7% 的情况引用了 Facebook。

免責聲明:本頁面資訊可能來自第三方,不代表 Gate 的觀點或意見。頁面顯示的內容僅供參考,不構成任何財務、投資或法律建議。Gate 對資訊的準確性、完整性不作保證,對因使用本資訊而產生的任何損失不承擔責任。虛擬資產投資屬高風險行為,價格波動劇烈,您可能損失全部投資本金。請充分了解相關風險,並根據自身財務狀況和風險承受能力謹慎決策。具體內容詳見聲明

相關文章

Chrome 偷裝 4GB AI 刪掉又重裝,研究員指違歐盟隱私法

據 Decrypt 於 5 月 7 日報道,Google Chrome 在未取得用戶同意的情況下,靜默地向符合條件的設備下載約 4GB 的 Gemini Nano AI 模型。隱私研究員 Alexander Hanff 在對新用戶配置文件進行自動化審計時發現了這行為,指此舉可能違反歐盟《電子隱私指令》。

Market Whisper6分鐘前

法院文件顯示 Altman 曾於 2023 年 11 月提議收購微軟,以保留執行長職務

根據 5 月 7 日發布的法院文件,在 Musk v. Altman 案中顯示出 Sam Altman 與當時的 CTO Mira Murati 之間的簡訊,時間為 2023 年 11 月 19 日;當時正值 OpenAI 的董事會突然將 Altman 從執行長職位撤換的時候。在危機期間,Altman 提議讓 Microsoft 收購 OpenAI 以

GateNews10分鐘前

大型 CEX 增加 SpaceX、OpenAI 和 Anthropic 的上市前交易

根據報導,領先的中心化交易所今天(5 月 7 日)推出 SPACEX/USDT、OPENAI/USDT 與 ANTHROPIC/USDT 的 Pre-IPO 交易對。該平台支援針對這些工具進行槓桿交易。

GateNews18分鐘前

Cloudflare 在 Consensus 2026 上每天觸發 10 億筆 HTTP 402 回應,並與 Visa 與 Experian 推出「Agent Trust Framework」

根據 Foresight News,Cloudflare 首席安全官 Stephanie Cohen 於 2026 年的 Consensus 上宣布,該平台每天觸發約 10 億次 HTTP 402 回應,反映出 AI 代理對付費存取網頁內容的需求。該公司與 Visa 和 Experian 共同推出了 Agent Trust

GateNews34分鐘前

新加坡國會承諾在 AI 時代不造成失業式成長(經過 7 小時辯論後)

根據 CNA,新加坡國會在 5 月 6 日一致通過一項動議,呼籲在 AI 轉型期間實現包容性成長;該動議在超過七小時的辯論後表決通過,辯論涉及 24 名議員,其中包括來自工人黨的 7 名。該動議由勞工事務主管黃志明以及另外三位

GateNews54分鐘前

Anthropic 佈局消費者市場,提升 Claude 聊天機器人速度

根據公司實驗室團隊的共同負責人 Mike Krieger 表示,Anthropic 正在將其 Claude 聊天機器人策略,從以企業客戶為主的市場轉向消費者市場。該 AI 新創公司正利用近期在消費者市場的進展,來提升軟體對一般使用者的吸引力,內部

Crypto Frontier1小時前
留言
0/400
暫無留言