Google裡有多少個P?根據Google的說法,有兩個。Google的AI概述也提到,「poop」這個單字裡有「正好一個R」,以及「journalism」這個單字中有兩個D,但卻拼成:j-o-u-r-n-a-d-i-s-m。Google至少識別出美國總統姓氏中有一個P,但卻拼成t-r-p-u-m。你不需要預言家就能預測到Google將其搜索功能轉向AI前導的改革會搞砸。我們曾經做過這件事。當Google第一次將AI概述加入搜索功能時,這個功能最終引用了The Onion和Reddit上的諷刺文章,建議人們吃岩石、把膠水塗在披薩上。這次Google再次將生成式AI作為其29歲旗艦產品的核心,出現錯誤也就不足為奇了。Google正在重組整個搜索引擎,這邊附上圖片:pic.twitter.com/PIR4llFhiV — mersomas (@mersomas) 2026年5月27日 「在單字內進行計數一直是大型語言模型的已知挑戰,我們正在努力解決這個問題,」Google透過電子郵件告訴TechCrunch。這些基本的拼寫錯誤看起來似乎很熟悉。驅動聊天機器人和其他文字生成器的大型語言模型(LLMs)並不是設計來理解拼寫的。多年來,這一直是個笑話:每次公司推出新的AI模型時,你應該問它「strawberry」這個單字中有多少個R。這些AI模型——它們能在幾秒內編出應用程式,或解決讓數學家苦惱數十年的問題——在拼寫方面的能力,大概就像幼稚園小孩一樣。Google的AI概述問題不僅僅是這些愚蠢的拼寫錯誤。Google已經修復了上周出現的問題,當搜尋「disregard」這個單字時,會顯示看起來像詞典定義的結果,但實際上顯示的是:「明白了。有任何新的提示或問題時請告訴我!」但這些拼寫錯誤仍然令人發笑,因為它們很難徹底解決。當我們之前詢問過這些拼寫問題時,研究人員曾解釋過,AI並不會將句子視為由單字和字母組成的語言單位。許多LLMs是基於transformer模型建立的,這類模型會將文字分解為tokens,這些tokens可以是完整的單字、音節或字母,視模型而定。與人類閱讀不同,AI會將文字轉換為數值表示,然後根據上下文來幫助AI產生邏輯回應。圖片來源:TechCrunch 「LLMs是基於這種transformer架構,值得注意的是,這並不是實際在閱讀文字。當你輸入一個提示時,它會被轉換為編碼,」亞伯塔大學的AI研究員兼助理教授Matthew Guzdial告訴TechCrunch。「當它看到『the』這個單字時,它會有一種關於『the』意義的編碼,但它並不知道『T』、『H』、『E』。」驅動Google AI概述的基於tokens架構的LLMs本質上是有局限性的,研究人員並沒有樂觀認為他們能解決拼寫問題。「很難繞過這個問題:語言模型究竟什麼樣的『單字』才算正確,即使我們讓人類專家達成一致的完美token詞彙,模型還是可能會認為進一步『分塊』是有用的,」紐約大學的博士生Sheridan Feucht告訴TechCrunch。「我的猜測是,由於這種模糊性,不存在完美的tokenizer。」這並不是研究人員目前最緊急的問題,因為LLMs的實用性並不在於它們的拼寫能力。但這些明顯的失敗提醒我們,AI並不完美,即使它有時看起來像超越我們理解的全知力量。我們不能盲目信任AI的輸出,而不去驗證其準確性。
為何谷歌的 AI 無法拼寫「谷歌」(或任何其他東西)
分享這篇文章: