GPT-6 Astra傳出矚目突破?傳說一天解開5道數學難題引發熱議
- 首頁
- GAMING NEWS
- Gaming Trends
- GPT-6 Astra傳出矚目突破?傳說一天解開5道數學難題引發熱議
近日有消息指出,OpenAI推出了全新旗艦模型 GPT-6 Astra,並主打它是品牌目前能力最強、對齊表現也相當出色的生成式 AI。
這次訓練據稱是在美國德州的 Stargate 超算基地完成,預訓練階段動用了超過10萬張 GPU,且也是 OpenAI 首次大規模讓前代模型參與監督訓練的重點產品。
那它到底有多猛?從最新流出的測試結果來看,答案似乎相當驚人。
Epoch AI 與曼徹斯特大學共同發表的 FrontierMath Erdős(FME)基準測試中,GPT-6 Astra 成了唯一一個交出有效解答的大模型。
在這項收錄68道人類至今仍未解開的 Erdős 數學難題測試裡,它據稱成功攻下5題,而其他幾款主流模型,像是 GPT-5.6、Claude Fable 5.1 等則都拿到零分。
這份測試相當嚴格,題目全部都沒有標準答案,目的就是避免模型靠背題庫作答;AI 必須輸出 Lean 形式化證明,並由內核自動驗證結果。所有模型還統一限制在300美元預算、72小時內完成,盡量維持公平。
在正式測試中,GPT-6 Astra 先解出2題,後續在放寬算力條件的追加實驗裡又多拿下3題。其中就包含 Erdős 在18歲提出、他自稱是「人生第一個正經問題」的1931年解離集猜想,以及極值圖論裡相當知名的 Erdős-Sós 猜想,都是困住數學界多年的老問題。
這5道成果裡,有些是透過構造反例推翻舊猜想,也有些是完整證明新命題,難度都不低。
不過,這份消息也提到,GPT-6 Astra 完成這5題的總算力成本超過22萬美元;反觀標準基準測試本身約花2萬美元。若以300美元一次、成功率約3%來估算,解出一道重要開放問題的期望成本大約落在1萬美元左右。
當然,論文也提醒,模型有時可能已經想出正確方向,卻無法順利轉成 Lean 證明。再加上這類基準主要是在考驗「解題能力」,而真正的數學研究還包含提出新問題、建立新架構等面向,所以68題之中仍有63題尚未被攻克。即使外界對這波成果反應熱烈,要說 AI 已經全面跨入高等數學領域,恐怕還是言之過早。
☆ 大家都在買 ☆





