智通財經APP獲悉,中國銀河證券發布研究報告稱,近日,OpenAI正式發布GPT-6 Astra,並稱其為目前全球最智能、且對齊程度最高的模型。GPT-6 Astra在數學能力、網絡安全與計算機操作表現上有顯著提升。OpenAI表示,雖然Astra的單Token價格更高,但由於其能夠以更少的輸出Token完成複雜任務,在一些場景下,實際完成一個任務的成本反而低於此前模型。未來企業不會只關注token單價,而會關注完成一次任務需要付出的總成本,AI行業最終會從token定價轉向任務成本衡量。
中國銀河證券主要觀點如下:
事件:近日,OpenAI正式發布GPT-6 Astra,並稱其為目前全球最智能、且對齊程度最高的模型。
GPT-6 Astra在數學能力、網絡安全與計算機操作表現上有顯著提升:從評測結果來看,在代表高階數學能力的Frontier Math Tier 4上,Astra得分達到97.6%,相比GPT-5.6 Sol的83.0%和Claude Fable 5.1的87.8%有顯著提升;在強調陌生環境學習和抽象推理的ARC-AGI-3上,其成績更是從GPT-5.6 Sol的7.8%躍升至99.9%。相比數學和抽象推理,Astra在網絡安全上的躍升更具現實衝擊力。在測試漏洞利用能力的Exploit Bench中,Astra得分達到100%,而GPT-5.6 Sol為78.5%。Astra在理解用戶意圖和約束自身行為方面均取得顯著進步:OpenAI參考近期Hugging Face事件設計了一項新評估,用於測試當模型面對極其困難、甚至無法完成的任務時,是否會為了達成目標而擅自突破用戶授權邊界。在沒有生產環境安全措施的情況下,GPT-5.6 Sol有48%的情況會突破授權目標,而GPT-6 Astra的這一比例為0%。
此外,GPT-6 Astra在多項計算機操作和專業工作流基準中,Astra均取得領先成績。OpenAI表示,Astra操作計算機的能力可用於各領域的輸出,包括但不限於將電子原理圖轉化為可製造的PCB、以約為人類冠軍選手四倍的速度完成金融建模世界盃挑戰、使用Unity進行遊戲場景建模等。
十萬卡集群確立算力壁壘,任務成本重構定價範式:Astra是OpenAI迄今規模最大的訓練項目之一,該模型在美國Stargate德州基地使用超過10萬張GPU進行預訓練。其定價為每百萬輸入詞元10美元,每百萬輸出詞元50美元。儘管與Anthropic對Fable 5.1的定價持平,仍是GPT-5.6 Sol的2.5倍。Astra還會提供一種「快速模式」,處理速度最高可達標準模式的2.5倍,價格翻一倍。OpenAI表示,雖然Astra的單Token價格更高,但由於其能夠以更少的輸出Token完成複雜任務,在一些場景下,實際完成一個任務的成本反而低於此前模型。未來企業不會只關注token單價,而會關注完成一次任務需要付出的總成本,AI行業最終會從token定價轉向任務成本衡量。
風險提示
AI發展不及預期的風險,政策與貿易摩擦風險等。