登入
關鍵字
#Astra 模型
官方認證
RexAA
2026/09/20
•
全球基模決戰!AI圈休不了十一長假了
現在就預告了——中秋和國慶的13天假期,可能會是今年AI圈最忙最炸的兩周。 盆友,別休了,別睡了,找好椅子癱坐吧。 「基模決戰周」,真要來了!! 矽谷那邊已經暗流湧動。
科技
#基模決戰
#AI大模型
#矽谷集體
讚
留言
分享
官方認證
RexAA
2026/09/20
•
剛剛,Fable 5.2也曝光了!
不少網友發現,Fable 5.2已開啟灰測。 現在,一大波真實測試案例已經在網上出現了。 根據大家的連夜實測,這波更新的跨度很大。 在最高推理模式下,Fable 5.2的實測表現竟然碾壓了GPT-6 Astra!
科技
#AI大模型
#Fable 5.2
#Anthropic
讚
留言
分享
官方認證
RexAA
2026/09/19
•
GPT-6 Astra只改14.4%,留給中國具身智能的時間不多了
GPT-6 Astra掀起的具身智能風暴仍在持續。 9月初,OpenAI發佈GPT-6 Astra。 這款通用語言模型針對Agent和Coding進行最佳化,用於電腦操作、網頁瀏覽、寫程式碼、網路安全、科學推理,但一個字沒留給機器人。 然而,隨後幾天,用GPT-6 Astra控制機械臂的視訊演示大範圍傳播,新模型無需額外訓練,直接操控機械臂抓取,放置物體,具身智能圈迅速展開了測試與爭論。
科技
#OpenAI
#GPT-6 Astra
#通用語言模型
讚
留言
分享
官方認證
美股艾大叔
2026/09/18
•
剛剛,Gemini 4 Pro偷跑上線!碾壓Astra和Fable
真是深藏不漏! 這一次,Google終於把底牌扔出來了。 就在這兩天,大模型競技場Arena悄然殺入一款新模型,名字竟掛著「gemini-3.8-flash」。 上手實測的AI大佬和開發者交手幾輪後,幾乎倒吸一口氣——
科技
#Gemini 4 Pro
#Astra
#Fable
讚
留言
分享
官方認證
美股艾大叔
2026/09/18
•
爆料!奧特曼自曝「後Astra」模型,已超越全球最強數學家
剛剛,奧特曼又曝新料了。 在和Salesforce CEO Marc Benioff的對談中,他親口劇透了OpenAI內部模型的最新進展。 首先,他給出了這樣一句判斷:「GPT-5.5的水平大概相當於一個普通的數學教授。GPT-5.6,大概能比肩全球排名前1%到2%的頂尖數學教授。」 接下來,他曝出了一個重磅猛料。
科技
#奥特曼
#後Astra模型
#數學家
讚
留言
分享
官方認證
美股艾大叔
2026/09/09
•
比GPT-6 Astra強!OpenAI新模型破解90年數學難題,遭紐約大學教授炮轟剽竊
10000個智能體合夥開工,搞定90年懸而未決數學難題。 智東西9月9日消息,今日,OpenAI宣佈使用比GPT-6 Astra更強的內部系統,破解了懸而未決約90年的“千禧年大獎難題”。 這道難題是納維–斯托克斯存在性與光滑性問題,OpenAI成功證明,描述流體運動的納維–斯托克斯方程,其動力學演化可在有限時間內產生奇點。 他們的策略是用不同智能體群組進行多樣化驗證,最後由Codex彙總結果。首批智能體啟動約88小時後,智能體群組於當地時間9月5日得到了證明結果,後續由GPT‑6 Astra耗時17小時,完成Lean形式化建構與核驗。
科技
#GPT-6 Astra
#OpenAI
#新模型
讚
留言
分享
官方認證
美股艾大叔
2026/09/09
•
GPT-6重回第一,OpenAI也打不過Anthropic
OpenAI重新有底氣談“第一”了。 頭圖|視覺中國 GPT-6 Astra發佈後,OpenAI重新有底氣談“第一”了。 9月3日,OpenAI發佈GPT-6 Astra,並將其稱為“世界上最智能的模型”。在軟體工程、電腦操作和專業工作等多項測試中,Astra均大幅超過上一代GPT-5.6 Sol,並在部分指標上領先Claude。其中FrontierMath Tier 4得分97.6%、ARC-AGI-3最高99.9%、ExploitBench達到100%。在更謹慎的獨立評測中,截至9月7日,Artificial Analysis最新綜合榜單中,Astra與Claude Fable 5.1以53分並列第一。
科技
#GPT-6 Astra
#OpenAI
#Anthropic
讚
留言
分享
官方認證
RexAA
2026/08/21
•
繼 Anthropic 後, OpenAI 也稱旗下模型 Astra 疑達關鍵網路攻擊能力門檻
OpenAI 於 2026 年 8 月 18 日宣佈放緩模型研發節奏,因即將推出的 Astra 模型可能達到「關鍵網路安全能力」門檻,已對擬部署的最新模型暫停兩周強化學習訓練,最大規模的前沿 RL 運行也仍處暫停。 公司同時加強監控、對齊與安全防護:新增多階段自動化調查,目標在異常出現後 30 分鐘內報警,監控開銷約佔被監控推理算力的 20%。(firemail)
科技
#OpenAI
#Anthropic
#Astra 模型
讚
留言
分享