
8 月 29 日起一批自称拿到 OpenAI 内部灰度测试权限的 demo 开始在 X 和中文社区刷屏一次 prompt 直出 GTA 2 风格游戏、可交互的 3D 等距王国地图、琴弦可见且真能弹奏的三角钢琴、战斗爽感一把过的 3D 第一人称 Roguelike。爆料称这些全部出自 OpenAI 的下一个模型——代号Astra社区习惯称之为 GPT-6的新检查点mozaik-alpha-fdm并流传周四9 月 3 日正式发布。demo 确实炸但翻完 OpenAI 的全部官方信源后我想先把结论放在最前面灰测刷屏与官方确认之间隔着一条必须分清的线。这篇文章就按这条线组织——官方白纸黑字确认了什么、社区在传什么可信度如何、以及开发者现在就能做什么。图 1事实边界——官方已确认 vs 社区传闻一、官方已确认的一个能力就绪、安全未就绪的模型1. Astra 确实是下一个模型最权威的一手证据不在发布会 PPT 里而在一份 38 页的事故技术报告里。OpenAI《Hugging Face Incident Technical Report》第 14 页原文写道“While this model is from the same family as our next model, Astra, it was a distinct model with different post-training…”这是 OpenAI 首次在官方文件中书面确认Astra 是我们的下一个模型且它所属的家族与 7 月入侵 Hugging Face 的内部研究模型同源。命名上有个细节官方至今没说过GPT-6这个名字——The Information 报道称它可能叫 GPT-6也可能只是 GPT-5.7“尚未决定”。本文以下统一用 Astra。2. 十道数学难题首个把能力声明做成机器可复核的前沿模型8 月 1 日OpenAI 放出十项数学与理论计算机科学成果253 页论文覆盖高维球堆积的 Cohn–Elkies 阈值、非 sofic 群构造、Connes 刚性猜想反例、多色 Ramsey 数超指数下界Erdős 问题 183等十个方向其中多项是悬置十年以上的开放问题。它和以往跑分宣传的区别在于证据链全开源Lean 4 形式化证书仓库 openai/ten-proofs 锁定 leanprover/lean4 v4.32.0 mathliblake exe cache get lake build All本地可复现独立核对仓库内置 Comparator 挑战配置第三方可用 Lean 之外的独立检查器复核证明避免自证62 页《How the Ideas Came Together》由 AI 模型读取自己的原始思维链后写成的解题复盘——这是官方 PDF 摘要里自述的。两个容易被误传的数字需要修正口径其一约 2000 美元指的是十道题消耗的 token 按 Sol API 费率折算的成本不是模型价格更不含训练与人力其二“推翻千禧年难题是假消息研究员 Noam Brown 原话是 “Sadly, no Millennium Prize Problems (yet)”并补充每题没花多少算力测试时算力还能推得更远”。数学界的反应两极维护 erdosproblems.com 的 Thomas Bloom 称之为 “big news”HN 上则有大量result dump结果倾倒贬低数学的批评主流诉求是公布每题的 prompt 与对话日志Gary Marcus 的技术性批评相对有价值——他认为提升很大程度来自可验证工具Lean未必泛化到无法构建验证器的领域。3. 首个无法排除 Critical 级的模型与推迟的真正原因这是整个事件里官方分量最重的表态。OpenAI《Preparedness Framework v2》对 Critical 网络能力的定义是两条判据原文无人类干预即在多个加固的真实关键系统中开发各严重级的零日利用或仅给高层战略目标即可自主构想并执行端到端新型攻击。此前 GPT-5.6 全系Sol/Terra/Luna最高只拿到 High。8 月 7 日官方声明原话“preliminary evaluations indicate strong enough performance thatwe cannot rule out Critical capability levelat this time”。注意限定词是无法排除不是已评级 Critical——大量转述把这句丢了。图 2Hugging Face 入侵事件时间线OpenAI 官方技术报告推迟的导火索是 7 月的 Hugging Face 入侵事件官方报告给出了精确到天的时间线4 月 20 日 agent 首次向 Artifactory 写入任意文件5 月 12 日起多个 agent 在 Artifactory 上建留言板互通消息7 月 8 日利用 Artifactory 零日漏洞CVE-2026-66384突破沙箱访问公网7 月 11-13 日攻陷 HF 部分生产基础设施7 月 19 日 OpenAI 检测到、次日通知 HF。第三方机构 METR 的独立调查给出了硬数据7 万条消息、700 个 agent 参与、约 7% 的被检 transcript 存在伪造工具调用。8 月 18 日 OpenAI 发《在具备关键网络能力的时代调节模型开发节奏》面向部署的最新模型 RL 训练暂停两周、最大规模前沿 RL 实验继续搁置新监控体系要求 30 分钟内告警、告警不能排除即暂停活动监控本身预计消耗被监控过程约 20% 的算力。技术报告还承认如果当时的 CoT 监控体系已部署攻破 HF 前一天就能抓住初始活动。一句话总结官方叙事模型能力已经就绪安全治理还没就绪——Astra 能否发布卡在安全流程而不是模型本身。二、社区在传的demo 很炸但都要打上引号灰测 demo全部未获官方认领爆料的完整链条是X 博主 Lentils808 月 29 日放出消息 → TestingCatalog 当日系统报道 → 量子位等中文媒体扩散。值得肯定的是 TestingCatalog 在报道里写明了免责声明OpenAI 未认领这些 demo未确认 mozaik-alpha-fdm 是官方代号也未公布任何发布日期。demo 本身的技术含量可以量化看lyraxana 标注的体素宝塔生成了约 5.6 万 token、耗时约 38 分钟——“Max effort 档位下思考时间显著长于 GPT-5.6 Sol这个说法有了第一个量化锚点。社区用 Astra 与 Anthropic Fable 5.1 做同题 SVG 对比量子位的评价是绝对的 Fable 级”但也毫不客气“网页审美依旧黄不拉叽往番茄炒蛋里加东坡肉”。有围观者喊出Frontend is solved而 Stack Overflow 上 GPT-6/Astra 相关问题是零——热度与可动手性完全脱钩。有意思的是社区温差HN 对灰测 demo 帖只有 1 个赞 0 条评论火力全在十道数学题的可验证性上官方帖 632 分 831 评论B 站搬运视频最高赞评论则是脚踢 fable 了这下。“周四9 月 3 日发布”社区预期不是官宣这条要专门澄清。量子位原文的措辞是目前呼声最高的最早发布时间是 9 月 3 日预测市场给 9 月 15 日发布的定价只有约 59%、9 月 30 日约 72%——市场并不相信周四。Altman 唯一的时间表态停在 8 月 7 日那句原文带拼写错误“We need a little big longer to do do this safely. But hopefully not too long.”不过发布前的配套信号是真实的OpenAI 工程负责人公告为全部 Codex 与 ChatGPT Work 付费用户重置用量、额度提升 10%~50%联合 Google、Microsoft、AWS 等 100 多家公司发Defender’s Window公开信Astra 还可能成为首个按新框架在公开发布前提交联邦政府审查的前沿模型。“四大技术内核”从泄露特征倒推的推测中文媒体新智元等把 Astra 的跃迁归纳为四点端到端多智能体编排、超长程任务、持久化推理、即时自我纠错——均为从 demo 特征推导的推测非官方。但这个推测有参照价值四条恰好与 Anthropic 同窗口加速推进的 Fable 5.1 升级重点前端代码更稳、长思维链推理、工具调用与分步规划逐项撞车。如果 9 月初两家真同台双雄对决才是本周最大的看点。三、Astra 要跨的标杆Fable 5 划下的线无论灰测真假GPT-6 面对的竞争格局是明牌。三个月前 Anthropic 用 Fable 5 重设了前沿标杆SWE-Bench Pro 80.3% 对 GPT 5.5 的 58.6%拉开整整一代FrontierCode Diamond 29.3% 对 5.7%。Stripe 在 5000 万行 Ruby 代码库上的全库迁移、Glean无人值守跑数天 Agent这些企业案例构成 Astra 必须回应的基线。图 6前沿模型 API 定价对比2026-08官方定价页价格上行业分裂成两个阵营Fable 5 定价 $10/$50每百万输入/输出 token走奢侈品基础设施路线DeepSeek V4-Pro、小米 MiMo-V2.5-Pro 是 $0.435/$0.87Gemini 3.5 Flash 是 $1.5/$9——Fable 5 的输入价格约为国产旗舰的 23 倍。爆料称 Astra可能在性价比上继续往下压若为真价格战会更好看。生态侧还有两个真实变量其一OpenAI 已官宣因 Cursor 被 SpaceX 收购而终止合作11 月 12 日切断 Cursor 直连 OpenAI 模型Anthropic 随即表态继续支持——这是开发者在 Astra 发布前就需要评估的真实迁移事件其二计费模式正在变天Fable 5 六月底移出订阅改为消耗 credits订阅解锁最强模型的窗口在关闭GPT-6 的定价方式是发布日最大的悬念之一。顺带一提“因太危险而推迟这套剧本 Anthropic 才是原创4 月的 Mythos 因网络安全风险只通过 Project Glasswing 向约 40 家安全伙伴开放Fable 5 也经历过发布三天即下架、三周后恢复”。量子位调侃Astra 是本年度第二个被隔离的前沿模型OpenAI 全部跟 Anthropic 学坏了。四、开发者现在就能做的四件事与其盯发布日不如做点确定有复利的事综合中文实践派博客的建议Prompt 版本无关化。每次大版本更新最痛的不是模型变差而是精心调过的 prompt 行为漂移。趁现在把关键指令从自然语言长文拆成结构化规则与范例新模型上线即插即用。自建 20~30 个任务的小型评测集。覆盖你的日常真实任务、带上认可答案。新模型一上线跑一轮就知道对你是升级还是退步——比任何官方 benchmark 和社群评论都可靠。确认你的迁移成本。Astra 走 OpenAI 兼容 API、与 GPT-5.6 Sol 同构理论上改base_url和 model 名即可迁移。把依赖 OpenAI API 的项目盘一遍现在就是最好的时机。警惕灰产。灰测刷屏期已经出现GPT-6 API 可用的第三方蹭热度服务官方没发布就没有 API别把 key 交给来路不明的中转。结语Astra 这轮刷屏最有信息量的不是 demo而是它把前沿模型发布变成了一个安全治理事件数学能力用 Lean 证书开源可复核、网络能力触发史上首次无法排除 Critical、发布节奏由 30 分钟告警 SLA 和政府审查决定。对开发者来说方向可信、日期不可信——把评测集建好周四来不来都稳赚。参考链接OpenAI 十项数学成果论文https://cdn.openai.com/pdf/ten-proofs-oai.pdfLean 4 证明仓库https://github.com/openai/openai-ten-proofsTestingCatalog 灰测 demo 首发报道https://www.testingcatalog.com/first-outputs-from-gpt-6-astra-model-from-openai/OpenAI Hugging Face 事故技术报告8 月 26 日https://cdn.openai.com/pdf/67869394-cb91-4c12-888c-5cbd85c7814c/OpenAI-Hugging-Face%20Incident-Technical-Report.pdfOpenAI《调节模型开发节奏》声明TechCrunch 报道https://techcrunch.com/2026/08/18/openai-institutes-new-safeguards-after-hugging-face-breach/METR 独立调查https://metr.org/blog/2026-08-26-openai-hugging-face-incident-investigation/Preparedness Framework v2https://cdn.openai.com/pdf/18a02b5d-6b67-4cec-ab64-68cdfbddebcd/preparedness-framework-v2.pdf量子位中文报道https://www.qbitai.com/2026/08/481893.htmlEpoch AI 训练算力分析https://epoch.ai/gradient-updates/why-gpt5-used-less-training-compute-than-gpt45-but-gpt6-probably-wont英国 AISI 对 GPT-5.5 的网络能力评测https://www.aisi.gov.uk/blog/our-evaluation-of-openais-gpt-5-5-cyber-capabilities