AI 大模型日报 — 2026-08-01(周六) AI 大模型日报 — 2026-08-01周六一句话概览GPT-5.6 家族Sol/Terra/Luna7 月上旬全面开放7 月起登陆 Cerebras 高速推理平台Kimi K3 发布即爆火、算力告急暂停新用户接入谷歌 Gemini 3.5 系列亮相、3.5 Pro「coming soon」智谱 GLM-5.2 以 1M 无损上下文主打长程 Coding AgentAnthropic 链上估值冲上 1.2 万亿美元反超 OpenAI 并启动 IPO旗下 Mythos 5 / Fable 5 曾因美出口管制令短暂下线中国大模型全球 Token 调用量持续领先美国。 数据来源Bing 网页搜索抓取OpenAI/DeepMind/Meta 官方页、智谱文档、腾讯云开发者社区、36氪、虎嗅、AI产品库等公开报道抓取时间 2026-08-01。 今日热点摘要1. GPT-5.6 全面开放Sol/Terra/Luna 三档齐发Cerebras 上线 750 token/sOpenAI 于6 月 26 日启动 GPT-5.6 有限预览配合美国政府分阶段审批7 月 9-10 日正式全面发布GPT-5.6 模型家族含旗舰Sol、中端Terra、轻量Luna三档。SolOpenAI 迄今最强模型编码Terminal-Bench 2.1 达91.9% 创纪录、网络安全CTF 命中率 96.7%、生物学GeneBench v1全面领先新增「max」深度推理模式与「ultra」子智能体模式上下文窗口达105 万 Token定价输入 $5 / 输出 $30每百万 Token仅为 Anthropic Claude Fable 5$10/$50的一半。Terra性能与 GPT-5.5 相当、价格便宜约 2 倍Luna最低价格覆盖日常高频场景。7 月上线 Cerebras 平台GPT-5.6 Sol 推理速度最高750 token/s初期仅向部分客户开放。背景发布前一天美国政府要求 OpenAI 分阶段发布、逐客户审批OpenAI 表态「不希望审批流程成为长期常态」但短期配合。中美 AI 监管博弈进入模型发布环节。2. Kimi K3 发布即爆火月之暗面算力告急月之暗面Kimi K3于7 月 15 日开始灰度测试、约 7 月 17 日正式上线1M Token 超长上下文、多模态理解、Tool Calling主打长程编程与智能体Agent工作流支持 Swarm 并行任务、可生成可玩的多人/3D 游戏。因海量需求涌入导致算力过载官方7 月 19 日宣布算力紧张、暂停新用户接入引发广泛讨论。同期开源Kimi K2.6262K 上下文持续迭代有评测指出 DeepSeek V4 系列价格仅为 Kimi K3 的几十分之一价格战激烈。3. Gemini 3.5 系列亮相3.5 Pro「coming soon」Google DeepMind 官网已更新至Gemini 3.5 系列主打「前沿智能 行动能力」frontier intelligence with action面向复杂多步工作流核心能力包括Agentic coding、多模态统一理解、长程任务执行。官方标注Gemini 3.5 Pro 即将推出当前主力仍是 3 月发布的 Gemini 3.1 Pro百万级上下文、长程推理无信息衰减。长上下文评测GDM-MRCR v28-needleGemini 3.5 在 128K 档平均91.8%、1M 档54.0%均领先同类竞品。4. Anthropic估值 1.2 万亿美元反超 OpenAIIPO 进程启动5 月初 Anthropic 链上 Pre-IPO 隐含估值飙升至1.2 万亿美元约合人民币 8.7 万亿元首次反超 OpenAI6 月 2 日正式启动IPO 进程。营收爆发2025 年底 ARR 约 90 亿美元2026 年上半年呈指数级增长成为资本市场「AI 新王」。产品线旗舰Claude Fable 5$10/$50 每百万 Token、Mythos 5曾因特朗普政府出口管制令下线约两周3 月更新的 Claude 4.6 已免费开放 1M 上下文、单次支持 600 张图像/PDF 解析。 各重要模型动态OpenAI / GPT 系列GPT-5.6见头条 1。三档分层 激进定价旗舰仅对手一半 政府审批式发布是本轮最受关注事件。生态GPT-5.6 Sol 在 Cerebras 平台高速推理此前 GPT-5.43 月1M 上下文、电脑控制、GPT-5.1 预览千万级上下文已奠定长上下文与 Agent 底座。Anthropic / Claude 系列Claude Fable 5 / Mythos 5性能对标 GPT-5.6 Sol但受美出口管制影响曾下线两周价格约为 Sol 的 2 倍压力明显。Claude 4.63 月 25 日1M 上下文取消溢价免费开放、多模态处理能力提升 6 倍编程场景可整仓处理大型代码库。资本与人才估值 1.2 万亿美元 IPO 启动此前 AlphaFold 核心团队诺奖得主 John Jumper 等加盟。Google DeepMind / Gemini 系列Gemini 3.5 系列7 月Agentic coding、长程任务、多模态统一3.5 Pro 即将推出。Gemini 3.1 Pro3 月 12 日百万级上下文长程推理无信息衰减配套Veo 3视频生成原生音频、首尾帧可控、1080P 最长 10 分钟。Meta / Llama 系列Llama 4.03 月 18 日7B/13B/70B/400B 四档70B 在 GLUE/MMLU 平均超越 GPT-4.5 约 5 个百分点刷新开源纪录取消商用限制超 10 万家企业接入Llama 4 系列支持10M 上下文窗口、多模态。战略扎克伯格在 Meta Q2 2026 财报会押注个人 AI 智能体personal AI agents。DeepSeekDeepSeek-V4 系列1M 超长上下文、思考/非思考双模式全面采用国产芯片海光、寒武纪训练与推理、彻底脱离 CUDA 生态推理成本较上代降低 60%支持文图音视频全链路多模态。价格杀手V4 系列尤其缓存命中价仅为 Kimi K3 的几十分之一持续扮演行业「价格锚」。月之暗面 / KimiKimi K37 月中旬发布即登顶全球榜单与 Unlimited OCR 包揽前二1M 上下文 Agent 能力因算力过载暂停新用户接入。研究团队论文《Attention Residuals》注意力残差架构可使训练计算量减少 25%已集成至 Kimi。智谱 AI / GLMGLM-5.26 月 14-16 日主打Solid 1M 无损上下文针对长程 Coding Agent 场景数月强化训练覆盖大规模实现、自动化研究、性能优化配套 ZCode 开发工具。GLM-5745B 总参数 / 44B 激活 MoE、200K 上下文、开源GLM-5.1强化代码与长程任务。阿里 / QwenQwen3.5-Max-Preview3 月 20 日LM Arena 盲测1464 分登顶中国第一、全球第五超越 GPT-5.4、Claude 4.5稀疏 MoE 397B 总参 / 17B 激活。开源侧Qwen3-Instruct-2507、Qwen3-235B-A22B 等 7 月版本持续更新Qwen3-VL 多模态迭代中。其他国产模型MiniMax M2.5、DeepSeek V3.2、阶跃星辰 Step 3.5 Flash3 月 OpenRouter 全球调用量 Top5 中占据 3 席海外开发者占比 47%。小米 MiMo-V21.2 万亿参数、1M 上下文全球综合排名第八已落地小米 15 手机与 SU7 汽车端侧。华为盘古 2.0具身智能驱动工业机械臂装配误差 0.01mm、车路云一体化。百度文心 5.0具身智能 低空经济无人机自主规划、多机协同开源端侧推理框架。科大讯飞星火 4.0语音交互延迟降至 200ms新增 12 种方言。腾讯混元 3.0内测中强化智能体与企业服务将深度接入微信、企业微信、腾讯云生态。 行业趋势分析1. 价格战进入「对半砍」阶段GPT-5.6 Sol 定价$5/$30仅为 Claude Fable 5$10/$50一半Terra 以 GPT-5.5 性能打五折DeepSeek V4 缓存命中价低至 Kimi K3 的几十分之一。「性能接近、价格腰斩」成为旗舰发布的标配打法开发者与企业调用成本持续下探。2. 百万 Token 上下文成标配长程任务规模化GPT-5.6105 万、Gemini 3.1/3.5、GLM-5.21M 无损、Kimi K31M、DeepSeek V41M、Llama 410M——「长上下文 长程 Agent 任务」取代单纯参数竞赛法律、金融、科研、代码库级应用进入实用阶段。3. Agent 智能体成为主战场从「会聊天」到「会干活」GPT-5.6 的 ultra 子智能体模式、Gemini 3.5 的 Agentic coding、GLM-5.2 的长程 Coding Agent、Kimi K3 的 Swarm 并行头部模型集体押注「能自主完成多步工作的智能体」电脑控制与工具调用成为标配能力。4. 中大模型话语权持续上升全球调用量反超3 月 OpenRouter中国 4.19 万亿 vs 美国 3.63 万亿 Token、LM Arena 登顶Qwen3.5-Max、开源霸榜Kimi K3 全球第一梯队、价格优势明显——中模型在「开源 性价比 垂直场景」三线建立影响力。5. 资本市场狂热AI 独角兽估值进入「万亿俱乐部」Anthropic 链上估值 1.2 万亿美元并启动 IPO、SSI 获英伟达 50 亿美元押注、OpenAI 硬件布局浮出水面——一级市场对前沿实验室的定价已脱离营收基本面转向对 AGI 卡位权的定价。 主要信息来源OpenAI GPT-5.6aiproducthub.cn 快讯openai-gpt-5-6-sol-terra-luna-launch、知乎专栏 p/20588457393887780787/10 正式发布、p/2054164116282124189Cerebras 750 token/s、houdao.com105 万上下文、meshlaunch / macgpu 评测汇总Gemini 3.5deepmind.google/models/gemini/官方3.5 Pro coming soon、GDM-MRCR v2 数据GLM 系列docs.bigmodel.cnGLM-5.2/5.1 官方文档、z.ai/blog/glm-5.26/16Kimi K3platform.kimi.com、moonshot.cn7/16、知乎问答 q/20623107544816560747/19 算力紧张、q/20606352066510655017/15 灰度Anthropic36氪 p/3799097984080899估值 1.2 万亿5/7、虎嗅 huxiu.com/article/4863841.htmlIPO 启动6/22026 年 3 月全球大模型全景腾讯云开发者社区 cloud.tencent.com/developer/article/2658619国产登顶、百万上下文、智能体爆发Meta Llamadeveloper.meta.com/ai/models/llama-4/10M 上下文、多模态排行榜datalearner.com/leaderboards2026 年 7 月更新知乎专栏 p/670574382国内外知名大模型 2026/07/31本报告由 Hermes Agent 定时任务自动抓取整理生成Firecrawl 额度受限本次经 Bing 搜索直接抓取。