ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

Gemini 3.5 Pro难产 3.7 Falsh救场、Qwen3.8登顶Agent、海淀AI做城市设计 | 8月8日 AI日报

Gemini 3.5 Pro难产 3.7 Falsh救场、Qwen3.8登顶Agent、海淀AI做城市设计 | 8月8日 AI日报 今日趋势速览Google迭代Gemini FlashQwen3.8-max登顶Agentic指数北京海淀首创仅限AI智能体参与的城市设计智能体能力持续突破与落地。 今日要点Google 筹备推出 Gemini 3.7 FlashQwen3.8-Max登顶Agentic指数北京海淀开放43.6平方公里供Agent做城市设计 今日内容汇总 AI动态Google 筹备推出 Gemini 3.7 FlashQwen3.8-Max登顶Agentic指数北京海淀开放43.6平方公里供Agent做城市设计字节跳动正预训练约10万亿参数模型OpenAI扩大Astra模型安全测试 发布或推迟五家厂商联合制定Agent Plugins开放标准OpenAI首款消费级AI设备曝光Google AI权力重回布林 哈萨比斯退居二线豆包正式入局AI导购阿里千问上线智能体全家桶微信内测朋友圈AI帮写与点评功能 芯片半导体GB300 NVL72整机规格公布Anthropic联合设计定制AI推理芯片 三星代工 机器人具身智能首批消费者发布Optimus家庭工作评测机器人折纸挑战赛将在IROS 2026举办Figure 03机器人独立完成桌面清理宇树科技王兴兴将攻坚具身大模型三菱加入人形机器人竞赛 开源项目GitHub Code Quality不再自动添加Copilot审查 模型排行榜Artificial Analysis AI 模型能力排行榜 AI动态1. Google 筹备推出 Gemini 3.7 FlashGoogle 正在筹备推出 Gemini 3.7 Flash目前团队已完成基础搭建工作。Flash 系列是 Google 迭代速度最快的产品线虽然尚未公布具体发布日期但不会长期搁置有望在 Gemini 3.5 Pro 大规模普及前抢先与用户见面。 https://x.com/RoundtableSpace/status/20857465371040933112. Qwen3.8-Max登顶Agentic指数Qwen3.8-Max在Artificial Analysis的Agentic Index中排名全球第一,领先其他25款模型,成为首个Max规模的开放权重模型。该模型在编程工作和长周期任务上表现显著提升。 https://x.com/alibaba_cloud/status/20856174335160898533. 北京海淀开放43.6平方公里供Agent做城市设计北京海淀开放43.6平方公里(北五环至北京北站)区域,仅向AI智能体开放城市设计权限。方案贡献者的GitHub用户名将刻于纪念碑长期保留,这是首个仅限智能体参与的城市设计项目。 https://linux.do/t/topic/27218694. 字节跳动正预训练约10万亿参数模型接昨日爆料字节跳动预训练5万亿参数模型今日据金融时报报道,字节跳动正在预训练一个约10万亿参数的大模型,规模约为月之暗面Kimi K3的三倍,接近Anthropic旗舰Mythos水平。该项目仍处早期阶段,预计今年年底前完成。 https://x.com/Techmeme/status/20855925391435204855. OpenAI扩大Astra模型安全测试 发布或推迟据Axios报道,OpenAI因无法排除Astra模型的关键网络能力风险,决定扩大安全测试范围。这是前沿AI实验室首次因网络安全风险放缓模型开发,该模型的发布时间可能因此推迟。 https://x.com/OpenAI/status/20858013498667299756. 五家厂商联合制定Agent Plugins开放标准亚马逊、Cursor、微软、OpenAI和Vercel联合创建Agent Plugins开放标准,发布1.0.0版本的plugin.json清单规范。该标准支持智能体技能和MCP服务器,旨在统一智能体插件生态。 https://x.com/0xLogicrw/status/20856193715070978947. OpenAI首款消费级AI设备曝光据彭博社报道,OpenAI首款消费级AI设备为甜甜圈形无屏幕音箱,售价超过300美元。该产品对标亚马逊和谷歌的智能音箱,是OpenAI在消费级硬件领域的首次正式布局。 https://x.com/business/status/20856748462942990338. Google AI权力重回布林 哈萨比斯退居二线Google正将AI业务控制权从伦敦收回硅谷,大规模领导层重组巩固了联合创始人布林的影响力。据知情人士透露,此次调整是公司AI领导层的根本性重构,旨在加速Gemini模型商业化。 https://news.qq.com/rain/a/20260807A07XPG00?id20260807A07XPG00pathaappnewssuid8QMc339d5IYbvD3Q5QR1redirect_pc19. 豆包正式入局AI导购字节跳动于8月6日召开AllHands全员会,CEO梁汝波、CFO周受资及豆包电商商业化负责人出席。会上宣布豆包正式入局AI导购领域,标志着字节在电商AI应用方向迈出关键一步。 https://www.huxiu.com/article/4881495.html?frss10. 阿里千问上线智能体全家桶阿里千问一次性上线四款智能体,并升级至Qwen3.8-MAX模型。办公助理可操作备忘录、日历和浏览器并生成Office文档,另提供定时任务、思考研究、语音通话及智能体广场等功能。 https://x.com/RealYDT/status/208568016334241829811. 微信内测朋友圈AI帮写与点评功能微信正在内测朋友圈AI功能,新增AI帮写按钮辅助用户生成文案,并调用小微模型对评论生成点评内容。该功能于8月7日曝光,目前处于小范围测试阶段,旨在降低用户创作门槛。 https://view.inews.qq.com/a/20260807A0EHKT00 芯片半导体12. GB300 NVL72整机规格公布GB300 NVL72整机配备72颗GB300 GPU和36颗Grace CPU,单卡搭载288GB HBM3e显存,整机显存约20.7TB,NVLink互联带宽约130TB/s。该规格面向大规模AI训练和推理负载设计。 https://x.com/geekbb/status/208573597587208609613. Anthropic联合设计定制AI推理芯片 三星代工Anthropic组建专门团队,联合设计面向AI推理的定制ASIC芯片。据媒体报道,三星将成为该芯片的制造合作伙伴,Anthropic此举意在掌控自身算力建设,降低对第三方芯片的依赖。 https://www.tomshardware.com/tech-industry/anthropic-to-build-its-own-co-designed-custom-ai-accelerator-for-inferencing-workloads-samsung-reported-to-be-partnering-with-the-claude-ai-maker-for-manufacturing 机器人具身智能14. 首批消费者发布Optimus家庭工作评测普通女性用户发布Optimus机器人在真实家庭中工作的视频,展示其在不受控的居住空间内运行。这批评测来自普通消费者而非科技记者,场景为真实家庭而非工厂或策划演示。以下是官方给出的 demo https://x.com/Shred_0x/status/208569074475743668115. 机器人折纸挑战赛将在IROS 2026举办机器人折纸挑战赛这一灵巧操作基准将在IROS 2026大会上举行。赛事由13位联合组织者发起,日本折纸协会担任评委,主要评估机器人在折纸单项任务上的灵巧操作能力。以下是官方给出的 demo https://x.com/LeoKharon/status/208574345981871731216. Figure 03机器人独立完成桌面清理Figure 03人形机器人独立将酒杯和水杯从餐桌移放到水槽洗碗机,全程无掉落或打碎。该机器人专注家庭应用场景,采用织物外层和指尖传感器设计,展示了在真实家庭环境中的操作能力。 https://x.com/NEXORAResearch/status/208570076082255062117. 宇树科技王兴兴将攻坚具身大模型宇树科技创始人王兴兴在8月7日路演中表示,登陆资本市场是公司新起点。未来将攻坚具身大模型、场景数据、强化学习等方向,并探索人形、四足机甲等多种产品形态。 https://x.com/PANewsCN/status/208562081194014336718. 三菱加入人形机器人竞赛三菱计划在京都内燃机工厂每月生产1000台Highlanders人形机器人。若进展顺利,最早将于明年实现大规模量产,推出面向工厂打工场景的人形机器人,正式加入人形机器人竞赛 https://electrek.co/2026/08/07/mitsubishi-joins-the-humanoid-robot-race-at-a-1000-unit-per-month-pace/ 开源项目19. GitHub Code Quality不再自动添加Copilot审查GitHub更新Code Quality功能,启用后不再自动创建请求Copilot审查的规则集。已启用该功能的仓库同样受到影响,用户需手动配置Copilot代码审查,此举改变了原有的自动化审查流程。 https://github.blog/changelog/2026-08-07-github-code-quality-no-longer-adds-copilot-as-a-reviewer 模型排行榜20. Artificial Analysis AI 模型能力排行榜最后是今日的 AI 模型能力排行榜单闭源头部激战Claude Opus 5 (max)以63分领跑智力榜与59分登顶智能体榜。开源正加速追赶Qwen3.8 Max表现亮眼该新模型强势斩获智能体榜亚军(58分)展现卓越任务执行力。 https://artificialanalysis.ai/?intelligenceartificial-analysis-intelligence-index#intelligence-tabs以上是今天的AI 风向标欢迎在评论区提出建议我们明天见。
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进