💡今日趋势速览:Google迭代Gemini Flash,Qwen3.8-max登顶Agentic指数,北京海淀首创仅限AI智能体参与的城市设计,智能体能力持续突破与落地。
🎯 今日要点
- Google 筹备推出 Gemini 3.7 Flash
- Qwen3.8-Max登顶Agentic指数
- 北京海淀开放43.6平方公里供Agent做城市设计
📋 今日内容汇总
🤖 AI动态
- Google 筹备推出 Gemini 3.7 Flash
- Qwen3.8-Max登顶Agentic指数
- 北京海淀开放43.6平方公里供Agent做城市设计
- 字节跳动正预训练约10万亿参数模型
- OpenAI扩大Astra模型安全测试 发布或推迟
- 五家厂商联合制定Agent Plugins开放标准
- OpenAI首款消费级AI设备曝光
- Google AI权力重回布林 哈萨比斯退居二线
- 豆包正式入局AI导购
- 阿里千问上线智能体全家桶
- 微信内测朋友圈AI帮写与点评功能
🧪 芯片半导体
- GB300 NVL72整机规格公布
- Anthropic联合设计定制AI推理芯片 三星代工
🦾 机器人具身智能
- 首批消费者发布Optimus家庭工作评测
- 机器人折纸挑战赛将在IROS 2026举办
- Figure 03机器人独立完成桌面清理
- 宇树科技王兴兴将攻坚具身大模型
- 三菱加入人形机器人竞赛
📦 开源项目
- GitHub Code Quality不再自动添加Copilot审查
📌 模型排行榜
- Artificial Analysis AI 模型能力排行榜
🤖 AI动态
1. Google 筹备推出 Gemini 3.7 Flash
Google 正在筹备推出 Gemini 3.7 Flash,目前团队已完成基础搭建工作。Flash 系列是 Google 迭代速度最快的产品线,虽然尚未公布具体发布日期,但不会长期搁置,有望在 Gemini 3.5 Pro 大规模普及前抢先与用户见面。
🔗 https://x.com/RoundtableSpace/status/2085746537104093311
2. Qwen3.8-Max登顶Agentic指数
Qwen3.8-Max在Artificial Analysis的Agentic Index中排名全球第一,领先其他25款模型,成为首个Max规模的开放权重模型。该模型在编程工作和长周期任务上表现显著提升。
🔗 https://x.com/alibaba_cloud/status/2085617433516089853
3. 北京海淀开放43.6平方公里供Agent做城市设计
北京海淀开放43.6平方公里(北五环至北京北站)区域,仅向AI智能体开放城市设计权限。方案贡献者的GitHub用户名将刻于纪念碑长期保留,这是首个仅限智能体参与的城市设计项目。
🔗 https://linux.do/t/topic/2721869
4. 字节跳动正预训练约10万亿参数模型
接昨日爆料,字节跳动预训练5万亿参数模型,今日据金融时报报道,字节跳动正在预训练一个约10万亿参数的大模型,规模约为月之暗面Kimi K3的三倍,接近Anthropic旗舰Mythos水平。该项目仍处早期阶段,预计今年年底前完成。
🔗 https://x.com/Techmeme/status/2085592539143520485
5. OpenAI扩大Astra模型安全测试 发布或推迟
据Axios报道,OpenAI因无法排除Astra模型的关键网络能力风险,决定扩大安全测试范围。这是前沿AI实验室首次因网络安全风险放缓模型开发,该模型的发布时间可能因此推迟。
🔗 https://x.com/OpenAI/status/2085801349866729975
6. 五家厂商联合制定Agent Plugins开放标准
亚马逊、Cursor、微软、OpenAI和Vercel联合创建Agent Plugins开放标准,发布1.0.0版本的plugin.json清单规范。该标准支持智能体技能和MCP服务器,旨在统一智能体插件生态。
🔗 https://x.com/0xLogicrw/status/2085619371507097894
7. OpenAI首款消费级AI设备曝光
据彭博社报道,OpenAI首款消费级AI设备为甜甜圈形无屏幕音箱,售价超过300美元。该产品对标亚马逊和谷歌的智能音箱,是OpenAI在消费级硬件领域的首次正式布局。
🔗 https://x.com/business/status/2085674846294299033
8. Google AI权力重回布林 哈萨比斯退居二线
Google正将AI业务控制权从伦敦收回硅谷,大规模领导层重组巩固了联合创始人布林的影响力。据知情人士透露,此次调整是公司AI领导层的根本性重构,旨在加速Gemini模型商业化。
🔗 https://news.qq.com/rain/a/20260807A07XPG00?id=20260807A07XPG00&path=a&app=news&suid=8QMc339d5IYbvD3Q5QR1&redirect_pc=1
9. 豆包正式入局AI导购
字节跳动于8月6日召开AllHands全员会,CEO梁汝波、CFO周受资及豆包电商商业化负责人出席。会上宣布豆包正式入局AI导购领域,标志着字节在电商AI应用方向迈出关键一步。
🔗 https://www.huxiu.com/article/4881495.html?f=rss
10. 阿里千问上线智能体全家桶
阿里千问一次性上线四款智能体,并升级至Qwen3.8-MAX模型。办公助理可操作备忘录、日历和浏览器并生成Office文档,另提供定时任务、思考研究、语音通话及智能体广场等功能。
🔗 https://x.com/RealYDT/status/2085680163342418298
11. 微信内测朋友圈AI帮写与点评功能
微信正在内测朋友圈AI功能,新增AI帮写按钮辅助用户生成文案,并调用小微模型对评论生成点评内容。该功能于8月7日曝光,目前处于小范围测试阶段,旨在降低用户创作门槛。
🔗 https://view.inews.qq.com/a/20260807A0EHKT00
🧪 芯片半导体
12. GB300 NVL72整机规格公布
GB300 NVL72整机配备72颗GB300 GPU和36颗Grace CPU,单卡搭载288GB HBM3e显存,整机显存约20.7TB,NVLink互联带宽约130TB/s。该规格面向大规模AI训练和推理负载设计。
🔗 https://x.com/geekbb/status/2085735975872086096
13. Anthropic联合设计定制AI推理芯片 三星代工
Anthropic组建专门团队,联合设计面向AI推理的定制ASIC芯片。据媒体报道,三星将成为该芯片的制造合作伙伴,Anthropic此举意在掌控自身算力建设,降低对第三方芯片的依赖。
🔗 https://www.tomshardware.com/tech-industry/anthropic-to-build-its-own-co-designed-custom-ai-accelerator-for-inferencing-workloads-samsung-reported-to-be-partnering-with-the-claude-ai-maker-for-manufacturing
🦾 机器人具身智能
14. 首批消费者发布Optimus家庭工作评测
普通女性用户发布Optimus机器人在真实家庭中工作的视频,展示其在不受控的居住空间内运行。这批评测来自普通消费者而非科技记者,场景为真实家庭而非工厂或策划演示。以下是官方给出的 demo
🔗 https://x.com/Shred_0x/status/2085690744757436681
15. 机器人折纸挑战赛将在IROS 2026举办
机器人折纸挑战赛这一灵巧操作基准将在IROS 2026大会上举行。赛事由13位联合组织者发起,日本折纸协会担任评委,主要评估机器人在折纸单项任务上的灵巧操作能力。以下是官方给出的 demo
🔗 https://x.com/LeoKharon/status/2085743459818717312
16. Figure 03机器人独立完成桌面清理
Figure 03人形机器人独立将酒杯和水杯从餐桌移放到水槽洗碗机,全程无掉落或打碎。该机器人专注家庭应用场景,采用织物外层和指尖传感器设计,展示了在真实家庭环境中的操作能力。
🔗 https://x.com/NEXORAResearch/status/2085700760822550621
17. 宇树科技王兴兴将攻坚具身大模型
宇树科技创始人王兴兴在8月7日路演中表示,登陆资本市场是公司新起点。未来将攻坚具身大模型、场景数据、强化学习等方向,并探索人形、四足机甲等多种产品形态。
🔗 https://x.com/PANewsCN/status/2085620811940143367
18. 三菱加入人形机器人竞赛
三菱计划在京都内燃机工厂每月生产1000台Highlanders人形机器人。若进展顺利,最早将于明年实现大规模量产,推出面向工厂打工场景的人形机器人,正式加入人形机器人竞赛
🔗 https://electrek.co/2026/08/07/mitsubishi-joins-the-humanoid-robot-race-at-a-1000-unit-per-month-pace/
📦 开源项目
19. GitHub Code Quality不再自动添加Copilot审查
GitHub更新Code Quality功能,启用后不再自动创建请求Copilot审查的规则集。已启用该功能的仓库同样受到影响,用户需手动配置Copilot代码审查,此举改变了原有的自动化审查流程。
🔗 https://github.blog/changelog/2026-08-07-github-code-quality-no-longer-adds-copilot-as-a-reviewer
📌 模型排行榜
20. Artificial Analysis AI 模型能力排行榜
最后是今日的 AI 模型能力排行榜单,闭源头部激战,Claude Opus 5 (max)以63分领跑智力榜与59分登顶智能体榜。开源正加速追赶,Qwen3.8 Max表现亮眼,该新模型强势斩获智能体榜亚军(58分),展现卓越任务执行力。
🔗 https://artificialanalysis.ai/?intelligence=artificial-analysis-intelligence-index#intelligence-tabs
以上是今天的AI 风向标,欢迎在评论区提出建议,我们明天见。