
OpenAI 发布 GPT-6 Astra,宣告进入 AGI 时代
OpenAI 正式发布新一代旗舰模型 GPT-6 Astra,被官方称为”代际飞跃”,并宣告进入通用人工智能时代。该模型基于迄今最大规模的训练任务,动用得州 Stargate 园区超过 10 万块 GPU,主打”计算机使用”能力,可跨浏览器、表格、网站与桌面应用完成多步骤工作流。定价为每百万输入 token 10 美元、输出 50 美元;在 ARC-AGI-3 基准上取得 62.7% 的成绩,配合新适配框架可达 99.9%。
谷歌 Gemini 3.8 Flash 上线并登顶
谷歌推出 Gemini 3.8 Flash,在多个公开榜单登顶,并同步发布专攻网络安全的 Gemini 3 版本,在真实威胁模拟评测中迈出关键一步。新模型面向软件工程与智能体任务进行了强化,响应速度与多模态理解均有明显提升。Flash 系列的轻量定位使其更适合大规模落地与边缘部署。
Anthropic 上线 Fable 5.1 与 Mythos 5.1
Anthropic 上线 Claude Fable 5.1 与 Mythos 5.1,在多项基准上刷新记录,并将 Fable 缓存读取成本下调约 75%,输入缓存命中价降至每百万 0.25 美元。新版本引入反蒸馏机制以保护模型权重,同时更强的长上下文与工具调用能力引发开发者热议。配套的”计算机使用”能力也全面开放。
Meta 发布 Muse Spark 1.3 打响价格战
Meta 发布 Muse Spark 1.3,官方称其具备前沿模型级别的性能,并以激进定价打响模型价格战。其最强成绩来自仍在安全测试中的最高推理配置,该版本将稍后开放;同步推出的 Muse Voice Transcribe 语音转写定价低至每小时 0.18 美元,支持 20 人以上实时说话人分离。
英伟达 129 亿美元收购 Hugging Face
英伟达同意以约 129 亿美元收购 Hugging Face,这是其史上规模第二大的并购,仅次于 2025 年底以 200 亿美元收购 Groq 相关资产。交易凸显算力巨头向模型分发与开源社区入口延伸的战略意图。Hugging Face 作为全球最大的开源模型与数据集托管平台,其归属变化引发开发者生态广泛关注。
OpenAI 重启 AI 浏览器,入口争夺升级
在 Atlas 项目下线不到一个月后,OpenAI 以换壳方式重新推出 AI 浏览器,核心高管公开表示已改用 ChatGPT 直接上网。新版浏览器将对话式助手嵌入浏览体验,强调在网页上下文中完成研究、比对与操作。这一动作意味着头部模型公司正把入口争夺从聊天框延伸至整个上网场景。
Claude 升级”计算机使用”,可后台接管电脑
Anthropic 全面升级 Claude 的”计算机使用”能力,可在后台接管用户电脑,实现真·赛博替身式的人机并行工作。新能力让模型像人一样操作操作系统与软件界面,执行长流程任务而无需逐步人工确认。这被视为 Agent 从”对话”走向”执行”的关键一步,也带来更高的安全与授权考量。
G20 达成轻触式 AI 监管框架
在 G20 峰会上,各国科技领袖与政府官员共同游说,推动对新兴技术采取更轻触(light-touch)的监管方式。与会各方一致认可美国提出的非约束性”Carolina Principles”框架,主张为 AI 等技术的治理保留灵活空间。与此同时,围绕是否设立国家级 AI 监管机构的内部争论仍在持续。
英伟达推个人 AI 路由器 PAIR 与 RTX Spark N1X
英伟达推出个人 AI 路由器 PAIR(测试版),可将在网兼容设备的本地推理负载统一调度分配,让家庭或多机环境共享算力。同期披露的 RTX Spark N1X 将于 10 月上市,提供 18 核或 20 核 CPU 搭配 Blackwell 架构 GPU、最高 128GB 统一内存的两种配置。两款产品共同指向”本地化、分布式 AI 推理”的下一站。
微软 MAI-Transcribe-2 语音模型价格速度双杀
微软 AI 推出 MAI-Transcribe-2 语音识别模型,称其在准确率与速度上均超越同类竞品,且价格更低。相较五个月前首代模型每小时 0.36 美元,新模型早鸟价降至约 0.10 美元,降幅约 72%,对企业级呼叫中心等海量音频场景意义重大。该模型直接对标多家头部语音与通用模型厂商。
阿里 Qwen3.8 27B 实现约 1500 token/秒 推理
阿里 Qwen3.8 的 270 亿参数版本登陆 Cerebras 云平台,实现约 1500 token/秒 的推理速度,在开发者社区引发高热讨论。高速推理让大模型在交互式编码、实时问答等场景中更接近”无感延迟”体验。开源权重叠加专用硬件加速,正成为中小团队低成本获得前沿能力的重要路径。
K2 Horizon:六款开放模型组成的”模型舰队”
一家研究机构发布 K2 Horizon——由六款相互联通的开放模型组成的”模型舰队”,在开发者社区获得数百点赞。该方案主张以多模型协作替代单一巨型模型,在推理、检索、对齐等环节分工配合。开放权重与模块化设计,为社区低成本构建定制化 AI 系统提供了新范式。
GitHub Copilot 支持并行运行多个代理
GitHub 详解 Copilot 应用中”并行运行多个代理”的用法,指导开发者在同一会话中安全编排多个自动化编码任务。文章强调,让代理并行工作可把令人畏惧的大规模重构变得高效可控,同时需配合清晰的边界与审查机制。这反映出开发者工具正从”单助手”迈向”多智能体协作”。
嬴彻科技卡车自动驾驶里程破 10 亿公里
中国自动驾驶企业嬴彻科技披露,其卡车自动驾驶累计里程已突破 10 亿公里,并提出”货运物理 AI”概念,称已占据相关市场约 90% 的份额。该里程碑意味着干线物流的 L3 级自动驾驶在真实商业运营中的规模化验证取得实质进展。在具身智能热潮之外,封闭场景的高频运输正率先跑通商业闭环。
