
Gemini 3.8 Live与Meta One上线,TranslateGemma、APXInf开源齐发,巨头减速与结盟并行
Google 推出 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking,自称迄今最先进的实时对话模型。新模型强化了语音智能体的长时记忆与多轮理解,可在通话、助手等场景更自然地承接任务。实时多模态对话正成为头部实验室的下一道主战场。
Meta 将 Meta One 订阅包向全球推出,提供由 Muse 驱动的增强 AI 能力,个人套餐定价为每月 7.99 与 19.99 美元。该捆绑把聊天、创作与设备助手整合进统一订阅,标志着个人智能体进入规模化收费阶段。超级智能正从演示走向消费级账单。
Anthropic 宣布 Claude for Small Business 新增 43 个工作流与 27 个集成,可自动化大量后台事务。官方称过去需 120 小时的活,现在约 5 分钟即可完成,已覆盖约 90 万家小企业。AI 正从个人助手下沉到中小企业的日常运营中枢。
在行业大会上,黄仁勋公开力挺开源路线,称开放生态能加速创新;与此同时,Anthropic 负责人则呼吁全行业为前沿能力提升踩下刹车。两派观点同台交锋,折射出开源与安全的路线分歧。生态走向正被两种叙事同时拉扯。
Google 开源 TranslateGemma,专为离线设备打造,原生支持 55 种语言,断网也能在端侧跑通翻译。模型甚至可在按键手机等低算力设备上运行,把多语翻译能力下沉到最末端。端侧大模型正在消解对云服务的强依赖。
TypeSafe AI 发布新模型 Jev,完全跳过逐字吐 token 的老规矩,直接返回结构化决策与置信度。官方称速度较传统方式提升约 200 倍,且输出可免费使用,并已完成 4000 万美元种子融资。可信概率输出正成为模型工程的新卖点。
面向不信任第三方大模型数据处理的客户,微软顺势推出隔离式 AI 方案,按较高客单价提供独立环境。该方案主打数据不出域、可控可审计,瞄准金融与大型企业的合规刚需。企业 AI 的竞争正从能力转向信任与隔离。
三家公司被曝已就 AI 安全展开数周协作,并称无需反垄断豁免即可协调安全事务。OpenAI 还公开支持一项两党法案中”引入外部评估方”的条款,要求头部模型接受独立安全审查。行业自律与立法约束开始相向而行。
消息称 OpenAI 已与投资人就上市前新一轮私募融资展开早期沟通,目标估值约 1.2 万亿美元。若落地,将刷新私营 AI 公司的融资体量纪录。资本对头部实验室的押注仍在加速。
主打编程智能体 Droids 的初创公司 Factory 完成 2 亿美元融资,估值升至 50 亿美元,较 4 月的 15 亿翻逾三倍。其智能体可按任务复杂度在多个模型间切换,主打自动化软件交付。AI 编码赛道估值仍在快速重估。
Agility 推出新人形机器人 Digit 5,借助传感器与避障算法,可在无物理隔离的情况下安全与人并肩工作。该设计面向仓储与工厂的常态化协作场景。人形机器人正从演示围栏走向产线实景。
无问芯穹联合清华大学、上海交通大学正式开源具身端侧推理引擎 APXInf,在 Pi 0.5 上取得 SOTA 表现。项目瞄准具身智能规模化落地的”最后一公里”,把大模型推理压到端侧可负担。国产开源正在补齐具身智能的基础设施。
智象未来发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0,主打遵循物理规律导向的画面生成。该模型试图解决生成视频中物体运动不合规、逻辑断裂等痛点。物理一致性正成为视频生成的下一道分水岭。
7 名博士生仅用 3 个月从零训练出 7B 大模型,并将代码、数据与训练日志全部公开,数百个智能体参与了研发过程。该项目把”AI 造 AI”的协作范式摊开在阳光下。开放训练正在降低前沿研究的参与门槛。
