AI行业在模型能力、安全治理、产品入口与产业组织上密集变化:OpenAI高管称AGI时代已来,苹果把照片真实性验证前移到传感器,字节分拆AI制药业务,Claude与华为小艺强化统一工作入口,Google Home开放MCP,B站用真实测评重构模型榜单。
1. 苹果推出 Reference Image,从相机传感器开始验证照片真实性
苹果公布 Apple Reference Image 技术细节。该功能是 iPhone 18 Pro 与 iPhone 18 Pro Max 主摄上的可选模式:定制传感器会在成像处理前为原始像素数据签名,再由 Private Cloud Compute 生成带安全时间戳的参考图像。查看者可将其与后续编辑版对照,判断照片是否仍反映拍摄当时画面。苹果认为,C2PA 类方案在拍摄后才附加溯源凭证,编辑链路中某环节被攻破后,查看者可能无法察觉。Reference Image 还将实名身份与照片分离,支持在不暴露拍摄者身份的情况下撤销异常凭证。该功能首发仅支持两款 Pro 机型主摄,超广角和长焦尚不能生成同类验证数据,且普通照片不会默认启用。
创新看点: 把照片真实性验证前移到传感器与云端签名,试图从源头堵住编辑链路的信任缺口。
2. 字节跳动分拆 AI 制药业务,Anew Labs 完成 2.9 亿美元融资
据路透社报道,字节跳动分拆的 AI 制药公司 Anew Labs 完成首轮外部融资,规模 2.9 亿美元,投后估值 15 亿美元。本轮由 HSG、IDG 资本和高瓴等参与,五源资本联合领投,高榕创投、春华资本、博裕资本、上海未来产业基金及战略投资方 SBP 集团也在投资人名单中。Anew Labs 总部位于上海,主要用 AI 开发药物。消息人士称,字节跳动融资后仍持有 56% 股权;公司认为 AI 制药与字节核心互联网业务有不同的产业逻辑和管理方式,因此将其独立运营。
创新看点: 大厂把AI制药放到独立资本与管理框架中,试图用生物医药逻辑而非互联网逻辑加速。
3. 扎克伯格反对 AI 行业集体减速,主张独立评估
Meta CEO 马克·扎克伯格 9 月 15 日表示,AI 实验室不需要通过行业协调共同减速。他认为,市场竞争、法律责任和声誉风险已提供足够安全激励,更可行的办法是让独立评估机构持续测试前沿模型。此番表态回应了 Anthropic CEO Dario Amodei 提出的行业放缓建议。扎克伯格称,Meta 超级智能实验室已使用第三方评估,并会在发现风险时延后发布;此前公司就以安全为由推迟了 Muse 模型。他同时强调,Meta 大部分算力仍用于改善现有产品,而非让模型递归式自我升级。其分歧重点在责任主体:行业集体承诺容易把风险判断交给少数实验室协调,独立评估则允许不同机构用统一方法比较模型能力、可控性和滥用风险,再由监管与市场追究具体公司责任。
创新看点: 安全治理路线从“行业集体减速”转向“独立评估+公司问责”,强调可比较与可追责。
4. Claude 关闭 Cowork 独立入口,正式打通聊天、文档与幻灯片生成
Anthropic 宣布将 Claude Cowork 与 Claude Chat 合并为一个统一的 Claude 产品入口,不再保留 Cowork 独立工作空间。同时,Claude Docs 和 Claude Slides 正式上线,Claude Design 也已支持直接在对话中调用。此前,Cowork 与 Claude Design 分别面向大型任务和视觉创作场景独立运作,但用户切换工具时面临判断成本,且工作流程无法自动延续。合并后,Claude 能根据任务需求自动判断并调用所需能力,在任意对话中继承用户的历史上下文、技能与连接器。生成内容将集中于统一的可分享链接中,支持直接在线编辑、移动端查看,以及导出为 PowerPoint 或 PDF。该整合已进入 Beta 测试,将在未来几周率先面向网页版、桌面端和移动端的 Pro 及 Max 订阅用户推出,随后逐步覆盖 Team 和免费计划。
创新看点: AI工作台从多工具切换变为统一上下文的自动编排,入口竞争转向工作流连续性。
5. 华为小艺 Work 开启内测,可跨鸿蒙设备执行办公、编程与设计任务
华为昨天宣布「小艺 Work」开启内测。它可在鸿蒙手机、平板和电脑之间协同处理办公、编程、设计等任务。用户提交需求后,系统会拆解步骤、调用工具并展示执行进度,关键节点仍可由用户检查和确认。小艺 Work 支持调用云端或本地电脑完成远程任务,也能同时连接多台电脑。华为称,用户可按需授权本地文件与应用访问;服务到期后数据会按规则保留一段时间,相关记忆不会用于模型训练。报名入口已在小艺官网开放。
创新看点: 跨设备、端云协同的任务代理进入内测,AI助手从“问答”走向可确认的办公执行。
6. B 站上线「AI 无限竞技场」,汇总 UP 主真实场景模型测评
B 站昨天上线「AI 无限竞技场」,把不同分区 UP 主对主流大模型的实测内容集中到一个榜单。首期已收录 30 多个测评主题、100 多个参战模型,累计观看量超过 1300 万。该项目不限定统一跑分题目,而是让 UP 主围绕代码修复、量化交易、游戏开发、多 Agent 协作和知识问答等真实工作流自主命题,再按各模型在测评中获得榜首的次数动态更新排名。首期前五名中有三款国产模型,平台后续将持续向 UP 主开放报名。
创新看点: 用UP主真实工作流众测替代单一跑分,模型排名更接近实际场景表现。
7. Google Home 开放 MCP,第三方 AI Agent 可控制智能家居
Google 开始为 Google Home 推出 Home MCP 早期访问,让支持 MCP 的 AI Agent 直接读取家庭结构、设备状态和历史事件,并执行智能家居控制指令。Claude Cowork、OpenClaw 和 Google Antigravity 等兼容客户端均可接入。Home MCP 提供设备发现、实时状态查询、历史记录分析和控制动作等能力。用户可以让 Agent 统计一周内洗衣机运行次数、分析照明时长,或直接控制接入 Google Home 的设备;配置时需要 Google Cloud 项目、Home API 权限和 OAuth 凭据。该功能首批面向美国的 Google Home Premium Advanced 订阅用户,未来数周逐步开放。Google 会限制开锁等敏感操作,并提醒用户:第三方 Agent 仍可能产生非预期行为,共享家庭中的其他成员也应知悉 Agent 可以访问家庭数据和控制设备。
创新看点: 智能家居从App控制迈向Agent可调用,权限、敏感操作与家庭成员知情成为落地关键。
8. OpenAI 总裁称已进入 AGI 时代:GPT-6 Astra 可自主执行任务 24 小时
9 月 16 日,OpenAI 总裁 Greg Brockman 在 a16z 采访中称,AI 正进入「AGI时代」。他认为 AGI 更像能力渐变光谱,而非明确节点;GPT-6 Astra 已能连续自主执行任务约 24 小时,因此可被合理称为 AGI。他举例,Codex 检查其个人网站,15 分钟发现 13 个安全问题,约 45 分钟完成配置调整、托管迁移,并为需等待 48 小时的流程设置后续任务;但也承认写作质量等能力仍不均衡。OpenAI 已将安全和对齐视为发布节奏关键,曾抽调约 25% 生产环境工程师参与内部安全排查,并计划投入 10 亿美元支持医院、供水等关键基础设施防御。需要指出,Astra 是否达到 AGI 仍属高管判断,行业无统一标准。
创新看点: 以“连续自主执行24小时”作为AGI判断线索,把争议从定义转向可观察的任务能力。
9. 马斯克再次暗示特斯拉和 SpaceX 可能合并
9 月 16 日,埃隆·马斯克再次暗示,他麾下的「两大王牌」特斯拉和 SpaceX 之间可能会深化合作,甚至合并。在洛杉矶「All-In Summit」峰会上,被问及为何特斯拉和 SpaceX 尽管关系日益紧密却仍保持独立时,马斯克称这是一个「好问题」,并暗示双方关系最终可能促使采取行动。他说:「在这么多层面上开展如此广泛的合作,当这么多领域存在如此密切的合作时,谁能想象可能会采取什么行动呢?」这番表态延续了外界对两家公司资源协同甚至合并的猜测,但马斯克未给出时间表、交易结构或具体方案。
创新看点: 若两大王牌进一步整合,航天、出行与AI资源的协同边界可能被重新定义。
10. 豆包大模型 2.1 Pro 更新,多 Agent 任务与多模态 Coding 升级
火山引擎昨天上线 Doubao-Seed-2.1-pro 0915 版本。新版本强化了复杂 Agent 任务中的计划、工具调用与交叉核验能力,可把一个研究任务拆给数百个子 Agent,再通过多轮验证汇总结论,以降低长链路执行中的错误累积。Coding 能力也扩展到 CAD、3D 模型和密集文档等多模态场景。官方测试中,模型曾在约 36 小时内处理 Luanti 项目近 38.7 万行代码和 1000 个 issue,生成结果中有 83% 达到可合并标准。新版已接入火山方舟,豆包工作和 TRAE 也同步上线。
创新看点: 多Agent交叉核验与多模态Coding结合,重点提升长任务可靠性和工程可用性。
结语
今日动态的共同主线,是AI正从“会回答”走向“能执行”,从单点工具走向统一工作流。与此同时,模型越自主,安全评估、身份分离、权限控制与责任归属就越关键。苹果验证照片、Google限制敏感家居操作、扎克伯格主张独立评估,均说明行业竞争已进入“能力+责任”并行的新阶段。



