从 OpenAI 挑战千禧年数学难题,到 DeepSeek 降价、微信接入 AI 助手、Meta 发布个人 Agent、Mistral 完成巨额融资——巨头与初创在模型能力、应用落地和商业扩张上同步发力。
1、OpenAI 发布 Navier–Stokes 千禧年难题候选解
OpenAI 于 9 月 8 日公布了一份针对 Navier–Stokes 存在性与光滑性问题的候选解,同时发布数学论文与 Lean 形式化证明。该证明构造了光滑三维不可压缩流体在有限时间内形成奇点的情形,对应克莱数学研究所问题表述中的 C 类和 D 类情形。证明由能力超越 GPT-6 Astra 的内部模型主导,系统协调约 1 万个并发 Agent,从启动到获得候选解耗时约 88 小时,随后由 GPT-6 Astra 花费 17 小时完成 Lean 形式化验证,整个项目产出约 270 万条代理消息和 1300 亿个输出 token。
不过,这项成果也牵出争议:纽约大学数学教授 Tristan Buckmaster 质疑 OpenAI 是否利用了他与 Anthropic 研究人员 Levent Alpöge 在 Codex 中的项目数据。OpenAI 回应称求解过程未访问具体用户数据,但不能完全排除去标识化数据曾参与模型改进。该候选解尚未经全球数学界独立检验,按克莱数学研究所规则,需在合格出版物发表并经至少两年严格审查后方可进入奖项程序。OpenAI 表示无意申请奖项。
创新看点:AI 不再只是「解题助手」,而是以大规模多智能体协作方式直接参与千禧年难题的原创性数学发现,开启了 AI 驱动数学前沿突破的新范式。
2、DeepSeek Flash 系列 9 月 10 日起降价,V4.1 Flash 同步内测
DeepSeek 宣布自 9 月 10 日 12:00 起大幅调整 flash 系列模型定价:闲时输入价格从每百万 token 1.5 元降至 1 元,闲时输出价格从 4.5 元降至 4 元,闲时缓存价格从 0.05 元降至 0.02 元;高峰时段价格为闲时价格的 2 倍。与此同时,DeepSeek V4.1 Flash 中间版本已开放内测,API 用户无需更改 base_url,将模型名切换为「deepseek-v4.1-flash-expires-on-0910」即可调用,当前计费与 V4 Flash 相同,单账号最多支持 20 并发请求。该模型 ID 中的失效日期为 9 月 10 日,属短期测试版本,新版本采用不同模型架构并原生支持多模态,测试重点为能力、生成速度和推理成本。
创新看点:以「限时试用 + 大幅降价」组合拳抢占开发者生态,多模态架构升级暗示 DeepSeek 正从纯文本向全能模型快速演进。
3、微信 PC 版接入 AI 助手「小微」,可操作聊天与小程序
微信开始在 PC 版测试 AI 助手「小微」。它能查看朋友圈、发送消息、发起语音和视频通话,也能在聊天中回答文件内容(视频文件和定时消息暂不支持)。「小微」还能调用小程序完成订餐等服务,涉及支付时交由用户确认。微信内置浏览器的「元宝总结」入口已被替换为「问 AI」,支持围绕当前网页继续提问。面向开发者,PC 端已支持开发和调试小程序、生成体验版。个性化推荐默认关闭,用户可在设置中单独开启;目前未提供关闭「小微」入口的选项。
创新看点:微信将 AI 助手深度嵌入社交与生活服务场景,「能操作聊天、能调用小程序」让 AI 从信息窗口升级为微信生态内的「执行中枢」。
4、高通与亚马逊达成多代定制芯片合作
高通 9 月 8 日宣布与亚马逊达成多代产品合作,双方将为 AWS 的大规模 AI 数据中心开发定制芯片,并共同推进 AI 推理基础设施,合作还将覆盖最高 1.6T 的光互联及后续方案。高通将提供 SerDes、光学 DSP、低功耗计算和系统集成能力,用于提升数据中心内部高带宽互联;亚马逊则提供云端 AI 基础设施。双方希望构建一套在计算、存储、网络带宽和能效之间可扩展的整体方案。此外,高通还计划扩大对 AWS AI 基础设施和 Amazon Bedrock 的使用,用于电子设计自动化工作负载,以缩短芯片设计周期。
创新看点:高通的通信与低功耗计算能力与亚马逊云基础设施深度绑定,AI 芯片竞争正从单点算力扩展到「计算 + 互联」的全栈基础设施层面。
5、Meta 发布个人 AI Agent Muse
Meta 于 9 月 8 日发布个人 AI Agent Muse,用户可在独立应用或 WhatsApp 中与其对话,让它拆解目标、制定计划,并在用户关闭应用后继续执行任务。Muse 由 Muse Spark 模型驱动,可打开浏览器、填写表单、发送邮件、预订旅行和完成购物,还能连接 Instagram 等 Meta 产品与第三方应用——例如将用户保存的食谱 Reels 整理成采购清单,或在宴请前根据宾客饮食偏好生成菜单。为保障隐私安全,Meta 为每个 Muse 配置专用云端 Muse Secure VM,并让独立的 Sentinel 审查对外请求;发送邮件、付款等敏感动作需用户确认,账号密码和支付信息存入独立安全区。Muse 已在美国面向 iOS、Android 和网页用户陆续开放,后续将登陆 Meta AI 眼镜。基础功能免费,同时准备面向高强度使用者的订阅方案。
创新看点:Muse 代表了「AI 不再只是对话对象,而是用户的数字代理人」——它能在用户离线时持续执行任务,真正实现「交代任务后不用管」的自动化体验。
6、Mistral 完成 30 亿欧元 D 轮融资,投后估值超 210 亿欧元
法国 AI 公司 Mistral 于 9 月 8 日宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,这是欧洲科技公司迄今完成的最大单轮股权融资。本轮由三星电子领投,EQT 管理的 Scaleup Europe Fund 与现有投资者 PSG Equity 共同领投;Advent、贝莱德管理的基金和卢森堡大公国新加入投资,ASML、英伟达、a16z、法国公共投资银行、Salesforce Ventures 等现有股东继续跟投。Mistral 表示资金将用于前沿模型研究、训练算力、基础设施扩建及商业和国际业务增长。公司目前在 20 个国家开展业务,为空中客车、ASML、汇丰等超过 125 家企业提供 AI 服务。
创新看点:三星电子领投欧洲 AI 冠军,标志着亚洲科技巨头与欧洲 AI 核心力量的战略结盟——AI 地缘竞争正从「中美对决」走向「多极博弈」。
7、梁琛奇:AI 娱乐产品要让消费过程实时使用算力
字节跳动前 AI 产品团队 Flow 负责人梁琛奇接受《晚点》采访时提出:AI 娱乐产品若只降低内容生产成本,产出的内容仍会回到既有平台;新的独立平台需要让用户在消费过程中实时与模型互动,并获得过去不存在的长尾反馈。他认为 DeepSeek-R1 后推理成本持续下降,图片和视频模型已跨过可用门槛,用户也已习惯与 AI 交互,因此娱乐产品可以从静态生成转向「一边消费、一边生成」。其创办的「动念引线」正同时开发七八个产品,由一两人小组在两周至一月内做出 Demo,按用户信号决定去留。首款产品「松果时刻」可将照片和文字扩展为带配音、配乐和动画的多图故事。他认为 AI 娱乐仍离不开人的主观表达——模型擅长「熟悉感」,真正的惊喜来自创作者。
创新看点:梁琛奇提出了 AI 娱乐的「实时互动消费」理念——让算力在用户观看的同时生成内容,而非提前批量生产,这或将重新定义内容平台的底层逻辑。
8、ChatGPT Images 2.5 上线,新增草图生成与局部批注编辑
OpenAI 于 9 月 8 日发布 ChatGPT Images 2.5,官方称新模型重点改进了参考图主体保真度、局部编辑精度和多轮修改一致性,生成延迟最高比 Images 2.0 降低 50%。ChatGPT 同步新增 Sketch、模板和图片批注功能:用户可输入「@Sketch」直接画出构图或轮廓,再用文字指定风格和细节;也可从海报、商品照等模板开始,或在已生成图片上直接留下修改批注。新版还支持在分享图片时附带 prompt,方便他人复刻同类效果。Images 2.5 已向 ChatGPT 各档用户在桌面端、移动端和网页端陆续开放。API 端推出 GPT-Image-2.5 Flare(面向高频快速工作流)与 GPT-Image-2.5 Sunburst(强调高精度和多轮编辑控制),生成图仍携带 C2PA 元数据和不可见水印。
创新看点:「@Sketch + 文字描述」的多模态交互方式,将「画图」和「写 prompt」融为一体,大幅降低了图像创作的可控性门槛,让创意表达更直观。
9、微软发布 Opal:用户只需提目标,AI 跑全流程交付成品
9 月 7 日,微软首席执行官萨提亚·纳德拉在 X 平台宣布为 Microsoft 365 Copilot 推出全新 AI 功能 Project Opal,定位是在可控安全环境中,让用户规划和执行复杂、长周期任务的 AI 智能体。Opal 的核心是在可控制、可追踪的环境内,让 AI 从处理快速问题逐步覆盖委派型工作和长期运行的自动化任务。用户交代任务后,它可连续工作数小时或数天,自动完成「找素材、做表格、生成 PPT、发给同事」的完整工作流。
创新看点:Opal 将 Copilot 从「即时问答助手」升级为「可托管数天的数字员工」,标志着企业 AI 从碎片化辅助迈入端到端任务自动化时代。
10、阿里发布 QoderWake 1.0,已有近 10 万个数字员工「上岗」
9 月 8 日,阿里发布数字员工产品 QoderWake 1.0。用户一句话描述岗位需求,QoderWake 即可生成角色文档,经修改配置确认后生成一个理解工作职责、协作关系和工作权限的数字员工。过去三个月,QoderWake 上已有近 10 万个数字员工在真实工作场景上岗,执行约 200 万次有效任务。产品已内置前端、后端、产品经理、内容运营、数据分析师等 10 个专岗,集成了行业头部团队经验,无需专门训练即可承接真实任务。用户也可自定义数字员工,只需写清核心职责、工作风格、工作流和红线,并提供核心业务资料即可「培训」专属数字员工。QoderWake 已打通钉钉、飞书和企业微信,天然理解组织文档、表格、待办、日历和组织架构,群聊中的讨论和附件均可作为持续更新的知识来源。
创新看点:QoderWake 的核心突破在于「将组织协作关系和工作权限数字化」——数字员工不仅是任务执行者,更是理解企业组织结构的「组织成员」,实现了从工具到「同事」的身份跃迁。
结语
本期 AI 发展的三条清晰主线:模型能力突破(OpenAI 数学推理、ChatGPT Images 2.5 多模态编辑)、应用深度落地(微信小微、Meta Muse、微软 Opal、阿里 QoderWake 将 AI 嵌入真实工作与生活场景)、基础设施扩张(DeepSeek 降价、高通与亚马逊合作、Mistral 巨额融资)。AI 正从「对话工具」向「执行任务的数字同事」加速进化,下一阶段的竞争焦点或许是谁能率先让 AI 真正「替人把事办了」。



