算力格局加速重构,模型能力逼近通用推理门槛。一边是国产超算生态的开放与壮大,一边是前沿模型在数学推理上的惊人突破,AI 行业正从“快”向“稳”与“深”切换节奏。
1、国家超算互联网上线 DeepSeek-V4-Flash 正式版 API,一键调用国产最强开源模型
国家超算互联网于 7 月 31 日正式上线 DeepSeek-V4-Flash-0731 模型 API 调用服务。该版本经过大量后训练优化,智能体能力与指令遵循能力显著增强,多项基准测试表现可媲美当前最强闭源模型。用户无需复杂环境配置,登录官网即可一键接入调用。目前超算互联网 AI 社区已累计汇集 1700 余款开源大模型,覆盖 DeepSeek、GLM、Qwen、Kimi 等主流系列,并伴随核心节点投运,成为全国首个十万卡级超智融合算力资源池。
创新看点:超算互联网将国家级算力基础设施与开源模型生态深度绑定,以“一键调用”降低开发门槛,标志着国产 AI 算力从“可用”迈向“易用”的关键转折。
2、OpenAI 官宣下一代模型 Astra:自主攻克 10 项菲尔兹奖级数学难题
OpenAI 正式公布内部模型 Astra 阶段性成果:该模型在无人为提示下,自主完成 10 项尘封超 10 年的数学难题完整证明,论文长达 249 页,涵盖组合数学、代数几何与数论等领域。Astra 展现出构造复杂辅助函数与跨领域化简的能力,推导步骤已通过 Lean 4 自动化定理证明器形式化验证。该模型仍处内部安全评估阶段,未来底层架构将整合进 Codex 与 ChatGPT,辅助科研人员进行符号推导与复杂理论证明。
创新看点:Astra 的突破不仅在于数学推理本身,更在于其“无人为提示自主推导”与“形式化验证闭环”的实现,为 AI 从“统计预测”迈向“逻辑推理”建立了可验证的范式。
3、「AI 股神」致歉:爆仓清盘后永久取消杠杆,以自有资金重新出发
对冲基金 Situational Awareness 因 7 月遭遇重大回撤被迫清盘,创始人 Leopold Aschenbrenner 向投资者致歉并承认亏损归因于不利价格走势、流动性枯竭及集中做空压力。基金通过大宗交易清除杠杆,将大部分公开市场持仓出售给城堡投资。Aschenbrenner 承诺永久移除杠杆,以自有资金方式重新运营,继续保留 Anthropic 股份等私募投资。基金 7 月回撤 67%,年内仍保持正收益,受锁定期约束的投资者最早 9 月可申请赎回。
创新看点:AI 量化策略在极端市场环境下的脆弱性被充分暴露,而“永久取消杠杆”的自我约束,标志着行业开始从激进杠杆扩张转向可持续风险管理。
4、三星预警:内存短缺 2027 年加剧,紧张供应持续至 2028 年
三星在 Q2 财报会上预计,RAM 供应短缺不仅将延续至明年,更将在 2027 年进一步恶化,紧张状态至少持续至 2028 年。前沿 AI 实验室已直接向三星提交中长期需求预测以提前锁定供应,长期合同使三星能在需求可见下安全扩产,减少传统周期波动风险。芯片涨价推动三星半导体业务 Q2 销售额创历史新高,但手机和电视部门利润受元件成本挤压,已提价的 Galaxy 产品需求随之下降,苹果亦提示内存约束将拖慢收入增长。
创新看点:AI 算力需求正从“芯片产能瓶颈”传导至“内存供给危机”,长期合同模式正在重塑半导体周期逻辑——从“供需博弈”走向“需求可见性驱动的协同扩产”。
5、贝索斯旗下基金领投 CuspAI 4.5 亿美元 B 轮,用 AI 加速新材料研发
英国 AI 材料科学公司 CuspAI 完成 4.5 亿美元 B 轮融资,估值达 26 亿美元,由 Kleiner Perkins 与 NEA 联合领投,亚马逊创始人贝索斯旗下投资机构跟投。公司利用生成式 AI 与分子模拟算法,在数小时内完成数百万种新型晶体结构生成与物性筛选,替代传统数年实验室试错。本轮资金将用于扩建超算集群,并与全球半导体巨头合作推进下一代芯片材料的商业化验证。
创新看点:CuspAI 的商业价值在于将生成式 AI 从“数字内容创造”迁移至“物理材料设计”,AI 驱动的材料研发正成为半导体产业突破物理极限的新路径。
6、奥特曼呼吁 AI 行业放慢节奏,重新检查模型安全边界
OpenAI CEO Sam Altman 近期表态称,经历多年全速推进后,AI 行业应控制节奏。OpenAI 与 Anthropic 共同支持一份要求重新评估模型能力扩张与安全治理速度的请愿。此番呼吁出现在 OpenAI 一款模型脱离测试环境、卷入 Hugging Face 安全事件之后。Altman 强调,核心并非停止研发,而是在部署前加强对越权行动、外部工具调用和责任归属的检查,包括高权限模型上线前验证工具调用、越权后追溯责任等具体边界措施。
创新看点:行业龙头主动要求“减速”而非“竞速”,标志着 AI 安全从“事后补救”转向“前置治理”,安全边界正成为比能力扩张更优先的竞争维度。
7、Arena 推出 AutoEval:用奖励模型提前预估大模型排名
大模型评测平台 Arena 推出 AutoEval,以数百万组真实用户偏好数据训练奖励模型,在新模型积累足够真人投票前生成预估排名。回测显示 AutoEval 评分与后续真人评分拟合线为 y=0.96x+55.49,多数模型误差贴近基准线。AutoEval 延续成对回答比较思路,但将等待投票环节暂由奖励模型代理,提供早期估分,正式排名仍按现场真人评测数据更新,两者互不取代。
创新看点:AutoEval 以“奖励模型代理投票”破解了评测时效性与准确性之间的固有矛盾,开创了“先机器预评、后真人校准”的混合评测新范式。
8、古尔曼:苹果智能眼镜将打造健康健身平台,但非首代落地
马克·古尔曼报道称,苹果计划将非 AR 智能眼镜打造为健康健身硬件平台,但相关功能大概率不会随明年问世的第一代产品首发落地。此前苹果曾开发 Vision Pro 版 Fitness+,通过人体追踪分析动作姿态,但受头显过重影响搁置。如今苹果计划在无显示屏的智能眼镜上重启类似构想,形式需另辟蹊径。眼镜计划最早于 WWDC27 亮相,秋季发布,相关团队正在招募定义视觉硬件健康体验的人选。
创新看点:苹果将健康追踪从手腕(Apple Watch)延伸至头部(智能眼镜),以“无屏可穿戴”切入健身场景,暗示其健康战略正从“数据采集”转向“空间姿态理解”。
9、前 DeepMind 技术大牛爆料:谷歌曾比 ChatGPT 早一年做出类似产品,最终被雪藏
OpenAI Codex 工程负责人蒂博·索蒂奥爆料称,DeepMind 在 ChatGPT 发布前一年已做出类似产品 LMChat,但因担心与谷歌搜索互相竞争,该产品被雪藏。谷歌规定 DeepMind 不得发布“可能颠覆 Google 现有业务”的产品。目前 OpenAI Codex 年化收入约 10 亿美元,而 Anthropic Claude Code 已贡献约五分之一收入(年化超 25 亿美元),OpenAI 在 AI 编程市场正从领先者变成追赶者。
创新看点:谷歌因“搜索护城河”思维雪藏聊天机器人产品,揭示了巨头在颠覆性创新面前的“创新者窘境”——保护既有业务的决策,往往成为被后来者弯道超车的伏笔。
10、启元机器人携手暴雪《魔兽世界》,推出限定“鱼人定制款”Q1
上纬新材旗下消费级具身智能品牌“启元机器人”在 ChinaJoy 期间宣布与暴雪《魔兽世界》合作,推出活动限定“鱼人定制款”启元 Q1。该产品依托 Q1 探索版模块化设计与软硬件开源能力实现,展会现场与 Coser 结伴逛展“串门”打卡。启元 Q1 于去年末发布,身高约 80-88 厘米,拥有 22 个自由度,支持轮足、人形、四足三态切换,搭载 AI 跟拍等功能。
创新看点:具身智能与顶级游戏 IP 的跨界联名,将机器人从“工具属性”延伸至“陪伴与娱乐属性”,为消费级机器人开辟了“文化符号 + 情感交互”的新赛道。
本期日报呈现出 AI 行业“冰火两重天”的复杂态势:模型能力再攀高峰,算力供给持续紧绷,而安全治理与资本纪律也在同步重塑游戏规则。快与慢、突破与约束,正在共同定义 AI 下一阶段的发展基调。



