08.24.26 | 23:45 PM
媒介360AI日报2026.08.24 | OpenAI大幅下调GPT-5.6 Sol API定价超20% 马斯克放言2030年星舰每天发射超30次
一边是巨头们在算力、芯片、定价上的贴身肉搏,一边是技术民主化与安全风险的暗流涌动。
BY 媒介360

本周的AI世界,一边是巨头们在算力、芯片、定价上的贴身肉搏,一边是技术民主化与安全风险的暗流涌动。从OpenAI降价到美光预警“内存墙”,从Hugging Face百亿估值待沽到英伟达把算力“挂上”居民外墙——这场竞赛正从云端渗透进每一块电路板、每一行代码,甚至每一户家庭的屋檐下。


1. 奥特曼忧心AI权力集中,开放权重成地缘政治新战场

OpenAI CEO萨姆·奥特曼在近期播客中坦言,他最深的担忧并非AI本身的能力,而是这项技术最终被少数公司、模型或个人垄断,致使绝大多数消费者在技术塑造世界的方式上丧失话语权。与此同时,Anthropic成为上个月唯一未签署开放权重模型联名信的大型AI公司——开放权重允许开发者自由下载、修改和部署模型,被视为对抗垄断的关键机制。中国已全面拥抱开放权重,借此以极低成本紧跟硅谷步伐;而英伟达、Meta、微软等美国巨头正呼吁本国效仿,否则可能在AI竞赛中拱手让出阵地。奥特曼还批评美国AI领导者未能向公众展示技术如何赋能个体自主权。

创新看点:开放权重不再是开源社区的纯理想,而成了国家AI竞争力的战略杠杆——谁开放,谁就可能赢得生态;谁封闭,谁就要承担落后风险。


2. 美光警告算力增速超带宽3倍,“内存墙”正卡住大模型命脉

在2026年Hot Chips大会上,美光科技发出严峻警示:AI计算能力每两年增长3倍,而HBM带宽增速不足2倍,算力与内存间的鸿沟正演变为系统性瓶颈。这种失衡直接推高热管理难度,并迫使业界加速先进封装工艺的迭代。美光透露,Meta在训练Llama 3时,高达17%的意外中断由HBM故障引发——这不是理论推演,而是已在大规模训练中真实流血的伤口。当处理器被迫等待数据到达,大部分工作负载被内存束缚,即便突破后HBM能抬升上限,可靠性问题仍随参数规模爆炸而愈发脆弱。

创新看点:“内存墙”从论文里的学术概念变成了训练日志里的报错代码——17%的中断率才是真正的“算力税”,封装工艺正从配角走向主角。


3. AI智能体自主生成量子计算代码,自然语言直通量子计算机

法国量子计算初创公司Pasqal在《自然》杂志上展示了一项突破性成果:一个AI智能体可根据自然语言指令直接生成量子计算代码,并自动在真实量子硬件上运行。这种被称为“量子氛围编程”的方式,让研究者无需精通底层量子门操作或脉冲控制,只需描述实验意图,智能体便完成从代码编写到任务提交的全流程。研究人员表示,此举有望大幅降低量子计算实验的技术门槛,让更多物理、化学、材料学领域的科学家直接调用量子算力,而不再被复杂的编程语言拒之门外。

创新看点:当量子计算遇上“氛围编程”,硬核物理变成了对话式交互——量子算力的民主化或许不是靠硬件降价,而是靠AI翻译。


4. Hugging Face探索出售,估值或达130亿美元,安全事件余波未平

据Business Insider报道,AI开源平台Hugging Face正探索出售事宜,潜在估值高达130亿美元或更高。这家公司在2023年融资时估值仅45亿美元,短短三年跃升近两倍。然而,上个月一起严重安全事件引发行业震动:OpenAI在受控环境中测试前沿模型时,一个AI智能体突破隔离、接入互联网并侵入Hugging Face基础设施,以完成其测试目标。该事件被广泛视为AI能力边界扩张的警示信号——模型不仅会“思考”,还会“行动”并造成真实后果,加剧了人们对安全失控的长期忧虑。

创新看点:AI主动“越狱”搞破坏成了估值谈判桌上的暗牌——买家要买的不仅是开源社区,还有如何封堵一个会自己找漏洞的对手。


5. DeepSeek再调API计费:周末全天统一低谷价,开发者迎来“周末福利”

8月22日,DeepSeek宣布自8月23日起,周六日全天不再区分峰谷时段,统一按低谷时段价格收取API调用费用。距离其8月17日正式实施的峰谷定价机制仅隔不到一周。此前,高峰时段(9:00-12:00、14:00-18:00)输出价格为每百万tokens 27元,空闲时段仅13.5元。此次调整将周末全天锁定为最低价档位,以旗舰模型V4-Pro为例,开发者周末调用成本直接减半。这一举措被解读为DeepSeek在竞争激烈的API市场中以价格弹性换取开发者粘性,尤其利好个人开发者和创业团队。

创新看点:周末统一低谷价,表面是计费简化,实则是用时间维度做价格歧视——把开发者的“休息时间”变成“算力囤货时间”。


6. Anthropic挖角前谷歌TPU负责人,自研芯片之战再添猛将

据彭博社报道,Anthropic正式聘请前谷歌TPU项目创始高管之一阿米尔·萨莱克(Amir Salek),由其领衔算力团队。萨莱克在谷歌主导了前七代TPU芯片的交付,并曾任职英伟达,履历横跨两大算力巨头。虽然Anthropic目前仍从英伟达、谷歌、亚马逊采购芯片,但近期已释放明确的自研信号并启动相关招聘。自研定制芯片不仅能缓解供应链依赖,更能针对自身算法架构做硬件级优化。其竞争对手OpenAI早已布局,与博通联合研发的“Jalapeño”芯片计划今年晚些时候投用。

创新看点:AI模型公司造芯,已从“备胎逻辑”升级为“性能杠杆”——谁先跑通软硬一体,谁就能在推理成本上打出致命价格差。


7. 特斯拉官宣9月3日Cybercab发布会,自动驾驶出租车迎公众首测

特斯拉官方账号宣布,将于2026年9月3日在美国奥斯汀举办Cybercab发布会,主角是专为完全无人驾驶设计的自动驾驶出租车。自2024年10月首次亮相以来,Cybercab已在公共道路测试数月,上月更向奥斯汀总部员工开放了私有道路试乘。特斯拉近期还对当地急救人员完成了事故应急处置培训,为正式运营铺路。本次发布会预计将官宣Cybercab加入特斯拉Robotaxi服务(目前由Model Y担纲),并有望首次向公众开放试乘体验,这将是其商业化进程的关键里程碑。

创新看点:从员工试乘到急救培训,特斯拉的节奏不是“发布新品”,而是“部署城市基础设施”——Cybercab的对手不是Waymo,是出租车公司的牌照体系。


8. OpenAI大幅下调GPT-5.6 Sol API定价超20%,价格战再升级

面对Anthropic及中国模型的夹击,OpenAI宣布未来三个月将前沿模型GPT-5.6 Sol的开发者API定价下调超20%,涵盖ChatGPT Work和Codex的积分计划,但Pro、Plus、Business订阅价不变。调整后,标准短上下文场景下每百万输入token降至4美元、输出降至20美元,此前分别为5美元和30美元。对比竞品:Anthropic Claude Fable 5为输入10美元/输出50美元,Claude Opus 5为5美元/25美元。OpenAI此举意图明显——用价格优势锁定开发者生态,在模型能力趋同的当下,将性价比作为护城河。

创新看点:当模型性能进入“微创新”阶段,价格成了最粗暴的产品特性——OpenAI在告诉市场:我的最强模型,可以比你的中杯还便宜。


9. 马斯克放言2030年星舰每天发射超30次,从年飞几次到日飞几十次

在特朗普签署推动美国年发射1000次的备忘录次日,马斯克在X平台抛出惊人目标:SpaceX星舰计划到2030年实现每天30次以上发射,折合年超1万次。需注意,这专指仍处研发阶段的星舰,而非成熟的猎鹰9号。今年以来星舰仅完成2次飞行,甚至低于2024年(4次)和2025年(5次)的节奏。从年个位数到日三十次,意味着可重复使用技术、燃料加注、地面周转、空域管理需实现指数级跨越。新的联邦政策正试图扫清监管障碍,但工程挑战依然巨大。

创新看点:马斯克的目标不是为了登月,而是为了把星舰变成“太空货运高铁”——每天30次发射,本质是把航天从“项目制”变成“流水线制”。


10. 英伟达试点“壁挂式算力”:16块顶级GPU免费上墙,民宅变身微型数据中心

英伟达推出一项大胆的分布式算力计划:将价值超25万美元的顶级计算设备免费安装在试点家庭外墙上,零首付、电费网费高额补贴,房主还可参与利润分成。目前仅在约100户特定社区家庭中试点,若商业模式可行,未来或像屋顶太阳能板一样普及。设备预计在夜间用电低谷期运算,或与家庭光伏联动,消纳过剩绿电。这套系统实质是将闲置的住宅墙面转化为算力节点,既缓解集中式数据中心压力,又为AI算力供给开辟了分布式新路径。

创新看点:算力租赁的终极形态不是云,是“邻居家的墙”——英伟达把数据中心拆成积木,把电费账单变成分红账单,让每个房主都成为算力资本家。


这一天的新闻拼凑出一幅立体图景:AI的竞争已不限于算法和参数,而是蔓延到芯片自研、封装工艺、定价策略、开源生态、发射频率乃至居民外墙。技术的权力正在集中,也在分散——集中在大厂的算力囤积中,分散在每一个开放权重、每一块壁挂GPU、每一个周末打折的API调用里。未来不属于最聪明的模型,而属于最会“连接”的系统。

advertisement