08.07.26 | 22:24 PM
媒介360AI日报2026.08.07 | 字节拟训练超 5 万亿参数大模型 小红书加大 AI 投入
从硬件到模型、从社交到创作,AI 的边界正在被重新定义。
BY 媒介360

AI 世界的脚步从未停歇。从硬件到模型、从社交到创作,AI 的边界正在被重新定义——OpenAI 的"甜甜圈"AI 音箱浮出水面,字节跳动剑指 5 万亿参数的超大规模模型,小红书全面转向 AI 社交自研,Adobe 全家桶接入 ChatGPT……

一、古尔曼爆料 OpenAI 首款 AI 硬件:甜甜圈造型、冰球大小,主打先进语音交互

据彭博社马克·古尔曼今日发布的 Power On 通讯,OpenAI 首款 AI 硬件为一款冰球大小的"甜甜圈形"设备,售价预计在 300 至 400 美元之间,计划 2027 年发布。该设备由 OpenAI 与前苹果设计总监乔纳森·伊夫(Jony Ive)的 LoveFrom 工作室合作开发,定位为"没有显示屏的智能音箱",面向家庭场景,用户可单手携带移动。硬件方面配备可移动机械部件、灯光、摄像头及多种传感器,交互上采用比当前 ChatGPT 语音模式更先进的模型,支持接近人类交流的自然互动。

创新看点: OpenAI 首次从软件走向硬件,用"有生命感"的机械反馈和先进语音模型,重新定义人机交互的物理形态——AI 不再只是屏幕里的对话窗口。

二、曝字节拟训练超 5 万亿参数大模型,规模超 Kimi K3

据《晚点 LatePost》报道,字节跳动正在讨论训练一个参数规模超 5 万亿的大模型,超过阿里 Qwen 3.8-Max(2.4 万亿)和月之暗面 K3(2.8 万亿),为目前国内已知参数规模最大的模型。该计划由 Seed Foundation 负责人项亮主导,与大模型预训练数据负责人沈科合作。报道称 Seed 团队认为与其在现有尺寸上追赶,不如一次性将参数推到同行数倍以争取领先位置。张一鸣在 Seed 全员会上明确表态反对蒸馏,认为蒸馏只是在复制已有能力,无法真正实现超越。

创新看点: 张一鸣"以退为进"——接受短期落后、追求智能上限的战略选择,标志着中国大模型竞争从"追赶"进入"押注范式突破"的新阶段。

三、宇树科技 IPO 定价 150.80 元/股,发行市值约 610 亿元

宇树科技公告称首次公开发行股票并在科创板上市,发行价格为 150.80 元/股,发行数量 4044.6434 万股,占发行后总股本 10%,发行后总市值约 609.93 亿元。发行市盈率达 219.23 倍,远高于行业平均的 38.56 倍。战略配售获配 808.9286 万股,参与方包括社保基金、深度求索、中国石油等。网上申购日为 8 月 10 日,缴款日为 8 月 12 日。

创新看点: "人形机器人第一股"以超 200 倍市盈率登陆科创板,市场用真金白银为具身智能的长期价值投票——这是资本对"AI 物理化"赛道的集体押注。

四、小红书加大 AI 投入:布局 AI 社交方向,开启 AI 陪伴产品自研

小红书正全面提速 AI 战略,从后台技术应用转向前台自研、产品化与生态化全面竞速,布局 AI 社交产品、AI 社区互动工具等方向。小红书近日密集招募 AI 应用研发人才,其中"AI 社交产品经理"岗位职责包括"主导 AI 陪伴产品的设计与打造,探索 AI 在情感连接、兴趣匹配、个性化互动等维度的深度应用,构建有温度的 AI 陪伴体验"。今年 5 月,小红书已成立 AI 一级部门 Dots 和企业智能部。

创新看点: 小红书从"种草社区"转向"AI 陪伴社交",用情感连接和个性化互动切入 AI Native 社交新赛道——AI 社交不再只是效率工具,而是有"温度"的陪伴。

五、ChatGPT 正式接入 Adobe 全家桶,一句话调用 70 多款创意工具

Adobe 推出全新的 ChatGPT 统一插件,用户安装后可直接在 ChatGPT 中调用 Photoshop、Premiere、Acrobat、Lightroom、Illustrator、InDesign 等 70 多款 Adobe 工具。用户只需在提示框中输入"@Adobe"和具体任务即可调用相应工具,不登录 Creative Cloud 账户也能使用基本功能,登录后可保存跨会话工作进度并直接访问云端文件。Adobe 强调该插件并非旗舰应用的替代品,而是让用户在任何工作场景中都能使用 Adobe 的专业工具。

创新看点: AI 聊天界面正在成为创意工作的"统一入口"——无需切换软件,一句话完成修图、剪辑、设计,生产力工具的使用门槛被无限拉低。

六、阿里 Wan3.0 视频生成模型公测:单次生成 30 秒,支持文档直接转视频

阿里云宣布全新一代视频生成模型 Wan3.0 开启公测。Wan3.0 单次可生成 30 秒视频,支持文本、图片、音频、视频及 doc、xls、ppt、pdf、md 等文档格式输入,号称"万物皆可生视频"。模型支持智能时长推荐和视频延长功能,人像生成追求"千人千面",可细腻刻画五官与皮肤细节。即日起在阿里云百炼、万镜一刻、万相官网、千问创作 PC 端开启公测,千问 APP 灰度开放,480P/720P/1080P 的 API 价格分别为 0.3/0.6/1.2 元/秒。

创新看点: 视频生成从"几秒的动图"进化到"30 秒的完整叙事",更关键的是 PPT、PDF 等文档可直接"变"视频——内容创作的范式正在被彻底重构。

七、OpenAI 首款 AI 音箱细节再曝光:圆环设计,主打"有生命感"的交互

据彭博社进一步报道,OpenAI 代号为"Doughnut"的 AI 设备采用高品质金属材质圆环设计,配备扬声器网罩、麦克风阵列及相机系统,能够感知环境并学习用户习惯以提供定制化对话服务。设备包含可移动机械部件,能根据交互状态自主摆动,赋予设备类似"生命"的个性化反馈。OpenAI 内部将其视为进军硬件市场的切入点,长远目标是开发能够替代智能手机的终端产品。值得注意的是,苹果近期已就金属表面处理技术起诉 OpenAI,OpenAI 已申请驳回。

创新看点: 当 AI 硬件拥有"自主摆动的机械部件"和"感知环境的学习能力",设备不再是冷冰冰的工具,而是具备" personality "的智能伴侣——这或许是后智能手机时代的人机交互雏形。

八、Meta 推出编程智能体 Muse Code,定价低于主流竞品

Meta 以测试版推出首个终端编程 AI 智能体 Muse Code,并同步更新编程模型 Muse Spark 1.2。开发者通过一条命令即可安装,用于规划代码变更、编写代码并验证结果。定价策略激进:每 100 万 Token 输入 1.25 美元、输出 4.25 美元,另有约为按量价十分之一的 contributor tier——选择低价档需同意 Meta 使用提交数据改进模型。企业用户可申请零数据保留,获批后数据不会用于模型训练。

创新看点: Meta 以"骨折价"杀入编程 AI 赛道,用"数据换低价"的模式拉拢开发者——AI 编程工具的竞争从模型能力延伸到定价策略和数据生态。

九、OpenAI 为 ChatGPT 免费用户新增"Think"按钮,推理能力大普及

OpenAI 今日宣布 ChatGPT 重大更新:GPT-5.6 Sol 向 Plus 和 Pro 用户开放,集成"Instant"与"深度推理"支持,付费用户可通过滑动条自主调节回复时的推理强度。免费版及 Go 用户即日起开放 GPT-5.6 Luna 的无限文本聊天权限,更重要的是——免费用户现在也可使用"Think"按钮,在处理复杂问题时调用更多推理资源。

创新看点: "Think"按钮向免费用户开放,标志着深度推理能力从"付费特权"变为"基础权益"——AI 的"思考"正在成为像搜索一样人人可用的基础设施。

十、亚马逊 Zoox 本月在拉斯维加斯启动收费机器人出租车服务

亚马逊旗下 Zoox 将从 8 月 10 日起在拉斯维加斯对机器人出租车行程收费,结束近一年的免费公开试乘。美国国家公路交通安全管理局上周给予 Zoox 两年临时豁免,允许最多 2500 辆无方向盘和踏板的定制车辆用于商业运营。车费由基础费、里程和行程时间组成,机场、Sphere 和 T-Mobile Arena 等高流量目的地可能另收附加费。Zoox 在旧金山和 Austin 的服务目前仍免费,加州商业运营尚需两项许可。

创新看点: 从免费试乘到正式收费,Zoox 的收费启动标志着"真·无人驾驶"(无方向盘、无踏板)从实验室走向商业化运营——L5 级自动驾驶终于有了第一个收费运营样本。

今天的 AI 日报呈现了一个清晰的信号:AI 正在从"软件层的智能"向"硬件层的物理化"全面延伸。OpenAI 的甜甜圈音箱、宇树科技的人形机器人 IPO、Zoox 的收费无人出租车——AI 正在长出"身体"。与此同时,字节的 5 万亿参数豪赌、Meta 的低价编程 Agent、ChatGPT 的"Think"按钮普及,则提醒我们:模型能力的军备竞赛远未结束,而"让 AI 更聪明、更便宜、更可用"仍是所有人的共同命题。AI 的未来,不止于对话。

advertisement