
主编寄语
7月7日,AI产业迎来多个定档时刻。GPT-5.6公测窗口开启,Sol/Terra/Luna三款模型配Speed Dial速度拨盘一齐登场;SpaceX以43亿美元被动资金创纪录闪电纳入纳指100。国内方面,腾讯混元3正式版交付,搜索追平GPT-5.5;字节Seedance 2.0从被好莱坞抵制到反杀进入长片工作流——四个月完成逆袭。微信、支付宝两大国民级超级App同日启动AI整合,大厂从赛马百模正式步入大一统。
模块1:大模型与产品发布
① GPT-5.6 系列正式公测上线
7月7日,OpenAI 按此前预告公开发布 GPT-5.6 系列并开启公测窗口。本次发布包含旗舰版 Sol、均衡版 Terra、轻量版 Luna 三款模型,并首次引入 Speed Dial(速度拨盘)功能,用户可根据任务需求在速度与深度之间滑动调节。Sol 在编程基准 Terminal-Bench 2.1 上标准模式得分 88.8%,Ultra 模式下达到 91.9%,均超越 Claude Mythos 5。定价方面,Sol 收费 $5/百万输入 token、$30/百万输出 token,约为 Anthropic Claude Fable 5 对应价格的一半。需注意:受美国政府监管要求约束,OpenAI 仅向少数“可信合作伙伴”提供完整预览权限,当前并非全员可用,公测窗口为分批开放模式。
来源:量子位 / 36氪 / 财新
② 腾讯混元 3 正式版发布:搜索追平 GPT-5.5,幻觉率减半
姚顺雨加入腾讯后首个重量级产品 Hy3 正式版于7月7日落地。模型总参 295B、单次激活 21B、外加 3.8B MTP 层,80 层 GQA 分组注意力,64 头中 8 个 KV 头,隐藏层维度 4096,中间层 13312,专家系统 192 选 top-8,上下文 256K,词表 120832,精度 BF16。官方将性能提升归因于“后训练数据质量与多样性提升”以及“RL 算力规模扩大”,有效参数量约为 GLM 5.2 的一半,但搜索能力追平 GPT-5.5、幻觉率减半。
来源:36氪·字母AI
③ 字节 Seedance 2.0 进入好莱坞长片工作流
据《洛杉矶时报》7月7日报道,Seedance 2.0 正在进入洛杉矶 AI 创作者圈与好莱坞周边工作流。95 分钟长片《Hell Grind》由 15 人团队两周完成;AI 奇幻剧集《骸骨编年史》月更一集、单集观看量达 300 万。今年 2 月因皮特/克鲁斯天台视频被 MPA 点名批评,仅四个月后好莱坞从抵触转向接受,工具已被用于概念短片、镜头风格测试、pitch 素材与长片制作。
来源:量子位 / 洛杉矶时报
模块2:学术研究前沿
④ ICML 2026 公布 10 篇获奖论文:清华黄高团队获杰出论文
ICML 2026 第四十三届会议 7 月 6-11 日在首尔举行,7月7日公布获奖名单:2 篇杰出论文、1 篇杰出立场论文、5 篇杰出论文荣誉提名、1 篇立场论文荣誉提名、1 篇时间检验奖。清华黄高团队参与的论文获杰出论文,提出 JustGRPO 方法,GSM8K 准确率达 89.1% 并保留并行解码能力;A3C 算法获时间检验奖;麻省理工/耶鲁论文获第二篇杰出论文。
来源:36氪·机器之心
模块3:AI产业与大厂整合
⑤ 大厂 AI 步入“大一统”:微信小微、支付宝阿宝同日进场
7月7日行业分析指出“百模大战”正式落幕。微信启动“小微”灰度测试,支持语音调设置、发消息、打电话、调用小程序;支付宝上线“阿宝”,覆盖居家、交通、优惠采购、政务、钱包、陪伴六大场景。字节豆包开启付费做 C 端分层运营;百度整合文心全产品线、打造一站式 AI 门户;阿里收拢 QoderWork/悟空/MuleRun、推统一生产力平台。两大国民级超级 App 同日进场,标志行业从“模型军备竞赛”转向“入口资源卡位战”。
来源:36氪·商业新研社
⑥ Karpathy:Agent 性能差距核心在 Harness 而非模型
Anthropic 研究员 Karpathy 指出:Agent 最大误区在于“逼 Agent 干活却不理解底层机制”。实验证实:冻结 DeepSeek-V4-Pro 权重、仅换 5 种 Harness,分数从 3.5% 飙至 80.1%;22 轮自动迭代后在 100 个测试任务上追平 Claude Sonnet 4.6,成本仅为原来 1/7。同一 Harness 迁移到 V4-Flash 仍提升 14.4 分——Harness 比 prompt 调优更可沉淀。
来源:36氪·AI前线
模块4:算力基础设施与芯片
⑧ SpaceX 正式纳入纳斯达克 100 指数,43 亿美元被动资金候场
7月7日美股开盘前,SpaceX(SPCX)正式成为纳指 100 成分股。IPO 到纳入仅 15 个交易日,创最快纪录。摩根大通测算约 $43 亿被动资金强制买入;纳入 MSCI 和富时罗素后规模更大。SpaceX 将成为纳指 100 市值前十五,权重 2.5%-3%。其星链和太空计算网络正成为 AI 分布式算力新基础设施。
来源:证券时报 / 财联社 / 新浪财经
模块5:AI政策与治理
⑨ 首届联合国“人工智能治理全球对话”在日内瓦召开
7月6-7日在日内瓦举行,约1500名代表参会,覆盖193个会员国。聚焦四大优先事项:AI机遇与影响、能力建设与弥合AI鸿沟、AI治理国际合作框架、新兴风险与安全管控。古特雷斯开幕呼吁全球参与转化为全球行动;7月7日进一步就AI芯片进入战场和“杀人机器人”问题发出紧急治理呼吁。
来源:新华社 / 联合国新闻
模块6:资本与市场动态
⑩ 微软宣布裁员 4800 人,Xbox 部门裁减约五分之一
微软7月7日宣布裁减 4800 个岗位(约占全球员工 2.1%),Xbox 游戏部门裁减约五分之一。公司资源正加速向 Azure AI 基础设施和 Copilot 倾斜。结合同日 GPT-5.6 公测窗口开启的背景,科技巨头的“AI优先”战略正以前所未有的速度重塑内部资源配置。
来源:综合财经报道
⑪ GLM 5.2 引发 AI 利润率塌缩讨论:开源模型压低推理成本
7月7日 Hacker News 热议:当 GLM 5.2 等新一代开源模型进一步压缩推理成本,Anthropic/OpenAI 的 $25/MTok 定价将无法维持,行业进入利润率塌缩阶段。市场此前对 DeepSeek R1 训练成本低于 $600 万的恐慌性抛售是误读——训练是固定资本支出,真正边际成本在推理端,API 标价远高于真实成本。
来源:Hacker News / Martin Alderson 博客
······END······
