OpenAI GPT-5.6 模型套件获批公开发布
特朗普政府已批准 OpenAI GPT-5.6 模型套件公开发布,结束自 6 月 26 日发布以来的审批僵局。该套件包含三款模型:旗舰 Sol、中端高吞吐 Terra 和快速经济的日常模型 Luna。此前因安全审查暂停,而今正式放行为 OpenAI 的商业化和生态扩张扫清障碍。据 Axios 报道,审批通过标志着白宫对前沿 AI 部署的态度出现关键性转变。
~ | 00:00 ~ 08:00
2026-07-07 ~ 2026-07-08 | 2026-07-08 00:00 ~ 2026-07-09 08:00
特朗普政府已批准 OpenAI GPT-5.6 模型套件公开发布,结束自 6 月 26 日发布以来的审批僵局。该套件包含三款模型:旗舰 Sol、中端高吞吐 Terra 和快速经济的日常模型 Luna。此前因安全审查暂停,而今正式放行为 OpenAI 的商业化和生态扩张扫清障碍。据 Axios 报道,审批通过标志着白宫对前沿 AI 部署的态度出现关键性转变。
OpenAI 正式发布 GPT-Live-1 语音模型,支持同时听说的全双工实时对话,大幅减少打断和抢话问题。新模型在自然度和响应速度上有明显提升,并在同日举行直播发布会。TechCrunch 指出新语音模式为 ChatGPT 的语音交互设立了更高标准,Google 和 Anthropic 在语音赛道面临更大压力。
Anthropic 将 Claude Cowork 智能体工作平台扩展至移动端和网页端,实现跨设备同步。用户可在桌面端开始任务后通过手机查看进度,Claude 在后台持续运行并支持定时任务(如周一自动准备客户简报)。需要用户决策时,Claude 会将问题推送到手机。数据显示超 90% 的使用场景为非编程业务(业务流程 33%、内容创作 16%),软件开发仅 8.7%。Beta 版将率先面向 Max 用户开放,双倍额度延长至 8 月 5 日。
Meta Superintelligence Labs 发布首个媒体生成模型 Muse Image 和 Muse Video。Muse Image 可精确遵循指令、多参考构图,并整合 Instagram 社交上下文——用户可通过「@提及」的方式将好友拉入 AI 生成的照片中。这一功能立刻引发隐私争议,《连线》等媒体呼吁用户手动关闭 Instagram 的「允许他人使用你的内容创作」开关。Muse Video 基于相同预训练基础,实现高视觉保真度并原生支持音频,用户可通过 Meta AI 应用、网页、Instagram Stories 和 WhatsApp 试用。
SpaceXAI 发布 Grok 4.5,马斯克将其定位为「Opus 级模型」,对标 Anthropic 的旗舰产品线。Grok Imagine 同步更新支持 15 秒 AI 视频生成,在生成质量和速度上明显提升。此次发布发生在 SpaceX 以 857 亿美元完成史上最大 IPO 之后,Grok 4.5 被视为 xAI 并入 SpaceX 后技术和资源整合的首个重大成果。
AI 芯片制造商 SambaNova 在上轮超级融资仅 5 个月后再次完成 10 亿美元 F 轮融资首次交割,估值飙升至 110 亿美元。此轮融资反映出资本市场对 AI 推理和训练专用芯片的持续狂热。SambaNova 的定制芯片在数据中心推理场景中与 Nvidia GPU 形成差异化竞争,本轮资金将用于扩大产能和研发下一代架构。
中国商务部主导、发改委参与,拟出台措施限制外国访问中国最强 AI 模型,近期已与阿里巴巴、字节跳动、Z.ai 等企业会谈。拟将先进模型(含未发布)留在中国国内,涵盖闭源和开源模型,不仅限 API 访问还包括可下载权重。同时讨论将模型泄漏视为国家安全犯罪,并限制外国资本投资中国 AI 初创公司。若实施,外国公司将失去低成本获取中国先进模型的渠道,此举可能进一步加剧全球 AI 市场分裂。
微软正用自研 MAI 模型替换 Copilot 产品中的 OpenAI 和 Anthropic 模型以降低开支。MAI 已在 Excel 和 Outlook 中每周处理数万次请求,Build 大会发布推理模型 MAI-Thinking 1,声称编码能力媲美 Sonnet 4.6 和 Opus 4.6,但基准测试仅与 DeepSeek V3.2 相当。AI 负责人承认目标是削减并消除对 Anthropic 的支出,CEO 暗示未来可能按用量计费,MAI 为默认引擎、第三方模型按需付费。
AI 基础设施初创公司 Prime Intellect 完成 1.3 亿美元 A 轮融资,旨在帮助企业客户自行构建 AI 智能体,而非依赖第三方平台。该公司的差异化策略是提供底层基础设施和工具链,让企业在自有环境中训练和部署 AI Agent,兼顾能力与数据安全。此轮融资反映出在企业 AI Agent 竞赛中,基础设施层的投资热度正在超越应用层。
据 Tomasz Tunguz 分析,AI 公司在过去 12 个月内合计承诺 97.5 亿美元用于前端部署工程(FDE)。三种模式浮现:资产负债表模式(微软、亚马逊从内部调配,Salesforce 承诺 1000 个 FDE 岗位)、独立实体模式(OpenAI 部署公司融资 40 亿美元估值 140 亿,Anthropic 从黑石等融资 15 亿)、合作伙伴生态模式(Google Cloud 承诺 7.5 亿合作伙伴基金)。瓶颈从模型能力转向客户部署——多数企业无法自行安装配置前沿 AI,FDE 投资正成为新的护城河。
2026 年以来多家科技巨头以 AI 为由大规模裁员:微软裁减约 4800 人(2.1%),Oracle 裁减 21000 人(13%),GitLab 裁减 350 人(14%),Meta 裁减 8000 人(10%)并转岗 7000 人至 AI 部门,其他涉及 Google Cloud、Intuit(3000 人)、Cisco(4000 人)、Cloudflare(1100 人)等。据 Layoffs.fyi 统计,2026 年累计已裁约 12 万个技术岗位,AI 自动化正深刻重塑科技行业的人力结构。
据 Business Insider 报道,亚马逊正推进内部代号为「Moonraker」的项目,旨在让 Alexa AI 具备处理高级多步骤任务的能力,以追赶 Google、OpenAI 等竞争对手在 AI Agent 领域的领先地位。内部文件显示该项目成本高昂,是亚马逊在 AI 助手市场的战略反击。此前亚马逊 Alexa AI 的升级进展缓慢,Moonraker 被视为扭转局面的关键赌注。
特朗普政府批准 OpenAI GPT-5.6 模型套件公开发布,含旗舰 Sol、中端高吞吐 Terra 和快速经济的 Luna 三款模型。此前自 6 月 26 日发布以来因安全审查暂停,此次放行标志着白宫对前沿 AI 部署态度的关键转变。GPT-5.6 是 OpenAI 迄今为止最强大的模型系列。
OpenAI 正式发布 GPT-Live-1 语音模型,支持同时听说的全双工实时对话,大幅减少打断问题。同日举行直播发布会,新语音模式在自然度和响应速度上明显提升,为 ChatGPT 语音交互设立更高标准。
Anthropic 将 Claude Cowork 扩展至移动端和网页端,实现跨设备同步和后台持续运行。支持定时任务和推送决策,超 90% 使用场景为非编程业务。Beta 版率先面向 Max 用户开放,双倍额度延长至 8 月 5 日。
Meta 发布 Muse Image(支持 @提及 Instagram 好友生成 AI 图片)和 Muse Video,引发隐私担忧。用户可通过 Instagram 设置中的「分享与复用」菜单手动关闭 AI 创作授权。《连线》和 The Verge 均呼吁用户尽快检查隐私设置。
SpaceXAI 发布 Grok 4.5,马斯克将其对标 Anthropic Opus 产品线。Grok Imagine 同步支持 15 秒 AI 视频生成。此次发布是 xAI 并入 SpaceX 后的首个重大成果,紧随 SpaceX 857 亿美元史上最大 IPO 之后。
AI 芯片制造商 SambaNova 在上一轮融资仅 5 个月后完成 10 亿美元 F 轮首次交割,估值达 110 亿美元。其定制芯片在数据中心推理场景与 Nvidia GPU 差异化竞争,本轮资金将用于扩产和新架构研发。
AI 基础设施公司 Prime Intellect 完成 1.3 亿美元 A 轮融资,帮助企业在自有环境中构建和部署 AI 智能体,兼顾能力与数据安全。在 AI Agent 竞赛中,基础设施层投资热度正超越应用层。
微软在 Copilot 产品中用自研 MAI 模型大规模替代 OpenAI 和 Anthropic 以降低开支。MAI-Thinking 1 已上线,AI 负责人承认目标是消除对 Anthropic 的支出。CEO 暗示未来默认 MAI 引擎、第三方模型按需付费。
亚马逊推进「Moonraker」项目以让 Alexa AI 处理高级多步骤任务,追赶 Google 和 OpenAI 在 AI Agent 领域的领先地位。内部文件显示成本高昂,是在 AI 助手市场的战略反击。
Google Photos 上线 AI Video Remix 功能,基于 Gemini Omni 提供电影级重打光、自定义背景和水彩素描等艺术处理。该功能向 Google AI Plus/Pro/Ultra 订阅用户开放,进一步模糊了专业视频编辑与消费级工具的边界。
Anthropic 于 7 月 1 日全球重新部署 Fable 5 模型,此前因美国政府安全审查暂停访问。同时联合 Amazon、微软、Google 等 Glasswing 合作伙伴,提出行业通用的越狱严重度评分框架。7 月 2 日进一步公布 Fable 5 网络防护细节和越狱框架的技术方案。
Google 的 Deepfake 检测系统被用于揭穿涉及参议员 McConnell 的伪造照片骗局,展示出 AI 检测工具在政治信息战中的实战价值。该事件正值 2026 年美国中期选举前深伪内容泛滥引发担忧之际。
据《连线》报道,Meta 通过外包公司 Covalen 开展「Cannes」项目,让数百名外包人员伪装成未成年人向 ChatGPT、Gemini 及 Character.AI 发送涉及自杀、自残等高风险提示词,以测试竞品安全机制。单轮测试发送超 4.5 万个提示词,创建虚假未成年账号并上传药片、刀具等图片。Meta 声称此为常规安全测试且不使用竞品数据训练模型。
苹果研究人员发现,在 7 个模型(1.7B 至 70B 参数)中,仅需抑制单个「拒绝神经元」即可绕过安全对齐回答有害请求,或放大单个「概念神经元」从无害提示诱导出有害内容。整个过程无需训练或提示工程,表明安全对齐由个别神经元因果控制,对大模型安全防护机制提出根本性挑战。
Discord 承认其 AI 内容审核系统存在 Bug,导致大量用户因无害图片被错误封禁。事件引发对 AI 审核系统的可靠性和问责机制的广泛讨论,凸显自动化审核在社交平台大规模部署时的风险。
云安全公司 Sysdig 记录首例 AI 智能体勒索软件 JadePuffer:AI 自主完成入侵、横向移动、加密 1300+ 配置记录并撰写赎金信,能在 31 秒内修复失败登录并注释推理过程。但 Sysdig 澄清人类仍负责搭建设施和选择目标。AI 在攻击中窃取了 OpenAI、Anthropic、DeepSeek 和 Gemini 的 API 密钥。
Liquid AI 开源 Antidoom,基于 Final Token Preference Optimization 针对性减少推理模型中的死循环问题。在 LFM2.5-2.6B 上将循环率从 10.2% 降至 1.4%,Qwen3.5-4B 上从 22.9% 降至 1%。全套流程可在数小时内完成,代码和数据集已开源。
Hugging Face Storage 成为 SkyPilot 一级后端,用户可通过 hf:// URL 将存储挂载到 20+ 云的 GPU 任务中。Hugging Face 不收取出站和 CDN 费用,存储价格 $12-18/TB/月,低于 AWS S3 加出站费。基于 Xet 增量存储技术,仅传输模型变体的改动部分。
SK 海力士启动规模约 280 亿美元的美股上市计划,在纳斯达克通过存托凭证发行 1779 万股新股。受益于 AI 热潮,该股年内涨幅超 270%。预计为史上第二大新股发行,仅次于 SpaceX 的 857 亿美元 IPO。SK 海力士是高带宽内存芯片核心供应商,产品用于英伟达、谷歌等 AI 设备。
法国热门 AI 初创公司 ZML 发布免费产品,可在多种 AI 芯片上加速推理。此举将企业级推理优化能力开放给更广泛的开发者社区,降低 AI 部署的硬件门槛。
Google 为 Gemini API Managed Agents 新增后台异步执行(立即返回任务 ID 供轮询)、远程 MCP 服务器直接集成、自定义函数调用与凭证刷新功能。这些更新旨在帮助开发者构建可靠的生产级 AI 智能体,无需自定义代理中间件。
Anthropic 发表对齐研究论文,提出在 AI 模型中为双重用途知识(可用于良性或恶意目的)安装「关停开关」机制,在不损害模型正常能力的前提下阻断危险知识的激活路径。
Vercel CEO Guillermo Rauch 在 TechCrunch 采访中主张将模型与智能体分层解耦,应用层不应绑定特定模型。这一观点与微软 MAI 替换策略和 OpenAI/Anthropic 各自生态锁定形成鲜明对比,反映出业界对 AI 架构灵活性的路线之争。
美国 Forterra 公司宣布过去九个月向乌克兰战场部署超 100 辆基于 Polaris ATV 的 Lancer 自主地面车辆,执行 1100+ 次任务并完成 52 次伤员撤离。当前主要采用远程操作,正结合生成式 AI 提升自主能力。
Google 于 6 月通过客户邮件低调更新搜索服务隐私设置,新增默认将用户上传的图片、文件、音频等媒体数据保存并用于 AI 训练的选项。用户可通过取消勾选「保存媒体」退出,并设置自动删除周期。该更新适用于搜索、地图、购物、翻译等多项服务。
Y Combinator CEO Garry Tan 宣称每日与 AI 编码代理部署 37000 行代码并连续 72 天发布,波兰开发者审查其网站前端后发现大量臃肿代码:页面加载 169 次请求、6.42MB 数据、28 个测试文件、78 个未使用的 JavaScript 控制器。事件引发关于 AI 编程质量与数量的广泛讨论。
斯坦福数字经济实验室基于 ADP 薪资数据发现,美国 22-25 岁软件开发人员就业较 2022 年峰值下降 19%,而 41-49 岁增长 14%。入门级岗位招聘减少 28%,计算机科学毕业生失业率 6.1% 高于文科专业。核心推手是 2024-2025 年兴起的智能体编程,GitHub 一年新增 3600 万账号。
Synthetic Sciences 推出开源 AI 科研工作台 OpenScience(Apache 2.0),覆盖机器学习、生物学、物理学、化学的完整科研循环。支持按请求切换任意模型,内置 250+ 可编辑技能和约 30 个科学数据库。定位为 Anthropic Claude Science 的开源替代方案。
中国商务部主导、发改委参与,拟限制外国访问中国最强 AI 模型,已与阿里巴巴、字节跳动、Z.ai 等企业会谈。拟将先进模型(含未发布)留在中国国内,涵盖闭源和开源模型的权重下载,并讨论将模型泄漏视为国家安全犯罪及限制外资进入中国 AI 初创。若实施可能加剧全球 AI 市场分裂。
字节跳动 Seed 团队发布超长程评测集 EdgeBench,含 134 个真实任务覆盖六大领域,每个任务支持 Agent 持续工作至少 12 小时。基于约 38000 小时交互数据,发现 Agent 环境学习表现遵循高精度 log-sigmoid 曲线(R²=0.998),自 2025 年 9 月至 2026 年 5 月前沿模型学习速度约每三个月翻一倍。EdgeBench 已开源 51 个任务及完整评测框架。
阿里通义实验室发布 Fun-ASR-Realtime 实时语音识别模型,单模型覆盖 30 种语言及 16 种方言。在工业级方言测评上取得 87.8% 语义准确率,大幅领先同类产品。引入上下文理解与动态热词注入实现语义消歧,流式识别首字延迟控制在百毫秒级。API 已上线阿里云百炼平台。
蚂蚁 inclusionAI 发布开源多智能体协作基础设施 Avernet V0.1,聚焦 Agent 注册、发现、邀请等协作层问题。支持群组、会话和共享上下文构建多方共识,兼容自由聊天和领导-跟随等协作模式,并利用协作反馈形成自动进化闭环。支持 OpenClaw、自定义 Agent 及现有 Bot 平台等异构生态。