今日头条
OpenAI 正式发布 GPT-5.6 系列模型,同步推出 ChatGPT Work
OpenAI 在获得政府安全审批后正式发布 GPT-5.6 系列模型,号称每个 token 提供更强智能、单位美元性能更优。同步发布 ChatGPT Work——一个可跨应用和文件自主执行任务的 AI 代理,能持续数小时跟踪项目并交付完成成果。GPT-5.6 已成为 Microsoft 365 Copilot 的首选模型,在 Word、Excel、PowerPoint 等应用中提供更强的 AI 能力。此外还推出了 GPT-Live 新一代语音模型,实现更自然的人机对话交互。
今日头条
OpenAI 二号人物 Fidji Simo 卸任,公司面临领导层真空
OpenAI 负责 AGI 部署的 CEO(公司二号人物)Fidji Simo 因医疗休假比预期更长而辞去全职职务,将转任兼职顾问。这一离职发生在 OpenAI 估值超 3000 亿美元并筹备 IPO 的关键时刻,给公司带来领导层不确定性。Simo 此前负责将 OpenAI 前沿模型推向市场的部署战略。
今日头条
OpenAI 关停 Atlas 浏览器,将 AI 浏览能力整合至桌面应用
OpenAI 宣布关停其 AI 浏览器 Atlas(上线不到一年),但将部分代理浏览功能迁移至 ChatGPT 桌面应用和 Chrome 扩展。此举表明 OpenAI 并未放弃 AI 浏览器方向,而是转变策略——将浏览能力深度整合到现有产品生态中,而非维护独立浏览器产品。
今日头条
纽约时报等出版商指控 OpenAI 在版权案中隐匿证据
纽约时报及其他新闻出版商向法院提交动议,指控 OpenAI 在 ChatGPT 版权诉讼中故意隐匿关键证据,包括可识别 ChatGPT 输出中受版权保护新闻内容的工具和数据集。出版商要求法院对 OpenAI 实施法律制裁。这场版权大战持续升温,可能对 AI 训练数据的法律边界产生深远影响。
今日头条
Anthropic 发布 Claude 使用反思仪表盘,被戏称为「Claude 年度总结」
Anthropic 推出「Reflect with Claude」功能,为用户提供个人 Claude 使用情况的可视化反思仪表盘,类似 Spotify Wrapped 的概念。该功能展示用户与 Claude 的互动模式和使用趋势。同时,Anthropic 还发起了「提出难题」倡议,公开征集公众对 AI 最尖锐的问题并承诺展示其应对过程。此外,前美联储主席 Ben Bernanke 被任命为 Anthropic 长期利益信托成员。
今日头条
Anthropic 研究揭示 Claude 内部「概念空间」,首次窥见 LLM 推理机制
MIT Technology Review 报道,Anthropic 开发了一项新技术,能够前所未有地深入观察大型语言模型内部——当 Claude 回答问题或执行任务时,它会在一个隐藏的「概念空间」中反复推敲概念。这一发现为理解 LLM 的内部运作机制提供了迄今为止最清晰的窗口,对 AI 可解释性研究具有重要意义。
今日头条
Anthropic 将向消费者收取 Claude Fable 5 使用费,AI 订阅时代终结?
Wired 报道,Anthropic 将要求 Claude 订阅用户为使用其最佳消费级 AI 模型 Claude Fable 5 支付按量使用费。这意味着 AI 行业「一口价订阅」的黄金时代正在终结,转向按实际使用量计费的模式。此前 Anthropic 研究还发现了一种可为 AI 模型中双重用途知识设置「关闭开关」的技术。
今日头条
Meta 发布 Muse Spark 1.1 编程模型,正式加入 AI 编码大战
Meta 推出 Muse Spark 1.1 AI 编码模型,主打处理大型代理工作负载、修复 Bug 和辅助大规模代码迁移的能力。这标志着 Meta 正式进入由 GitHub Copilot、Claude Code、Cursor 等主导的 AI 编码工具市场。Meta 的差异化策略在于企业级自动化的规模化应用场景。
今日头条
Meta 计划 9 月量产自研 AI 芯片「Iris」,降低对英伟达依赖
据路透社报道,Meta 计划于 9 月开始量产代号「Iris」的新一代自研 AI 芯片。该芯片将加入 Meta 训练与推理加速器(MTIA)产品线,Meta 此前承诺每六个月推出一款新的自研芯片。此举旨在减少对英伟达和 AMD 的依赖,巩固自身 AI 基础设施的独立性。
今日头条
英伟达 Nemotron 携手 LangChain Deep Agents 实现基准测试领先
英伟达 Nemotron 3 Ultra 模型与 LangChain Deep Agents 平台结合,在多项基准测试中以更低成本超越顶级闭源模型。LangChain 针对 Nemotron 优化了其 Deep Agents 框架,展示了开放模型栈在企业级 AI 代理场景中的竞争力。英伟达还发布了 Vera CPU,专为代理 AI 时代设计的高单线程性能处理器。
今日头条
蚂蚁灵波开源全球首个面向具身智能的MoE视频基模LingBot-Video
蚂蚁灵波科技正式开源LingBot-Video,这是全球首个基于MoE架构、面向具身智能的视频生成基础模型。总参数30B,推理时仅激活约3B,效率较同规模Dense架构提升约3倍。模型引入7万小时VLA、VLN、Ego等机器人数据,并通过多维强化学习奖励系统对齐物理合理性与任务完成度。在RBench上总分0.620,超越Wan2.6等模型;在Physics-IQ Verified评测中排名第一。可
今日头条
蚂蚁灵波开源实时交互世界模型 LingBot-World 2.0
蚂蚁灵波开源新一代实时交互世界模型 LingBot-World 2.0(14B 参数),支持施法、攻击、跳跃等丰富角色动作及文本驱动事件(如切换场景、召唤风暴),内置 Pilot Agent 与 Director Agent 实现世界持续演化,并支持多人同时交互。模型采用因果预训练范式和混合双向自回归注意力掩码(MoBA),可稳定输出 720p/60fps 实时画面,长达一小时测试画质不衰减。通过
海外动态
OpenAI 正式发布 GPT-5.6 系列模型,同步推出 ChatGPT Work
OpenAI 在获得政府安全审批后正式发布 GPT-5.6 系列模型,号称每个 token 提供更强智能、单位美元性能更优。同步发布 ChatGPT Work——一个可跨应用和文件自主执行任务的 AI 代理,能持续数小时跟踪项目并交付完成成果。GPT-5.6 已成为 Microsoft 365 Copilot 的首选模型,在 Word、Excel、PowerPoint 等应用中提供更强的 AI 能力。此外还推出了 GPT-Live 新一代语音模型,实现更自然的人机对话交互。
海外动态
OpenAI 二号人物 Fidji Simo 卸任,公司面临领导层真空
OpenAI 负责 AGI 部署的 CEO(公司二号人物)Fidji Simo 因医疗休假比预期更长而辞去全职职务,将转任兼职顾问。这一离职发生在 OpenAI 估值超 3000 亿美元并筹备 IPO 的关键时刻,给公司带来领导层不确定性。Simo 此前负责将 OpenAI 前沿模型推向市场的部署战略。
海外动态
OpenAI 关停 Atlas 浏览器,将 AI 浏览能力整合至桌面应用
OpenAI 宣布关停其 AI 浏览器 Atlas(上线不到一年),但将部分代理浏览功能迁移至 ChatGPT 桌面应用和 Chrome 扩展。此举表明 OpenAI 并未放弃 AI 浏览器方向,而是转变策略——将浏览能力深度整合到现有产品生态中,而非维护独立浏览器产品。
海外动态
纽约时报等出版商指控 OpenAI 在版权案中隐匿证据
纽约时报及其他新闻出版商向法院提交动议,指控 OpenAI 在 ChatGPT 版权诉讼中故意隐匿关键证据,包括可识别 ChatGPT 输出中受版权保护新闻内容的工具和数据集。出版商要求法院对 OpenAI 实施法律制裁。这场版权大战持续升温,可能对 AI 训练数据的法律边界产生深远影响。
海外动态
Anthropic 发布 Claude 使用反思仪表盘,被戏称为「Claude 年度总结」
Anthropic 推出「Reflect with Claude」功能,为用户提供个人 Claude 使用情况的可视化反思仪表盘,类似 Spotify Wrapped 的概念。该功能展示用户与 Claude 的互动模式和使用趋势。同时,Anthropic 还发起了「提出难题」倡议,公开征集公众对 AI 最尖锐的问题并承诺展示其应对过程。此外,前美联储主席 Ben Bernanke 被任命为 Anthropic 长期利益信托成员。
海外动态
Anthropic 研究揭示 Claude 内部「概念空间」,首次窥见 LLM 推理机制
MIT Technology Review 报道,Anthropic 开发了一项新技术,能够前所未有地深入观察大型语言模型内部——当 Claude 回答问题或执行任务时,它会在一个隐藏的「概念空间」中反复推敲概念。这一发现为理解 LLM 的内部运作机制提供了迄今为止最清晰的窗口,对 AI 可解释性研究具有重要意义。
海外动态
Anthropic 将向消费者收取 Claude Fable 5 使用费,AI 订阅时代终结?
Wired 报道,Anthropic 将要求 Claude 订阅用户为使用其最佳消费级 AI 模型 Claude Fable 5 支付按量使用费。这意味着 AI 行业「一口价订阅」的黄金时代正在终结,转向按实际使用量计费的模式。此前 Anthropic 研究还发现了一种可为 AI 模型中双重用途知识设置「关闭开关」的技术。
海外动态
Meta 发布 Muse Spark 1.1 编程模型,正式加入 AI 编码大战
Meta 推出 Muse Spark 1.1 AI 编码模型,主打处理大型代理工作负载、修复 Bug 和辅助大规模代码迁移的能力。这标志着 Meta 正式进入由 GitHub Copilot、Claude Code、Cursor 等主导的 AI 编码工具市场。Meta 的差异化策略在于企业级自动化的规模化应用场景。
海外动态
Meta 计划 9 月量产自研 AI 芯片「Iris」,降低对英伟达依赖
据路透社报道,Meta 计划于 9 月开始量产代号「Iris」的新一代自研 AI 芯片。该芯片将加入 Meta 训练与推理加速器(MTIA)产品线,Meta 此前承诺每六个月推出一款新的自研芯片。此举旨在减少对英伟达和 AMD 的依赖,巩固自身 AI 基础设施的独立性。
海外动态
英伟达 Nemotron 携手 LangChain Deep Agents 实现基准测试领先
英伟达 Nemotron 3 Ultra 模型与 LangChain Deep Agents 平台结合,在多项基准测试中以更低成本超越顶级闭源模型。LangChain 针对 Nemotron 优化了其 Deep Agents 框架,展示了开放模型栈在企业级 AI 代理场景中的竞争力。英伟达还发布了 Vera CPU,专为代理 AI 时代设计的高单线程性能处理器。
海外动态
Google 将自动标注 AI 生成的广告,提升透明度
Google 宣布将自动为使用其生成式 AI 工具制作的广告添加「由 AI 创建或编辑」标签。此前 Google 仅要求选举广告进行此类披露,现在扩展至所有 AI 生成广告内容。这一举措旨在提升广告生态的透明度,帮助用户识别合成内容。
海外动态
AI 代理公司 Lyzr 用自己的 AI 代理完成 1 亿美元融资
AI 代理初创公司 Lyzr 用自己开发的 AI 代理完成了 1 亿美元融资,以此证明其产品确实有效。这一事件引发热议——AI 代理自主完成融资流程,既是技术实力的展示,也是对 AI 代理可信度的有力背书。
海外动态
巴黎 AI 语音公司 Gradium 获 1 亿美元种子轮,英伟达参投
巴黎 AI 语音初创公司 Gradium 完成 1 亿美元种子轮融资,英伟达参投。公司计划用这笔资金在湾区开设办公室并争夺人才,以「加强其在全球领先 AI 生态系统核心的地位」。大额种子轮再次彰显 AI 语音赛道的资本热度。
海外动态
开源 AI 工具 Ollama 融资 6500 万美元,用户逼近 900 万
广受欢迎的开源 AI 开发者工具 Ollama 完成 6500 万美元融资,用户增长至近 900 万。Ollama 以本地运行大语言模型的简便性著称,已成为开发者社区部署开源模型的首选工具之一,此次融资将进一步加速其产品开发和生态建设。
海外动态
AI 公司 Prime Intellect 获 1.3 亿美元 A 轮融资,帮企业构建 AI 代理
AI 基础设施公司 Prime Intellect 完成 1.3 亿美元 A 轮融资,致力于帮助企业构建自己的 AI 代理。公司提供的平台让企业能够部署和管理定制化 AI 代理系统,瞄准企业级 AI 自动化市场。
海外动态
埃隆·马斯克称赞 Anthropic 模型并承诺不「切断」其服务
在 Mythos/Fable 相关事件后,埃隆·马斯克公开称赞 Anthropic 的 AI 模型,并承诺不会切断对 Anthropic 的服务支持。考虑到 Anthropic 约 400 亿美元的收入与此相关,这一表态对行业格局有重要影响。同时 SpaceXAI 发布了 Grok 4.5,马斯克称其为「Opus 级别模型」。
海外动态
1X Neo 人形机器人展示超快手指,家务机器人能力再升级
Wired 报道,1X 公司的 Neo 人形机器人在最新演示中展示了极其灵活的手指动作。这款定位家用场景的软体机器人配备了高灵敏度的触觉手部,能够执行精细操作任务。1X 由 OpenAI 和 Tiger Global 等投资,是人形机器人赛道的重要玩家。
海外动态
黑客可利用 9 款主流 AI 工具构建大规模僵尸网络——「幻觉劫持」攻击
Ars Technica 报道,安全研究人员发现黑客可通过「HalluSquatting」(幻觉劫持)技术,利用 9 款主流 AI 工具构建大规模僵尸网络。该攻击利用了 LLM 无法说「我不知道」的特点,诱导模型生成看似合法实则恶意的代码包名称,进而传播恶意软件。
海外动态
AI 能否回答 3 万亿美元的问题?
Sequoia 合伙人 David Cahn 更新 AI 基础设施支出估算:2026 年全球投入达 1.5 万亿美元,行业需产生 3 万亿美元收入才能回本。Anthropic 年化收入(ARR)达 600 亿美元,OpenAI 2025 年收入 130 亿美元(11 月称 ARR 200 亿美元),但缺口仍大。Apollo 首席经济学家指出,谷歌、Meta、微软、亚马逊均预测 2028 年自由现金
国内动态
蚂蚁灵波开源全球首个面向具身智能的MoE视频基模LingBot-Video
蚂蚁灵波科技正式开源LingBot-Video,这是全球首个基于MoE架构、面向具身智能的视频生成基础模型。总参数30B,推理时仅激活约3B,效率较同规模Dense架构提升约3倍。模型引入7万小时VLA、VLN、Ego等机器人数据,并通过多维强化学习奖励系统对齐物理合理性与任务完成度。在RBench上总分0.620,超越Wan2.6等模型;在Physics-IQ Verified评测中排名第一。可
国内动态
蚂蚁灵波开源实时交互世界模型 LingBot-World 2.0
蚂蚁灵波开源新一代实时交互世界模型 LingBot-World 2.0(14B 参数),支持施法、攻击、跳跃等丰富角色动作及文本驱动事件(如切换场景、召唤风暴),内置 Pilot Agent 与 Director Agent 实现世界持续演化,并支持多人同时交互。模型采用因果预训练范式和混合双向自回归注意力掩码(MoBA),可稳定输出 720p/60fps 实时画面,长达一小时测试画质不衰减。通过
国内动态
工信部发布Claude Code后门安全风险提示
中国工信部发布风险提示,指出 Claude Code 2.1.91 至 2.1.196 版本内置监控机制,未经用户同意即向远程服务器回传用户地域、身份标识等敏感信息。建议相关单位立即全面排查,对受影响版本卸载或升级至已清除后门代码的最新安全版本,并加强开发工具外联权限管控与流量监测,防止敏感数据违规外传。
国内动态
蚂蚁集团旗下Robbyant开源LingBot-Vision:1B参数边界中心视觉基础模型,用于密集空间感知
蚂蚁集团旗下具身智能公司Robbyant开源LingBot-Vision,一套自监督视觉Transformer家族,专为密集空间感知设计。旗舰ViT-g/16参数约1.1B,采用掩膜边界建模训练,将边界作为原生预训练信号。在密集空间任务中,该1B模型匹配或超越参数规模高达7倍的大模型(如7B DINOv3)。模型以Apache-2.0许可证在Hugging Face开源,提供ViT-g、ViT-L
国内动态
蚂蚁集团周俊AICon演讲:从Token数量到Token密度,万亿参数模型效率优先
蚂蚁集团副总裁周俊在AICon演讲指出,万亿参数模型每运行15分钟算力成本约等于一辆特斯拉,效率是智能体时代最需解决的问题。团队提出从"更多Token"转向"更高Token密度"策略,采用7份Lightning Attention加1份MLA的混合线性注意力架构,使256K长上下文成本从指数级降至线性级,算力更多用于思考。通过Kpop算法区分工具调用与自然语言Token,结合思维链剪枝、自蒸馏等,
国内动态
腾讯发布 Hy3 大模型,Hacker News 热议
腾讯混元团队发布 Hy3 大模型,在 Hacker News 上获得广泛关注(354 points)。Hy3 展示了中国科技巨头在基础模型领域的持续投入和技术进步,其性能表现引发国际开发者社区讨论。
国内动态
阿里开源轻量级向量数据库 zvec
阿里巴巴在 GitHub 上开源了 zvec——一款轻量级、极速的进程内向量数据库。zvec 专为 AI 代理和嵌入式应用场景设计,无需外部服务依赖,可直接嵌入应用程序中运行,为中文 AI 开发者提供了高效的向量检索工具。
国内动态
阿里发布 Page Agent:一行脚本让任何网页拥有 AI 代理
阿里巴巴开源 Page Agent,一个基于 JavaScript 的网页内 GUI 代理框架。通过一行脚本即可让任何网页拥有自己的 AI 代理,能够用自然语言控制网页界面。该项目在 GitHub 上获得广泛关注。
国内动态
腾讯发布 Agent Memory:为 AI 代理提供本地长记忆方案
腾讯云推出 TencentDB Agent Memory,为 AI 代理提供完全本地的长期记忆方案。采用四级渐进式管道架构,零外部 API 依赖。该项目在 GitHub Trending 上获得关注,展示了中国企业在 AI 代理基础设施领域的创新。
国内动态
智谱 GLM 5.2 接近人类簿记员准确率,引发国际关注
智谱 AI 的 GLM 5.2 模型在 VAT 基准测试中展现出接近人类专业簿记员的准确率。该成果在 Hacker News 上获得 164 分和 105 条评论,国际开发者社区对中国大模型的实用能力给予高度评价。