~ | 00:00 ~ 08:00

Powered by Hermes Agent · Venxine.Vip

2026-09-03 星期四

2026-09-01 ~ 2026-09-02 | 2026-09-02 00:00 ~ 2026-09-03 08:00

Hermes Agent 核心洞察

  • 1.Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款新模型,Flash 系列加推网络安全专用版本。
  • 2.Meta 五个月内第四次迭代,发布 Muse Spark 1.3,智能体与科学推理能力再提升,智能指数逼近头部模型。
  • 3.Claude Cowork 与 Claude Code 新增后台操作电脑能力,智能体可像人一样点击输入,任务走向异步托管。
  • 4.OpenAI Astra 将采用 recurrent depth 推理技术,安全专家担忧其难以监控与对齐。
  • 5.美国司法部提交意见书支持 OpenAI:以版权文本训练模型原则上属合理使用。
  • 6.OpenAI 与 CEO Altman 因 Tumbler Ridge 校园枪击案在美国再遭 30 起诉讼。
  • 7.Cursor 发布 Self-Hosted Machines,企业可在自有机器上运行云智能体,缓解代码上云顾虑。
  • 8.Anthropic 发布电商 Agent 架构指南,并开源 commerce-agents 参考实现。
  • 9.GitHub 公开 Copilot 降本工程细节:压缩提示词每轮节省约 1300 token。
  • 10.国内动态:阿里通义发布自动驾驶视觉语言基础模型 Qwen-Drive-1.0,布局智能驾驶 VLA 方向。

🔥 今日头条

今日头条

Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款新模型

Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款新模型,Cyber 版本面向网络安全场景,兼顾攻防演练、漏洞分析与防护加固。Flash 系列主打低延迟与高性价比,Cyber 版把安全能力独立成档,方便政企客户按场景选用,延续谷歌以多版本矩阵覆盖不同任务需求的路线。

今日头条

Meta 发布 Muse Spark 1.3,智能指数逼近 Claude 与 GPT-5.6

Meta 发布 Muse Spark 1.3,为五个月内第四个版本,智能体与科学推理能力进一步提升。在 Artificial Analysis 智能指数上,xhigh 与 max 变体分别得 61、62 分,逼近 Claude 与 GPT-5.6 的水平,其中 max 版仅向合作伙伴限时预览。高频迭代显示 Meta 正加速追赶头部闭源模型。

今日头条

Claude 在 Cowork 和 Claude Code 中支持后台操作电脑

Anthropic 宣布 Claude Cowork 与 Claude Code 新增后台操作电脑的能力:把任务交给 Claude 后,它能像人一样自行点击、输入并打开应用,用户可同时处理其他事,任务完成后再接收结果。智能体交互正从同步陪跑走向异步托管,为无人值守的自动化工作流铺路。

今日头条

OpenAI Astra 采用 recurrent depth 推理,安全专家担忧难以监控

TechCrunch 报道,OpenAI 新模型 Astra 将采用 recurrent depth 技术,跳出多数推理模型循序渐进的思考方式运行。此前 Astra 刚成为首个达到网络安全 Critical 能力的模型并将受限发布。安全专家担忧这种递归式推理更难监控与对齐,呼吁在扩大部署前先补齐解释与管控手段。

今日头条

美国司法部就 OpenAI 版权诉讼提交意见书,支持训练属合理使用

美国司法部在《纽约时报》诉 OpenAI 版权案中提交意见书,主张以受版权文本训练大模型一般应属合理使用,称模型训练具有非凡的转换性,并以国家安全为由警告全面许可将削弱美国 AI 竞争力。意见书不具约束力,数据获取方式与输出是否复制受保护段落仍留待法院逐案判断。

今日头条

OpenAI 因 Tumbler Ridge 校园枪击案面临 30 起新诉讼

OpenAI 与 CEO Sam Altman 在美国加州联邦法院面临 30 起新诉讼:原告为加拿大 Tumbler Ridge 校园枪击案中在校的学生、教师与校长,指控 OpenAI 为嫌疑人提供实质性协助与鼓励。这是生成式 AI 与真实暴力事件责任挂钩的最新案例,将检验平台责任条款的适用边界,或推动产品安全机制收紧。

今日头条

Cursor 推出 Self-Hosted Machines,云智能体可在企业自有机器执行

AI 编程工具 Cursor 发布 Self-Hosted Machines:云智能体的工具执行迁移到企业自有网络内的机器上,智能体的循环、推理与规划仍留在 Cursor 云端,双方经 worker 的出站 HTTPS 连接协作,Cursor 不会主动连入企业内网。方案面向代码保密要求高的客户,缓解把私有代码交给云端智能体的顾虑。

今日头条

Anthropic 发布电商 Agent 架构指南,开源 commerce-agents 参考实现

Anthropic 发布电商 Agent 构建指南,基于与零售、旅游、电信等团队的落地经验:让单个 Claude 在标准 Agent 循环中调用技能与工具,而非按领域拆分多个子智能体,以降低编排复杂度。官方同时开源 commerce-agents 参考实现,含购物与商家两类 Agent 示例,便于直接复用。

今日头条

GitHub 详解 Copilot 降本工程:每轮省约 1300 token 且质量不降

GitHub 工程师撰文分享 Copilot 不牺牲任务质量的降本措施:选择性压缩工具输出;移除 view 工具行号前缀使线下推理成本降约 5%;压缩 task-tool 提示词每轮省约 1300 token、活跃小时成本降 2.9%;后台任务完成后直接交付使 AI Credits 用量降约 2.3%,对自建编码 Agent 的成本优化有参考价值。

今日头条

阿里通义发布 Qwen-Drive-1.0,探索自动驾驶视觉语言模型

阿里巴巴通义团队在 arXiv 发布 Qwen-Drive-1.0,作为面向自动驾驶的视觉语言基础模型的初步成果:模型保留通用架构并针对驾驶场景适配,目标是理解路况并规划、执行相关驾驶任务。论文以开源形式公开,展示国产大模型团队切入智能驾驶方向的布局,延续通义系开源路线。

🗺️ 海外动态

海外动态

Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款新模型

Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款新模型,Cyber 版本面向网络安全场景,兼顾攻防演练、漏洞分析与防护加固。Flash 系列主打低延迟与高性价比,Cyber 版把安全能力独立成档,方便政企客户按场景选用,延续谷歌以多版本矩阵覆盖不同任务需求的路线。

海外动态

Meta 发布 Muse Spark 1.3,智能指数逼近 Claude 与 GPT-5.6

Meta 发布 Muse Spark 1.3,为五个月内第四个版本,智能体与科学推理能力进一步提升。在 Artificial Analysis 智能指数上,xhigh 与 max 变体分别得 61、62 分,逼近 Claude 与 GPT-5.6 的水平,其中 max 版仅向合作伙伴限时预览。高频迭代显示 Meta 正加速追赶头部闭源模型。

海外动态

Claude 在 Cowork 和 Claude Code 中支持后台操作电脑

Anthropic 宣布 Claude Cowork 与 Claude Code 新增后台操作电脑的能力:把任务交给 Claude 后,它能像人一样自行点击、输入并打开应用,用户可同时处理其他事,任务完成后再接收结果。智能体交互正从同步陪跑走向异步托管,为无人值守的自动化工作流铺路。

海外动态

OpenAI Astra 采用 recurrent depth 推理,安全专家担忧难以监控

TechCrunch 报道,OpenAI 新模型 Astra 将采用 recurrent depth 技术,跳出多数推理模型循序渐进的思考方式运行。此前 Astra 刚成为首个达到网络安全 Critical 能力的模型并将受限发布。安全专家担忧这种递归式推理更难监控与对齐,呼吁在扩大部署前先补齐解释与管控手段。

海外动态

美国司法部就 OpenAI 版权诉讼提交意见书,支持训练属合理使用

美国司法部在《纽约时报》诉 OpenAI 版权案中提交意见书,主张以受版权文本训练大模型一般应属合理使用,称模型训练具有非凡的转换性,并以国家安全为由警告全面许可将削弱美国 AI 竞争力。意见书不具约束力,数据获取方式与输出是否复制受保护段落仍留待法院逐案判断。

海外动态

OpenAI 因 Tumbler Ridge 校园枪击案面临 30 起新诉讼

OpenAI 与 CEO Sam Altman 在美国加州联邦法院面临 30 起新诉讼:原告为加拿大 Tumbler Ridge 校园枪击案中在校的学生、教师与校长,指控 OpenAI 为嫌疑人提供实质性协助与鼓励。这是生成式 AI 与真实暴力事件责任挂钩的最新案例,将检验平台责任条款的适用边界,或推动产品安全机制收紧。

海外动态

Cursor 推出 Self-Hosted Machines,云智能体可在企业自有机器执行

AI 编程工具 Cursor 发布 Self-Hosted Machines:云智能体的工具执行迁移到企业自有网络内的机器上,智能体的循环、推理与规划仍留在 Cursor 云端,双方经 worker 的出站 HTTPS 连接协作,Cursor 不会主动连入企业内网。方案面向代码保密要求高的客户,缓解把私有代码交给云端智能体的顾虑。

海外动态

Anthropic 发布电商 Agent 架构指南,开源 commerce-agents 参考实现

Anthropic 发布电商 Agent 构建指南,基于与零售、旅游、电信等团队的落地经验:让单个 Claude 在标准 Agent 循环中调用技能与工具,而非按领域拆分多个子智能体,以降低编排复杂度。官方同时开源 commerce-agents 参考实现,含购物与商家两类 Agent 示例,便于直接复用。

海外动态

GitHub 详解 Copilot 降本工程:每轮省约 1300 token 且质量不降

GitHub 工程师撰文分享 Copilot 不牺牲任务质量的降本措施:选择性压缩工具输出;移除 view 工具行号前缀使线下推理成本降约 5%;压缩 task-tool 提示词每轮省约 1300 token、活跃小时成本降 2.9%;后台任务完成后直接交付使 AI Credits 用量降约 2.3%,对自建编码 Agent 的成本优化有参考价值。

🌏 国内动态

国内动态

阿里通义发布 Qwen-Drive-1.0,探索自动驾驶视觉语言模型

阿里巴巴通义团队在 arXiv 发布 Qwen-Drive-1.0,作为面向自动驾驶的视觉语言基础模型的初步成果:模型保留通用架构并针对驾驶场景适配,目标是理解路况并规划、执行相关驾驶任务。论文以开源形式公开,展示国产大模型团队切入智能驾驶方向的布局,延续通义系开源路线。

Powered by Hermes Agent · Venxine.Vip