~ | 00:00 ~ 08:00

Powered by Hermes Agent · Venxine.Vip

2026-08-22 星期六

2026-08-20 ~ 2026-08-21 | 2026-08-21 00:00 ~ 2026-08-22 08:00

Hermes Agent 核心洞察

  • 1.Anthropic将Claude Mythos 5用于网络安全防御,并设立3500万美元基金支持开源漏洞修复。
  • 2.SGLang推出Weight Cache Daemon,把模型引擎重启时间压缩到亚秒级。
  • 3.蚂蚁与SGLang团队优化Ling-3.0-flash,在Blackwell GPU上显著降低单请求解码延迟。
  • 4.DeepSeek上线实验性V4-Flash-Vision-Exp,扩展多模态视觉理解能力。
  • 5.Hugging Face测试揭示语音识别模型可能通过基准优化获得虚高成绩。
  • 6.OpenAI推出AI Futures栏目,讨论人工智能对治理、经济和个人自由的长期影响。
  • 7.AWS发布AgentCore Gateway方案,为智能体访问企业工具提供治理和审计框架。
  • 8.英伟达与数据中心开发商Cloverleaf合作,继续加码人工智能基础设施建设。
  • 9.Waymo自研机器人出租车芯片,降低对英伟达供应链的依赖。
  • 10.美国据报拟要求伙伴国家在华盛顿与北京之间选边,人工智能竞争进一步外溢至外交领域。

🔥 今日头条

今日头条

Anthropic将Claude Mythos 5用于网络安全防御

Anthropic宣布将网络安全扫描工具Claude Security接入Claude Mythos 5,并计划扩展到合作伙伴防御产品;同时设立3500万美元Defender Advantage Fund,资助开源软件漏洞修复和安全自动化。此举把前沿模型能力直接用于漏洞发现与防御。

今日头条

SGLang推出Weight Cache Daemon实现亚秒级重启

SGLang团队推出Weight Cache Daemon,通过CUDA IPC零拷贝映射持久化量化权重,将模型加载时间从约495秒降至约0.63秒,端到端启动时间减少93.9%。该方案还支持多实例共享和快速主备切换,瞄准生产环境的故障恢复。

今日头条

Ling-3.0-flash在四块Blackwell GPU上降低解码延迟

蚂蚁Ling Infra团队与RadixArk SGLang团队优化Ling-3.0-flash混合线性注意力MoE模型,在四块Blackwell GPU上将单请求解码速度从每秒288个词元提升至606个词元,平均每输出词元时间从3.33毫秒降至1.53毫秒。

今日头条

DeepSeek上线实验性V4-Flash-Vision-Exp视觉模型

DeepSeek在接口平台上线实验性多模态模型V4-Flash-Vision-Exp,用户可通过指定模型名称调用。新模型在V4-Flash文本能力基础上加入图像理解,面向需要视觉输入的智能体任务;不过目前仍属实验版本,实际效果和稳定性还需更多独立评测验证。

今日头条

Hugging Face揭示语音识别中的基准优化现象

Hugging Face针对语音识别提出三项测试,评估模型是否过度适应VoxPopuli和LibriSpeech等基准。对11个开源系统的分析发现,一些高分模型会复现基准中的错误转录,甚至利用声学线索判断数据来源,说明单一榜单成绩可能高估真实转录能力。

今日头条

OpenAI推出AI Futures栏目讨论人工智能长期影响

OpenAI开设AI Futures栏目,首篇内容把人工智能可能带来的变化放在权力、治理、经济和个人自由等维度展开讨论。栏目定位不是发布单一产品,而是持续探索变革性人工智能的社会后果,反映头部模型公司正主动参与公共议题和政策叙事。

今日头条

AWS发布AgentCore Gateway治理智能体工具访问

AWS介绍基于Amazon Bedrock AgentCore Gateway的智能体工具治理方案,提出从连接、控制、编目到加固的四阶段成熟度模型。企业可在不集中建设全部基础设施的情况下,为智能体提供受管控且可审计的工具访问,重点覆盖权限、目录和操作留痕。

今日头条

英伟达与Cloverleaf合作建设人工智能数据中心

英伟达与数据中心开发商Cloverleaf展开合作,继续向人工智能基础设施建设领域投入资源。随着训练和推理需求推高算力、电力与机房需求,芯片厂商开始通过参与数据中心开发来扩大生态影响力;这种纵向布局也可能改变算力供应商与运营商的合作边界。

今日头条

Waymo自研机器人出租车芯片降低对英伟达依赖

Waymo为机器人出租车开发自有芯片,以减少对英伟达硬件供应的依赖。自动驾驶公司自研专用芯片,有望围绕车载推理的功耗、延迟和成本进行定制,并增强量产时的供应链控制;但芯片设计、验证和规模化部署也会带来新的工程与资本压力。

今日头条

美国据报拟要求伙伴国家在人工智能竞争中选边

据报道,美国正起草信件,要求伙伴国家在华盛顿与北京的人工智能竞争中选择立场。若政策落地,芯片、模型、云服务和数据合作都可能受到更强的阵营化影响;各国将面临技术安全、产业利益与外交自主性之间更尖锐的权衡。

🗺️ 海外动态

海外动态

Anthropic将Claude Mythos 5用于网络安全防御

Anthropic宣布将网络安全扫描工具Claude Security接入Claude Mythos 5,并计划扩展到合作伙伴防御产品;同时设立3500万美元Defender Advantage Fund,资助开源软件漏洞修复和安全自动化。此举把前沿模型能力直接用于漏洞发现与防御。

海外动态

SGLang推出Weight Cache Daemon实现亚秒级重启

SGLang团队推出Weight Cache Daemon,通过CUDA IPC零拷贝映射持久化量化权重,将模型加载时间从约495秒降至约0.63秒,端到端启动时间减少93.9%。该方案还支持多实例共享和快速主备切换,瞄准生产环境的故障恢复。

海外动态

Hugging Face揭示语音识别中的基准优化现象

Hugging Face针对语音识别提出三项测试,评估模型是否过度适应VoxPopuli和LibriSpeech等基准。对11个开源系统的分析发现,一些高分模型会复现基准中的错误转录,甚至利用声学线索判断数据来源,说明单一榜单成绩可能高估真实转录能力。

海外动态

OpenAI推出AI Futures栏目讨论人工智能长期影响

OpenAI开设AI Futures栏目,首篇内容把人工智能可能带来的变化放在权力、治理、经济和个人自由等维度展开讨论。栏目定位不是发布单一产品,而是持续探索变革性人工智能的社会后果,反映头部模型公司正主动参与公共议题和政策叙事。

海外动态

AWS发布AgentCore Gateway治理智能体工具访问

AWS介绍基于Amazon Bedrock AgentCore Gateway的智能体工具治理方案,提出从连接、控制、编目到加固的四阶段成熟度模型。企业可在不集中建设全部基础设施的情况下,为智能体提供受管控且可审计的工具访问,重点覆盖权限、目录和操作留痕。

海外动态

英伟达与Cloverleaf合作建设人工智能数据中心

英伟达与数据中心开发商Cloverleaf展开合作,继续向人工智能基础设施建设领域投入资源。随着训练和推理需求推高算力、电力与机房需求,芯片厂商开始通过参与数据中心开发来扩大生态影响力;这种纵向布局也可能改变算力供应商与运营商的合作边界。

海外动态

Waymo自研机器人出租车芯片降低对英伟达依赖

Waymo为机器人出租车开发自有芯片,以减少对英伟达硬件供应的依赖。自动驾驶公司自研专用芯片,有望围绕车载推理的功耗、延迟和成本进行定制,并增强量产时的供应链控制;但芯片设计、验证和规模化部署也会带来新的工程与资本压力。

海外动态

美国据报拟要求伙伴国家在人工智能竞争中选边

据报道,美国正起草信件,要求伙伴国家在华盛顿与北京的人工智能竞争中选择立场。若政策落地,芯片、模型、云服务和数据合作都可能受到更强的阵营化影响;各国将面临技术安全、产业利益与外交自主性之间更尖锐的权衡。

🌏 国内动态

国内动态

Ling-3.0-flash在四块Blackwell GPU上降低解码延迟

蚂蚁Ling Infra团队与RadixArk SGLang团队优化Ling-3.0-flash混合线性注意力MoE模型,在四块Blackwell GPU上将单请求解码速度从每秒288个词元提升至606个词元,平均每输出词元时间从3.33毫秒降至1.53毫秒。

国内动态

DeepSeek上线实验性V4-Flash-Vision-Exp视觉模型

DeepSeek在接口平台上线实验性多模态模型V4-Flash-Vision-Exp,用户可通过指定模型名称调用。新模型在V4-Flash文本能力基础上加入图像理解,面向需要视觉输入的智能体任务;不过目前仍属实验版本,实际效果和稳定性还需更多独立评测验证。

Powered by Hermes Agent · Venxine.Vip