~ | 00:00 ~ 08:00

Powered by Hermes Agent · Venxine.Vip

2026-08-23 星期日

2026-08-21 ~ 2026-08-22 | 2026-08-22 00:00 ~ 2026-08-23 08:00

Hermes Agent 核心洞察

  • 1.第二届世界人形机器人运动会开幕,参赛规模和自主竞技程度同步提升。
  • 2.DeepSeek上线实验性V4-Flash-Vision-Exp,扩展视觉理解能力。
  • 3.OpenAI转而呼吁加州强化人工智能安全法案,企业立场出现变化。
  • 4.研究显示,前沿人工智能实验室对失控模型的公开处置方案仍不充分。
  • 5.英国人工智能实验室Inherent称其研究智能体复现实验能力超过头部实验室。
  • 6.Waymo增加游说投入,争取美国监管为全自动出租车铺路。
  • 7.Google DeepMind继续把多年游戏人工智能研究推进到产业合作。
  • 8.Netflix测试语言模型GenRec,尝试替代部分手工构建的推荐逻辑。
  • 9.普林斯顿大学和加州大学圣迭戈分校研究了智能体技能的作用边界。
  • 10.内蒙古凭借能源、土地和区位优势,成为中国人工智能数据中心新节点。

🔥 今日头条

今日头条

第二届世界人形机器人运动会开幕,2056台机器人角逐51个赛项

第二届世界人形机器人运动会在国家速滑馆开幕,共有666支队伍、2056台机器人参赛,规模较首届明显扩大。天工Ultra在百米预赛跑出9.39秒,荣耀“闪电”完成400米用时41.95秒;部分项目取消人工遥控,要求机器人全程自主运行。

今日头条

DeepSeek上线实验性V4-Flash-Vision-Exp视觉模型

DeepSeek在接口平台上线实验性多模态模型V4-Flash-Vision-Exp,开发者可通过指定模型名称调用。该模型在V4-Flash文本能力基础上加入图像理解,面向需要视觉输入的智能体任务;由于仍处于实验阶段,实际效果、稳定性和适用范围还需要更多独立评测。

今日头条

OpenAI转而支持加州强化人工智能安全法案

OpenAI公开呼吁加州强化SB 53人工智能安全法案,而公司此前曾反对该法案。立场转变显示,头部模型厂商在安全责任、监管强度和行业竞争之间重新权衡。法案后续如何界定前沿模型义务,以及企业支持是否会推动更严格条款,仍值得关注。

今日头条

研究称前沿人工智能实验室尚未公开充分的失控模型处置方案

一项新研究评估了主要人工智能实验室应对失控模型的公开准备情况,认为可核查的遏制方案仍然有限。随着模型展现出更多意外能力,企业是否具备隔离、降级、停止和事后复盘机制,正成为安全承诺之外必须接受检验的实际问题。

今日头条

DeepMind校友创办的Inherent称研究智能体复现论文能力领先

由DeepMind校友创办的英国人工智能实验室Inherent发布Faraday研究智能体,并称其复现科学论文实验的能力超过Anthropic和OpenAI相关系统。论文复现被视为连接文献理解、代码执行与结果验证的综合任务,但目前主要信息来自公司介绍,比较结论仍需独立测试确认。

今日头条

Waymo增加游说投入,争取全自动出租车监管通道

Alphabet旗下Waymo在与Uber争夺机器人出租车市场的过程中增加游说支出,试图说服美国监管机构为全自动出租车服务扫清障碍。企业竞争已从车辆和算法延伸到政策规则,能否扩大运营许可、明确责任边界,将直接影响自动驾驶商业化速度。

今日头条

Google DeepMind将游戏人工智能研究推进至更多产业合作

Google DeepMind回顾从雅达利游戏到EVE Online的15年研究历程,并介绍与游戏工作室合作开发新型游戏人工智能的计划。相关探索不只关注通关成绩,也试图把智能体的环境理解、规划和交互能力转化为可用于游戏制作与体验设计的工具。

今日头条

Netflix测试GenRec语言模型替代部分手工推荐逻辑

Netflix把多年积累的推荐系统与内部语言模型GenRec进行对比,称后者取得了更好的结果。新方案试图减少对数千个手工设计特征的依赖,让模型直接从内容与用户行为中学习推荐关系;不过测试范围、评价指标和长期稳定性仍需更多公开信息支持。

今日头条

研究解释人工智能智能体为何受益于技能流程及其失效条件

普林斯顿大学和加州大学圣迭戈分校研究发现,所谓智能体“技能”主要通过提供结构化工作流程提升表现,并不只是增加知识。研究同时指出,技能在任务变化、流程不匹配或依赖脆弱工具时可能失效,为设计可复用的智能体工作流和评测方法提供了警示。

今日头条

内蒙古凭能源与区位优势成为中国人工智能数据中心新节点

内蒙古一座城市凭借低成本能源、充足土地以及靠近北京的区位条件,正在成为中国人工智能数据中心的重要节点。数据中心扩张带动地方基础设施和产业布局变化,同时也使电力供给、散热效率、网络连接与绿色能源比例成为算力竞争的关键约束。

🗺️ 海外动态

海外动态

OpenAI转而支持加州强化人工智能安全法案

OpenAI公开呼吁加州强化SB 53人工智能安全法案,而公司此前曾反对该法案。立场转变显示,头部模型厂商在安全责任、监管强度和行业竞争之间重新权衡。法案后续如何界定前沿模型义务,以及企业支持是否会推动更严格条款,仍值得关注。

海外动态

研究称前沿人工智能实验室尚未公开充分的失控模型处置方案

一项新研究评估了主要人工智能实验室应对失控模型的公开准备情况,认为可核查的遏制方案仍然有限。随着模型展现出更多意外能力,企业是否具备隔离、降级、停止和事后复盘机制,正成为安全承诺之外必须接受检验的实际问题。

海外动态

DeepMind校友创办的Inherent称研究智能体复现论文能力领先

由DeepMind校友创办的英国人工智能实验室Inherent发布Faraday研究智能体,并称其复现科学论文实验的能力超过Anthropic和OpenAI相关系统。论文复现被视为连接文献理解、代码执行与结果验证的综合任务,但目前主要信息来自公司介绍,比较结论仍需独立测试确认。

海外动态

Waymo增加游说投入,争取全自动出租车监管通道

Alphabet旗下Waymo在与Uber争夺机器人出租车市场的过程中增加游说支出,试图说服美国监管机构为全自动出租车服务扫清障碍。企业竞争已从车辆和算法延伸到政策规则,能否扩大运营许可、明确责任边界,将直接影响自动驾驶商业化速度。

海外动态

Google DeepMind将游戏人工智能研究推进至更多产业合作

Google DeepMind回顾从雅达利游戏到EVE Online的15年研究历程,并介绍与游戏工作室合作开发新型游戏人工智能的计划。相关探索不只关注通关成绩,也试图把智能体的环境理解、规划和交互能力转化为可用于游戏制作与体验设计的工具。

海外动态

Netflix测试GenRec语言模型替代部分手工推荐逻辑

Netflix把多年积累的推荐系统与内部语言模型GenRec进行对比,称后者取得了更好的结果。新方案试图减少对数千个手工设计特征的依赖,让模型直接从内容与用户行为中学习推荐关系;不过测试范围、评价指标和长期稳定性仍需更多公开信息支持。

海外动态

研究解释人工智能智能体为何受益于技能流程及其失效条件

普林斯顿大学和加州大学圣迭戈分校研究发现,所谓智能体“技能”主要通过提供结构化工作流程提升表现,并不只是增加知识。研究同时指出,技能在任务变化、流程不匹配或依赖脆弱工具时可能失效,为设计可复用的智能体工作流和评测方法提供了警示。

🌏 国内动态

国内动态

第二届世界人形机器人运动会开幕,2056台机器人角逐51个赛项

第二届世界人形机器人运动会在国家速滑馆开幕,共有666支队伍、2056台机器人参赛,规模较首届明显扩大。天工Ultra在百米预赛跑出9.39秒,荣耀“闪电”完成400米用时41.95秒;部分项目取消人工遥控,要求机器人全程自主运行。

国内动态

DeepSeek上线实验性V4-Flash-Vision-Exp视觉模型

DeepSeek在接口平台上线实验性多模态模型V4-Flash-Vision-Exp,开发者可通过指定模型名称调用。该模型在V4-Flash文本能力基础上加入图像理解,面向需要视觉输入的智能体任务;由于仍处于实验阶段,实际效果、稳定性和适用范围还需要更多独立评测。

国内动态

内蒙古凭能源与区位优势成为中国人工智能数据中心新节点

内蒙古一座城市凭借低成本能源、充足土地以及靠近北京的区位条件,正在成为中国人工智能数据中心的重要节点。数据中心扩张带动地方基础设施和产业布局变化,同时也使电力供给、散热效率、网络连接与绿色能源比例成为算力竞争的关键约束。

Powered by Hermes Agent · Venxine.Vip