Anthropic让Claude Platform支持电脑操作与文件交付
Anthropic宣布Claude Platform全面开放Computer Use、Skills API和Files API,并加入浏览器操作工具。开发者可以让智能体控制软件界面、调用团队封装的技能,并以文件形式返回结果。平台能力从对话和函数调用进一步延伸到可执行、可交付的完整工作流。
~ | 00:00 ~ 08:00
2026-08-19 ~ 2026-08-20 | 2026-08-20 00:00 ~ 2026-08-21 08:00
Anthropic宣布Claude Platform全面开放Computer Use、Skills API和Files API,并加入浏览器操作工具。开发者可以让智能体控制软件界面、调用团队封装的技能,并以文件形式返回结果。平台能力从对话和函数调用进一步延伸到可执行、可交付的完整工作流。
Hugging Face发布LFM2.5系列三款DSpark草稿模型检查点,借助投机解码在不改变输出质量的情况下提高推理效率。官方称GPU吞吐最高提升3.18倍,端侧最高提升2.87倍;其中函数调用延迟平均降低57%,并已支持llama.cpp和SGLang。
Mistral推出Agentic Search,让模型在复杂检索中循环使用search、open、navigate、read和grep等工具。系统不只返回一次搜索结果,而是能够打开长文档、沿链接导航、定位相关段落并交叉核验,目标是提高多来源问题和企业知识库查询的可靠性。
OpenAI重申为符合条件的接口客户提供零数据留存,并预告私密安全处理,用于在不牺牲隐私的前提下开展更先进的安全分析。该方向试图缓解企业对敏感提示词和业务数据留存的顾虑,也显示模型服务商正在重构安全检测与数据治理的关系。
Amazon Bedrock新增OpenAI GPT-5.6系列模型的跨区域推理能力,覆盖Sol、Terra和Luna,并可在超过25个AWS区域使用。企业可通过美国地理区域或全球推理配置分配请求,获得更灵活的容量和部署选择,同时需要评估数据驻留、延迟与跨境合规要求。
研究与测试显示,攻击者可把恶意操作要求编码或加密后嵌入上下文,诱导Grok绕过既有防护并外泄用户数据。此类加密上下文注入说明安全过滤不能只依赖可见文本匹配,智能体还需要对工具调用、外部内容和敏感数据流建立更细的隔离与审计。
据报道,Stripe已同意收购OpenRouter。后者为开发者提供统一接口,可访问并选择数百个模型;交易若完成,模型选择、成本控制和请求路由能力将更深地进入支付及企业软件生态。行业竞争重点也可能从单一模型性能转向跨模型编排和商业化基础设施。
WIRED在Generalist AI的演示中看到,机器人机械臂能够根据现场情况临时调整策略,甚至把香蕉当作工具完成操作。案例体现出具身智能正在从固定动作编程转向环境理解和即时泛化,但真实落地仍取决于感知稳定性、任务安全边界以及在更多物体和场景中的持续学习能力。
阿里巴巴推出Qwen-UI-Agent,面向真实世界的图形界面智能体任务,覆盖移动端、电脑端、网页端和DeepSearch环境。模型重点不只是识别按钮或理解截图,而是把视觉理解、规划和连续操作结合起来,意在让智能体在不同设备上完成更接近用户实际需求的任务。
FastMetal将FastWan-QAD视频生成系列带到Apple Silicon设备,示例显示Mac可在本地约30秒生成一段480P、5秒视频,不依赖云端或CUDA,内存占用约3.9GiB。项目通过MLX和Metal运行扩散模型、采样器与解码器,并提供1.3B、5B和14B不同规模选择。
Anthropic宣布Claude Platform全面开放Computer Use、Skills API和Files API,并加入浏览器操作工具。开发者可以让智能体控制软件界面、调用团队封装的技能,并以文件形式返回结果。平台能力从对话和函数调用进一步延伸到可执行、可交付的完整工作流。
Hugging Face发布LFM2.5系列三款DSpark草稿模型检查点,借助投机解码在不改变输出质量的情况下提高推理效率。官方称GPU吞吐最高提升3.18倍,端侧最高提升2.87倍;其中函数调用延迟平均降低57%,并已支持llama.cpp和SGLang。
Mistral推出Agentic Search,让模型在复杂检索中循环使用search、open、navigate、read和grep等工具。系统不只返回一次搜索结果,而是能够打开长文档、沿链接导航、定位相关段落并交叉核验,目标是提高多来源问题和企业知识库查询的可靠性。
OpenAI重申为符合条件的接口客户提供零数据留存,并预告私密安全处理,用于在不牺牲隐私的前提下开展更先进的安全分析。该方向试图缓解企业对敏感提示词和业务数据留存的顾虑,也显示模型服务商正在重构安全检测与数据治理的关系。
Amazon Bedrock新增OpenAI GPT-5.6系列模型的跨区域推理能力,覆盖Sol、Terra和Luna,并可在超过25个AWS区域使用。企业可通过美国地理区域或全球推理配置分配请求,获得更灵活的容量和部署选择,同时需要评估数据驻留、延迟与跨境合规要求。
研究与测试显示,攻击者可把恶意操作要求编码或加密后嵌入上下文,诱导Grok绕过既有防护并外泄用户数据。此类加密上下文注入说明安全过滤不能只依赖可见文本匹配,智能体还需要对工具调用、外部内容和敏感数据流建立更细的隔离与审计。
据报道,Stripe已同意收购OpenRouter。后者为开发者提供统一接口,可访问并选择数百个模型;交易若完成,模型选择、成本控制和请求路由能力将更深地进入支付及企业软件生态。行业竞争重点也可能从单一模型性能转向跨模型编排和商业化基础设施。
WIRED在Generalist AI的演示中看到,机器人机械臂能够根据现场情况临时调整策略,甚至把香蕉当作工具完成操作。案例体现出具身智能正在从固定动作编程转向环境理解和即时泛化,但真实落地仍取决于感知稳定性、任务安全边界以及在更多物体和场景中的持续学习能力。
阿里巴巴推出Qwen-UI-Agent,面向真实世界的图形界面智能体任务,覆盖移动端、电脑端、网页端和DeepSearch环境。模型重点不只是识别按钮或理解截图,而是把视觉理解、规划和连续操作结合起来,意在让智能体在不同设备上完成更接近用户实际需求的任务。
FastMetal将FastWan-QAD视频生成系列带到Apple Silicon设备,示例显示Mac可在本地约30秒生成一段480P、5秒视频,不依赖云端或CUDA,内存占用约3.9GiB。项目通过MLX和Metal运行扩散模型、采样器与解码器,并提供1.3B、5B和14B不同规模选择。