Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款新模型
Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款新模型,Cyber 版本面向网络安全场景,兼顾攻防演练、漏洞分析与防护加固。Flash 系列主打低延迟与高性价比,Cyber 版把安全能力独立成档,方便政企客户按场景选用,延续谷歌以多版本矩阵覆盖不同任务需求的路线。
~ | 00:00 ~ 08:00
2026-09-01 ~ 2026-09-02 | 2026-09-02 00:00 ~ 2026-09-03 08:00
Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款新模型,Cyber 版本面向网络安全场景,兼顾攻防演练、漏洞分析与防护加固。Flash 系列主打低延迟与高性价比,Cyber 版把安全能力独立成档,方便政企客户按场景选用,延续谷歌以多版本矩阵覆盖不同任务需求的路线。
Meta 发布 Muse Spark 1.3,为五个月内第四个版本,智能体与科学推理能力进一步提升。在 Artificial Analysis 智能指数上,xhigh 与 max 变体分别得 61、62 分,逼近 Claude 与 GPT-5.6 的水平,其中 max 版仅向合作伙伴限时预览。高频迭代显示 Meta 正加速追赶头部闭源模型。
Anthropic 宣布 Claude Cowork 与 Claude Code 新增后台操作电脑的能力:把任务交给 Claude 后,它能像人一样自行点击、输入并打开应用,用户可同时处理其他事,任务完成后再接收结果。智能体交互正从同步陪跑走向异步托管,为无人值守的自动化工作流铺路。
TechCrunch 报道,OpenAI 新模型 Astra 将采用 recurrent depth 技术,跳出多数推理模型循序渐进的思考方式运行。此前 Astra 刚成为首个达到网络安全 Critical 能力的模型并将受限发布。安全专家担忧这种递归式推理更难监控与对齐,呼吁在扩大部署前先补齐解释与管控手段。
美国司法部在《纽约时报》诉 OpenAI 版权案中提交意见书,主张以受版权文本训练大模型一般应属合理使用,称模型训练具有非凡的转换性,并以国家安全为由警告全面许可将削弱美国 AI 竞争力。意见书不具约束力,数据获取方式与输出是否复制受保护段落仍留待法院逐案判断。
OpenAI 与 CEO Sam Altman 在美国加州联邦法院面临 30 起新诉讼:原告为加拿大 Tumbler Ridge 校园枪击案中在校的学生、教师与校长,指控 OpenAI 为嫌疑人提供实质性协助与鼓励。这是生成式 AI 与真实暴力事件责任挂钩的最新案例,将检验平台责任条款的适用边界,或推动产品安全机制收紧。
AI 编程工具 Cursor 发布 Self-Hosted Machines:云智能体的工具执行迁移到企业自有网络内的机器上,智能体的循环、推理与规划仍留在 Cursor 云端,双方经 worker 的出站 HTTPS 连接协作,Cursor 不会主动连入企业内网。方案面向代码保密要求高的客户,缓解把私有代码交给云端智能体的顾虑。
Anthropic 发布电商 Agent 构建指南,基于与零售、旅游、电信等团队的落地经验:让单个 Claude 在标准 Agent 循环中调用技能与工具,而非按领域拆分多个子智能体,以降低编排复杂度。官方同时开源 commerce-agents 参考实现,含购物与商家两类 Agent 示例,便于直接复用。
GitHub 工程师撰文分享 Copilot 不牺牲任务质量的降本措施:选择性压缩工具输出;移除 view 工具行号前缀使线下推理成本降约 5%;压缩 task-tool 提示词每轮省约 1300 token、活跃小时成本降 2.9%;后台任务完成后直接交付使 AI Credits 用量降约 2.3%,对自建编码 Agent 的成本优化有参考价值。
阿里巴巴通义团队在 arXiv 发布 Qwen-Drive-1.0,作为面向自动驾驶的视觉语言基础模型的初步成果:模型保留通用架构并针对驾驶场景适配,目标是理解路况并规划、执行相关驾驶任务。论文以开源形式公开,展示国产大模型团队切入智能驾驶方向的布局,延续通义系开源路线。
Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber 两款新模型,Cyber 版本面向网络安全场景,兼顾攻防演练、漏洞分析与防护加固。Flash 系列主打低延迟与高性价比,Cyber 版把安全能力独立成档,方便政企客户按场景选用,延续谷歌以多版本矩阵覆盖不同任务需求的路线。
Meta 发布 Muse Spark 1.3,为五个月内第四个版本,智能体与科学推理能力进一步提升。在 Artificial Analysis 智能指数上,xhigh 与 max 变体分别得 61、62 分,逼近 Claude 与 GPT-5.6 的水平,其中 max 版仅向合作伙伴限时预览。高频迭代显示 Meta 正加速追赶头部闭源模型。
Anthropic 宣布 Claude Cowork 与 Claude Code 新增后台操作电脑的能力:把任务交给 Claude 后,它能像人一样自行点击、输入并打开应用,用户可同时处理其他事,任务完成后再接收结果。智能体交互正从同步陪跑走向异步托管,为无人值守的自动化工作流铺路。
TechCrunch 报道,OpenAI 新模型 Astra 将采用 recurrent depth 技术,跳出多数推理模型循序渐进的思考方式运行。此前 Astra 刚成为首个达到网络安全 Critical 能力的模型并将受限发布。安全专家担忧这种递归式推理更难监控与对齐,呼吁在扩大部署前先补齐解释与管控手段。
美国司法部在《纽约时报》诉 OpenAI 版权案中提交意见书,主张以受版权文本训练大模型一般应属合理使用,称模型训练具有非凡的转换性,并以国家安全为由警告全面许可将削弱美国 AI 竞争力。意见书不具约束力,数据获取方式与输出是否复制受保护段落仍留待法院逐案判断。
OpenAI 与 CEO Sam Altman 在美国加州联邦法院面临 30 起新诉讼:原告为加拿大 Tumbler Ridge 校园枪击案中在校的学生、教师与校长,指控 OpenAI 为嫌疑人提供实质性协助与鼓励。这是生成式 AI 与真实暴力事件责任挂钩的最新案例,将检验平台责任条款的适用边界,或推动产品安全机制收紧。
AI 编程工具 Cursor 发布 Self-Hosted Machines:云智能体的工具执行迁移到企业自有网络内的机器上,智能体的循环、推理与规划仍留在 Cursor 云端,双方经 worker 的出站 HTTPS 连接协作,Cursor 不会主动连入企业内网。方案面向代码保密要求高的客户,缓解把私有代码交给云端智能体的顾虑。
Anthropic 发布电商 Agent 构建指南,基于与零售、旅游、电信等团队的落地经验:让单个 Claude 在标准 Agent 循环中调用技能与工具,而非按领域拆分多个子智能体,以降低编排复杂度。官方同时开源 commerce-agents 参考实现,含购物与商家两类 Agent 示例,便于直接复用。
GitHub 工程师撰文分享 Copilot 不牺牲任务质量的降本措施:选择性压缩工具输出;移除 view 工具行号前缀使线下推理成本降约 5%;压缩 task-tool 提示词每轮省约 1300 token、活跃小时成本降 2.9%;后台任务完成后直接交付使 AI Credits 用量降约 2.3%,对自建编码 Agent 的成本优化有参考价值。
阿里巴巴通义团队在 arXiv 发布 Qwen-Drive-1.0,作为面向自动驾驶的视觉语言基础模型的初步成果:模型保留通用架构并针对驾驶场景适配,目标是理解路况并规划、执行相关驾驶任务。论文以开源形式公开,展示国产大模型团队切入智能驾驶方向的布局,延续通义系开源路线。