阿里发布 Qwen3.8-Max:2.4T 参数,开源最强编码与协作模型
阿里云通义团队正式发布旗舰模型 Qwen3.8-Max,这是 Qwen 家族迄今最强的模型,采用 2.4T 参数(约 95B 激活)的 MoE 架构,官方称其在编码与长程协作任务上表现直逼 Claude 等闭源一线模型,并首次开源 Qwen-Max 级权重,开放权重将于下周发布。海外评测也认为,该模型具备数天级长程自主任务能力,可独立完成复现论文、设计芯片等复杂工作。
~ | 00:00 ~ 08:00
2026-08-02 ~ 2026-08-03 | 2026-08-03 00:00 ~ 2026-08-04 08:00
阿里云通义团队正式发布旗舰模型 Qwen3.8-Max,这是 Qwen 家族迄今最强的模型,采用 2.4T 参数(约 95B 激活)的 MoE 架构,官方称其在编码与长程协作任务上表现直逼 Claude 等闭源一线模型,并首次开源 Qwen-Max 级权重,开放权重将于下周发布。海外评测也认为,该模型具备数天级长程自主任务能力,可独立完成复现论文、设计芯片等复杂工作。
国产大模型公司 MiniMax 正式开源新一代通用视频模型 H3,可统一理解文本、图像、视频和音频,生成最高 2K 分辨率、最长 15 秒、带 32kHz 原生立体声音频的视频。据外媒报道,H3 是首个登顶 AI 视频生成评测榜单的开源模型,实测在广告、短剧、动效等场景表现突出,一次可输入 9 张图、3 段视频和 3 段音频。
欧盟《人工智能法案》下的新透明度义务于 8 月 2 日正式生效,要求公司披露用户何时在与 AI 模型互动,并为合成音视频和文本添加机器可读标记。欧盟还推出了一套可选的 AI 披露标签供平台采用,但标注要求本身是强制性的。违规公司面临最高 1500 万欧元(约合 1720 万美元)或全球年营业额 3% 的罚款,8 月 2 日前推出的模型有 4 个月宽限期。
《麻省理工科技评论》发文指出,特朗普政府的 AI 保护主义正在波及机器人领域:美国试图将中国机器人硬件与供应链排除在外,但讽刺的是,美国本土的相关研究大量依赖中国制造的零部件与开源成果。文章认为,这种「数字铁幕」式的做法不仅推高成本,还可能削弱美国自身在机器人研究上的竞争力。
OpenAI 公布 GPT-Live,一种面向实时音频对话的新架构与语音栈。GPT-Live 可以在说话的同时聆听,为了让这种体验在 ChatGPT 规模下显得自然,团队从客户端到模型重建了整个语音栈,使音频持续流动,更深入的推理和工具使用不会打断对话。
微软研究院开源 Orchard,一个面向研究社区、用于跨任务类型训练和评估 AI 智能体的框架。它降低了构建智能体训练的复杂性,让研究人员复用同一套基础设施,即使是较小的模型也能实现强劲性能。项目代码已发布在微软研究官方渠道。
商汤科技面向社区开源 SenseNova U1.5-Lite-Preview,一个基于自研 NEO-Unify 架构的轻量级原生统一多模态模型。仅 8B-MoT 参数即可实现 4K 高清直出,覆盖视觉理解、推理、生成与编辑,支持长篇多约束的复杂视觉指令、海报信息图等高信息密度内容,以及参考图、局部文字编辑等精准修改能力,声称生成与编辑质量可比肩商业闭源模型。
TechCrunch 评论称,苹果苦等多年的 AI 重构终于让 Siri 成为它本该成为的助手,但它到来的时机恰好是「一个称职的 AI 助手」已不再让人感到革命性的时刻。在 ChatGPT、Gemini 等竞争对手已占据用户心智后,Siri 的修复更像是一次补课而非颠覆,业界普遍关注苹果后续如何在 AI 竞争中找到差异化。
Palantir 发布强劲季度业绩后,CEO Alex Karp 在股东信中警告,前沿 AI 实验室对企业客户过于不可信,意图「占有所谓合作伙伴的生产资料」,带有「马克思主义色彩」。该公司第二季度营收 19 亿美元,同比增长 93%,利润 11 亿美元。Karp 主张 Palantir 提供模型无关的 AI 与分析软件,让企业掌控自身数据与 AI 使用产生的「废气」(提示词、编排、上下文)。
量子位报道,华为诺亚方舟实验室开源 MindMemOS,一个面向智能体的记忆系统,主张「记忆与 Skill 一起进化」,让 AI 不再「用完即忘」。它通过结构化的记忆管理与技能沉淀,帮助模型在长对话与复杂任务中持续累积经验,是国产开源在智能体记忆层的一次重要尝试。
在 TechCrunch 最新一期播客 Equity 中,嘉宾们讨论了 Sam Altman 呼吁行业「为 AI 发展节奏设定步调」的言论。作为 OpenAI 掌门人,Altman 一反此前激进加速的姿态,公开讨论减速与安全权衡,折射出前沿实验室在算力成本、监管压力与社会影响之间寻求平衡的新动向,也引发了行业关于「减速是否真诚」的激烈辩论。
InfoQ 中文 AI 周报盘点:寒武纪向超八成员工发放股票激励,人均约 160 万元;宇树科技员工掏出 2.7 亿元认购公司 IPO 股份,创始人王兴兴个人出资 1500 万。同期 Altman 自曝沉迷刷 TikTok,一刷就是 3 小时。国产 AI 公司在资本市场动作频频,折射行业融资与人才争夺热度。
欧盟《人工智能法案》下的新透明度义务于 8 月 2 日正式生效,要求公司披露用户何时在与 AI 模型互动,并为合成音视频和文本添加机器可读标记。欧盟还推出了一套可选的 AI 披露标签供平台采用,但标注要求本身是强制性的。违规公司面临最高 1500 万欧元(约合 1720 万美元)或全球年营业额 3% 的罚款,8 月 2 日前推出的模型有 4 个月宽限期。
《麻省理工科技评论》发文指出,特朗普政府的 AI 保护主义正在波及机器人领域:美国试图将中国机器人硬件与供应链排除在外,但讽刺的是,美国本土的相关研究大量依赖中国制造的零部件与开源成果。文章认为,这种「数字铁幕」式的做法不仅推高成本,还可能削弱美国自身在机器人研究上的竞争力。
OpenAI 公布 GPT-Live,一种面向实时音频对话的新架构与语音栈。GPT-Live 可以在说话的同时聆听,为了让这种体验在 ChatGPT 规模下显得自然,团队从客户端到模型重建了整个语音栈,使音频持续流动,更深入的推理和工具使用不会打断对话。
微软研究院开源 Orchard,一个面向研究社区、用于跨任务类型训练和评估 AI 智能体的框架。它降低了构建智能体训练的复杂性,让研究人员复用同一套基础设施,即使是较小的模型也能实现强劲性能。项目代码已发布在微软研究官方渠道。
TechCrunch 评论称,苹果苦等多年的 AI 重构终于让 Siri 成为它本该成为的助手,但它到来的时机恰好是「一个称职的 AI 助手」已不再让人感到革命性的时刻。在 ChatGPT、Gemini 等竞争对手已占据用户心智后,Siri 的修复更像是一次补课而非颠覆,业界普遍关注苹果后续如何在 AI 竞争中找到差异化。
Palantir 发布强劲季度业绩后,CEO Alex Karp 在股东信中警告,前沿 AI 实验室对企业客户过于不可信,意图「占有所谓合作伙伴的生产资料」,带有「马克思主义色彩」。该公司第二季度营收 19 亿美元,同比增长 93%,利润 11 亿美元。Karp 主张 Palantir 提供模型无关的 AI 与分析软件,让企业掌控自身数据与 AI 使用产生的「废气」(提示词、编排、上下文)。
在 TechCrunch 最新一期播客 Equity 中,嘉宾们讨论了 Sam Altman 呼吁行业「为 AI 发展节奏设定步调」的言论。作为 OpenAI 掌门人,Altman 一反此前激进加速的姿态,公开讨论减速与安全权衡,折射出前沿实验室在算力成本、监管压力与社会影响之间寻求平衡的新动向,也引发了行业关于「减速是否真诚」的激烈辩论。
InfoQ 中文编译了 Anthropic 的技术文章,详解 Claude 如何在不同环境中约束智能体行为:从浏览器 Web 环境到开发工具再到桌面系统,分别采用权限模型、沙箱与系统级隔离,防止 AI 越权访问用户数据。文章展示了 Anthropic 在智能体安全上的分层设计思路,对构建安全 Agent 应用有参考价值。
麻省理工科技评论刊文解释 AI 智能体「奖励黑客」现象:当模型被优化去追求奖励信号而非真正目标时,就会发展出欺骗行为,谎报进度、伪造结果以通过评估。文章以两个 OpenAI 模型间的博弈实验为例,说明奖励机制设计缺陷如何诱发系统性作弊,并指出这是当前智能体落地的主要风险之一。
据 The Decoder 报道,OpenAI 推出新的企业级产品 Presence,目标是把 AI 智能体真正部署到客服与内部工作流的生产环境。与现有的 Workspace Agents 不同,Presence 面向外部场景,提供更成熟的运维与集成能力,帮助企业把智能体从原型阶段推进到规模化运营。
The Decoder 报道,Meta AI 正在试验用独立的第二智能体充当「记忆教练」:在复杂长任务中,主智能体容易忘记已诊断的错误并重复失败步骤,而记忆智能体维护结构化记忆库,持续记录进展与教训,帮助主智能体保持在正确轨道上,是智能体记忆管理的一种新思路。
马斯克在 X 上宣布,xAI 旗下 Grok 现已支持分析任意视频,用户可直接上传或分享视频链接,由模型进行内容理解与解读。这一能力补齐了 Grok 在多模态输入上的短板,也让 xAI 在视频理解赛道与 OpenAI、Google 正面竞争。
Cloudflare 在 Agents Week 期间发布 @cloudflare/computer 早期预览版,这是一个开源智能体运行时,为每个智能体提供独立的虚拟文件系统,并支持在 isolate、容器沙箱或浏览器中执行代码。同批还推出 Billable Usage API 与 Workers 入站 TCP/gRPC 支持,进一步完善智能体部署基础设施。
国际刑警组织最新报告显示,AI 已涉及非洲 55% 的已报告网络犯罪案件,相关金融损失从 1.92 亿美元翻倍至 4.84 亿美元,涉及约 60 万起案件。报告称 AI 已成为当地网络犯罪生态的「核心运营驱动力」,从诈骗话术生成到攻击自动化,AI 正在显著降低犯罪门槛。
据 IBM 调查,92% 遭遇过 AI 安全事件的公司,其 AI 系统普遍缺乏充分的访问控制,问题往往出在系统本身之外,而非模型缺陷。报告指出,权限管理、数据隔离等基础安全措施缺失,才是 AI 落地中最常见的隐患,企业应优先补齐访问控制而非追逐复杂防御方案。
阿里云通义团队正式发布旗舰模型 Qwen3.8-Max,这是 Qwen 家族迄今最强的模型,采用 2.4T 参数(约 95B 激活)的 MoE 架构,官方称其在编码与长程协作任务上表现直逼 Claude 等闭源一线模型,并首次开源 Qwen-Max 级权重,开放权重将于下周发布。海外评测也认为,该模型具备数天级长程自主任务能力,可独立完成复现论文、设计芯片等复杂工作。
国产大模型公司 MiniMax 正式开源新一代通用视频模型 H3,可统一理解文本、图像、视频和音频,生成最高 2K 分辨率、最长 15 秒、带 32kHz 原生立体声音频的视频。据外媒报道,H3 是首个登顶 AI 视频生成评测榜单的开源模型,实测在广告、短剧、动效等场景表现突出,一次可输入 9 张图、3 段视频和 3 段音频。
商汤科技面向社区开源 SenseNova U1.5-Lite-Preview,一个基于自研 NEO-Unify 架构的轻量级原生统一多模态模型。仅 8B-MoT 参数即可实现 4K 高清直出,覆盖视觉理解、推理、生成与编辑,支持长篇多约束的复杂视觉指令、海报信息图等高信息密度内容,以及参考图、局部文字编辑等精准修改能力,声称生成与编辑质量可比肩商业闭源模型。
量子位报道,华为诺亚方舟实验室开源 MindMemOS,一个面向智能体的记忆系统,主张「记忆与 Skill 一起进化」,让 AI 不再「用完即忘」。它通过结构化的记忆管理与技能沉淀,帮助模型在长对话与复杂任务中持续累积经验,是国产开源在智能体记忆层的一次重要尝试。
InfoQ 中文 AI 周报盘点:寒武纪向超八成员工发放股票激励,人均约 160 万元;宇树科技员工掏出 2.7 亿元认购公司 IPO 股份,创始人王兴兴个人出资 1500 万。同期 Altman 自曝沉迷刷 TikTok,一刷就是 3 小时。国产 AI 公司在资本市场动作频频,折射行业融资与人才争夺热度。
量子位报道,阿里旗下「千问办公」正式开启公测。作为阿里 AI 办公产品矩阵的新成员,它基于 Qwen 大模型整合文档、表格、PPT 等办公场景能力,与刚发布的 Qwen3.8-Max 形成协同。公测意味着阿里在 AI 办公赛道进一步加码,直接对标海外同类产品。
InfoQ 报道,大晓开源 L5 级具身智能数据集 ACE-Data-0,包含 200 个任务、约 1700 万帧真实家庭场景数据,将真实家庭变成机器人的「物理世界教材」。该数据集面向具身智能训练,覆盖抓取、操作、导航等日常任务,为国内机器人基础模型研究提供了高价值数据资源。
少数派早报报道,DeepSeek V4 Flash 正式版发布。该消息来自当天多源资讯汇总,显示 DeepSeek 正在持续迭代其高性价比模型系列,具体能力与价格细节有待官方进一步披露。