OpenAI与Broadcom发布首款自研推理芯片Jalapeño
OpenAI联合Broadcom推出首款定制AI芯片Jalapeño,专为大语言模型推理优化。该芯片将于2026年底大规模部署,标志着OpenAI从纯软件公司向垂直整合迈进,减少对NVIDIA GPU的依赖。此举呼应了AI巨头自研芯片的趋势,预计将显著降低推理成本。
~ | 00:00 ~ 08:00
2026-06-23 ~ 2026-06-24 | 2026-06-24 00:00 ~ 2026-06-25 08:00
OpenAI联合Broadcom推出首款定制AI芯片Jalapeño,专为大语言模型推理优化。该芯片将于2026年底大规模部署,标志着OpenAI从纯软件公司向垂直整合迈进,减少对NVIDIA GPU的依赖。此举呼应了AI巨头自研芯片的趋势,预计将显著降低推理成本。
Anthropic发布Claude Tag功能,用户可在Slack频道中@Claude直接委派任务,包括写PR、查数据、分析报告等。内部已用Claude Tag生成65%代码。该功能面向Enterprise和Team用户,标志着AI从单人对话工具转向团队协作代理。
Google将Computer Use作为内置工具集成至Gemini 3.5 Flash,开发者可构建跨浏览器、移动端和桌面的AI Agent。此前该功能仅作为独立模型在Gemini 2.5中提供,此次原生整合大幅降低了Agent开发门槛,直接对标Anthropic的Computer Use和OpenAI的Operator。
Anthropic公开指控阿里巴巴使用虚假账户「提取」Claude模型能力,构成非法访问。该指控发生在中美AI竞争加剧背景下,此前已有美国立法者要求限制对华AI模型出口。Anthropic称已采取措施封堵漏洞,但事件引发对AI模型安全的广泛关注。
特朗普白宫要求Anthropic保证Claude模型完全免疫越狱攻击(jailbreak)。此前NSA因与Anthropic纠纷失去Mythos系统访问权限。Anthropic工程师认为技术上无法实现100%防越狱,Dario Amodei已被联合创始人Tom Brown取代出席白宫会议。
高通以近40亿美元收购AI芯片软件创业公司Modular,后者是AI时代最具潜力的芯片软件初创之一。Modular的MAX引擎可优化跨硬件平台的AI推理性能,收购将强化高通在数据中心AI芯片领域与NVIDIA的竞争能力。高通同时宣布Meta成为其数据中心芯片首个大客户。
Google DeepMind诺贝尔化学奖得主John Jumper(AlphaFold核心开发者)离职加盟Anthropic。Jonas Adler和Alexander Pritzel等顶级AI研究员也同期离开Google转投Anthropic。此前Noam Shazeer已离开Google,反映AI人才争夺战白热化。
Oracle在财年裁员21000人(13%员工),AI技术采用是主要原因。同时计划通过债务和股权筹集450-500亿美元用于数据中心扩张。SK Hynix超越三星成为韩国市值最高公司,HBM芯片需求激增。Cerebras上市后首份财报毛利率预期低于预期,股价暴跌。
OpenAI发布GPT-5.5 Instant新版本,改进意图识别、多轮上下文理解和约束处理能力。该模型是ChatGPT使用量最大的模型,更新后购物和本地推荐等场景更加实用连贯。付费用户已可用,免费用户次日推送。
Figma在年度大会Config 2026上发布重大更新:新增Code Layers(代码与设计并存)、Motion动画系统、3D深度层、Shader着色器效果,以及AI驱动的Generative Plugin系统。但AI推理能力依赖第三方API,引发利润空间被压缩的担忧。
AI编程工具Cursor公布首款完全自研AI模型详细情报,同时发布新Git协作平台和移动App。Cursor此前依赖第三方模型API,自研模型将增强差异化竞争力。Notion同期宣布通过Cursor SDK将编码Agent嵌入产品,用户可在文档中@Cursor自动完成PR。
Mistral AI发布OCR 4,新增边界框、块分类(标题/表格/方程式/签名)和逐页置信度分数。支持170种语言,可单容器自托管。在OlmOCRBench得分85.20,72%盲测案例中优于竞品,目标场景为RAG、Agent和企业搜索管线。
三星电子扩大员工对ChatGPT Enterprise和Codex的访问权限,覆盖技术和非技术岗位。此前三星曾因数据泄露风险限制AI工具使用,此次全面开放反映企业对AI生产力工具的管控思路从「禁用」转向「治理」。
全球最强大情报联盟「五眼」(美英加澳新)于6月22日发布紧急公开警告,AI驱动的网络攻击威胁将不再局限于企业数据中心,数月内将影响普通公众。警告指出AI降低了攻击门槛,自动化钓鱼、深度伪造和自主漏洞利用工具正在快速扩散。
人形机器人创业公司Agility Robotics计划通过SPAC上市,估值25亿美元,预计募资6.2亿美元。该公司2015年从俄勒冈州立大学分拆,旗下Digit机器人在物流仓储领域已投入商业运营。
Meta暂停其备受争议的员工AI追踪项目,此前包含私人对话和绩效数据的训练数据集在公司内部被广泛访问。Meta正在调查泄露事件,该事件引发对AI工作场所监控边界的激烈讨论。
TechCrunch报道,企业AI预算正面临「token配给制」转型。员工使用昂贵AI工具处理琐碎任务导致预算超支,「tokenmaxxing」时代结束,公司开始实施token配额和使用审计。反映了企业AI ROI核算的成熟化趋势。
NVIDIA发布企业Agent工具包,帮助公司构建可信任的专业化AI系统。工具包涵盖开放模型、技能模块和安全运行时,支持企业根据实际工作流定制AI代理,已在电信等行业取得显著投资回报。
美光科技季度利润同比增长15倍至282亿美元,营收翻四倍达414.5亿美元。HBM高带宽内存芯片需求持续旺盛,盘后股价大涨。公司预测AI驱动的存储需求将长期持续。
智谱AI的GLM-5.2在Snowflake内部103项编码任务基准测试中接近Claude Opus 4.7性能,但每输出token成本仅为其五分之一。然而GLM-5.2的token消耗量接近Opus两倍,实际性价比需综合评估。
ChatGPT网页版和App版上线双向AI语音模型Bidi 1,支持边说话边监听,用户可在对话中途打断并发起新指令。该模型与标准语音和高级语音并列,标志着语音交互从「轮流发言」进入「自然打断」模式。
UC San Diego团队提出DFlash,一种用于投机解码的轻量块扩散草稿模型。一次前向推理生成整块token,目标模型并行验证保证输出无损。相比EAGLE-3最高2.5倍加速,在NVIDIA Blackwell GPU上实现最高15倍推理吞吐量提升。
近400家美国地方报纸组成联盟,集体起诉OpenAI和微软未经许可使用其内容训练AI模型。这是继纽约时报、Ziff Davis等之后最大规模的新闻版权诉讼。People Inc. CEO同时指责Google利用搜索爬虫抓取内容训练AI是「滥用权力」。
字节跳动豆包专业版正式上线,基于豆包2.1系列大模型,面向复杂办公与生产力场景。支持Agent执行本地电脑操作、浏览器自动化、Skills技能调用和定时任务。内置Office办公套件,可生成带后端数据库的在线应用,免费用户和付费用户均可使用。
火山引擎在FORCE大会上推出面向企业智能应用的Agent Ready基础设施。架构分为AI云底座、Agent中间层和应用层。AgentKit升级提供Identity身份、Runtime运行时、Sandbox沙箱和Evaluation评估等模块,ArkClaw企业版同步升级。
通义千问推出首个原生语言世界模型Qwen-AgentWorld,覆盖MCP、Search、Terminal、SWE、Web、OS、Android七大领域。模型基于超1000万条真实交互轨迹,经CPT→SFT→RL三阶段训练,让Agent学会「先预测,再行动」。
字节技术副总裁洪定坤在FORCE大会透露:过去一年字节AI代码贡献率增长6倍,tokens消耗增长5倍。TRAE团队代码超90%由AI生成,但人均需求吞吐率仅提升60%。90%的AI代码后续需人工修改,提示AI编码工具仍有较大优化空间。
字节跳动在火山引擎FORCE大会上发布五款新AI模型,核心产品Seedance 2.5突破30秒AI视频生成长度限制,预计7月初上线。该模型在画质一致性和时间连贯性上有显著提升,直接对标Runway和Kling等国际竞品。
MiniCPM-V 4.6在Apple Core AI框架上实现高速设备端推理,以不到2B参数量级跑出令人印象深刻的多模态性能。展示了端侧AI在Apple生态中的潜力,为隐私保护的设备端AI应用开辟新可能。