豆包 2.1、OpenAI 自研芯片、AI 记忆层和 Claude 工作流都有新进展

2026年6月25日 · 2040 字 · 5 分钟 · AI快讯 AI工具 人工智能 豆包 OpenAI AI芯片 Claude AI记忆 委内瑞拉地震

今日 AI 快讯封面

今天是 6 月 26 日 农历五月十二

今日 AI 快讯速览

1.豆包 2.1 Pro 上线办公任务模式,开始把 Agent 能力推向普通办公场景。 2.OpenAI Jalapeño(墨西哥辣椒) 首次亮相,标志着 OpenAI 把全栈能力推进到 LLM 推理芯片。 3.Engram 押注企业 AI 记忆层,让模型持续学习公司内部知识而不只是临时检索。 4.Claude 正在进入 Anthropic 工程流程,闭环验证成为 Agent 产品的关键能力。


豆包 2.1 Pro 上线办公任务模式,Agent 能力开始进入大众办公应用

6 月 24 日,豆包上线专业版,同步发布豆包 2.1 系列大模型。最核心的变化,是面向办公场景推出由 Agent 驱动的“办公任务模式”。

专业版用户可使用豆包 2.1 Pro,免费用户则接入豆包 2.1 Turbo。这个模式可以自主拆解目标、调用本地电脑、浏览器和飞书办公套件等工具,产出报告、数据分析表、PPT,甚至带后端数据库的网站。

文章还提到一个芯片设计 RTL 测试案例:豆包 2.1 Pro 连续运行近 18 小时,完成 6 个核心模块、1303 行 RTL 代码,并经历 9 轮迭代,跑通仿真、测试和综合检查等流程。

豆包日活超过 2 亿,这意味着 Agent 不再只停留在 Claude Code、Codex 这类专业工具圈层,而是开始进入更大众的办公应用入口。(来源:新智元)

这一轮竞争的看点,是谁能把“能干活”做成普通用户每天都能打开的产品。


OpenAI 发布 Jalapeño(墨西哥辣椒)推理芯片,把全栈能力推进到硬件层

OpenAI 与 Broadcom 发布了 Jalapeño(墨西哥辣椒),这是 OpenAI 首款 Intelligence Processor,也是双方多代计算平台的第一步。它不是通用训练芯片,而是从一开始就围绕现代 LLM 推理设计。

Jalapeño 面向 ChatGPT、Codex、API 和未来 Agent 产品的真实服务负载,重点优化模型推理中的内核、内存移动、网络和 serving 模式。OpenAI 称,工程样片已经在实验室以目标频率和功耗运行 ML 工作负载。

官方说法是,Jalapeño 的早期测试显示,性能/功耗将显著优于当前先进水平。OpenAI 还表示,这颗芯片从初始设计到制造流片只用了 9 个月,部分流程由 OpenAI 模型辅助加速。

Jalapeño 计划在 2026 年底前开始初步部署,并在未来几年扩大规模。它的战略意义不只是“多一颗芯片”,而是让 OpenAI 从产品、模型继续向芯片架构、内存系统、网络和部署系统延伸。(来源:OpenAI)

推理成本会直接决定 AI 产品的速度、价格和可用性,芯片开始变成模型竞争的一部分。


Engram 获 9800 万美元融资,想为企业 Agent 构建持续学习的记忆层

当许多公司还在竞争更长上下文和更复杂的 Agent 工作流时,Engram 押注的是另一个问题:AI 能不能持续从资料、对话和经验中学习。

这家公司刚刚公开亮相,并已完成 9800 万美元融资。投资方包括 General Catalyst、Kleiner Perkins、Sequoia 等,投资人与顾问名单中还包括 Andrej Karpathy 和 Pieter Abbeel。

Engram 想解决的是“模型懂互联网,却不懂你的公司”。相比每次回答前重新检索 GitHub、Slack、Notion、文档和项目记录,它希望让模型提前学习这些组织知识,并在之后的任务中自然调用。

它的首个产品是一套面向 Agent 的 API,服务于大型共享知识工作区;文章中提到,Notion、Harvey 和 Microsoft 已经进入早期合作。(来源:机器之心)

企业 AI 的瓶颈不只在模型能力,也在模型能不能真正记住组织自己的上下文。


Claude 深入 Anthropic 工程流程,闭环验证正在重塑 Agent 产品

Anthropic 团队研究产品经理 Theodora Chu 的一段演讲提到,越来越多开发者已经在日常工作中感受到 Claude 带来的效率提升。

文章中最醒目的信息是,Claude 已经进入 Anthropic 自身工程流程,“内部超过 80% 的代码由 Claude 合并”。这意味着模型不只是回答问题,而是在有反馈、验证和修正的环境里持续完成任务。

Theo Chu 将这个方向概括为“Close the Loop”,也就是给模型一种验证自身输出结果的方式。对于开发者来说,重点不只是调用模型,而是构建能让模型循环、计划和动态工作流持续运行的产品环境。

文章还提到,Anthropic 用 SWE-bench Verified 观察 Claude 编程能力提升:一年前 Sonnet 3.7 得分约 60%,到 Opus 4.8 已达到 88%。失败率下降之后,模型才更可能承担长任务和真实工作。(来源:机器之心)

模型榜单会吸引注意力,但 Agent 产品真正难的地方,是把验证和修正做进流程里。


其他大新闻

委内瑞拉发生 7.2 与 7.5 连发强震,至少 32 人遇难、700 人受伤

当地时间 6 月 24 日傍晚,委内瑞拉北部沿海地区发生两次强震。美国地质调查局称,这是一组“双震”事件:先发生 7.2 级前震,约 39 秒后发生 7.5 级主震,震中位于加勒比海沿岸 Morón 附近,距离首都加拉加斯约 168 公里,震源深度约 13 公里。

截至 6 月 25 日最新公开信息,委内瑞拉方面称至少 32 人死亡、700 人受伤。加拉加斯、La Guaira 等地出现建筑倒塌和严重受损,主国际机场 Maiquetía 受损关闭,地铁和铁路系统也一度暂停运行。

救援仍在持续,受损建筑和余震带来的二次坍塌风险仍需警惕。美国地质调查局提示,此次灾害可能造成较高伤亡和广泛破坏,实际损失仍可能随搜救推进继续上升。(来源:The Guardian)


==关注我==,每天筛选值得关注的 AI 新进展、实用工具和关键用法,帮你快速获取真正有用的前沿信息。

有帮助👉 「点赞」「转发」「小心心」

也欢迎在评论区 灵感流淌!