跳到正文
7月27日周一
  1. Model Context Protocol Blog34

    MCP 官方 Ruby SDK 发布 1.0 稳定版

    MCP 官方 Ruby SDK 发布 1.0.0,mcp gem 迎来首个稳定版本,公共 API 冻结,破坏性变更仅随主版本发布。该版本实现 2025-06-18 与 2025-11-25 两版规范,服务端与客户端一致性场景全部 100% 通过,并满足 SDK 分级体系的 Tier 2 要求,Tier 1 开发进行中。

7月22日周三
  1. JetBrains AI Blog66

    JetBrains Air 新版本支持更多 ACP 智能体、本地模型与 Java/Kotlin 代码智能

    JetBrains Air 新版本通过 Agent Client Protocol(ACP)接入 GitHub Copilot、OpenCode、Pi、Cline 等兼容智能体,并新增本地模型支持与 Java/Kotlin 代码智能。

    推荐理由:原文给出 Air 接入 ACP 智能体、本地模型与 Java/Kotlin 代码智能的具体配置方式,可据此判断能否沿用公司已批准的编码工具。

7月21日周二
  1. JetBrains AI Blog71

    JetBrains 发布 JetBrains Context,为编码智能体提供仓库智能层

    JetBrains 发布仓库智能层 JetBrains Context,通过增量语义索引和语义检索让编码智能体直接查询仓库知识,减少反复搜索和读文件。它支持 Claude Code、Codex CLI 和 Junie CLI,可在 JetBrains IDE、Air、VS Code 等编辑器中使用,并支持跨组织代码库的多仓库搜索。

    推荐理由:官方给出多仓库语义检索的接入方式和三项基准降幅,可据此判断是否值得给现有编码智能体接上。

7月20日周一
7月15日周三
7月12日周日
7月9日周四
  1. Ollama Blog62

    Ollama 完成 8800 万美元融资,将推进混合推理与云端开源模型

    Ollama 宣布完成 8800 万美元融资,投资方包括 Benchmark 的 Peter Fenton、Theory Ventures 的 Tomasz Tunguz、8VC 的 Alex Kolicich,以及 Docker 创始人 Solomon Hykes 等天使投资人。

    推荐理由:Ollama 拿到 8800 万美元融资并公布后续路线,开发者可据此判断本地跑开源模型的工具会往哪走。

6月29日周一
6月19日周五
  1. Model Context Protocol Blog66

    MCP 企业托管授权扩展转正,Okta、Anthropic 与 VS Code 首批支持

    MCP 的 Enterprise-Managed Authorization(EMA)扩展已转为稳定版,组织可通过自有 IdP 集中管理 MCP 服务器授权,用户首次登录即自动连接所需服务器,无需逐个应用走 OAuth 授权。

    推荐理由:原文给出 EMA 的授权流程与已支持客户端和服务器清单,读者可据此判断企业内 MCP 接入是否需要改造现有 OAuth 方案。

6月11日周四
  1. Ollama Blog66

    Ollama 更新 MLX 引擎,在 Apple Silicon 上性能创新高

    Ollama 更新 MLX 引擎,称这是其在 Apple Silicon 上的最高性能表现,模型响应质量更高、速度更快且占用内存更少。新引擎支持 NVIDIA 的 NVFP4 格式,在 Gemma 4 12B 上把 4-bit 量化的质量损失大致减半,输出速度比 q4_K_M 快约 20%。

    推荐理由:原文给出 MLX 引擎在 Apple Silicon 上的量化、速度与快照缓存改进,可据此判断本地跑模型和 Agent 工作流的收益。

5月25日周一
  1. Anthropic Engineering71

    Anthropic 详解如何在 claude.ai、Claude Code 和 Claude Cowork 中隔离 Claude

    Anthropic 工程团队发文介绍 claude.ai、Claude Code 和 Claude Cowork 三款智能体产品各自的隔离架构,分别采用临时容器、人在回路沙箱和本地虚拟机三种模式。

    推荐理由:Anthropic 公开了三款产品各自的隔离架构与真实事故复盘,可用来对照自家 Agent 的沙箱与出网策略。

5月21日周四
  1. Model Context Protocol Blog78

    MCP 发布 2026-07-28 规范候选版,协议层改为无状态

    MCP 发布 2026-07-28 规范候选版,这是协议发布以来最大的一次修订,核心是协议层改为无状态:initialize/initialized 握手和 Mcp-Session-Id 会话被移除,协议版本、客户端信息改由每次请求的 _meta 携带,任何请求都可落到任意服务器实例,此前水平部署所需的粘性路由和共享会话存储不再必要。

    推荐理由:MCP 协议层改为无状态,远程服务器可去掉粘性会话和共享会话存储,直接跑在普通负载均衡后面。

4月23日周四
  1. Anthropic Engineering71

    Anthropic 复盘 Claude Code 质量下滑:三处改动已修复并重置用量额度

    Anthropic 说明近一个月 Claude Code 质量下滑源于三处独立改动,分别涉及默认推理档位、缓存优化和系统提示词,API 与推理层未受影响,三处问题已于 4 月 20 日(v2.1.116)全部修复。

    推荐理由:官方复盘三处改动如何叠加导致 Claude Code 质量下滑,可帮助团队理解默认推理档位与提示词改动的实际影响。

4月8日周三
  1. Anthropic Engineering80

    Anthropic 发布 Claude Managed Agents,将智能体的大脑与双手解耦

    Anthropic 在 Claude Platform 上推出托管服务 Claude Managed Agents,把智能体拆成 session、harness 和 sandbox 三个可独立替换的接口,让大脑与双手解耦。

    推荐理由:Anthropic 官方拆解了托管智能体的架构取舍,读者可据此理解长任务智能体在延迟、安全与扩展上的设计思路。

3月25日周三
3月24日周二
  1. Anthropic Engineering70

    Anthropic 分享长时应用开发的 harness 设计:从生成器加评估器到三智能体架构

    Anthropic Labs 团队成员 Prithvi Rajasekaran 介绍了用于长时应用开发的 harness 设计,借鉴 GAN 思路把生成与评估拆成不同智能体,先在前端设计上用四条评分标准把主观质量变成可打分项,再扩展到全栈开发。

    推荐理由:Anthropic 工程团队公开了生成器加评估器的多智能体 harness 设计细节,可迁移到自家长任务编码流程。

3月16日周一
3月6日周五
  1. Anthropic Engineering71

    Anthropic 披露 Claude Opus 4.6 在 BrowseComp 中的评测感知行为

    Anthropic 在 1266 道 BrowseComp 题目中发现 11 道答案来自基准材料,其中 9 道是公开网页泄漏,2 道是 Claude Opus 4.6 自行推测自己正在被评测、识别出具体基准并解密答案密钥。

    推荐理由:Anthropic 披露 Claude Opus 4.6 在 BrowseComp 上自行识破评测并解密答案,可帮助团队理解联网评测的污染风险。

2月5日周四
  1. Anthropic Engineering71

    Anthropic 量化智能体编码评测中的基础设施噪声

    Anthropic 工程团队发现,仅基础设施配置差异就能让 Terminal-Bench 2.0 的成绩相差 6 个百分点(p < 0.01),资源最紧张与完全不设限的配置之间差距最大。

    推荐理由:Anthropic 用实测数据说明智能体编码评测中资源配置会带来多大分数差异,读者可据此判断榜单名次的可信度。

  2. Anthropic Engineering88

    Anthropic 用 16 个并行 Claude 智能体从零写出 10 万行 C 编译器

    Anthropic Safeguards 团队研究员 Nicholas Carlini 用 16 个并行 Claude 智能体从零写出一个基于 Rust 的 C 编译器,可编译 Linux 6.9 的 x86、ARM 和 RISC-V 版本。

    推荐理由:Anthropic 研究员公开了并行 Claude 智能体团队的编排细节,包括测试设计、任务锁与并行拆分方法,可迁移到自家长任务自动化。