跳到正文
7月28日周二
  1. Model Context Protocol Blog88

    MCP 发布 2026-07-28 规范,协议核心转为无状态

    MCP 发布 2026-07-28 规范,将协议核心从双向有状态改为请求/响应无状态,取消 initialize 握手与 Mcp-Session-Id,任何请求都可落到普通轮询负载均衡后的任意实例。

    推荐理由:MCP 新版把协议核心改为无状态请求响应,开发者可据此判断现有 MCP 服务端与网关的改造量。

7月27日周一
  1. Model Context Protocol Blog34

    MCP 官方 Ruby SDK 发布 1.0 稳定版

    MCP 官方 Ruby SDK 发布 1.0.0,mcp gem 迎来首个稳定版本,公共 API 冻结,破坏性变更仅随主版本发布。该版本实现 2025-06-18 与 2025-11-25 两版规范,服务端与客户端一致性场景全部 100% 通过,并满足 SDK 分级体系的 Tier 2 要求,Tier 1 开发进行中。

7月21日周二
  1. JetBrains AI Blog71

    JetBrains 发布 JetBrains Context,为编码智能体提供仓库智能层

    JetBrains 发布仓库智能层 JetBrains Context,通过增量语义索引和语义检索让编码智能体直接查询仓库知识,减少反复搜索和读文件。它支持 Claude Code、Codex CLI 和 Junie CLI,可在 JetBrains IDE、Air、VS Code 等编辑器中使用,并支持跨组织代码库的多仓库搜索。

    推荐理由:官方给出多仓库语义检索的接入方式和三项基准降幅,可据此判断是否值得给现有编码智能体接上。

7月20日周一
7月15日周三
7月12日周日
7月9日周四
  1. Ollama Blog62

    Ollama 完成 8800 万美元融资,将推进混合推理与云端开源模型

    Ollama 宣布完成 8800 万美元融资,投资方包括 Benchmark 的 Peter Fenton、Theory Ventures 的 Tomasz Tunguz、8VC 的 Alex Kolicich,以及 Docker 创始人 Solomon Hykes 等天使投资人。

    推荐理由:Ollama 拿到 8800 万美元融资并公布后续路线,开发者可据此判断本地跑开源模型的工具会往哪走。

6月29日周一
6月11日周四
  1. Ollama Blog66

    Ollama 更新 MLX 引擎,在 Apple Silicon 上性能创新高

    Ollama 更新 MLX 引擎,称这是其在 Apple Silicon 上的最高性能表现,模型响应质量更高、速度更快且占用内存更少。新引擎支持 NVIDIA 的 NVFP4 格式,在 Gemma 4 12B 上把 4-bit 量化的质量损失大致减半,输出速度比 q4_K_M 快约 20%。

    推荐理由:原文给出 MLX 引擎在 Apple Silicon 上的量化、速度与快照缓存改进,可据此判断本地跑模型和 Agent 工作流的收益。

5月25日周一
  1. Anthropic Engineering71

    Anthropic 详解如何在 claude.ai、Claude Code 和 Claude Cowork 中隔离 Claude

    Anthropic 工程团队发文介绍 claude.ai、Claude Code 和 Claude Cowork 三款智能体产品各自的隔离架构,分别采用临时容器、人在回路沙箱和本地虚拟机三种模式。

    推荐理由:Anthropic 公开了三款产品各自的隔离架构与真实事故复盘,可用来对照自家 Agent 的沙箱与出网策略。

5月21日周四
  1. Model Context Protocol Blog78

    MCP 发布 2026-07-28 规范候选版,协议层改为无状态

    MCP 发布 2026-07-28 规范候选版,这是协议发布以来最大的一次修订,核心是协议层改为无状态:initialize/initialized 握手和 Mcp-Session-Id 会话被移除,协议版本、客户端信息改由每次请求的 _meta 携带,任何请求都可落到任意服务器实例,此前水平部署所需的粘性路由和共享会话存储不再必要。

    推荐理由:MCP 协议层改为无状态,远程服务器可去掉粘性会话和共享会话存储,直接跑在普通负载均衡后面。

4月23日周四
  1. Anthropic Engineering71

    Anthropic 复盘 Claude Code 质量下滑:三处改动已修复并重置用量额度

    Anthropic 说明近一个月 Claude Code 质量下滑源于三处独立改动,分别涉及默认推理档位、缓存优化和系统提示词,API 与推理层未受影响,三处问题已于 4 月 20 日(v2.1.116)全部修复。

    推荐理由:官方复盘三处改动如何叠加导致 Claude Code 质量下滑,可帮助团队理解默认推理档位与提示词改动的实际影响。

4月8日周三
  1. Anthropic Engineering80

    Anthropic 发布 Claude Managed Agents,将智能体的大脑与双手解耦

    Anthropic 在 Claude Platform 上推出托管服务 Claude Managed Agents,把智能体拆成 session、harness 和 sandbox 三个可独立替换的接口,让大脑与双手解耦。

    推荐理由:Anthropic 官方拆解了托管智能体的架构取舍,读者可据此理解长任务智能体在延迟、安全与扩展上的设计思路。

3月24日周二
  1. Anthropic Engineering70

    Anthropic 分享长时应用开发的 harness 设计:从生成器加评估器到三智能体架构

    Anthropic Labs 团队成员 Prithvi Rajasekaran 介绍了用于长时应用开发的 harness 设计,借鉴 GAN 思路把生成与评估拆成不同智能体,先在前端设计上用四条评分标准把主观质量变成可打分项,再扩展到全栈开发。

    推荐理由:Anthropic 工程团队公开了生成器加评估器的多智能体 harness 设计细节,可迁移到自家长任务编码流程。

2月5日周四
  1. Anthropic Engineering71

    Anthropic 量化智能体编码评测中的基础设施噪声

    Anthropic 工程团队发现,仅基础设施配置差异就能让 Terminal-Bench 2.0 的成绩相差 6 个百分点(p < 0.01),资源最紧张与完全不设限的配置之间差距最大。

    推荐理由:Anthropic 用实测数据说明智能体编码评测中资源配置会带来多大分数差异,读者可据此判断榜单名次的可信度。