跳到正文

技术方向

部署工程 最新动态

把模型跑起来的工程实践:推理优化、显存与成本、Serving 架构与基础设施选型。

26 条精选近 30 天 7 条共收录 56 条

更新

精选归档 · 第 2 页

5月25日周一第 21–26 条
  1. Anthropic Engineering71

    Anthropic 详解如何在 claude.ai、Claude Code 和 Claude Cowork 中隔离 Claude

    Anthropic 工程团队发文介绍 claude.ai、Claude Code 和 Claude Cowork 三款智能体产品各自的隔离架构,分别采用临时容器、人在回路沙箱和本地虚拟机三种模式。

    推荐理由:Anthropic 公开了三款产品各自的隔离架构与真实事故复盘,可用来对照自家 Agent 的沙箱与出网策略。

5月21日周四
  1. Model Context Protocol Blog78

    MCP 发布 2026-07-28 规范候选版,协议层改为无状态

    MCP 发布 2026-07-28 规范候选版,这是协议发布以来最大的一次修订,核心是协议层改为无状态:initialize/initialized 握手和 Mcp-Session-Id 会话被移除,协议版本、客户端信息改由每次请求的 _meta 携带,任何请求都可落到任意服务器实例,此前水平部署所需的粘性路由和共享会话存储不再必要。

    推荐理由:MCP 协议层改为无状态,远程服务器可去掉粘性会话和共享会话存储,直接跑在普通负载均衡后面。

4月23日周四
  1. Anthropic Engineering71

    Anthropic 复盘 Claude Code 质量下滑:三处改动已修复并重置用量额度

    Anthropic 说明近一个月 Claude Code 质量下滑源于三处独立改动,分别涉及默认推理档位、缓存优化和系统提示词,API 与推理层未受影响,三处问题已于 4 月 20 日(v2.1.116)全部修复。

    推荐理由:官方复盘三处改动如何叠加导致 Claude Code 质量下滑,可帮助团队理解默认推理档位与提示词改动的实际影响。

4月8日周三
  1. Anthropic Engineering80

    Anthropic 发布 Claude Managed Agents,将智能体的大脑与双手解耦

    Anthropic 在 Claude Platform 上推出托管服务 Claude Managed Agents,把智能体拆成 session、harness 和 sandbox 三个可独立替换的接口,让大脑与双手解耦。

    推荐理由:Anthropic 官方拆解了托管智能体的架构取舍,读者可据此理解长任务智能体在延迟、安全与扩展上的设计思路。

3月24日周二
  1. Anthropic Engineering70

    Anthropic 分享长时应用开发的 harness 设计:从生成器加评估器到三智能体架构

    Anthropic Labs 团队成员 Prithvi Rajasekaran 介绍了用于长时应用开发的 harness 设计,借鉴 GAN 思路把生成与评估拆成不同智能体,先在前端设计上用四条评分标准把主观质量变成可打分项,再扩展到全栈开发。

    推荐理由:Anthropic 工程团队公开了生成器加评估器的多智能体 harness 设计细节,可迁移到自家长任务编码流程。

2月5日周四
  1. Anthropic Engineering71

    Anthropic 量化智能体编码评测中的基础设施噪声

    Anthropic 工程团队发现,仅基础设施配置差异就能让 Terminal-Bench 2.0 的成绩相差 6 个百分点(p < 0.01),资源最紧张与完全不设限的配置之间差距最大。

    推荐理由:Anthropic 用实测数据说明智能体编码评测中资源配置会带来多大分数差异,读者可据此判断榜单名次的可信度。