Kubernetes 创始人推出云端 Agent harness Mecatl
Kubernetes 创始人 Craig McLuckie 和 Joe Beda 创办的 Stacklok 推出云端 harness Mecatl,把 Agent 循环与客户端、模型供应商、状态存储和执行环境解耦,使会话管理和记忆不再以 JSONL 文件形式存在本地磁盘。
Kubernetes 创始人 Craig McLuckie 和 Joe Beda 创办的 Stacklok 推出云端 harness Mecatl,把 Agent 循环与客户端、模型供应商、状态存储和执行环境解耦,使会话管理和记忆不再以 JSONL 文件形式存在本地磁盘。
GitHub Copilot 应用中的 canvas 是一种可自定义界面,用户与智能体共享同一份状态,可做成看板、issue 分诊板、发布清单或仪表盘。创建时无需写代码或手动设计,在智能体会话中输入 /create-canvas 技能并用自然语言描述工作流、界面可做的操作和智能体可做的操作即可,生成的界面会显示在右侧面板。
GitHub Copilot 应用推出 canvas,一种运行在应用内、无浏览器外壳的全栈应用,可与 Copilot 智能体双向通信,也能调用第三方 API 并在本地执行代码。作者认为聊天框只适合未知任务,明确任务下应让智能体生成可复用工具,例如用 canvas 管理 Winget 包或操作 SQLite 数据库,避免反复消耗 token。
GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会自动识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。
推荐理由:GitHub 把模糊测试的 harness 编写、覆盖率追踪和崩溃分诊交给 LLM 智能体,可参考其任务流与工具分层设计。
Gemini 开始推送新一批 Connected Apps,用户可在 Gemini 内直接管理项目、设计创意素材和规划健身,无需切换标签页。
GitHub Podcast 最新一期拆解了五个 AI 热门观点:AI 生成的代码仍需阅读,但审查力度应按风险分级;Skills 与 MCP 解决不同问题,前者是打包的专家经验,后者是智能体连接工具与数据的标准;RAG 并未消亡,检索能让模型更接近答案、减少 token 浪费。节目还讨论了企业招聘看重的是使用 AI 的判断力,以及微调需求往往暴露的是代码库可维护性问题。
Anthropic 博客发布电商 AI 智能体解剖指南,基于与零售、旅游、电信等团队的落地合作,给出单一模型加技能、而非子智能体的架构建议。文章分三部分:架构设计上把高频指令放进系统提示词、长尾做成技能,并把 UI 组件也做成工具;性能上通过减少对话轮次、急切分发工具、提示词缓存和模型扫表测试压缩延迟与成本,缓存命中率可达 90–99%。
Cursor 支持自托管机器,让工具执行完全留在你自己的网络内,代码库、构建产物和密钥都保留在自有基础设施的内部机器上,由智能体在本地处理工具调用。My Machines 可将单台笔记本电脑或 VM 连接到账户用于个人工作流,团队池则是面向团队或企业的具名 worker 队列,容量随请求扩容、worker 断开时缩容,池不与代码仓库绑定,还可让闲置机器休眠并在重连窗口内恢复。
推荐理由:原文说明了自托管机器的池化调度与沙箱接入方式,可据此判断工具调用能否留在自有网络内。
Addy Osmani 建议每隔几周运行 Claude Code 的 /doctor 审计技能、MCP server 和 CLAUDE.md,并单独用 /memory 检查记忆,因为模型和 harness 变强后旧指令可能反而拖累效果。
Ollama 发布 Claude Desktop 支持,开发者可在 Ollama 中打开 Claude 开关,由 Ollama 自动配置第三方网关,从而在 Claude 中使用本地或云端模型。连接期间可选用 Ollama 内任意模型,关闭开关即可恢复原有 Claude 设置。官方称默认关闭遥测,并对所有模型和服务执行零数据保留政策,用户仍可在 Anthropic 模型与 Ollama 之间切换。
推荐理由:原文给出在 Claude Desktop 中接入 Ollama 的具体开关步骤,读者可据此判断本地与云端模型如何切换。
MCP 官方发布更新版路线图,覆盖下一次规范发布及之后的工作,由核心维护者与社区共同制定。路线图分为五个优先方向:Agent 消息原语、HTTP 原生传输统一与加固、Agent 身份与企业级安全、原语改进、SDK 开发体验改进。
推荐理由:官方路线图列出五个优先方向,可据此判断 MCP 后续在传输、Agent 身份和工具发现上的演进节奏。
Addy Osmani 分享了他日常并行运行 5 到 10 个智能体的 Loop Engineering 实践,并梳理 Claude Code 中 goal、loop、schedule 三类原语的用法。
JetBrains 发布 JetBrains Central CLI,把第三方终端 Agent 的请求统一走自家 AI 路由层,从而对 Claude Code、Codex 等工具施加 AI credits 形式的 token 预算。
推荐理由:JetBrains 公开了内部 AI 成本治理的完整路径,读者可参考其用 CLI 统一路由第三方 Agent 并设置 token 预算的做法。
MCP 发布 2026-07-28 规范,将协议核心从双向有状态改为请求/响应无状态,取消 initialize 握手与 Mcp-Session-Id,任何请求都可落到普通轮询负载均衡后的任意实例。
推荐理由:MCP 新版把协议核心改为无状态请求响应,开发者可据此判断现有 MCP 服务端与网关的改造量。
针对 @cellier_ 提出的通用 Agent 吃掉垂直 Agent、开放吃掉封闭、下沉吃掉傲慢三个判断,宝玉补充了自己的六点看法:通用 Agent 赛道本身也会是少数赢家通吃。
MCP 官方 Ruby SDK 发布 1.0.0,mcp gem 迎来首个稳定版本,公共 API 冻结,破坏性变更仅随主版本发布。该版本实现 2025-06-18 与 2025-11-25 两版规范,服务端与客户端一致性场景全部 100% 通过,并满足 SDK 分级体系的 Tier 2 要求,Tier 1 开发进行中。
JetBrains Air 新版本通过 Agent Client Protocol(ACP)接入 GitHub Copilot、OpenCode、Pi、Cline 等兼容智能体,并新增本地模型支持与 Java/Kotlin 代码智能。
推荐理由:原文给出 Air 接入 ACP 智能体、本地模型与 Java/Kotlin 代码智能的具体配置方式,可据此判断能否沿用公司已批准的编码工具。
MCP 发布四个 Tier 1 SDK 的 beta 版本,用于测试 2026-07-28 规范候选版,Python v2 和 TypeScript v2 领衔,Go 与 C# 也提供 beta。
推荐理由:MCP 四个 Tier 1 SDK 放出 beta,开发者可提前在真实负载上验证无状态协议改动并反馈问题。
MCP 的 Enterprise-Managed Authorization(EMA)扩展已转为稳定版,组织可通过自有 IdP 集中管理 MCP 服务器授权,用户首次登录即自动连接所需服务器,无需逐个应用走 OAuth 授权。
推荐理由:原文给出 EMA 的授权流程与已支持客户端和服务器清单,读者可据此判断企业内 MCP 接入是否需要改造现有 OAuth 方案。
Anthropic 工程团队发文介绍 claude.ai、Claude Code 和 Claude Cowork 三款智能体产品各自的隔离架构,分别采用临时容器、人在回路沙箱和本地虚拟机三种模式。
推荐理由:Anthropic 公开了三款产品各自的隔离架构与真实事故复盘,可用来对照自家 Agent 的沙箱与出网策略。
MCP 发布 2026-07-28 规范候选版,这是协议发布以来最大的一次修订,核心是协议层改为无状态:initialize/initialized 握手和 Mcp-Session-Id 会话被移除,协议版本、客户端信息改由每次请求的 _meta 携带,任何请求都可落到任意服务器实例,此前水平部署所需的粘性路由和共享会话存储不再必要。
推荐理由:MCP 协议层改为无状态,远程服务器可去掉粘性会话和共享会话存储,直接跑在普通负载均衡后面。
MCP 维护者团队迎来两项调整:AWS 高级首席工程师 Clare Liguori 加入 Core Maintainer,Anthropic 技术团队成员 Den Delimarsky 从 Core Maintainer 升任 Lead Maintainer。
MCP 工具注解自 2025-03-26 规范版本起提供 readOnlyHint、destructiveHint、idempotentHint、openWorldHint 四个布尔提示,规范明确它们不保证如实描述工具行为,客户端须默认视为不可信。