跳到正文
今天10月10日周六3 条
10月9日周五
10月8日周四
  1. JetBrains AI Blog71

    JetBrains 发布 Mellum2.1:面向编码智能体的 12B 开源 MoE 模型

    JetBrains 发布 Mellum2.1,这是其 6 月开源的 12B MoE 模型的下一版,架构不变,仍为 2.5B 激活参数、Apache 2.0 许可,主要改进来自后训练阶段的强化学习。

    推荐理由:JetBrains 开源 12B MoE 编码模型,给出与 Qwen3.5-9B、Gemma 4 E4B 的同口径对比和自托管入口,便于团队评估本地编码智能体选型。

  2. GitHub Blog · AI & ML60

    GitHub 推出基于 ModernBERT 的通用密钥检测模型,扩展推送保护

    GitHub 发布与 Microsoft Applied Sciences 联合微调的分类器,用代码上下文识别无固定格式的密钥,可在 2 毫秒内评估一批候选密钥,据称能把可拦截的密钥数量提升一倍以上。

    推荐理由:GitHub 公开了密钥扫描的九季度数据和新分类器,读者可据此判断推送前拦截能力与 AI credits 成本。

  3. The Pragmatic Engineer32

    Sam Newman 谈构建弹性分布式系统:微服务是"最后手段"

    Sam Newman 在新书《Building Resilient Distributed Systems》中提出分布式系统三原则:信息传输需要时间、资源可能离线、资源终会耗尽,并指出多数故障源于资源池耗尽。他认为微服务应被视作"最后手段",其核心是独立可部署与业务边界清晰,同时强调可观测性及根据业务场景决定 fail open 还是 fail closed。该书于 10 月 7 日出版。

  4. GitHub Changelog60

    GitHub 推出专用模型检测泄露密钥,覆盖推送保护与 Copilot 安全审查

    GitHub 发布专用于泄露密钥检测的微调模型,可读取上下文代码识别无固定格式的密码等凭据,且不生成代码或文本。现有 AI 检测密码告警已自动升级到新模型,推送保护中的 AI 密钥检测进入私有预览,Copilot CLI 与 Copilot App 的 /security-review 命令也将加入该检测。

    推荐理由:GitHub 把微调后的密钥检测模型接入推送保护和 Copilot 安全审查,开发者可据此判断是否开启并预估 AI Credits 消耗。

10月7日周三
10月6日周二
10月1日周四
  1. JetBrains AI Blog71

    JetBrains 在 IDE 中开启 Air 智能体体验 EAP

    JetBrains 为 IDE 推出 Air 智能体开发体验的 Early Access Program,现已作为插件上线 JetBrains Marketplace,或内置于 JetBrains IDE 的 2026.3 EAP 版本。

    推荐理由:JetBrains 把多智能体并行会话做进 IDE,并支持接入已有订阅,读者可据此判断现有编码工作流是否值得迁移。

9月29日周二
  1. Ollama Blog66

    Ollama 0.35 支持 Jev 风格决策模型,新增三个本地决策模型

    Ollama 0.35 新增基于 TypeSafe Jev API 的决策模型支持,通过 /v1/systemone 端点把文本作为 state 连同多个命名问题一次性提交,由本地模型一次请求返回全部答案。

    推荐理由:Ollama 新增决策模型接口与三个可本地运行的模型,开发者可据此评估低延迟分类与路由场景的落地方式。

9月24日周四
  1. GitHub Blog · AI & ML28

    GitHub Copilot 应用如何渲染超大 pull request

    GitHub Copilot 应用重建了 pull request 视图,用一个包含 2,200 个文件、超 100 万行改动和 400 多条行内评论的开源 PR 做压力测试。其做法是把文档高度拆成确定性的代码几何与动态评论块几何两部分,评论高度按需惰性测量,修正幅度小且锚定在用户当前浏览位置。

9月23日周三
  1. Cursor Changelog71

    Cursor 推出 Rollouts 与 Security Review 两个 bot

    Cursor 推出 Rollouts 和 Security Review 两个 bot,均已在团队版和企业版上线。Rollouts 会为每个 PR 附加监控项,读取 diff 生成监控规划,并在部署事件触发后基于日志、指标和链路追踪按环境报告变更健康状态,检测到回归时可创建回滚 PR 或交给云端智能体修复,目前不会自行合并或回滚。

    推荐理由:官方说明了两个 bot 的监控与审查流程和启用方式,可据此判断是否接入现有 PR 与部署链路。

9月17日周四
  1. JetBrains AI Blog66

    JetBrains 分享语义代码搜索 RAG 流水线:解析、分块与向量化

    JetBrains 撰文分享其为 Air Context 构建语义代码搜索 RAG 流水线的第一阶段经验,覆盖解析、分块与向量化。其结构感知分块支持 Kotlin、Java、Python、JavaScript、TypeScript、C#、PHP、Go 和 Rust 九种语言,其他语言回退到按行切分。

    推荐理由:JetBrains 公开了语义代码搜索 RAG 流水线的解析、分块与向量化细节,含二进制量化的取舍经验。

9月14日周一
  1. Addy Osmani71

    Addy Osmani 谈在遗留代码库中引入智能体工程

    Addy Osmani 撰文讨论在遗留(brownfield)代码库中引入智能体工程的做法,核心是把隐藏约束显性化,让廉价改动变得可信。他提出按绿、黄、红三区划分代码库,绿区可让智能体在紧循环中自主迭代,黄区需先写特征测试,红区涉及认证、计费、权限等敏感逻辑必须人工逐步配对;并强调迁移应以完整单元收尾、删除旧路径,否则智能体面对矛盾先例会出错。

9月10日周四
  1. Cursor Changelog78

    Cursor 推出项目功能,用协调智能体承接长期任务

    Cursor 推出「项目」功能,用于承接一项功能、一次迁移或完整应用这类长达数月的工作,目前处于 beta 阶段并逐步向所有用户开放。项目中的协调智能体不写代码,负责规划并把任务委派给具体实现的智能体,可按需并行运行任意多个智能体,并在云端独立计算机上运行。每个项目维护一组文件,在云端和本地机器间同步共享上下文,还可监听 Slack 频道、按计划运行或跟踪 PR 以主动触发工作。

    推荐理由:原文说明了项目如何用协调智能体与共享上下文承接长期任务,可据此判断多智能体协作的适用边界。

9月2日周三
  1. 宝玉66

    Anthropic 博客:高效电商 AI 智能体的架构、延迟优化与生产实践指南

    Anthropic 博客发布电商 AI 智能体解剖指南,基于与零售、旅游、电信等团队的落地合作,给出单一模型加技能、而非子智能体的架构建议。文章分三部分:架构设计上把高频指令放进系统提示词、长尾做成技能,并把 UI 组件也做成工具;性能上通过减少对话轮次、急切分发工具、提示词缓存和模型扫表测试压缩延迟与成本,缓存命中率可达 90–99%。

  2. Cursor Changelog67

    Cursor 推出自托管机器,工具调用可留在自有网络

    Cursor 支持自托管机器,让工具执行完全留在你自己的网络内,代码库、构建产物和密钥都保留在自有基础设施的内部机器上,由智能体在本地处理工具调用。My Machines 可将单台笔记本电脑或 VM 连接到账户用于个人工作流,团队池则是面向团队或企业的具名 worker 队列,容量随请求扩容、worker 断开时缩容,池不与代码仓库绑定,还可让闲置机器休眠并在重连窗口内恢复。

    推荐理由:原文说明了自托管机器的池化调度与沙箱接入方式,可据此判断工具调用能否留在自有网络内。

8月31日周一
  1. 宝玉58

    宝玉:AI 原生思维,像训练大模型一样训练自己

    AI 博主宝玉在腾讯内部以自己做了三年的字幕翻译 App 为主线,分享 AI 产品从找需求、判边界、最小验证、重设计到落地交付的完整过程。他提出找需求要盯模型能力边界线,评估需求看能力、成本、价值三条边界,并以一次真实优化为例把调用从 33 次降到 12 次、单集处理从 31 分钟降到 18 分钟。

  2. Ollama Blog60

    Ollama 云服务改用按 token 透明计费并上线 Team 计划

    Ollama 的 Pro、Max、Team 计划改为按 token 透明计费,每档包含每月用量额度:Pro 每月 20 美元含 60 美元用量,Max 每月 100 美元含 300 美元用量,Team 每月 500 美元含 1000 美元共享用量且不限用户数。

    推荐理由:Ollama 云服务改为按 token 计费并公布各档价格,团队可据此估算用开源模型跑编码智能体的成本。

8月27日周四
  1. Cursor Changelog60

    Cursor 云端智能体支持无需代码仓库从零开始

    Cursor 云端智能体不再需要连接 GitHub 或其他第三方 SCM 提供商即可开始使用,用户可直接输入提示,Cursor 会在后台创建 Origin 代码仓库。满意后点击创建代码仓库按钮,可自定义名称并将可见性设为私有或内部。此外,Cursor 支持将云端智能体实时环境通过端口转发在浏览器中预览,连接 Vercel 账户后点击发布即可生成可访问 URL。

    推荐理由:云端智能体不再依赖 GitHub 即可起步,读者可据此判断无仓库场景下的原型开发流程变化。

8月25日周二
  1. Ollama Blog60

    Ollama 支持将 Claude Desktop 配置为第三方网关

    Ollama 发布 Claude Desktop 支持,开发者可在 Ollama 中打开 Claude 开关,由 Ollama 自动配置第三方网关,从而在 Claude 中使用本地或云端模型。连接期间可选用 Ollama 内任意模型,关闭开关即可恢复原有 Claude 设置。官方称默认关闭遥测,并对所有模型和服务执行零数据保留政策,用户仍可在 Anthropic 模型与 Ollama 之间切换。

    推荐理由:原文给出在 Claude Desktop 中接入 Ollama 的具体开关步骤,读者可据此判断本地与云端模型如何切换。

8月24日周一
  1. 宝玉62

    我的 AI 原生开发流程:一个真实案例的完整复盘

    宝玉以给字幕转录翻译 App BaoCut 添加远程转录功能为例,复盘了 AI 原生开发的完整流程:可行性分析、设计文档、高精度原型设计、编码实现、测试验证。核心结论是流程没变但执行主体从人变成 Agent,人只在关键路径做确认和决策,文档成为人和 Agent 之间以及 Agent Session 之间传递上下文的核心媒介。

8月22日周六
  1. Model Context Protocol Blog62

    MCP 发布新版路线图,列出五个优先方向

    MCP 官方发布更新版路线图,覆盖下一次规范发布及之后的工作,由核心维护者与社区共同制定。路线图分为五个优先方向:Agent 消息原语、HTTP 原生传输统一与加固、Agent 身份与企业级安全、原语改进、SDK 开发体验改进。

    推荐理由:官方路线图列出五个优先方向,可据此判断 MCP 后续在传输、Agent 身份和工具发现上的演进节奏。

8月21日周五
8月20日周四
  1. JetBrains AI Blog41

    JetBrains Air 新增多项目视图、Markdown 编辑器与 Windows IME 支持

    JetBrains Air 新增多项目视图,可在同一窗口打开多个项目并并行运行多个智能体,侧边栏按项目分组任务。Markdown 文件现以格式化文本渲染,无需分屏预览,语法在阅读时隐去、编辑时显示。Windows 上的中文、日文、韩文等 IME 输入问题已修复,该版本还新增首次启动的 Customize 界面和可选择智能体与模型的 Agent Review。

8月14日周五
8月8日周六
8月3日周一
  1. JetBrains AI Blog62

    JetBrains 推出 Central CLI,统一管控第三方 AI 工具开销

    JetBrains 发布 JetBrains Central CLI,把第三方终端 Agent 的请求统一走自家 AI 路由层,从而对 Claude Code、Codex 等工具施加 AI credits 形式的 token 预算。

    推荐理由:JetBrains 公开了内部 AI 成本治理的完整路径,读者可参考其用 CLI 统一路由第三方 Agent 并设置 token 预算的做法。

7月28日周二