跳到正文
  1. JetBrains AI Blog71

    JetBrains 发布 Mellum2.1:面向编码智能体的 12B 开源 MoE 模型

    JetBrains 发布 Mellum2.1,这是其 6 月开源的 12B MoE 模型的下一版,架构不变,仍为 2.5B 激活参数、Apache 2.0 许可,主要改进来自后训练阶段的强化学习。

    推荐理由:JetBrains 开源 12B MoE 编码模型,给出与 Qwen3.5-9B、Gemma 4 E4B 的同口径对比和自托管入口,便于团队评估本地编码智能体选型。

  2. Hugging Face Blog66

    作者用 ML Intern 在几天内自建六个模型,总花费约 103 美元

    作者在 HuggingChat 中开启 ML-intern,用提示词驱动智能体完成数据构建、训练、评测与发布,几天内做出六个模型,总计算成本约 103 美元。其中把 Qwen-Image 2.1 的 9B 提示词改写器蒸馏成 0.8B 版本,可在 CPU 上运行,输出有效率 99.7%,token 用量约为教师模型的四分之一。作者公开了七个提示词,并建议在提示中要求基线分数、冒烟测试和预算上限。

    推荐理由:作者用 ML Intern 从零训练六个小模型的完整提示词与成本清单,可迁移到自己的微调与蒸馏流程。

  1. Hugging Face Blog60

    Nemotron 微调后在 IOI 2026 与 IMO 2026 双双达到金牌水平

    NVIDIA 团队从 Nemotron 3 出发,用 SFT、RL 和反馈驱动的推理流程做出两个专家系统,在 IOI 2026 得 535.4/600、IMO 2026 得 30/42,均超过各自金牌线。

    推荐理由:原文公开了微调配方、数据集与推理流水线,读者可据此复现领域专家模型的训练与验证流程。

  2. Google DeepMind62

    Google DeepMind 发布 EmbeddingGemma 2 端侧多模态嵌入模型

    Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、740M 参数的开源多模态嵌入模型,采用 Apache 2.0 许可,可把文本、图像、音频和视频映射到统一嵌入空间。

    推荐理由:原文给出 740M 参数、量化后内存占用和 8K 上下文等具体指标,便于开发者判断端侧多模态检索能否落地。

  1. Mistral AI76

    Mistral AI 发布 Mistral Large 4 公开预览

    Mistral AI 发布 Mistral Large 4 公开预览,这是一个 1 万亿参数、52B 激活参数的原生多模态模型,权重将于本月底开放。

    推荐理由:官方给出 1 万亿参数、52B 激活的多模态模型在编码与智能体基准上的具体分数,可据此判断开源权重模型的选型空间。

  1. Ollama Blog66

    Ollama 0.35 支持 Jev 风格决策模型,新增三个本地决策模型

    Ollama 0.35 新增基于 TypeSafe Jev API 的决策模型支持,通过 /v1/systemone 端点把文本作为 state 连同多个命名问题一次性提交,由本地模型一次请求返回全部答案。

    推荐理由:Ollama 新增决策模型接口与三个可本地运行的模型,开发者可据此评估低延迟分类与路由场景的落地方式。

  1. GitHub Blog · AI & ML71

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会自动识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。

    推荐理由:GitHub 把模糊测试的 harness 编写、覆盖率追踪和崩溃分诊交给 LLM 智能体,可参考其任务流与工具分层设计。

  1. Ollama Blog71

    NVIDIA Nemotron 3.5 Lightning 上线 Ollama,30B 总参数 3B 激活可本地运行

    NVIDIA Nemotron 3.5 Lightning 已在 Ollama 上线,可完全在本地设备运行,这是一个 30B 总参数、每 token 仅 3B 激活的开放模型,采用混合 MoE 架构,面向持续运行的智能体任务。

    推荐理由:想在本机跑长时智能体的团队,可据此了解这款 30B 总参数、3B 激活的 MoE 模型在吞吐和工具调用上的定位。

  1. Model Context Protocol Blog71

    MCP 2026-07-28 规范候选版配套 Beta SDK 发布

    MCP 发布四个 Tier 1 SDK 的 beta 版本,用于测试 2026-07-28 规范候选版,Python v2 和 TypeScript v2 领衔,Go 与 C# 也提供 beta。

    推荐理由:MCP 四个 Tier 1 SDK 放出 beta,开发者可提前在真实负载上验证无状态协议改动并反馈问题。

已经到底了