跳到正文
10月8日周四
  1. JetBrains AI Blog71

    JetBrains 发布 Mellum2.1:面向编码智能体的 12B 开源 MoE 模型

    JetBrains 发布 Mellum2.1,这是其 6 月开源的 12B MoE 模型的下一版,架构不变,仍为 2.5B 激活参数、Apache 2.0 许可,主要改进来自后训练阶段的强化学习。

    推荐理由:JetBrains 开源 12B MoE 编码模型,给出与 Qwen3.5-9B、Gemma 4 E4B 的同口径对比和自托管入口,便于团队评估本地编码智能体选型。

10月7日周三
  1. Google DeepMind62

    Google DeepMind 发布 EmbeddingGemma 2 端侧多模态嵌入模型

    Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、740M 参数的开源多模态嵌入模型,采用 Apache 2.0 许可,可把文本、图像、音频和视频映射到统一嵌入空间。

    推荐理由:原文给出 740M 参数、量化后内存占用和 8K 上下文等具体指标,便于开发者判断端侧多模态检索能否落地。

10月1日周四
  1. Google DeepMind76

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步扩展到开发者、企业和消费者,首发面向付费 API 客户和 Google AI Ultra 订阅用户。

    推荐理由:官方给出输出上限、定价与多项基准成绩,便于团队评估它在长周期编码与知识工作流中的定位。

  2. Google · Gemini74

    Google 发布 Gemini 4 Argon 前沿模型

    Google 发布新前沿模型 Gemini 4 Argon,先通过 Fairwind Program 向受信任的网络安全防御方开放,随后逐步扩展到开发者、企业和消费者,起步价为每百万输入 token 2 美元、每百万输出 token 10 美元,缓存输入 token 按输入价的 95% 折扣计费。

    推荐理由:Gemini 4 Argon 把输出上限提到 1M token 并给出编码与安全基准成绩,可据此判断长任务与代码迁移场景的选型。

9月24日周四
9月23日周三
9月16日周三
8月11日周二
  1. Ollama Blog71

    NVIDIA Nemotron 3.5 Lightning 上线 Ollama,30B 总参数 3B 激活可本地运行

    NVIDIA Nemotron 3.5 Lightning 已在 Ollama 上线,可完全在本地设备运行,这是一个 30B 总参数、每 token 仅 3B 激活的开放模型,采用混合 MoE 架构,面向持续运行的智能体任务。

    推荐理由:想在本机跑长时智能体的团队,可据此了解这款 30B 总参数、3B 激活的 MoE 模型在吞吐和工具调用上的定位。