跳到正文

技术方向

开源生态 最新动态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

14 条精选近 30 天 6 条共收录 30 条

更新

开源生态的精选

10月8日周四第 1–14 条
  1. JetBrains AI Blog71

    JetBrains 发布 Mellum2.1:面向编码智能体的 12B 开源 MoE 模型

    JetBrains 发布 Mellum2.1,这是其 6 月开源的 12B MoE 模型的下一版,架构不变,仍为 2.5B 激活参数、Apache 2.0 许可,主要改进来自后训练阶段的强化学习。

    推荐理由:JetBrains 开源 12B MoE 编码模型,给出与 Qwen3.5-9B、Gemma 4 E4B 的同口径对比和自托管入口,便于团队评估本地编码智能体选型。

10月7日周三
  1. Google DeepMind62

    Google DeepMind 发布 EmbeddingGemma 2 端侧多模态嵌入模型

    Google DeepMind 发布 EmbeddingGemma 2,一个基于 Gemma 4 架构、740M 参数的开源多模态嵌入模型,采用 Apache 2.0 许可,可把文本、图像、音频和视频映射到统一嵌入空间。

    推荐理由:原文给出 740M 参数、量化后内存占用和 8K 上下文等具体指标,便于开发者判断端侧多模态检索能否落地。

9月29日周二
  1. Ollama Blog66

    Ollama 0.35 支持 Jev 风格决策模型,新增三个本地决策模型

    Ollama 0.35 新增基于 TypeSafe Jev API 的决策模型支持,通过 /v1/systemone 端点把文本作为 state 连同多个命名问题一次性提交,由本地模型一次请求返回全部答案。

    推荐理由:Ollama 新增决策模型接口与三个可本地运行的模型,开发者可据此评估低延迟分类与路由场景的落地方式。

9月25日周五
  1. GitHub Blog · AI & ML71

    GitHub Security Lab 发布 Fuzzing Taskflow 智能体

    GitHub Security Lab 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的自主模糊测试流水线,只需指向一个 GitHub 仓库,它就会自动识别入口点、分析构建系统、编写 harness、运行 AFL++、读取覆盖率报告并改进 harness,最后对每个崩溃做分诊并生成漏洞报告。

    推荐理由:GitHub 把模糊测试的 harness 编写、覆盖率追踪和崩溃分诊交给 LLM 智能体,可参考其任务流与工具分层设计。

9月17日周四
  1. JetBrains AI Blog66

    JetBrains 分享语义代码搜索 RAG 流水线:解析、分块与向量化

    JetBrains 撰文分享其为 Air Context 构建语义代码搜索 RAG 流水线的第一阶段经验,覆盖解析、分块与向量化。其结构感知分块支持 Kotlin、Java、Python、JavaScript、TypeScript、C#、PHP、Go 和 Rust 九种语言,其他语言回退到按行切分。

    推荐理由:JetBrains 公开了语义代码搜索 RAG 流水线的解析、分块与向量化细节,含二进制量化的取舍经验。

8月31日周一
  1. Ollama Blog60

    Ollama 云服务改用按 token 透明计费并上线 Team 计划

    Ollama 的 Pro、Max、Team 计划改为按 token 透明计费,每档包含每月用量额度:Pro 每月 20 美元含 60 美元用量,Max 每月 100 美元含 300 美元用量,Team 每月 500 美元含 1000 美元共享用量且不限用户数。

    推荐理由:Ollama 云服务改为按 token 计费并公布各档价格,团队可据此估算用开源模型跑编码智能体的成本。

8月25日周二
  1. Ollama Blog60

    Ollama 支持将 Claude Desktop 配置为第三方网关

    Ollama 发布 Claude Desktop 支持,开发者可在 Ollama 中打开 Claude 开关,由 Ollama 自动配置第三方网关,从而在 Claude 中使用本地或云端模型。连接期间可选用 Ollama 内任意模型,关闭开关即可恢复原有 Claude 设置。官方称默认关闭遥测,并对所有模型和服务执行零数据保留政策,用户仍可在 Anthropic 模型与 Ollama 之间切换。

    推荐理由:原文给出在 Claude Desktop 中接入 Ollama 的具体开关步骤,读者可据此判断本地与云端模型如何切换。

8月11日周二
  1. Ollama Blog71

    NVIDIA Nemotron 3.5 Lightning 上线 Ollama,30B 总参数 3B 激活可本地运行

    NVIDIA Nemotron 3.5 Lightning 已在 Ollama 上线,可完全在本地设备运行,这是一个 30B 总参数、每 token 仅 3B 激活的开放模型,采用混合 MoE 架构,面向持续运行的智能体任务。

    推荐理由:想在本机跑长时智能体的团队,可据此了解这款 30B 总参数、3B 激活的 MoE 模型在吞吐和工具调用上的定位。

7月28日周二
  1. Model Context Protocol Blog88

    MCP 发布 2026-07-28 规范,协议核心转为无状态

    MCP 发布 2026-07-28 规范,将协议核心从双向有状态改为请求/响应无状态,取消 initialize 握手与 Mcp-Session-Id,任何请求都可落到普通轮询负载均衡后的任意实例。

    推荐理由:MCP 新版把协议核心改为无状态请求响应,开发者可据此判断现有 MCP 服务端与网关的改造量。

7月9日周四
  1. Ollama Blog62

    Ollama 完成 8800 万美元融资,将推进混合推理与云端开源模型

    Ollama 宣布完成 8800 万美元融资,投资方包括 Benchmark 的 Peter Fenton、Theory Ventures 的 Tomasz Tunguz、8VC 的 Alex Kolicich,以及 Docker 创始人 Solomon Hykes 等天使投资人。

    推荐理由:Ollama 拿到 8800 万美元融资并公布后续路线,开发者可据此判断本地跑开源模型的工具会往哪走。

6月29日周一
5月21日周四
  1. Model Context Protocol Blog78

    MCP 发布 2026-07-28 规范候选版,协议层改为无状态

    MCP 发布 2026-07-28 规范候选版,这是协议发布以来最大的一次修订,核心是协议层改为无状态:initialize/initialized 握手和 Mcp-Session-Id 会话被移除,协议版本、客户端信息改由每次请求的 _meta 携带,任何请求都可落到任意服务器实例,此前水平部署所需的粘性路由和共享会话存储不再必要。

    推荐理由:MCP 协议层改为无状态,远程服务器可去掉粘性会话和共享会话存储,直接跑在普通负载均衡后面。