AI 资讯聚合 · 智能体

创智学院联盟发 Nex-N2.5:Max 用 1.6T 的 DeepSeek 基座做完整后训练

国内智能体开源创智学院Nex AGI · 2026-09-08 · 约1分钟 · 来源:Nex AGI 官方站 + Hugging Face 模型仓库(createdAt 2026-09-08)
创智学院联盟发 Nex-N2.5:Max 用 1.6T 的 DeepSeek 基座做完整后训练

Nex AGI(由上海创智学院发起的创新联盟)发布 Nex-N2.5 智能体模型系列:Mini 基于 Qwen3.5-35B-A3B、Pro 基于 Qwen3.5-397B-A17B,两者权重已在 Hugging Face 与 ModelScope 开放;Max 基于 DeepSeek-V4-Pro-Base 的 1.6 万亿参数 MoE 纯文本架构,官方称这是首次在万亿参数规模上开展完整后训练,并配套放出面向 Pro 的单请求推理引擎 NexRT(8 张 H100 或 H200 上跑普通解码、MTP 与 DFlash)。

值得记的是底座选择:Mini/Pro 用 Qwen、Max 用 DeepSeek。国产开源权重正在成为下游做智能体模型的事实底座——这与 Cognition 拿 Kimi K3 后训练出 SWE-2 是同一个走向,只是这次发生在国内联盟内部,且是万亿参数档。

原文链接:Nex AGI 官方站 + Hugging Face 模型仓库(createdAt 2026-09-08)