383.1K 3 周前

Nemotron-3-Nano 是高效、开放且智能的智能体模型新标准,现已更新为 4B 参数模型。

工具 思考 4b 30b
ollama run nemotron-3-nano

应用

Claude Code
Claude 代码 ollama launch claude --model nemotron-3-nano
Codex
Codex ollama launch codex --model nemotron-3-nano
OpenCode
OpenCode ollama launch opencode --model nemotron-3-nano
OpenClaw
OpenClaw ollama launch openclaw --model nemotron-3-nano

自述文件

Nemotron-3-Nano

Nemotron 3 Nano 4B

ollama run nemotron-3-nano:4b

Nemotron 3 Nano 30B

ollama run nemotron-3-nano:30b

Ollama 的云服务

ollama run nemotron-3-nano:30b-cloud

什么是 Nemotron?

NVIDIA Nemotron™ 是一系列具有开放权重、训练数据和配方的开放模型,为构建专门的 AI 代理提供领先的效率和准确性。

Nemotron 3 Nano 是 NVIDIA 从头开始训练的大型语言模型 (LLM),专为推理和非推理任务设计为统一模型。它首先生成推理轨迹,然后得出最终响应来响应用户的查询和任务。模型的推理能力可以通过聊天模板中的一个标志进行配置。如果用户希望模型在没有中间推理轨迹的情况下提供最终答案,可以将其配置为这样做,尽管对于需要推理的更难提示,准确性会略有下降。相反,允许模型首先生成推理轨迹通常会产生更高质量的查询和任务的最终解决方案。

该模型采用混合专家混合 (MoE) 架构,由 23 个 Mamba-2 和 MoE 层以及 6 个注意力层组成。每个 MoE 层包括 128 个专家和一个共享专家,每个令牌激活 6 个专家。该模型具有 3.5B 个活动参数和 30B 个总参数。

支持的语言包括:英语、德语、西班牙语、法语、意大利语和日语。使用 Qwen 改进。

许可/使用条款

管理条款:本模型的使用受 NVIDIA Open Model License Agreement 的约束。