dots3-note preview是一款由小红书dots.studio于2026年8月14日开源的280B MoE全模态大模型(预览版),激活参数16B,主要用于Agent任务执行、长上下文处理与多模态理解,支持512K超长上下文、文本视觉语音三模态,在Terminal-Bench 2.1取得75.1分,并完成华为昇腾Day 0适配,适用于Agent任务执行、长文档与代码库理解、国产算力部署等场景。
| 基础信息 | 内容 |
|---|---|
| 开发方 | 小红书dots.studio |
| 开源时间 | 2026年8月14日(preview预览版) |
| 架构 | MoE混合专家,总参数280B,激活16B |
| 上下文窗口 | 512K token |
| 支持模态 | 文本、视觉、语音(全模态) |
| 训练方法 | TEMPO强化学习(长时程Agent任务) |
| Terminal-Bench 2.1 | 75.1分(较美国开放权重模型最高分高4.9分) |
| 昇腾适配 | Atlas 800A3/900A3 Day 0(vLLM-Ascend、MTP投机解码、FUSED_MC2) |
| 权重获取 | Hugging Face: dots-studio/dots3-note-prev;API: OpenRouter |
| 产品定位 | 面向Agent任务的开源全模态MoE预览模型 |
| 适用人群 | Agent应用开发者、国产算力部署团队、大模型研究者 |

dots3-note preview核心能力与性能
名字里的”note”暗示了它的身份——预览版,正式版还在后面。但这个预览版的配置毫不含糊:280B总参数MoE架构每次只激活16B,推理成本接近16B模型;512K上下文能一次吞下整本书或大型代码库;TEMPO强化学习训练专为长时程Agent任务设计。最值得注意的是它与华为昇腾的深度绑定——Atlas 800A3/900A3集群Day 0即可跑,是国产模型+国产算力组合的标杆案例。
MoE架构:280B的容量,16B的成本
每次推理只激活16B参数,是MoE模型的核心经济账。280B总参数提供充足的知识容量,但每个token只路由到少量专家,推理显存和计算量接近一个16B密集模型。这意味着:知识面接近旗舰级,部署成本接近中型模型——对要在自有算力上跑Agent的企业,这是最实际的吸引力。
512K上下文与全模态
512K token约等于一百万汉字量级,一次能吞整部长篇小说或中大型代码库。长上下文对Agent场景尤其关键:任务执行中积累的工具返回、日志、中间结果都要挂在上下文里,窗口不够就会”失忆”。模态层面文本、视觉、语音原生打通——看截图、读文档、听语音指令可以在同一会话完成。
TEMPO强化学习与Terminal-Bench成绩
Terminal-Bench 2.1(终端任务基准,考察真实命令行环境中的任务完成能力)75.1分,比此前美国开放权重模型的最高分高出4.9分。这个成绩来自TEMPO训练法:针对长时程Agent任务做强化学习,优化的是”多步骤任务最终完成率”而非单轮问答准确率——正是Agent落地最需要的指标。数据来自dots.studio官方发布材料。
昇腾Day 0适配
开源当天即完成华为昇腾Atlas 800A3/900A3适配:vLLM-Ascend推理框架、MTP投机解码加速、FUSED_MC2算子融合全部就绪。在英伟达供应受限的背景下,”国产模型+国产算力”的完整技术栈对政企和信创场景有特殊意义,这也是dots3-note区别于其他开源MoE的鲜明标签。
dots3-note preview与同代开源模型对比
| 对比维度 | dots3-note preview | Muse Glimmer | Qwen3.8-27B |
|---|---|---|---|
| 开发方 | 小红书dots.studio | Meta | 阿里通义 |
| 架构 | MoE 280B(激活16B) | dense 30B | dense 27B |
| 上下文窗口 | 512K | 131K | 262K |
| 支持模态 | 文本+视觉+语音全模态 | 文本+视觉 | 原生多模态 |
| Agent专项成绩 | Terminal-Bench 2.1 75.1 | TerminalBench 51.7 | 未公布同级数据 |
| 国产算力适配 | 昇腾Day 0 | 无 | 部分支持 |
| 许可证 | 开源(预览版条款见官方仓库) | Apache 2.0 | Apache 2.0 |
三者的定位差异一目了然。Muse Glimmer是消费级单卡本地Agent模型;Qwen3.8-27B(系列评测)是均衡的中型主力;dots3-note preview则以512K上下文、全模态和昇腾适配瞄准企业级Agent部署。追求对话与创作能力的用户也可以对比GLM-5.3。
dots3-note preview应用场景与适用人群
- 企业Agent平台:长时程任务执行(Terminal-Bench 75.1)+ 512K上下文,适合代码助手、运维自动化、流程托管。
- 信创与国产算力部署:昇腾Day 0适配,政企、金融、能源等国产化要求场景可直接落地。
- 超长文档与代码库理解:整库代码审查、长报告分析、多文档交叉引用,512K窗口一次读完。
- 多模态研究与应用:文视音三模态统一建模,适合做跨模态检索、音视频理解的研究原型。
适合谁用:有自有算力(尤其昇腾)的企业技术团队、Agent应用开发者、大模型研究者。观望理由:preview是预览版,正式版发布在即,非急用场景可以等正式版;MoE的280B权重对下载和存储有不小压力,单机用户谨慎。
如何使用dots3-note preview
- 权重下载:Hugging Face搜索 dots-studio/dots3-note-prev,或从国内镜像拉取。
- API试用:已上架OpenRouter,无需本地部署即可调用体验。
- 昇腾部署:Atlas 800A3/900A3环境使用vLLM-Ascend加载,开启MTP投机解码与FUSED_MC2获得完整性能。
- 英伟达部署:参考仓库提供的vLLM部署指引,注意280B MoE的多卡显存需求。
dots3-note preview的项目地址
- 项目官网:dots3-note Preview:迈向服务真实生活的长程智能体,坚定的第一步
- GitHub仓库:https://github.com/studio-dots-ai/dots3-note-prev
- HuggingFace模型库:https://huggingface.co/dots-studio/dots3-note-prev
dots3-note preview开源状态与已知局限
预览版的定位要认清:能力强但版本会快速演进。正式版发布后预览权重可能不再维护,生产接入建议锚定正式版;商用条款以官方仓库最新说明为准,预览版许可证可能与正式版有差异。
局限:preview阶段文档和社区资料有限,遇到问题主要靠官方issue;多语种、对话、创作等通用能力官方未给出完整评测,主打场景是Agent和长上下文;512K满血推理对显存要求高,实际部署建议按需截断上下文;语音模态的细节能力(克隆、情感)官方材料着墨不多,相关需求建议实测。
常见问题
dots3-note preview本地部署需要什么硬件?
280B MoE需要多卡环境(激活16B但权重需整体加载),英伟达路线建议多卡A100/H100;昇腾路线Atlas 800A3/900A3已Day 0适配,用vLLM-Ascend部署并开启MTP投机解码。不想部署可直接用OpenRouter上的API。
dots3-note preview可以商用吗?
可以研究和技术评估,商用请以官方仓库最新许可条款为准。preview是预览版,正式版发布后条款可能调整,生产接入建议等正式版并通读协议。
dots3-note preview是免费的吗?
权重在Hugging Face免费开放(dots-studio/dots3-note-prev),API通过OpenRouter按量计费。本地部署本身免费,成本主要在算力。
dots3-note preview和Qwen、GLM这些国产模型比怎么样?
定位不同:dots3-note主打Agent长时程任务(Terminal-Bench 2.1达75.1)、512K超长上下文和昇腾适配;Qwen、GLM系列(如GLM-5.3)在通用对话、中文创作生态上更成熟。做Agent和国产算力部署选dots3-note,通用场景选Qwen或GLM。
512K上下文实际能干什么?
512K token约可容纳一百万汉字级别的文本,整部长篇小说、中大型代码库、数百页报告都能一次读入。对Agent场景尤其有价值——工具调用、日志、中间结果持续累积也不会”失忆”。实际使用建议按任务需要控制上下文长度以节省显存。
浙公网安备33010202004812号