dots3-note preview – 小红书开源的280B MoE全模态大模型

AI模型1天前更新 智小研
22 0

dots3-note preview是一款由小红书dots.studio于2026年8月14日开源的280B MoE全模态大模型(预览版),激活参数16B,主要用于Agent任务执行、长上下文处理与多模态理解,支持512K超长上下文、文本视觉语音三模态,在Terminal-Bench 2.1取得75.1分,并完成华为昇腾Day 0适配,适用于Agent任务执行、长文档与代码库理解、国产算力部署等场景。

基础信息内容
开发方小红书dots.studio
开源时间2026年8月14日(preview预览版)
架构MoE混合专家,总参数280B,激活16B
上下文窗口512K token
支持模态文本、视觉、语音(全模态)
训练方法TEMPO强化学习(长时程Agent任务)
Terminal-Bench 2.175.1分(较美国开放权重模型最高分高4.9分)
昇腾适配Atlas 800A3/900A3 Day 0(vLLM-Ascend、MTP投机解码、FUSED_MC2)
权重获取Hugging Face: dots-studio/dots3-note-prev;API: OpenRouter
产品定位面向Agent任务的开源全模态MoE预览模型
适用人群Agent应用开发者、国产算力部署团队、大模型研究者
dots3-note preview – 小红书开源的280B MoE全模态大模型

dots3-note preview核心能力与性能

名字里的”note”暗示了它的身份——预览版,正式版还在后面。但这个预览版的配置毫不含糊:280B总参数MoE架构每次只激活16B,推理成本接近16B模型;512K上下文能一次吞下整本书或大型代码库;TEMPO强化学习训练专为长时程Agent任务设计。最值得注意的是它与华为昇腾的深度绑定——Atlas 800A3/900A3集群Day 0即可跑,是国产模型+国产算力组合的标杆案例。

MoE架构:280B的容量,16B的成本

每次推理只激活16B参数,是MoE模型的核心经济账。280B总参数提供充足的知识容量,但每个token只路由到少量专家,推理显存和计算量接近一个16B密集模型。这意味着:知识面接近旗舰级,部署成本接近中型模型——对要在自有算力上跑Agent的企业,这是最实际的吸引力。

512K上下文与全模态

512K token约等于一百万汉字量级,一次能吞整部长篇小说或中大型代码库。长上下文对Agent场景尤其关键:任务执行中积累的工具返回、日志、中间结果都要挂在上下文里,窗口不够就会”失忆”。模态层面文本、视觉、语音原生打通——看截图、读文档、听语音指令可以在同一会话完成。

TEMPO强化学习与Terminal-Bench成绩

Terminal-Bench 2.1(终端任务基准,考察真实命令行环境中的任务完成能力)75.1分,比此前美国开放权重模型的最高分高出4.9分。这个成绩来自TEMPO训练法:针对长时程Agent任务做强化学习,优化的是”多步骤任务最终完成率”而非单轮问答准确率——正是Agent落地最需要的指标。数据来自dots.studio官方发布材料。

昇腾Day 0适配

开源当天即完成华为昇腾Atlas 800A3/900A3适配:vLLM-Ascend推理框架、MTP投机解码加速、FUSED_MC2算子融合全部就绪。在英伟达供应受限的背景下,”国产模型+国产算力”的完整技术栈对政企和信创场景有特殊意义,这也是dots3-note区别于其他开源MoE的鲜明标签。

dots3-note preview与同代开源模型对比

对比维度dots3-note previewMuse GlimmerQwen3.8-27B
开发方小红书dots.studioMeta阿里通义
架构MoE 280B(激活16B)dense 30Bdense 27B
上下文窗口512K131K262K
支持模态文本+视觉+语音全模态文本+视觉原生多模态
Agent专项成绩Terminal-Bench 2.1 75.1TerminalBench 51.7未公布同级数据
国产算力适配昇腾Day 0部分支持
许可证开源(预览版条款见官方仓库)Apache 2.0Apache 2.0

三者的定位差异一目了然。Muse Glimmer是消费级单卡本地Agent模型;Qwen3.8-27B(系列评测)是均衡的中型主力;dots3-note preview则以512K上下文、全模态和昇腾适配瞄准企业级Agent部署。追求对话与创作能力的用户也可以对比GLM-5.3

dots3-note preview应用场景与适用人群

  • 企业Agent平台:长时程任务执行(Terminal-Bench 75.1)+ 512K上下文,适合代码助手、运维自动化、流程托管。
  • 信创与国产算力部署:昇腾Day 0适配,政企、金融、能源等国产化要求场景可直接落地。
  • 超长文档与代码库理解:整库代码审查、长报告分析、多文档交叉引用,512K窗口一次读完。
  • 多模态研究与应用:文视音三模态统一建模,适合做跨模态检索、音视频理解的研究原型。

适合谁用:有自有算力(尤其昇腾)的企业技术团队、Agent应用开发者、大模型研究者。观望理由:preview是预览版,正式版发布在即,非急用场景可以等正式版;MoE的280B权重对下载和存储有不小压力,单机用户谨慎。

如何使用dots3-note preview

  • 权重下载:Hugging Face搜索 dots-studio/dots3-note-prev,或从国内镜像拉取。
  • API试用:已上架OpenRouter,无需本地部署即可调用体验。
  • 昇腾部署:Atlas 800A3/900A3环境使用vLLM-Ascend加载,开启MTP投机解码与FUSED_MC2获得完整性能。
  • 英伟达部署:参考仓库提供的vLLM部署指引,注意280B MoE的多卡显存需求。

dots3-note preview的项目地址

dots3-note preview开源状态与已知局限

预览版的定位要认清:能力强但版本会快速演进。正式版发布后预览权重可能不再维护,生产接入建议锚定正式版;商用条款以官方仓库最新说明为准,预览版许可证可能与正式版有差异。

局限:preview阶段文档和社区资料有限,遇到问题主要靠官方issue;多语种、对话、创作等通用能力官方未给出完整评测,主打场景是Agent和长上下文;512K满血推理对显存要求高,实际部署建议按需截断上下文;语音模态的细节能力(克隆、情感)官方材料着墨不多,相关需求建议实测。

常见问题

dots3-note preview本地部署需要什么硬件?

280B MoE需要多卡环境(激活16B但权重需整体加载),英伟达路线建议多卡A100/H100;昇腾路线Atlas 800A3/900A3已Day 0适配,用vLLM-Ascend部署并开启MTP投机解码。不想部署可直接用OpenRouter上的API。

dots3-note preview可以商用吗?

可以研究和技术评估,商用请以官方仓库最新许可条款为准。preview是预览版,正式版发布后条款可能调整,生产接入建议等正式版并通读协议。

dots3-note preview是免费的吗?

权重在Hugging Face免费开放(dots-studio/dots3-note-prev),API通过OpenRouter按量计费。本地部署本身免费,成本主要在算力。

dots3-note preview和Qwen、GLM这些国产模型比怎么样?

定位不同:dots3-note主打Agent长时程任务(Terminal-Bench 2.1达75.1)、512K超长上下文和昇腾适配;Qwen、GLM系列(如GLM-5.3)在通用对话、中文创作生态上更成熟。做Agent和国产算力部署选dots3-note,通用场景选Qwen或GLM。

512K上下文实际能干什么?

512K token约可容纳一百万汉字级别的文本,整部长篇小说、中大型代码库、数百页报告都能一次读入。对Agent场景尤其有价值——工具调用、日志、中间结果持续累积也不会”失忆”。实际使用建议按任务需要控制上下文长度以节省显存。

© 版权声明
AI工具站赚钱操作手册横幅,分享AI工具站SEO、GEO流量增长、CPS、CPA及数字产品变现经验

相关文章