小红书开源 dots3-note preview,重要的可能并不只是又发布了一个大模型,而是它正在尝试改变AI在平台中的位置:从服务搜索、排序和推荐的产品功能,走向能够支撑内容理解、智能助手,以及未来创作者和商业流程的通用智能层。
这并不意味着dots3-note preview已经成为新的通用模型王者。更稳妥的判断是,小红书希望打造一个足够适配自身内容和用户路径、具备部署效率,同时又能通过开放获得外部测试与工具支持的模型。
dots3-note preview是什么?
dots3-note preview是小红书dots3系列首个公开模型。它采用混合专家架构(Mixture-of-Experts,MoE),总参数量为2800亿,但每个token只激活160亿参数;模型支持最长512K token上下文,能够接收文本、图像、视频和音频输入,并生成文本输出。
2
4
9
总参数和激活参数的区别很关键。MoE模型可以拥有一组规模庞大的专业化权重,但不必在处理每个token时调用全部参数。对小红书而言,这意味着它既能追求更广泛的能力,又有机会避免每次推理都承担“2800亿参数全部运行”的成本。
公开介绍还将该模型定位于复杂推理和长程智能体任务,强调多轮搜索与跨阶段任务执行,而不仅是简单问答。
1
2这与小红书以笔记、图片、视频、测评和消费决策为核心的内容生态存在较强契合。
为什么这种架构适合小红书?
一个典型的生活决策,往往不是输入关键词后返回一条结果那么简单。用户可能需要比较目的地,判断商品,理解图片中的实际效果,权衡社区经验,最后再做出选择。
具备多模态输入和512K上下文窗口的模型,理论上可以在同一工作上下文中保留更多相关证据,从而支持一条类似这样的路径:
- 找到相关笔记或商品;
- 比较不同说法、图片和用户体验;
- 总结其中的取舍;
- 帮助用户继续采取行动。
这只是基于模型公开能力和评测目标作出的推断,并不代表小红书已经把上述每一步都做成了面向用户的功能。真正值得关注的是AI的目标范围正在扩大:它不再只是负责内容排序或推荐,而是试图连接“发现—理解—行动”这一整段用户旅程。
dots3系列透露出基础设施思路
dots3-note preview这一命名,也显示出小红书并非只想做一次性模型实验。小红书已介绍计划中的其他版本,包括jazz和aria,整个系列将覆盖能力、延迟和成本之间的不同取舍。
1
8
对于大型消费平台而言,这种模型家族更具实际意义:速度更快、成本更低的版本可以处理高频互动;能力更强的版本则用于复杂推理、多模态分析和长时间运行的智能体任务。
换句话说,小红书不必让所有任务都调用同一个重量级模型,而是可以根据产品需求和单位经济性匹配不同模型。这次发布的重点,与其说是“把一个模型放到所有地方”,不如说是搭建一套可复用的内部AI平台。
为什么选择Apache 2.0开源?
小红书以宽松的 Apache 2.0 许可发布该模型,并将其上线至Hugging Face和GitHub。
2
3
9在遵守许可条款的前提下,研究人员和开发者可以更方便地检查、运行、修改模型,并将其用于商业集成。
对小红书来说,开放带来的价值既包括声誉,也包括工程上的现实收益:
- **获得外部评测:**独立用户能够在真实工作负载中测试模型,发现内部基准可能遗漏的失效模式;
- **收集部署反馈:**开发者可以暴露性能瓶颈,并推动模型与推理框架、硬件之间的适配;
- **扩大生态影响力:**微调版本、工具和应用可以把模型带到小红书自身产品之外;
- **增强招聘与行业可信度:**研究人员有了可直接评估和构建的公开对象。
公开仓库和模型资料还提供了部署路径与检查点选项,因此这次发布更像一次可操作的工程交付,而不只是研究公告。
3
4
不过,开放权重并不会自动证明模型的质量、安全性或生产就绪程度。它只是让外部人员更容易检验这些属性。对于仍处于preview阶段的模型,公开评测应被视为能力证据,而不是完整、独立的最终结论。
同日支持华为昇腾,意味着什么?
此次发布还包括对华为昇腾硬件的同步适配。
1
15这说明硬件可移植性可能是小红书战略的一部分,而非发布后的补充工作。
对一家中国内容平台而言,支持不止一种加速器生态,有助于提升部署灵活性、供应链韧性,以及在国内硬件或本地化环境中运行的可行性。它本身并不能证明模型比竞争系统更强,但说明小红书已经在考虑模型将在哪里运行、哪些开发者和企业能够采用它。
第三方模型已经很多,小红书为何还要自研?
第三方模型可以提供强大的通用能力,但小红书拥有通用模型供应商无法完全控制的独特资产:自身的多模态内容、用户搜索和收藏行为、创作者社区形成的表达规范,以及与生活方式相关的具体决策场景。
掌握模型层,可能让小红书更好地控制以下环节:
- 模型如何适配平台内容和专属术语;
- 在超大查询规模下的推理成本;
- 响应延迟和产品迭代速度;
- 隐私与安全策略;
- 对外部供应商价格、可用性和产品路线图的依赖。
此外,小红书还拥有直接的分发入口。相关报道将其月活用户规模描述为超过3亿,为模型家族的测试和产品集成提供了庞大环境。
1
15这并不保证商业回报,但战略逻辑很清晰:如果AI逐渐成为用户发现生活信息并采取行动的主要界面,同时掌握内容生态和智能层的平台,可能更有机会留住由此产生的价值。
它如何融入中国的平台模型竞争?
小红书的动作符合一个更大的趋势:主要中国科技平台正在把基础模型与消费产品、云服务和硬件生态结合起来。字节跳动已发展豆包系列,阿里巴巴打造了Qwen(通义千问),路透社也记录了中国AI企业围绕低成本模型和开放策略展开的竞争。
17
18
19
IDC对中国基础模型格局的概览,同样列出了阿里巴巴、百度、字节跳动、腾讯等大型科技公司的模型布局。
21这些公司的共同逻辑是纵向整合:自有模型能够比外部API更紧密地连接企业数据、分发渠道、基础设施和开发者生态。
小红书的差异化切入点,在于生活方式内容和由内容驱动的决策。阿里巴巴更依托电商与云服务,百度具有搜索和企业服务基因,字节跳动拥有庞大的消费级分发渠道及自身模型体系,腾讯则坐拥大型社交和平台生态。具体产品与能力各有不同,但方向趋于一致:基础模型正从可选的应用功能,变成平台级核心基础设施。
真正值得关注的信号
dots3-note preview不需要击败所有领先前沿模型,才具备战略意义。它的价值在于多项选择的组合:大规模参数、稀疏激活、超长上下文、多模态理解、开放许可,以及对不同硬件的适配。
这些选择共同表明,小红书正在争取掌握未来产品之下的那一层。公司押注的是这样一种用户界面:用户不再只是搜索生活经验,或被动浏览推荐,而是直接向AI提出问题,让它理解内容、比较选项,并在多个步骤中协助完成决策。
因此,这次发布更适合被视为一次基础设施押注:能力足够强,但没有被证明是全能第一;开放程度足以接受外部检验;同时又与小红书自身的数据和用户工作流紧密相连。