新模型 2026-10-02

NaiveAI 开源 3090 亿参数模型,宣称架构由 AI 自己设计

NaiveAI 开源 3090 亿参数模型,宣称架构由 AI 自己设计

一句话说清:一家叫 NaiveAI 的创业公司开源了一个 3090 亿参数的大模型,用 MIT 许可(可免费商用),还号称它的「大脑结构」是 AI 自己摸索设计出来的——对想玩开源大模型的技术爱好者是个大新闻。

发生了什么

2026 年 9 月底,北京创业公司 NaiveAI 发布并开源了 Naive-N0.5-Flash:

  • 它是一个 3090 亿参数的混合专家(MoE)模型,每次只激活其中 155 亿参数,主打写代码和做 AI 研发。
  • 最特别的卖点是:NaiveAI 说它的网络结构(混合注意力架构)是 AI 系统自己探索、设计并调优出来的,人类研究员只定方向、设约束、做关键决策。
  • 采用 MIT 许可发布权重和推理代码,意味着个人和公司在遵守 MIT 条款下可免费商用。
  • 原生支持 100 万词元超长上下文,靠「滑动窗口 + 稀疏注意力」替代了传统昂贵的全注意力层。
  • 推理很快:标准模式每用户约 50 词元 / 秒,最快模式宣称可达 2000 词元 / 秒;API 定价约 0.10 / 0.40 美元每百万词元(输入 / 输出)。
  • 模型基于小米开源的 MiMo-V2.5 底座继续训练,权重已在 Hugging Face 放出(约 315GB,需要 FP8 显卡才能跑)。

对我有什么用

  • 技术爱好者 / 开发者:白拿一个能商用的顶级开源模型权重,适合拿来做本地代码助手、长文档分析的实验。
  • 小团队:不想被闭源模型高价绑定,可以用它搭自己的 coding agent,成本比很多闭源方案低。
  • 普通用户:暂时用不上(它太大、太吃显卡),但这代表「开源 + 免费商用」路线又往前走了一步,长期会压低大家用 AI 的成本。
  • 注意:官方自己的跑分大多藏在图片里、没给可直接引用的数字,性能要等第三方独立复测再下结论。

我可以怎么做

  1. 想看模型和论文,去 Hugging Face 搜 NaiveAI/Naive-N0.5-Flash,或读 NaiveAI 官方研究页。
  2. 有 FP8 显卡(如较新的英伟达卡)的,可按官方 NaiveRT 推理栈自行部署;没显卡的等第三方云托管或量化版。
  3. 做开发的,可对照它的 MIT 许可直接接入自己的项目;商用记得保留许可声明。
  4. 想试水更轻量的开源模型,可先从已成熟的小参数开源模型起步,别一上来就硬啃 315GB。

温馨提醒

  • 315GB 权重 + 推理显存,普通电脑根本带不动,别花钱买所谓「一键部署包」,官方都是免费开源的。
  • 「AI 自己设计架构」是公司的自我描述,目前没有独立可验证的硬标准,把它当技术故事看,性能以实测为准。
  • 任何号称「内部渠道 / 付费激活开源模型」的,基本是蹭热度骗局,开源模型认准 Hugging Face 和官网。
📤 一键转发小助手 帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发