新模型 2026-09-16

腾讯混元开源 0.5B~7B 端侧小模型,手机电脑都能跑

来源:AIBase

腾讯混元开源 0.5B~7B 端侧小模型,手机电脑都能跑

一句话说清:腾讯混元开源了 4 款小尺寸模型(0.5B 到 7B),能直接跑在手机、电脑、车机等设备上——你常用的腾讯会议、微信读书里的 AI,已经在用它们。

发生了什么

  • 腾讯混元团队开源 4 款小尺寸语言模型:Hunyuan-0.5B、1.8B、4B、7B,全部支持消费级显卡,最低能在笔记本、手机、智能座舱上直接部署。
  • 模型已在 GitHub、Hugging Face 上线,Arm、高通、英特尔、联发科等主流芯片平台都完成了适配验证。
  • 它们支持「快思考 / 慢思考」两种模式:快思考毫秒级响应,适合聊天、摘要;慢思考做多步推理、数学和规划。
  • 原生长上下文窗口 256K(约 40 万汉字),一口气读完三本《哈利波特》还能接着聊剧情。
  • 腾讯会议 AI 小助手、微信读书「AI 问书」已率先接入,能一次性理解整场会议、整本书。

对你有什么用

  • 「端侧模型」就是 AI 跑在你自己的设备上,不用联网、数据不出本机——更私密,也更省服务器成本。
  • 你其实已经在用:手机管家用它毫秒级拦垃圾短信(数据不上传)、微信读书用它一口气读懂整本书。
  • 对开发者:单卡就能部署,主流推理框架都支持,想在自己产品里塞个本地 AI 很方便。

怎么马上试(照着做)

  1. 普通用户:不用装任何东西——打开微信读书,用「AI 问书」问整本书的问题;开会用腾讯会议 AI 小助手总结纪要,背后就是这些小模型。
  2. 想体验手机端 AI:留意微信输入法、腾讯手机管家等腾讯系 App 里的本地 AI 功能。
  3. 开发者:去 Hugging Face 搜「tencent/Hunyuan」下载 0.5B~7B 权重,用 vLLM 等框架本地跑。

注意

  • 这是开源模型,主要面向开发者和厂商,不是给你直接聊天的 App;日常聊天仍用元宝、豆包等成品。
  • 小模型能力有上限,复杂任务还是云端大模型更强,端侧胜在「快、省、私密」。
  • 下载权重认准腾讯官方仓库,别从不明论坛下改过的版本。
📤 一键转发小助手 帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发