新模型
2026-09-16
腾讯混元开源 0.5B~7B 端侧小模型,手机电脑都能跑
来源:AIBase
腾讯混元开源 0.5B~7B 端侧小模型,手机电脑都能跑
一句话说清:腾讯混元开源了 4 款小尺寸模型(0.5B 到 7B),能直接跑在手机、电脑、车机等设备上——你常用的腾讯会议、微信读书里的 AI,已经在用它们。
发生了什么
- 腾讯混元团队开源 4 款小尺寸语言模型:Hunyuan-0.5B、1.8B、4B、7B,全部支持消费级显卡,最低能在笔记本、手机、智能座舱上直接部署。
- 模型已在 GitHub、Hugging Face 上线,Arm、高通、英特尔、联发科等主流芯片平台都完成了适配验证。
- 它们支持「快思考 / 慢思考」两种模式:快思考毫秒级响应,适合聊天、摘要;慢思考做多步推理、数学和规划。
- 原生长上下文窗口 256K(约 40 万汉字),一口气读完三本《哈利波特》还能接着聊剧情。
- 腾讯会议 AI 小助手、微信读书「AI 问书」已率先接入,能一次性理解整场会议、整本书。
对你有什么用
- 「端侧模型」就是 AI 跑在你自己的设备上,不用联网、数据不出本机——更私密,也更省服务器成本。
- 你其实已经在用:手机管家用它毫秒级拦垃圾短信(数据不上传)、微信读书用它一口气读懂整本书。
- 对开发者:单卡就能部署,主流推理框架都支持,想在自己产品里塞个本地 AI 很方便。
怎么马上试(照着做)
- 普通用户:不用装任何东西——打开微信读书,用「AI 问书」问整本书的问题;开会用腾讯会议 AI 小助手总结纪要,背后就是这些小模型。
- 想体验手机端 AI:留意微信输入法、腾讯手机管家等腾讯系 App 里的本地 AI 功能。
- 开发者:去 Hugging Face 搜「tencent/Hunyuan」下载 0.5B~7B 权重,用 vLLM 等框架本地跑。
注意
- 这是开源模型,主要面向开发者和厂商,不是给你直接聊天的 App;日常聊天仍用元宝、豆包等成品。
- 小模型能力有上限,复杂任务还是云端大模型更强,端侧胜在「快、省、私密」。
- 下载权重认准腾讯官方仓库,别从不明论坛下改过的版本。
📤 一键转发小助手
帮你写好小红书文案、微信群推荐语,还配一张中文海报,复制就能发
💬 说说你的看法