腾讯混元发布面向消费设备的开源AI模型
腾讯推出高效混元模型 扩展开源AI生态
腾讯混元AI研究团队发布了四款新的开源语言模型,参数量从5亿到70亿不等,专为消费级硬件部署设计。这一战略发布为开发者提供了适用于边缘计算场景的可扩展方案,同时保持强劲性能。
技术规格与获取方式
新发布的模型(0.5B、1.8B、4B和7B)采用融合推理架构,具备以下特性:
- 快速推理速度(毫秒级响应)
- 256k token上下文窗口(约合40万汉字)
- 双重思考模式:
- 快速模式处理简单查询
- 深度模式解决复杂问题

可通过GitHub和HuggingFace获取,支持:
- 多种量化格式
- 主流推理框架(vLLM、TensorRT-LLM)
- 跨平台兼容性(Arm、高通、英特尔芯片组)
实际应用案例
腾讯已将这些模型集成至产品生态:
- 腾讯会议:AI助手处理完整会议记录
- 微信读书:“AI问书”功能解析整本出版物
- 手机安全:零数据上传的垃圾信息检测
- 智能汽车:低延迟座舱助手
这些模型尤其擅长:
- 智能体能力(工具调用、多步规划)
- 长上下文记忆(相当于三本《哈利波特》小说)
- 边缘部署(可在单GPU或移动设备运行)
核心亮点
- 🚀 四款开源新模型(0.5B至7B参数)
- 🔋 为消费硬件优化(笔记本/手机/IoT设备)
- 📚 业界领先的256k上下文窗口
- 🤖 面向复杂任务的先进智能体能力
- 🌐 已部署于腾讯核心产品