跳转到主要内容

腾讯混元发布面向消费设备的开源AI模型

腾讯推出高效混元模型 扩展开源AI生态

腾讯混元AI研究团队发布了四款新的开源语言模型,参数量从5亿到70亿不等,专为消费级硬件部署设计。这一战略发布为开发者提供了适用于边缘计算场景的可扩展方案,同时保持强劲性能。

技术规格与获取方式

新发布的模型(0.5B、1.8B、4B和7B)采用融合推理架构,具备以下特性:

  • 快速推理速度(毫秒级响应)
  • 256k token上下文窗口(约合40万汉字)
  • 双重思考模式:
    • 快速模式处理简单查询
    • 深度模式解决复杂问题

Image

可通过GitHubHuggingFace获取,支持:

  • 多种量化格式
  • 主流推理框架(vLLM、TensorRT-LLM)
  • 跨平台兼容性(Arm、高通、英特尔芯片组)

实际应用案例

腾讯已将这些模型集成至产品生态:

  1. 腾讯会议:AI助手处理完整会议记录
  2. 微信读书:“AI问书”功能解析整本出版物
  3. 手机安全:零数据上传的垃圾信息检测
  4. 智能汽车:低延迟座舱助手

这些模型尤其擅长:

  • 智能体能力(工具调用、多步规划)
  • 长上下文记忆(相当于三本《哈利波特》小说)
  • 边缘部署(可在单GPU或移动设备运行)

核心亮点

  • 🚀 四款开源新模型(0.5B至7B参数)
  • 🔋 为消费硬件优化(笔记本/手机/IoT设备)
  • 📚 业界领先的256k上下文窗口
  • 🤖 面向复杂任务的先进智能体能力
  • 🌐 已部署于腾讯核心产品