跳转到主要内容

深圳AI模型:一个大脑掌控DNA、天气及所有科学

科学的超级大脑

7月19日,在上海2026年世界人工智能大会的科学智能开放论坛上,上海科学智能研究院揭开了一种新型AI的面纱——它不仅能聊天或生成图像,还能尝试理解科学的基本结构。它的名字“深圳”源自《西游记》中的“神珍铁”,这是一个恰当的比喻,代表一种以紧凑而强大的形式处理多种科学任务的工具。

可以把它看作是今年早些时候推出的“大圣”系统级智能研究代理的大脑。现在,这个大脑已经公开。

深圳有何特别之处?

从技术上讲,深圳是一个拥有约110亿参数的多模态基础模型。但真正的魔力在于它能处理的内容:DNA、RNA、蛋白质、小分子、地球系统和医学图像——全部集成在一个模型中。这就像拥有一个科学家,可以无缝地从遗传学切换到气象学。

它是如何做到的呢?共享主干使用Qwen3-VL-8B,但六种数据类型各有专用的处理路径。在输入通用模型之前,系统保留了生物序列的顺序、分子的连接结构、天气场的空间分布以及医学图像的局部细节。这意味着深圳可以直接生成RNA序列、分子表示(SMILES)、全球天气图,甚至医学图像分割——全部来自同一个框架。

开放科学,开放代码

最令人兴奋的一点是什么?它是开源的。上海科学智能研究院发布了模型权重、推理代码、示例脚本和文档。研究人员可以通过星河启智科学智能开放平台下载模型或调用API,该平台已托管超过1500个科学模型和工具。你也可以在Hugging Face上获取权重,在GitHub上获取代码。信息很明确:这是一个社区努力。

充满大创意的舞台

该模型的发布是在由复旦大学和上海科学智能研究院共同主办的科学智能开放论坛上进行的。论坛汇集了来自世界各地的科学家,讨论AI如何重塑科学发现的整个过程。

诺贝尔奖得主Arie Y. K. Wachter教授强调,AI必须基于可靠的物理机制。图灵奖得主Gilles Brassard教授分享了他对量子计算在新材料发现中潜力的兴奋,但也给年轻研究人员提出了建议:追随你的好奇心,而不是炒作。“当前的研究成果可能真正发挥作用需要十年时间,”他提醒道。

之江实验室主任、中国工程院院士王坚指出一个根本性转变:科学智能不是关于文本,而是关于数据。“今天的基础模型仍然基于文本,”他说。“未来,科学数据应该成为科学智能的原生居民。”他设想一个世界,每个学科的数据都被标记化并带入一个共同的表示空间,使AI像数学一样基础。

普林斯顿大学的范剑青教授谈到了AI在社会中的作用,将其描述为统计学习和优化的动态循环。他强调了AI如何将数据转化为社会洞察——从衡量经济到管理金融风险——但警告说,我们必须关注就业变化、教育变革和伦理问题。

更大的图景

在峰会对话中,参与者一致认为:AI原生时代原始创新的关键是创建一种新的协作发现机制,将人、数据、模型、实验和学术判断联系起来。这意味着不仅要升级研究基础设施,还要改变研究人员的思维方式。

复旦大学特聘教授、上海科学智能研究院院长漆远阐述了最终愿景:“AI应该从预测下一个标记转向发现未知规律。AI发现未知科学规律将标志着超级智能的开始。”他强调,真正的研究是一个长链条——文献、假设、数据、模型、模拟、实验、反馈——而科学智能是关于构建组织整个过程的系统能力。

这意味着什么

当深圳以其110亿参数将六种科学数据融入一个大脑时,科学发现的形式可能被悄然改写。它不仅仅是一个模型;它让我们一窥未来,AI不仅辅助科学家,而且成为揭示宇宙最深秘密的伙伴。

关键点

  • 深圳是一个110亿参数的多模态科学数据基础模型。
  • 它处理六种数据类型:DNA、RNA、蛋白质、小分子、地球系统和医学图像。
  • 该模型是开源的,权重、代码和API均可免费获取。
  • 论坛专家强调AI在发现未知科学规律中的作用,而不仅仅是预测标记。
  • 愿景:AI作为科学发现的基础工具,与数据和人类判断相结合。