面壁智能CEO李大海:智能时代,算力需要先行建设
8月28日下午,在服贸会常态化活动——“通用人工智能算力论坛”(AGICF)上,石景山智能算力中心签约及建设启动仪式举行。会议同期,面壁智能发布最新大模型成果Luca,其推理、知识、生成等多项能力媲美ChatGPT。从论坛中可以窥见,北京正在打造一整套完整的人工智能产业链市场环境,随着算力基础设施的进一步夯实,人工智能应用将加速落地。
百模大战,算力先行
今年以来,以ChatGPT为代表的 AI 大模型技术火遍全球,而在这样的大机遇下,国产大模型产业也逐渐崛起,成为备受关注的新兴领域。数据显示,截至2023年7月,中国累计已经有130个大模型问世。
大模型训练推理对算力提出了迫切需求。值得一提的是,在本次“通用人工智能算力论坛”上,由企商在线打造的石景山智能算力中心宣布开启建设,此前,其已被纳入北京市“城市超级算力中心建设工程”。
面壁智能联合创始人、CEO 李大海
面壁智能联合创始人、CEO李大海表示,进入智能时代,算力需要先行建设。石景山政府把算力的工作提前规划起来,是高瞻远瞩的举措,让企业能够没有后顾之忧。大规模的、双精度的智算中心对于未来大规模的大语言模型训练至关重要,只有规模足够大,并且精度足够高,才能在训练的过程中训练出足够好的模型,才有基础去做更小的模型的蒸馏。李大海表示,希望石景山智能算力中心进一步扩大算力规模,为大模型夯实“算力底座”。
据悉,石景山智能算力中心支持人工智能大模型训练和推理,是北京训推一体的大型双精度浮点智算超算中心。作为大型数字经济底座,该中心立足石景山,面向金融、政府、大模型、元宇宙、数字孪生、虚拟现实、高校科研、智能制造、智慧城市等全方位应用场景。项目建成后算力规模将达610PFlops。对于大模型企业、图形渲染、后期制作、3D游戏以及产业方向的消费级算力需求、科研算力需求等,石景山智能算力中心都能提供相应解决方案。
Luca“破壁”,逐浪大模型
论坛上,面壁智能发布最新大模型成果Luca。李大海介绍,三个月来,Luca总共迭代了85次,大语言模型能力整体提升39%。其中推理能力提升119%,推理、知识、生成等多项能力已媲美ChatGPT。除了优秀的大语言模型能力外,Luca 2.0还具备强大的多模态处理能力,图片理解能力已达中文全网最强,其中多模对话、细节描述和复杂推理三项整体得分为92.5分,而行业其他模型的平均得分是78.4分,远超现有支持中文且具备图片理解能力的大模型。
训练出高效的大模型是AI公司与从业者追逐的理想,面壁智能在仔细审视大模型技术与落地方案时,看到了一堵堵挡在面前的“墙壁”:包括内存墙、算法墙、通信墙、性能墙,甚至对大模型技术保持观望的人心之墙。“面壁”的面壁智能如何有信心和力量去“破壁”这一堵堵高墙呢?
据悉,Luca的语言交互基座模型是千亿级参数CPM大模型。CPM(Chinese Pretrained Model) 系列大模型享誉已久,是面壁智能从零自主研发的预训练大语言模型,其中包括国内首个中文大模型 CPM-1。最新的大模型训练直播项目 CPM-Live的第二期百亿模型CPM-Bee是国内首个开源免费商用基座模型,目前已授权给数百家企业合法商用。在基础模型的竞争中,技术背景出身清华的面壁智能始终占据高地。
Luca是面壁智能在大模型技术创新与应用落地道路上的一个里程碑,它不仅是基于CPM大模型的第一个AI原生应用,更是面壁智能开启AGI征途的起点,正如李大海介绍Luca 的名字取自地球生命始祖 LUCA(The Last Universal Common Ancestor)。[1] 作为一家初创公司,未来的征程中或许会有更多无形的“墙壁”等着面壁智能去打破。而面壁智能希望能够时刻保持清醒与冷静,正确看待问题与挑战,并在关键时刻给出最有力的一击,破壁而出。