昆仑芯科技副总裁孙孝思:AI大模型的突破与创新需要算力基础设施

发布时间:2023-03-09 10:13
作者:Ameya360
来源:网络
阅读量:3145

  2022年是整个人工智能芯片行业充满挑战的一年,从业者们都感受到丝丝寒意。因为2022年不仅处于疫情的波动期中,国际形势还对整个人工智能产业带来了限制。然而进入2023年后,CHATGPT带来了一点暖意。CHATGPT可以说是迄今为止增长最快的消费应用程序,它不是一触即发的,而是基于其前三代,不断迭代产生的,直到今天的爆发。

  为什么如今有更多的人关注它,很多演讲人也不断提及它?因为CHATGPT带来了质的飞跃,超越了人类平均基准线。

昆仑芯科技副总裁孙孝思:AI大模型的突破与创新需要算力基础设施

  来源:GARTNER2022年人工智能技术成熟度曲线

  GARTNER在2022年发布了一个人工智能技术成熟度曲线,生成式人工智能处于技术萌芽和期望的膨胀期,也就是说,技术从最初我们在人工智能的理解上,开始慢慢向发展阶段过渡,这对于人工智能产业中,无论是做芯片、框架,还是做算法的人来说,都是一个极大的利好。

  01

  CHATGPT背后:

  算法、数据、算力三要素共振

  CHATGPT背后是什么?今天在场的郑纬民院士以及其他很多演讲者此前都有提到,根源在于算法、数据、算力三个要素之间的共振。

  算力方面,现在的CHATGPT是基于GPT3.5的大模型,在训练中使用了微软专门建设的AI计算系统,由1万个业界主流GPU组成的高性能网络集群,总算力消耗约3640 PF-DAYS。

  数据方面,GPT-2的数据量是40G,GPT3的数据量达到了45TB,这是一个大规模的数据量的跃升。

  算法方面,如前所述,它不是一蹴而就的,而是经过了几次迭代。

  这几年的数据、算法、算力方面都有非常大的变化。中国在数据方面非常有优势,我们有场景、有大量的数据。在算法方面,实现了跨模态的融合,包括语音、图文、视频等很多方向。算力供给方面,这几年全国各地都在推进算力建设,我们相信未来国内的应用会有很大的变化和增长。

  02

  AI大模型应用突破与技术创新:

  目前,国内有很多关于CHATGPT的研究,除了清华大学的“八卦炉”,还有阿里、腾讯的大模型,也包括百度。百度即将在3月16日发布的文心一言,背后其实也是大参数、大算力、大数据量。我们可以意识到,未来的应用突破和技术创新需要算力的基础设施。

  也许有人会问,下一个CHATGPT到底是什么?现在火爆的聊天、语音生成属于CHATGPT的范畴,但是未来会有很多的衍生物,例如文本生成、视频生成、音频生成、虚拟人生成方面。

  我们认为,未来会有几个依托于算力的大场景,其中一大场景就是自动驾驶。自动驾驶场景中,模型感知和场景库的仿真训练需要上千P的算力。目前,我们跟新能源头部车企有很多紧密联动,我们发现自动驾驶的发展需要算力来提供技术的突破和跃升。生物医药也对算力有很强的需求,我们也看到了人工智能发挥的作用,例如ALPHAFOLD已预测出全球几乎所有已知蛋白质结构。

  可能有很多算力基础设施商都在思考,建了那么多数据中心、算力中心,到底应用在哪些地方?我们回顾一下,北京最早的京藏高速,我们叫G6,建设初期一辆车都没有,但今天却是北京堵车最严重的一条高速公路。还有4G网络,最早国家在建设4G网络的时候,大家都认为3G网络已经足够用了,为什么要上4G?为什么要投入那么大的成本?但今天看来,也有人觉得4G网络卡。所以我们要重新理解算力,它其实是信息基础设施。

  算力网络的布局会很大程度激发人工智能的应用和技术创新。

  目前,算力成本普遍偏高,有很多中小企业的创新在一定程度上受到了成本的影响。例如,复旦大学做MOSS大模型的时候,也会考虑到学校、科研机构是否能够承担起大模型的训练。

  从政府、国家、行业的角度看,我们怎么能够实现算力的普惠?我相信2023年之后,在算力建设过程当中,除了我们这些企业,各方都将更多参与进来,这样才能够真正实现普惠,大大降低企业使用算力的成本。

  03

  场景、数据驱动下人工智能芯片的挑战

  算力对于场景的创新很重要。但是作为一个人工智能芯片的企业,我们也充分认识到,在市场需求打开的情况下,整个人工智能芯片也面临巨大挑战。

昆仑芯科技副总裁孙孝思:AI大模型的突破与创新需要算力基础设施

  资料来源:《AI算力的阿喀琉斯之踵:内存墙》

  上图中,蓝线上是视频、自然语言处理和语音模型,其模型运算量平均每两年翻15倍;红线上TRANSFORMER的这种神经网络大模型,其模型运算量平均每两年会翻750倍;而灰线则标志摩尔定律下内存硬件大小的增长,平均每两年翻2倍。

  因此,可以由此想到两点:第一,未来摩尔定律会面临失效的风险;第二,要考虑内存墙的存在。对于整个芯片行业的发展来说,如何在未来的演进中找到突破口,其实CHIPLET是一个方向。可见,先进封装技术对于AI芯片行业将是一个重要的助推器。这几年,昆仑芯科技也在这方面做了很多基础研发。

  人工智能芯片离不开工程实现,为什么这么说?因为它毕竟是一个产品,想要在行业跟场景紧密结合,必须解决三个问题:通用性、易用性和性价比。

  企业、高校可以在基础科研上做很多的探索,人工智能芯片企业同时必须要考虑到它的应用、商业化落地等问题。如何去解决通用性、易用性和性价比的问题,是人工智能芯片厂商共同面临的挑战。

  芯片不是一个标品。在硬件层面,我们可以达到业界主流GPU产品差不多的性能指标,但在软件层面上差距较大。从同行的角度来看,我们需要自己的软件栈去解决通用性问题,也要给开发者提供更好的软件栈,让开发者可以基于国内的人工智能芯片做开发。

  04

  结语

  昆仑芯科技前身是百度智能芯片及架构部,虽成立不久,却已有十余年的芯片研发经验。基于百度丰富的AI场景积累,昆仑芯产品实现了与场景需求、客户需求的紧密耦合。

  基于对场景的深刻理解,昆仑芯与智能产业的上下游携手,逐步构建起软硬一体化的AI芯片生态。目前,昆仑芯产品已与百度飞桨、PYTORCH、TENSORFLOW等主流框架和服务器完成适配。

  完善解决方案才能够真正赋能产业。昆仑芯两代芯片产品均已实现量产,并凭借其强大通用性、易用性和高性能,广泛部署在智慧金融、智慧交通、智慧工业等领域,不断提供更优秀、更高效的解决方案,为客户提供更好的服务。

  未来,我们希望可以和在座的同行们一起共筑合力,赋能芯片产品与应用场景更紧密结合,在人工智能产业发展中构建更加繁荣的生态系统。


(备注:文章来源于网络,信息仅供参考,不代表本网站观点,如有侵权请联系删除!)

在线留言询价

相关阅读
芯模共生,生态共建:昆仑芯联合FlagOS实现MiniCPM5-2B模型Day 0部署
  近日,面壁智能联合OpenBMB正式开源新一代端侧模型「小钢炮」MiniCPM5-2B。作为面向端侧场景打造的新一代小尺寸模型,该模型原生支持混合思考、512K超长上下文,并具备工具调用、深度搜索、代码生成等智能体能力,可进一步拓展至手机、PC、智能座舱等多元端侧设备。  模型开源后,昆仑芯联合FlagOS,率先完成MiniCPM5-2B的Day 0适配与推理验证。  此次适配展现了昆仑芯面向前沿开源模型的快速响应能力。依托持续完善的软硬件协同体系,昆仑芯能够紧跟主流模型迭代,并通过与FlagOS的生态协同,进一步提升模型适配效率,缩短新模型从开源发布到国产算力平台可用的时间。  开源即适配,昆仑芯联合FlagOS实现模型高效部署  大模型快速迭代的今天,从“模型发布”到“算力可用”的时间窗口正在不断缩短。对于开发者而言,新模型发布后能否快速完成不同算力平台上的适配、部署与性能验证,已经成为衡量算力生态响应能力的重要指标。此次MiniCPM5-2B开源后,昆仑芯联合FlagOS快速完成模型的适配与推理验证,实现了开源即适配、开源即部署。在适配过程中,昆仑芯围绕模型运行涉及的算子、推理框架及运行环境开展逐一验证与优化,依托持续完善的软件体系和软硬件协同能力,推动模型在快速在昆仑芯平台实现稳定运行。与此同时,FlagOS通过统一算子库、编译器及推理插件等软件能力,为模型适配提供统一的软件支撑,进一步降低前沿模型跨芯片适配的复杂度。基于统一多芯片软件栈,此次MiniCPM5-2B的适配成果还可通过FlagRelease发布多芯片模型版本,进一步提升适配成果的复用效率。  软硬协同,昆仑芯持续提升适配效率  大模型适配并非简单地让模型“跑起来”。由于不同AI芯片在计算架构、算子支持、编译环境和软件栈等方面存在差异,新模型要实现稳定、高效运行,需要进行多层次的适配与优化。  对于昆仑芯而言,持续完善软硬件协同能力,提升模型适配与优化效率,是推动前沿模型快速落地的重要基础。  这一适配能力的背后,是昆仑芯长期积累并持续完善的自研软件体系。围绕开发者需求,昆仑芯构建了覆盖底层驱动、开发工具、SDK及专业算子库等核心环节的自研软件栈,为模型迁移、部署与运行提供完善的软件支撑。依托持续演进的软件能力,开发者能够以更低的适配成本和更高的部署效率,将前沿模型快速应用于实际场景。  此次MiniCPM5-2B适配过程中,昆仑芯依托自身软件体系和推理能力完成模型适配与验证,并联合FlagOS进一步提升适配成果的复用效率,为模型在国产AI芯片平台上的快速部署提供支持。  从单个模型的Day 0快速响应,到持续拓展主流模型生态,昆仑芯正不断拓展对前沿模型的兼容与支持能力,持续缩短模型从开源发布到国产算力平台落地的时间,让更多前沿模型能够更加高效地运行在国产算力平台之上。  深化生态协同,共建繁荣模型生态  随着大模型加速迭代,模型生态与算力生态之间的协同效率愈发重要。对于国产算力而言,除了具备稳定的硬件性能,还需要持续提升对主流模型的兼容与适配能力,才能更好承接前沿模型的发展。  昆仑芯正持续跟进主流开源模型迭代,不断提升模型适配与优化效率,当前已完成智谱GLM系列、Qwen系列、MiniMax、Kimi等多款主流模型的适配,持续拓展对主流模型生态的支持范围。  在不断提升自身适配能力的同时,昆仑芯也积极参与众智FlagOS社区等开源生态建设,通过与生态伙伴开展联合适配,推动模型适配成果进一步复用和共享,扩大国产算力对主流模型生态的支持范围。  未来,昆仑芯将持续提升前沿模型的适配与优化能力,深化模型、软件与芯片之间的协同,与生态伙伴共同推动更多前沿模型快速落地国产算力平台,助力构建更加开放、繁荣的国产AI生态。
2026-09-09 10:19 阅读量:252
GLM-5.3-Flash开源即适配,昆仑芯加速国产算力与大模型生态协同
  8月26日,智谱正式发布并开源GLM系列的首个原生多模态模型GLM-5.3-Flash (320B-A18B)。模型开源当日,昆仑芯即完成对GLM-5.3-Flash的适配与联合精调,成为首批完成该模型适配的国产算力厂商之一,展现了面向前沿大模型的快速响应能力与生态兼容实力。近半年来,随着智谱持续推进GLM系列模型迭代,昆仑芯已完成对GLM系列多款模型的快速适配。此次快速适配不仅体现了昆仑芯面向前沿模型的Day 0响应能力,也进一步验证了国产算力支撑新一代大模型高效推理的能力。通过持续提升模型适配效率与优化软硬件协同能力,昆仑芯正加速推动前沿模型与国产算力生态协同,为大模型应用落地提供更加高效、敏捷的算力支持。  低成本高效推理,解锁大模型多场景应用  据介绍,GLM-5.3-Flash是GLM-5系列首个原生多模态模型。模型采用低成本架构,以320B总参数、18B激活参数实现高效推理,在保持模型能力的同时降低计算与服务成本。通过线性注意力与稀疏注意力相结合的混合架构,以及IndexPool等技术,模型进一步降低长上下文场景下的计算、显存和时延开销,支持最高1M上下文。  同时,GLM-5.3-Flash将视觉能力融入Coding流程,能够结合界面、渲染结果和交互反馈持续优化代码,覆盖前端开发、游戏构建、Blender 3D场景以及BUA、CUA驱动的真实环境操作等场景。此外,模型进一步拓展至Office、金融研究、专业文档等复杂任务,支持从分析研究到专业成果交付的完整工作流。  开源即适配,昆仑芯持续提升模型部署效率  随着国产大模型迭代速度不断加快,模型创新周期持续缩短,算力平台能否快速完成适配,正成为影响先进模型落地效率的重要因素。围绕智谱GLM系列模型演进,昆仑芯始终保持同步跟进,已完成GLM-4.7、GLM-5、GLM-5.1、GLM-5.2等多款模型的Day 0适配,不断提升模型从开源发布到国产算力部署及产业应用的响应效率。此次GLM-5.3-Flash开源后,昆仑芯第一时间完成模型适配与联合精调,实现对智谱最新模型的快速支持。这一快速适配能力,源于昆仑芯自研架构与长期深耕的软件栈。昆仑芯现已构建了覆盖底层驱动、开发工具SDK、专业算子库等核心环节的自研软件栈,持续提升算子覆盖广度与生态兼容深度,为模型快速迁移、高效部署与稳定运行提供坚实保障。依托完善的软件生态,昆仑芯进一步降低模型迁移与部署门槛,帮助开发者以更低成本、更高效率完成模型部署,加速AI应用创新。在本次GLM-5.3-Flash适配中,昆仑芯实现了模型精度无损迁移与高效部署,在保障稳定运行的同时充分释放硬件计算性能,降低模型部署门槛,缩短从开源发布到产业应用的落地周期。依托高效算力平台与自研软件栈优化能力,昆仑芯为GLM-5.3-Flash提供稳定、高效的国产算力支持,助力企业快速将前沿模型能力转化为实际业务价值。  “发布即适配”加速,模型与算力生态协同提速  在模型能力持续突破、创新周期不断缩短的背景下,模型厂商、算力平台、开发者与产业伙伴之间的协同效率,正成为推动AI技术规模化应用的重要因素。面对智谱GLM系列模型的持续升级,昆仑芯始终保持同步跟进,以更快的响应速度衔接模型创新与算力部署,推动主流模型更快进入实际应用场景。  面向未来,昆仑芯将继续深化与模型厂商、开发者及产业伙伴的合作,持续提升主流模型适配与部署能力,推动国产算力与模型生态高效协同,共同加速“国芯+国模”生态成熟,助力国产AI产业高质量发展。
2026-08-28 16:02 阅读量:342
昆仑芯联合蚂蚁密算打造国产GPU机密计算方案,夯实国产AI安全算力底座
近日,中国信息通信研究院泰尔终端实验室(以下简称“泰尔终端实验室”)正式发布国内首份面向通用 GPU TEE(可信执行环境)的专项系统检测报告。本次测评是国内首次针对通用GPU可信执行环境技术开展权威专业评测,围绕安全隔离、远程证明、密态大模型推理安全保护三大核心维度完成严苛验证。作为首批完成适配的国产AI算力平台之一,昆仑芯P800系列产品已全面兼容该GPU TEE方案,双方共同打造兼具高性能、高安全的国产AI可信计算解决方案,为企业级大模型部署提供更加安全可靠的算力底座。依托昆仑芯P800系列产品与蚂蚁密算通用GPU TEE HyperGPU技术,该方案无需更换现有硬件,即可为昆仑芯GPU平台赋予可信执行能力,实现模型权重、用户提示词、推理结果等敏感数据在GPU计算过程中的硬件级安全保护,覆盖安全隔离、远程证明、密态推理等关键能力,有效解决AI训练与推理过程中“数据在用即裸奔”的行业难题,为国产AI算力筑牢硬件级数据安全底座。该方案通过在昆仑芯P800系列产品的AI服务器部署由蚂蚁密算团队提供的整套GPU TEE,即可为昆仑芯GPU平台赋予可信执行能力,整个P800的软件栈可以完整运行在蚂蚁密算团队提供的GPU TEE中实现正常业务操作。根据泰尔系统实验室测试结果,在开启全链路密态保护及最高级别安全防护的情况下,该方案推理性能损耗低于2%,实现安全能力与计算性能兼顾。基于昆仑芯领先的AI算力性能和完备的软件生态,结合蚂蚁密算机密计算技术,双方为数据敏感行业提供兼具高性能、高安全、自主可控的大模型基础设施解决方案。作为业界领先的AI计算芯片及软硬件系统供应商,昆仑芯科技始终坚持开放生态发展理念,持续完善芯片、集群系统和软件平台能力,已完成对国内主流模型的快速适配,并不断携手产业伙伴推动国产AI基础设施能力升级。此次与蚂蚁密算联合推进GPU可信执行环境落地,是昆仑芯在完善AI基础设施安全能力方面的重要实践,也进一步拓展了国产AI算力平台在机密计算领域的应用边界。未来,双方将围绕大模型训练、推理及多方协同计算等场景持续深化合作,加快国产算力可信执行环境在更多行业和应用场景中的落地,推动国产AI基础设施实现计算性能、安全可信与自主可控能力的协同提升,为大模型规模化应用提供更加坚实的安全算力底座。
2026-08-26 13:28 阅读量:386
MiniMax H3开源即适配,昆仑芯持续推动“芯模共生”协同发展
  今日,MiniMax正式开源多模态生成模型MiniMax H3。昆仑芯率先完成对该模型的适配与调优,成为首批完成适配的国产算力厂商之一,再次展现了其在主流大模型生态中的敏捷响应能力和广泛兼容实力。  截至目前,MiniMax已陆续开源M系列文本模型和H系列多模态模型。依托软硬协同、全栈自研的技术体系,昆仑芯已连续完成MiniMax多个开源模型的Day 0适配,并持续保持对主流开源大模型的快速响应能力,以高效的生态适配能力推动前沿模型第一时间完成国产算力部署,进一步夯实“国芯+国模”协同发展的生态基础。  MiniMax H3加速多模态生态创新  据悉,作为MiniMax从"特化任务模型"迈向"通用多模态智能"的重要探索,MiniMax H3突破了传统多模态模型围绕单一生成任务构建能力的模式,能够在统一的多模态上下文中理解创作意图,实现文本、图片、音频、视频等多模态内容的协同理解与生成。模型支持文本、图片、音频、视频等多种输入形式,可原生生成最高2K分辨率、最长15秒的音视频内容,在指令遵循、品牌信息呈现、Video-to-Video Motion Transfer(视频到视频动作迁移)等能力上表现突出,可广泛应用于广告创意、品牌营销、电商设计、产品设计、UI/UX、游戏制作等商业场景。极速适配,助力多模态模型高效落地  随着AI模型不断向多模态、长上下文和智能体方向演进,模型架构持续创新,对底层算力平台的软件适配效率提出了更高要求。模型发布后的快速适配能力,正成为衡量AI算力平台生态成熟度的重要指标。  本次Day 0适配过程中,昆仑芯围绕MiniMax H3统一多模态理解与生成、原生立体声音视频联合生成、高分辨率视频输出等核心能力,基于生成式AI推理框架SGLang及成熟的昆仑芯自研软件栈,快速完成模型适配、算子优化与精度对齐,实现模型在昆仑芯AI算力产品上的稳定高效运行,为开发者和企业用户提供开箱即用的国产算力支持。  高效适配能力的背后,是昆仑芯长期积累的软件生态能力。昆仑芯软件栈完整覆盖从底层驱动、开发工具SDK到专业库等核心组件,贴合开发者实际使用习惯,在保障计算性能充分释放的同时,有效降低开发门槛与模型迁移成本。开发者得以高效完成精度无损、性能稳定的模型部署,显著提升模型开发效率与应用部署体验。  持续完善生态建设,"发布即可用"成为常态  当前,人工智能技术创新与产业应用正进入协同加速发展的新阶段,大模型能力持续突破,行业应用需求快速增长。昆仑芯科技持续推动“国芯+国模”协同发展,已率先完成对头部厂商30余款旗舰模型的快速适配,覆盖语言、多模态、AIGC等多个方向。  凭借成熟开放的软件生态和持续增强的模型适配能力,昆仑芯已将“发布当日即适配”打造为常态化能力,让开发者和用户能够在模型发布当天获得高效、稳定的国产AI算力支持,加速AI能力走向千行百业。  未来,昆仑芯将继续强化软硬协同优化能力,持续完善软件生态建设,不断提升对主流模型架构演进和算法创新的支持能力,为开发者提供更加高效、易部署、可规模化的国产AI算力平台,助力前沿AI模型加速落地,推动国产人工智能生态持续繁荣发展。
2026-08-04 14:23 阅读量:549
  • 一周热料
  • 紧缺物料秒杀
型号 品牌 询价
MC33074DR2G onsemi
RB751G-40T2R ROHM Semiconductor
CDZVT2R20B ROHM Semiconductor
BD71847AMWV-E2 ROHM Semiconductor
TL431ACLPR Texas Instruments
型号 品牌 抢购
BP3621 ROHM Semiconductor
BU33JA2MNVX-CTL ROHM Semiconductor
STM32F429IGT6 STMicroelectronics
ESR03EZPJ151 ROHM Semiconductor
IPZ40N04S5L4R8ATMA1 Infineon Technologies
TPS63050YFFR Texas Instruments
热门标签
ROHM
Aavid
Averlogic
开发板
SUSUMU
NXP
PCB
传感器
半导体
相关百科
关于我们
AMEYA360微信服务号 AMEYA360微信服务号
AMEYA360商城(www.ameya360.com)上线于2011年,现 有超过3500家优质供应商,收录600万种产品型号数据,100 多万种元器件库存可供选购,产品覆盖MCU+存储器+电源芯 片+IGBT+MOS管+运放+射频蓝牙+传感器+电阻电容电感+ 连接器等多个领域,平台主营业务涵盖电子元器件现货销售、 BOM配单及提供产品配套资料等,为广大客户提供一站式购 销服务。

请输入下方图片中的验证码:

验证码