发布即适配!昆仑芯率先完成智谱新一代旗舰模型GLM-5.1深度支持

Release time:2026-04-09
author:AMEYA360
source:昆仑芯
reading:1115

发布即适配!昆仑芯率先完成智谱新一代旗舰模型GLM-5.1深度支持

  今日,智谱正式开源新一代旗舰模型GLM-5.1。作为当前全球领先的开源大模型之一,GLM-5.1在长程任务(Long Horizon Task)处理能力上实现了显著突破。模型发布当日,昆仑芯即完成P800系列产品的适配工作,成为国内首批实现GLM-5.1 Day 0适配的国产GPU厂商之一。

  相较于GLM-5,GLM-5.1在整体能力上实现显著提升,尤其在代码生成与复杂任务处理方面表现突出。在更贴近真实开发场景的SWE-bench Pro基准测试中,GLM-5.1刷新全球成绩,超越GPT-5.4与Claude Opus 4.6。

  与此同时,在模型整体性能大幅提升之外,GLM-5.1还在长程任务处理能力上取得了重要突破。不同于当前以分钟级交互为主的模型,GLM-5.1能够在单次任务中持续、自主地工作长达8小时,凭借自主规划、执行与迭代进化,最终交付完整的工程级成果。

  发布即适配,软硬协同支撑高效落地

  GLM-5.1发布当日,昆仑芯同步完成Day 0深度推理适配,实现模型“上线即可用”,并确保性能稳定释放。

  依托底层算子优化与硬件加速能力的协同,GLM-5.1在昆仑芯平台上实现了高吞吐、低延迟的稳定运行,在复杂任务与长序列场景下依然保持高效表现。在代码生成、复杂推理、长文本理解等核心纯文本场景中,模型能力得以满血释放。

  针对GLM-5.1的744B MoE架构、200K超长上下文及DSA稀疏注意力等核心特性,昆仑芯开展了全栈深度优化。在实际适配中,依托自研架构,团队持续完善算子覆盖能力与生态兼容体系,充分释放原生INT8/INT4精度的加速潜力,实现模型性能与算力效率的高效匹配,让每一份算力都能发挥最大价值。

  昆仑芯软件负责人王勇表示:“GLM-5.1的Day 0深度推理适配,充分体现了昆仑芯在软件生态与软硬件协同方面的综合能力。通过底层算子重构与推理框架协同优化,实现模型结构与硬件架构的深度耦合,使模型在上线首日即可高效、稳定地释放算力性能。”

  此次快速适配的背后,是昆仑芯长期构建的完备软硬件协同体系。昆仑芯提供从驱动到专用库的完备软件栈,全面覆盖模型开发与部署关键环节。该软件栈高度兼容主流AI开发生态,在保障计算性能充分释放的同时,有效降低开发门槛与模型迁移成本,使客户能够以更低的适应成本及更短的部署周期完成AI模型开发与部署落地。

  坚实算力底座,支撑规模化应用部署

  在硬件、系统和集群层面,昆仑芯持续推进算力基础设施的建设。从模型顺利跑通到性能持续优化,昆仑芯已为GLM-5.1打造了覆盖硬件、软件生态、系统和集群的全栈国产算力方案,全面适配企业级智能办公、代码开发、知识库构建等多元场景,助力企业高效释放模型能力,加速技术价值向产业价值转化。

  依托深厚的软硬件协同与大规模系统设计能力,昆仑芯推出32卡及64卡超节点方案。相较传统8卡/16卡服务器,昆仑芯超节点产品在节点内通信带宽与算力密度上实现显著提升,带来训练与推理性能的跨越式跃升。此外,昆仑芯进一步发布256卡及512卡超节点技术,并持续向千卡级超节点演进,为更大规模模型应用提供坚实支撑。

  在集群建设方面,2025年2月,昆仑芯成功点亮昆仑芯P800万卡集群,这是国内首个正式点亮的自研万卡AI集群。同年4月,该集群规模进一步扩展至3.2万卡。当前,昆仑芯的产品已落地多个千卡及万卡集群,实现长时间高效稳定运行。未来,昆仑芯将持续支持国产算力集群建设,推动模型在真实场景中的规模化应用,助力国产模型的创新发展。

  持续保持Day 0节奏,构建国产算力生态协同能力

  今年以来,昆仑芯已完成十余款主流模型的Day 0适配,覆盖智谱、通义千问、MiniMax等头部厂商的最新旗舰模型,实现语言、多模态、OCR与翻译等多场景全面覆盖。在适配数量、响应速度与生态广度方面,昆仑芯持续保持行业领先。

  凭借其成熟、开放的软件生态,昆仑芯已完成与多款行业主流大模型的首发适配,实现“发布即支持”的快速落地能力。目前,昆仑芯正持续深化大模型适配与优化,全面支持各类模型架构与算法创新,助力开发者获得更流畅、高效的开发与部署体验。

  随着国产开源大模型生态不断成熟,算力平台与模型之间的协同效率持续提升。常态化的Day 0级响应,充分验证了昆仑芯软件栈在模型快速迁移、性能释放及生态兼容方面的综合实力。

  面向未来,昆仑芯将继续强化对主流前沿模型的高效适配,通过持续的技术创新与软硬协同优势,不断夯实国产AI算力底座,为加速产业智能化升级与数字化转型贡献力量。

发布即适配!昆仑芯率先完成智谱新一代旗舰模型GLM-5.1深度支持


("Note: The information presented in this article is gathered from the internet and is provided as a reference for educational purposes. It does not signify the endorsement or standpoint of our website. If you find any content that violates copyright or intellectual property rights, please inform us for prompt removal.")

Online messageinquiry

reading
昆仑芯丨昆仑芯科技携超节点及千行百业落地方案亮相WAIC
  7月18日,2026世界人工智能大会(WAIC 2026)持续火热进行。央视新闻刊播《智汇上海 共赴AI新未来》,聚焦大会首发首秀首展及前沿科技成果,深入探访国产AI创新力量。  作为业内领先的国产AI算力企业,昆仑芯科技亮相央视镜头。报道中,昆仑芯科技自主研发的新品M100实物首次公开亮相,央视还探访了昆仑芯展台,重点展示了昆仑芯超节点产品、AI算力系统以及覆盖千行百业的应用实践。  最新AI芯片实物首次展示  昆仑芯CEO欧阳剑做客央视新闻直播间,首次展示了新一代AI芯片M100实物。作为昆仑芯科技今年推出的第四代AI芯片产品,M100延续自研XPU架构理念,面向大模型推理时代需求进行了针对性优化,以通用、高效、经济的产品能力,为AI计算提供全新选择。  量产交付的昆仑芯超节点亮相央视探展  在昆仑芯科技首席架构师顾沧海现场向记者介绍了本届WAIC昆仑芯世博展览馆展位展出的核心成果,全面展示昆仑芯从芯片、加速卡、整机到超节点的完整产品体系,以及在大规模AI基础设施建设方面的最新进展。  随着大模型进入万卡集群时代,高性能互联正成为AI基础设施的核心能力。此次WAIC,昆仑芯科技重点展示了32/64卡超节点产品及256卡超节点集群。值得关注的是,昆仑芯超节点已实现量产交付,是国内率先实现量产交付的超节点产品之一。从产品研发到规模化部署,昆仑芯持续推动国产AI算力迈向工程化、规模化应用,为万卡时代AI计算提供成熟可靠的基础设施支撑。  昆仑芯持续赋能千行百业智能化升级  在央视新闻探展过程中,昆仑芯首席架构师顾沧海还向记者重点介绍了昆仑芯AI算力赋能产业落地的最新实践。展区围绕互联网、运营商、政企、智能终端及万卡集群等重点行业,通过真实客户案例,集中展示了昆仑芯AI算力的产业化成果,充分展现国产AI算力从底层芯片、计算系统到行业应用的完整能力。  随着AI进入规模化应用阶段,产业竞争正从单一模型能力逐步演进为芯片、系统、集群与行业应用协同发展的综合能力竞争。凭借完善的产品矩阵、成熟的集群部署能力和丰富的产业实践,昆仑芯产品已为众多行业客户提供稳定、高效的AI算力支撑,市场份额稳居国产AI加速卡前列。面向未来,昆仑芯正持续推动国产AI算力走向更大规模、更广场景的产业化应用。  相约WAIC,共探AI未来  WAIC 2026精彩仍在继续。未来两天,昆仑芯科技诚邀各界嘉宾莅临昆仑芯展台,近距离了解国产AI算力最新成果,共探人工智能产业发展新机遇。
2026-07-20 10:04 reading:217
倒计时1天|明天见!昆仑芯WAIC 2026亮点抢先看
  历经十五年技术积淀与持续迭代,昆仑芯科技现已构建起覆盖底层硬件、计算系统与集群、以及软件生态的完整AI算力产品体系,能够灵活支持从单机部署到万卡级超大规模集群的全场景落地,为大模型应用与行业智能化升级提供高性能、高可靠、易扩展的算力底座。  本届WAIC,昆仑芯将携AI芯片、加速卡、整机、超节点及行业应用成果悉数亮相,集中展示高性能互联、超大规模集群部署、软硬件协同优化等关键技术成果,以及国产AI算力从产品创新到规模化商业落地的最新实践。  展区亮点产品抢先看  昆仑芯32/64卡超节点:作为国内率先实现量产交付的超节点产品之一,昆仑芯超节点采用自主研发超高密度集成架构,单柜集成32/64张加速卡,可扩展至512卡。单柜内卡间实现全互联通信,带宽提升8倍,MoE大模型训练性能提升5-10倍,单卡推理效率提升13倍。能耗层面,该产品采用冷板式液冷技术,整柜功率达66kW,集成漏液检测系统,显著降低PUE。同时,支持IB/RoCE跨柜高速通信,兼容国产OISA标准,可构建从单柜到万卡的完整国产化算力底座。  昆仑芯256超节点产品:最高支持256卡极速互联,性能较上一代提升25%,推理效率提升50%。该产品已完成对文心、DeepSeek、智谱、MiniMax等主流模型的适配,推理效率显著提升。256卡超节点可按需扩展至数十万卡乃至百万卡级超大规模集群,在最大化计算效率的同时,可使数据中心整体建设周期缩短约30%。  规模化商业落地实践  目前,昆仑芯已广泛应用于互联网、大模型、运营商、金融、能源电力、智能终端、智能驾驶等关键领域,为众多行业客户提供稳定、高效的AI算力支撑,市场份额稳居国产AI加速卡前三。  本次展区将通过真实客户案例与应用场景,围绕互联网、运营商、政企、终端及万卡集群等重点行业,集中展示昆仑芯从核心技术创新到产业规模落地的实践成果,让观众直观感受国产AI算力赋能千行百业的应用价值。各领域标杆实践包括:  互联网领域:为各家互联网头部企业提供稳定算力支撑,当前已实现数万卡规模的大模型部署,有效支撑了众多国民级AI应用的研发和应用。  终端领域:携手头部手机厂商打造端云协同AI方案。现场以vivo合作案例为例,展示昆仑芯如何支撑AI影像、多模态AIGC、智能视觉等能力,构建从云端算力到终端AI体验的完整支撑体系。  运营商行业:展示昆仑芯在运营商领域的实践成果。现场将呈现昆仑芯与国内多家运营商的合作案例,展现国产AI算力支撑运营商智算集群建设、模型推理和行业应用。值得一提的是,2025年,昆仑芯中标中国移动2025年集采十亿级订单,三个标包均份额第一。  政企合作方面:以头部政企客户为例,已服务南方电网、国家电网、招商银行、浦发银行等重点行业客户,支撑智能研发、金融分析、知识问答、电网智能运维等典型AI应用,持续推动行业智能化升级。  万卡集群:集中展示昆仑芯在超大规模AI集群建设中的实践成果,集中呈现多个万卡级、千卡级智算集群的商业化应用案例。值得一提的是昆仑芯3.2万卡集群部署案例,充分展现昆仑芯AI算力在大规模部署、稳定运行的能力。  智能驾驶:面向智能驾驶场景,提供高性能AI芯片及软件生态能力,助力多家头部车企推进智能驾驶算法研发与应用落地,为智能汽车提供稳定可靠的AI算力支撑。  芯模共生:展示昆仑芯与主流大模型生态协同发展的最新成果,覆盖文心、DeepSeek、Qwen、GLM、Hunyuan、MiniMax、SenseNova、Kimi、Xiaomi MiMo等模型,通过"开源即适配"能力,持续提升模型部署效率,为行业AI应用提供坚实的算力与软件生态支撑。  从AI芯片到率先实现超节点量产交付,从单机部署到万卡集群,再到丰富的行业应用实践,昆仑芯将携完整的AI算力产品体系亮相WAIC,全面展示国产AI算力在产品创新、系统构建与规模化应用方面的最新成果。  期待与您相聚上海,诚邀莅临昆仑芯展台,明天见!
2026-07-17 09:50 reading:311
相约WAIC 2026|昆仑芯科技邀您共探AI算力新机遇
极速响应,开放协同:昆仑芯高效适配智谱旗舰模型GLM-5.2
  6月17日,智谱GLM-5.2模型正式开源发布。昆仑芯在模型开源当日完成对该模型的适配与联合精调,成为首批完成适配的国产算力厂商之一,再次彰显其在主流大模型生态中的敏捷响应能力与广泛兼容实力,持续推动国产算力与模型生态协同演进。  长程任务能力再突破,GLM-5.2开启Agent工程新阶段据悉据悉,作为智谱最新一代开源模型,GLM-5.2进一步提升了超长上下文理解与工程级任务执行能力,支持真正可用的1M上下文窗口,在长程任务基准测试中保持领先表现,能够高效完成跨文档理解、多轮推理、复杂规划等高难度任务。在全球百万用户参与盲测的前端开发评估系统Code Arena上,GLM-5.2取得全球可用模型第一的表现。  GLM-5.2在前端、后端、长程任务等开发场景下的成功率相比前一代GLM-5.1都有长足提升,复杂系统工程与深度调试更稳。在主流编程基准上,GLM-5.2保持开源SOTA,与Claude Opus 4.8处于可比区间。  依托稳定的长链路执行能力,GLM-5.2能够自主推进复杂任务流程,并在长时间运行过程中持续保持高质量输出。相较于GLM-5.1,其在前后端开发、复杂系统工程、代码生成与深度调试等场景中的任务成功率进一步提升,以更强的可靠性与工程化能力,为开发者构建智能应用提供有力支撑。  开源即适配,昆仑芯再次实现极速响应  随着国产大模型迭代持续提速,算力平台的响应能力正成为影响模型落地效率的重要因素。智谱GLM-5.2正式开源当日,昆仑芯即完成适配,使开发者能够第一时间获得稳定、高效的国产算力支持。此次适配,是继GLM-4.7、GLM-5、GLM-5.1之后,昆仑芯再次实现对智谱旗舰模型的极速响应,进一步验证了其面向主流大模型生态的敏捷适配能力。依托自研架构与持续优化的软件能力,昆仑芯不断提升算子覆盖范围与生态兼容水平,实现模型性能与算力效率的高效匹配。在本次适配过程中,昆仑芯实现了GLM-5.2的精度无损迁移与高效部署,在保障模型稳定运行的同时充分释放硬件计算性能,降低部署门槛,缩短模型从开源发布到产业应用的落地周期,为GLM-5.2前沿能力的快速释放提供坚实的国产算力底座。支撑这一快速适配能力的,是昆仑芯长期深耕打造的自研软件栈。围绕开发者需求,昆仑芯构建了覆盖底层驱动、开发工具SDK、专业算子库等核心环节的自研软件栈,为模型快速迁移、高效部署与稳定运行提供系统性保障。依托成熟的软件生态与持续演进的底层能力,开发者能够以更低成本、更高效率完成模型部署与应用创新,加速先进模型能力向产业价值转化。  “发布即适配”成常态,生态协同全面提速  当前,国产大模型迭代周期持续缩短,从过去以月计逐步演变为以周计。面对不断加快的模型创新节奏,算力平台的响应速度已成为影响先进模型触达开发者与最终用户效率的重要因素。面对智谱GLM系列模型的持续升级,昆仑芯始终保持同步跟进。从GLM-4.7、GLM-5、GLM-5.1到GLM-5.2,昆仑芯均在模型开源后第一时间完成适配与优化,不断缩短先进模型从技术发布到实际应用的时间周期,持续提升国产模型生态的协同效率。  协同共进,加速国产AI生态繁荣  从GLM-5到GLM-5.2,智谱旗舰模型在不足半年的时间内完成多次迭代,折射出国产大模型生态快速演进的发展态势。在这一过程中,模型创新与算力平台之间的协同效率,正成为决定技术突破能否转化为产业价值的关键因素。面向未来,昆仑芯将继续秉持开放协同的发展理念,与模型厂商、开发者及产业伙伴携手推进生态共建,以高效适配加速创新扩散,以协同创新释放产业价值,共同推动国产AI生态迈向更加开放、繁荣的发展新阶段。
2026-06-18 09:40 reading:525
  • Week of hot material
  • Material in short supply seckilling
model brand Quote
CDZVT2R20B ROHM Semiconductor
RB751G-40T2R ROHM Semiconductor
TL431ACLPR Texas Instruments
MC33074DR2G onsemi
BD71847AMWV-E2 ROHM Semiconductor
model brand To snap up
ESR03EZPJ151 ROHM Semiconductor
STM32F429IGT6 STMicroelectronics
TPS63050YFFR Texas Instruments
BU33JA2MNVX-CTL ROHM Semiconductor
IPZ40N04S5L4R8ATMA1 Infineon Technologies
BP3621 ROHM Semiconductor
Hot labels
ROHM
IC
Averlogic
Intel
Samsung
IoT
AI
Sensor
Chip
About us

Qr code of ameya360 official account

Identify TWO-DIMENSIONAL code, you can pay attention to

AMEYA360 weixin Service Account AMEYA360 weixin Service Account
AMEYA360 mall (www.ameya360.com) was launched in 2011. Now there are more than 3,500 high-quality suppliers, including 6 million product model data, and more than 1 million component stocks for purchase. Products cover MCU+ memory + power chip +IGBT+MOS tube + op amp + RF Bluetooth + sensor + resistor capacitance inductor + connector and other fields. main business of platform covers spot sales of electronic components, BOM distribution and product supporting materials, providing one-stop purchasing and sales services for our customers.

Please enter the verification code in the image below:

verification code