趋境科技与摩尔线程战略合作,国产AI Token异构方案性价比超国际

2026-09-05 03:10 3 次浏览 前沿资讯

趋境科技与摩尔线程达成战略合作,推出基于国产GPU的高品质AI Token异构计算方案。该方案在生产级性能上实现突破,性价比超越国际先进算力,标志着国产AI基础设施在推理效率与成本控制上迈出关键一步。

当前大模型落地已进入深水区,AI Token作为推理过程中的核心计量单位,其生成质量与成本直接决定应用场景的经济可行性。2026年9月,趋境科技与摩尔线程正式宣布达成战略合作,双方联合打造的高品质AI Token国产异构方案,在性能与性价比两个维度均实现对国际先进算力的超越。这一合作不仅为国产AI基础设施注入新动力,也为行业提供了可复用的高性价比算力路径。

事件概览

据官方信息,趋境科技与摩尔线程将围绕AI推理场景,整合各自在算法优化与硬件设计上的优势,推出面向高品质AI Token生成的异构计算方案。该方案基于摩尔线程的国产GPU,结合趋境科技的推理框架与运行时优化技术,实现了从算力调度到模型部署的全链路协同。值得注意的是,双方宣称该方案在生产级环境下,能够稳定输出高品质AI Token,且其单位成本显著低于采用国际主流GPU的同类方案,形成了明确的性价比优势。

核心信息

高品质AI Token的生成能力

AI Token是大型语言模型推理过程中的基本语义单元,其生成质量直接影响回答的准确性与连贯性。传统上,高品质Token的生成依赖高端GPU的大显存与高带宽,而国产卡长期面临生态兼容与性能瓶颈。趋境科技与摩尔线程的合作,通过底层算子优化、显存管理以及动态批处理等技术,使国产卡在同等算力下能够产出不低于国际先进水平的Token质量。据合作方透露,该方案在多个主流开源模型上验证了生产级性能,包括长文本生成、多轮对话以及代码辅助等场景。

国产异构方案的技术特点

异构方案的核心在于将不同类型计算单元(如GPU、CPU、NPU)协同工作,以匹配AI推理中不同负载的算力需求。摩尔线程的GPU具备统一的CUDA兼容架构,趋境科技则在此基础上开发了针对性的推理引擎,实现了跨硬件资源的智能调度。此外,该方案还引入了量化压缩、稀疏计算等优化手段,在降低显存占用的同时保持高精度,使得国产卡在高并发、低延迟场景下仍能稳定运行。这种软硬协同的设计,避免了单纯堆砌硬件带来的成本上升,从而在性价比上形成突破。

性价比超越国际先进算力

性价比是衡量算力方案商业成熟度的关键指标。趋境科技与摩尔线程表示,该方案在总拥有成本(TCO)上相比国际头部GPU方案降低30%以上,同时性能表现达到或接近后者水平。具体而言,在同等Token输出量下,国产异构方案的单位算力成本更低,且由于国产GPU的供应链自主可控,客户无需担忧地缘政治风险导致的供货中断。这一优势对于需要大规模部署AI推理能力的企业尤为关键,有助于降低其AI应用的门槛与运营成本。

影响与观察

此次合作对国产AI算力生态具有多重意义。首先,它证明了国产GPU在推理场景中具备替代国际主流产品的潜力,打破了过去“国产卡只能做训练,推理仍需依赖进口”的刻板印象。其次,高品质AI Token的国产化,将推动更多企业将核心业务迁移至国产平台,加速国内AI产业链的自主可控进程。从行业角度看,趋境科技与摩尔线程的联合方案,也为其他AI基础设施厂商提供了“算法+硬件”协同创新的范例,有助于形成良性竞争、降低整体算力成本。值得关注的是,该方案能否在更大规模、更复杂的生产环境中持续验证其稳定性,将是未来市场接受度的关键。

结语

趋境科技与摩尔线程的战略合作,是国产AI算力从“可用”迈向“好用”的重要一步。通过高品质AI Token异构方案,双方不仅实现了性价比层面的超越,更在技术自主性上树立了标杆。随着大模型应用持续渗透各行各业,具备高性价比与国产化优势的算力方案,将为中国AI产业的高质量发展提供坚实底座。


信息来源:量子位,查看原始信息。本文由 AI ONLINE 基于公开资料整理,信息可能随时间变化,请以官方发布为准。