2026-10-01 · 行业动态 · 重要性 ★★★
针对 2.8 万亿参数模型 Kimi K3,海内外团队通过算子融合提升推理效率
硅谷扔出“巨内核”,中国团队祭出“超级算子”,万亿参数模型效率战打响! 浪潮信息和 Inferact 团队分别针对 2.8 万亿参数开源模型 Kimi K3 的推理效率提出解决方案。通过“超级算子”融合与 TPU“巨内核”技术,将推理时延降低至 5.85 毫秒或吞吐提升至 709 tokens/s,标志着大模型竞争从算法层深入到系统软件与底层硬件适配层。
一手来源:智东西 ↗
← 返回资讯列表本站仅做聚合整理与来源标注,版权归原作者所有。

