阿里云适配 Kimi K3 LLM,首个 Token 延迟降低 35%

BABA0.54%
据《Security Times》报道,阿里云在 7 月 27 日将其灵聚臻武 M890 超级节点实例适配为运行 Kimi K3,这是一款大型语言模型。通过芯片、推理平台和模型的联合优化,首 token 延迟——模型开始显示输出所需的时间——降低了约 35%,提升了长上下文交互的流畅度。阿里云还表示,将通过其通义千问 AI 平台和百炼为 Kimi K3 提供 API,双方也将进一步深化在国产算力方面的合作。
免责声明:本页面信息可能来自第三方,仅供参考,不代表 Gate 的观点或意见,亦不构成任何财务、投资或法律建议。数字资产交易风险较高,请勿仅依赖本页面信息作出决策。具体内容详见声明
评论
0/400
暂无评论