Liquid AI 发布 LFM2.5-DSpark 投机解码模型,推理速度最高提升 3.18 倍
Liquid AI 为 LFM2.5 系列三款模型 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 投机解码草稿模型,GPU 上推理吞吐最高提升 3.18 倍,端侧最高提速 2.87 倍,且不改变输出质量。
Liquid AI 为 LFM2.5 系列三款模型 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 投机解码草稿模型,GPU 上推理吞吐最高提升 3.18 倍,端侧最高提速 2.87 倍,且不改变输出质量。
Mistral 发布 Mistral Small 4,首次把 Magistral 推理、Pixtral 多模态和 Devstral 代码智能体能力整合到一个模型,采用 Apache 2.0 开源。
推荐理由:Mistral Small 4 将推理、多模态与代码能力整合到单一模型,可作为评估开源混合推理模型效率的对照参考。