Liquid AI 发布 LFM2.5-DSpark 投机解码模型,推理速度最高提升 3.18 倍
Liquid AI 为 LFM2.5 系列三款模型 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 投机解码草稿模型,GPU 上推理吞吐最高提升 3.18 倍,端侧最高提速 2.87 倍,且不改变输出质量。
Liquid AI 为 LFM2.5 系列三款模型 LFM2.5-1.2B-Instruct、LFM2.5-2.6B 和 LFM2.5-8B-A1B 发布 DSpark 投机解码草稿模型,GPU 上推理吞吐最高提升 3.18 倍,端侧最高提速 2.87 倍,且不改变输出质量。
Google Research 发布论文 SymptomAI,基于 Gemini Flash 2.0 构建 5 个不同问诊策略的对话式 AI 智能体,并在 n=13,917 的全国随机研究中让参与者描述症状、两周后回报临床诊断结果。
推荐理由:原文给出了 13,917 人随机对照的诊断准确率与可穿戴生理信号对照方法,读者可据此判断该方法在真实人群中的迁移潜力。
Mistral 发布 Mistral Small 4,首次把 Magistral 推理、Pixtral 多模态和 Devstral 代码智能体能力整合到一个模型,采用 Apache 2.0 开源。
推荐理由:Mistral Small 4 将推理、多模态与代码能力整合到单一模型,可作为评估开源混合推理模型效率的对照参考。