利好
Ant L3.0-flash开源,FP8版仅占128GB内存
2026-08-05 15:35
inclusionAI发布Ling-3.0-flash,1240亿参数模型FP8量化后性能偏差仅1.57分。
据 Woofun AI 消息,AntBabel(inclusionAI)正式开源 Ling-3.0-flash 模型权重,提供 BF16 与 FP8 两种格式,均采用 MIT 许可证。该模型拥有 1240 亿参数,支持 256,000 Token 上下文,单次生成仅激活 51 亿参数,主要面向编程及 Agent 任务。BF16 版本权重约 255GB,FP8 版本降至 128GB,官方基准测试显示两者性能最大偏差仅为 1.57 分。
WOOFUN AI
影响力评估 · 一键速读
Ling-3.0-flash 通过稀疏激活架构,以百亿级参数量实现与万亿级模型相当的性能,大幅降低部署门槛。FP8 量化将显存需求减半且精度损失极小,有利于在消费级硬件上运行高性能 Agent。此举或推动开源社区对高效推理架构的关注,加剧中小模型在垂直领域的竞争。
WOOFUN AI 生成 · 仅供参考,非投资建议
评论
暂无评论