跳到正文
热点事件持续更新

Qwen3.8-Flash-Next 2.39-bit 量化版发布

1 篇报道1 个报道来源2 小时前更新

先了解这件事

AI 综述

2026年10月2日,开发者 DJLougen 发布了 Qwen3.8-Flash-Next 的超低比特量化版本 Mooney,并已上架 Hugging Face。据 AGI Hunt 报道,该量化版对专家层采用 2.125-bit,全模型平均为 2.39 bits/weight,可保留 BF16 成绩的 95.5%,即仅损失约 4.5% 的性能。其下载体积为 92 GB,运行内存占用约 39 GiB,使这个 1800 亿参数的 MoE 模型能够在单台 DGX Spark 上运行。

AI 根据报道生成 · 1 小时前更新

报道时间线

沿着报道,了解事件的不同侧面。

10月2日
  1. AGI Hunt
    Qwen3.8-Flash-Next 2.39-bit 量化:180B 模型塞进单台 DGX Spark,仅损失 4.5%

    开发者 DJLougen 发布 Qwen3.8-Flash-Next 的超低比特量化版本 Mooney,已上架 Hugging Face,专家层 2.125-bit、全模型平均 2.39 bits/weight,保留 BF16 成绩的 95.5%。下载体积 92 GB、内存占用约 39 GiB,使这个 1800 亿参数的 MoE 模型可在单台 DGX Spark 上运行。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。