讨论精选
FoxiPanda (0↑): 具体是做什么任务?如果你在写生产级 Rust 代码和写生产级 waifu 散文,答案肯定不同。
Important_Quote_1180 (0↑): 很可能是 Qwen 3.5 122B A10B。 我们一直没有出现这个尺寸的模型能在这个尺寸级别上击败它,这让我很抓狂。
EmPips (0↑): 截至今天,2026年7月11日,差距相当大。如果你已经在运行 Qwen3.6-27B-Q8(上下文大约 36GB 才能舒适工作),我认为直到你遇到 V4-Flash 的较小 Q3 量化版本(约 120GB)之前,没什么值得一看的。这真的显示了阿里巴巴领先了多少,因为中间有大约 80GB 的空白,除了“运行更多并行的 qwens”之外什么都没有😂