讨论精选
sixx7 (0↑): 完全同意!我在这里做了评测: https://youtu.be/32pkyoYmNjI
但 TLDR 版本:
比 deepseek-v4-flash 强很多的编程能力
只有在速度是首要考虑因素时才继续使用 deepseek-v4-flash
比 MiniMax M3 好不少
思考很多,因此感觉慢
编辑:哦,我忘了重要的事情。Deepseek 可以容纳 100 万上下文,而我在 Hy3 上只能得到大约 19 万。这对某些人来说可能是决定性因素。我也不是在贬低 Deepseek v4,它是一项工程奇迹。
Cold_Tree190 (0↑): 好奇想听听高显存用户(羡慕)的看法,但像 Q3 Hy3 这样的模型与基本全量化的 Qwen3.6:27B 相比如何?运行一个更大的 MoE 模型,即使是 Q3 量化,真的比全量密集模型更好吗?
Voxandr (0↑): 我刚拿到 DGX Spark 的线缆,准备运行 2x 和 3x Spark Hy3 张量并行性能测试。看起来很有趣!