讨论精选
Cold_Tree190 (0↑): 嗯……我非常喜欢这个想法。你让我想到了一个我之前没考虑过的事情,谢谢。
whakahere (0↑): 这就是我在自己机器上搭建的东西。我的显存不算大,只有一块8GB的4060和一块16GB的5060 Ti。我把8GB的卡用于嵌入和排序。目前我还在索引所有内容。 我希望我的8GB卡作为内存GPU,16GB卡作为本地编码器。
无论如何,这在我的家庭实验室里是个有趣的实验。
Dry_Yam_4597 (0↑): 你在多少块特斯拉上运行它?
本地嵌入和重排序模型在资源有限时比本地LLM更实用。

获取在有限显存(如8GB+16GB)下部署嵌入和排序模型的实践经验。
深入阅读
讨论精选
Cold_Tree190 (0↑): 嗯……我非常喜欢这个想法。你让我想到了一个我之前没考虑过的事情,谢谢。
whakahere (0↑): 这就是我在自己机器上搭建的东西。我的显存不算大,只有一块8GB的4060和一块16GB的5060 Ti。我把8GB的卡用于嵌入和排序。目前我还在索引所有内容。 我希望我的8GB卡作为内存GPU,16GB卡作为本地编码器。
无论如何,这在我的家庭实验室里是个有趣的实验。
Dry_Yam_4597 (0↑): 你在多少块特斯拉上运行它?