https://hf.co/Qwen/Qwen3-Embedding-0.6B를 https://github.com/huggingface/text-embeddings-inference와 함께 실행하는 것은 GPU 없이 2~4GB RAM을 가진 서버에서도 충분히 가능할 것입니다.
3개의 좋아요
https://hf.co/Qwen/Qwen3-Embedding-0.6B를 https://github.com/huggingface/text-embeddings-inference와 함께 실행하는 것은 GPU 없이 2~4GB RAM을 가진 서버에서도 충분히 가능할 것입니다.