Vllm Embedding Server

Start, debug, and verify local vLLM embedding servers on this machine, especially Qwen embedding models under `/mnt/share_data_78` with the vLLM virtualenv at `/tmp2/howard/venv_manager/vllm`. Use when the user asks to open/start/serve an embedding model with vLLM, mentions qwen-embedding, Qwen3 embedding, first GPU/card, or needs an OpenAI-compatible `/v1/embeddings` endpoint.

yenhao-huang Updated

File contents

yenhao-huang/mcp-skills-package/tree/main/skills/engineer/vllm-embedding-server commit 078e3f2776

Frequently asked questions

npx skillmds@latest add yenhao-huang/vllm-embedding-server