--- # overrides of group_vars/all.yml hostname: phy-srv-gpu01 # geerlingguy.docker docker_users: - "{{ main_username }}" # ironicbadger.docker_compose_generator # services//NN-/compose.yml next to run.yml appdata_path: "/home/{{ main_username }}/appdata" docker_compose_generator_output_path: "/home/{{ main_username }}/docker/" docker_compose_hostname: phy-srv-gpu01 docker_compose_generator_uid: "{{ main_uid }}" docker_compose_generator_gid: "{{ main_gid }}" # --- LLM stack ------------------------------------------------------------- llm_dns_name: chat.phytron.local # ⚠️ TODO: pin to a build verified on SM120 (Blackwell) before the first deploy vllm_image: vllm/vllm-openai:latest vllm_model: Qwen/Qwen3-32B-FP8 vllm_served_model_name: qwen3-32b vllm_gpu_memory_utilization: "0.80" vllm_max_model_len: "32768" embedding_model: BAAI/bge-m3 embedding_model_name: bge-m3 embeddings_gpu_memory_utilization: "0.10" openwebui_image: ghcr.io/open-webui/open-webui:main pgvector_image: pgvector/pgvector:pg16 # --- AD/LDAP --------------------------------------------------------------- # ⚠️ TODO: real bind DN / base DN from the customer; group llm_users is agreed ldap_server_host: dc.phytron.local ldap_server_port: "389" ldap_bind_dn: "CN=svc-llm,OU=Service,DC=phytron,DC=local" ldap_search_base: "DC=phytron,DC=local" ldap_search_filter: "(&(objectClass=user)(memberOf=CN=llm_users,OU=Groups,DC=phytron,DC=local))"