Run This Ai
EN DE

vLLM Omni

Ein auf vLLM basierendes Framework für die effiziente Modellinferenz mit Omni-Modalitäts-Modellen.

★ 6,167 GitHub Apache-2.0 vllminferencemultimodalllmdiffusionaudio LLM & Chat

Überblick

vLLM Omni erweitert die vLLM-Inferenzengine auf Omni-Modalitäts-Modelle und ermöglicht die effiziente Bereitstellung von Text-, Bild- und Audio-Generierungs- sowie Diffusionsmodellen mit einheitlichen Schnittstellen, hohem Durchsatz und geringer Latenz.

Anforderungen

Min vCPU
2
Min RAM
4096 MB
Min Disk
10 GB
Rec vCPU
4
Rec RAM
8192 MB
Rec Disk
20 GB

Empfohlener VPS

Hostinger · KVM 4

4 vCPU · 16384 MB · 200 GB

$11.99
Zum Anbieter

Hostinger · KVM 4

4 vCPU · 16384 MB · 200 GB

$11.99
Zum Anbieter

Hostinger · KVM 8

8 vCPU · 32256 MB · 400 GB

$20.00
Zum Anbieter

Affiliate-Hinweis

Docker Compose

# Generated by Run This Ai — docker-compose.yml
services:
  vllm-omni:
    image: vllm/vllm-omni:latest
    restart: unless-stopped
    ports:
      - 8080:8080
    volumes:
      - ./data/vllm-omni:/data

Bester VPS für vLLM Omni →

Verwandte Tools

Anleitungen & Artikel