Run This Ai
EN DE

BentoML

Der einfachste Weg, KI-Apps und -Modelle bereitzustellen – erstellen Sie Inference-APIs, Job-Queues, LLM-Apps und Multi-Modell-Pipelines.

★ 8,770 GitHub Apache-2.0 mlopsmodel-servingllminferencepython LLM & Chat

Überblick

BentoML ist eine Open-Source-Plattform für die Erstellung, Bereitstellung und Skalierung von KI-Anwendungen. Verwandeln Sie jedes Python-Modell mit nur wenigen Zeilen Code in eine produktionsreife Inference-API. Unterstützt werden LLM-Apps, Vision-Modelle, Multi-Modell-Pipelines und Hintergrund-Job-Queues mit adaptivem Batching und verteilter Bereitstellung. Native Integrationen mit PyTorch, TensorFlow und Hugging Face Transformers. Überall bereitstellen: Docker, Kubernetes oder BentoCloud.

Anforderungen

Min vCPU
2
Min RAM
4096 MB
Min Disk
10 GB
Rec vCPU
4
Rec RAM
8192 MB
Rec Disk
20 GB

Empfohlener VPS

Hostinger · KVM 4

4 vCPU · 16384 MB · 200 GB

$11.99
Zum Anbieter

Hostinger · KVM 4

4 vCPU · 16384 MB · 200 GB

$11.99
Zum Anbieter

Hostinger · KVM 8

8 vCPU · 32256 MB · 400 GB

$20.00
Zum Anbieter

Affiliate-Hinweis

Docker Compose

# Generated by Run This Ai — docker-compose.yml
services:
  bentoml:
    image: bentoml/model-server:latest
    restart: unless-stopped
    ports:
      - 8080:8080
    volumes:
      - ./data/bentoml:/data

Bester VPS für BentoML →

Verwandte Tools

Anleitungen & Artikel