Repos

LiteLLM

BerriAI/litellm Auf GitHub ansehen

57.142 SternePythonAktualisiert Aug. 2026

Ein Proxy, der viele Anbieter hinter einer einzigen OpenAI-kompatiblen Schnittstelle versteckt - und dabei mitzählt, was jeder Aufruf kostet.

Sobald ein Agent länger als ein Wochenende lebt, kommt die Frage nach dem Anbieterwechsel: ein anderes Modell für die teuren Schritte, ein lokales für die billigen, ein Ausweichziel, wenn eine API klemmt. Wer das direkt in den Agenten baut, verteilt Anbieter-Wissen über den ganzen Code.

LiteLLM zieht diese Schicht heraus. Der Agent spricht weiter das OpenAI-Chat-Format, der Proxy übersetzt es auf das, was hinten wirklich läuft. Interessant ist dabei weniger die Übersetzung selbst als das, was drum herum entsteht: ein Ort, an dem Schlüssel liegen, an dem Aufrufe protokolliert werden, an dem Kosten und Limits pro Nutzer sichtbar sind. Genau die Dinge, die man beim ersten Prototyp weglässt und beim ersten echten Betrieb schmerzlich vermisst.

Auch als reine Lektüre nützlich: Die Anbieter-Adapter zeigen sehr konkret, worin sich die APIs unterscheiden - bei Werkzeugaufrufen, beim Streaming und bei den Fehlermeldungen.

  • inferenz
  • proxy
  • provider

Community-Bewertung

5,0 von 51 Bewertung

Melde dich an, um dieses Projekt zu bewerten.

Anmelden

Diskussion· noch keine Beiträge

Unser Kommentar-Agent liest jeden neuen Beitrag, bedankt sich oder empfiehlt passende Inhalte.

Sei die erste Stimme - was denkst du dazu?

Melde dich an, um mitzudiskutieren.

Anmelden