Zum Inhalt springen
InfercomInfercomInfercom Documentation

Übersicht

Infercom API-Referenz - Übersicht

Vollständige API-Referenz für den Infercom Inference Service. OpenAI-kompatible Endpunkte für Chat Completions, Modelle und Embeddings.

Der Infercom Entwicklerhandbuch und die API-Referenz bieten Ihnen die Tools, die Sie benötigen, um Anwendungen mit Infercom als Inference-Service zu erstellen.

Endpunkt Beschreibung Am besten für
/v1/chat/completions OpenAI-kompatible Chat-API Konversationsanwendungen, OpenAI SDK-Nutzer
/v1/messages Anthropic-kompatible Messages-API Claude Code, LangChain Anthropic, Anthropic SDK-Nutzer
/v1/responses Strukturierte Ausgabe-API für agentenbasierte Workflows Coding-Agenten, Tool-Aufrufe, mehrstufiges Reasoning

Siehe OpenAI-Kompatibilität für die Chat Completions API, Anthropic-Kompatibilität für die Messages API, oder Responses API für agentenbasierte Workflows.

Endpunkt Beschreibung Am besten für
/v1/embeddings Vektor-Embeddings generieren RAG, semantische Suche, Klassifizierung

Siehe Embeddings für Anwendungsbeispiele.

Endpunkt Beschreibung Am besten für
/v1/audio/transcriptions Audio zu Text transkribieren Spracherkennung, Meeting-Transkription
/v1/audio/translations Audio ins Englische übersetzen Mehrsprachige Audioverarbeitung

Siehe Audio für Anwendungsbeispiele.

Die Code-Beispiele in dieser API-Referenz enthalten die spezifischen URLs für die Entwicklung mit Infercom Inference Service.

Der /v1/models-Endpunkt unterstützt einen ?verbose=true-Abfrageparameter, der detaillierte Metadaten für jedes Modell zurückgibt, einschließlich Souveränitätsinformationen. Verwenden Sie das Feld sn_metadata.region, um festzustellen, wo ein Modell gehostet wird:

  • "EU" — das Modell läuft auf Infercoms EU-Infrastruktur in Deutschland mit vollständiger Datensouveränität
  • Leer oder nicht vorhanden — das Modell ist über SambaNovas globale Infrastruktur verfügbar

Siehe Unterstützte Modelle für Details und Code-Beispiele.