Skip to main content
Der Infercom Inference Service bietet Zugang zu einer breiten Auswahl an KI-Modellen über den Global Model Catalog. Modelle sind in zwei Kategorien verfügbar: EU-gehostete Modelle, die auf Infercoms souveräner Infrastruktur in Deutschland laufen, sowie zusätzliche Modelle über globale Infrastruktur.

EU-gehostete Modelle

Die folgenden Modelle laufen auf Infercoms EU-Infrastruktur in Deutschland. Für diese Modelle findet die gesamte Datenverarbeitung innerhalb der EU statt — keine Daten verlassen die EU-Gerichtsbarkeit, mit vollständiger DSGVO-Konformität und ohne Zugriff nach US CLOUD Act.

Textgenerierungsmodelle

Embedding-Modell

Audio-Modell

Global Model Catalog

Zusätzlich zu den EU-gehosteten Modellen bietet der Infercom Inference Service über den Global Model Catalog Zugang zu einer breiteren Auswahl an Modellen. Modelle, die nicht in unseren EU-Rechenzentren gehostet sind, werden über globale Infrastruktur bereitgestellt. Die Hosting-Region jedes Modells können Sie jederzeit über die API oder den Playground prüfen.
Jedes Modell ist eindeutig mit seiner Hosting-Region gekennzeichnet — sowohl in der API-Antwort als auch im Playground. Sie wissen immer, wo Ihre Daten verarbeitet werden.
Siehe Modellregionen identifizieren unten, um zu prüfen, wo jedes Modell läuft.

Empfohlene Sampling-Parameter

Sampling-Parameter sind modellspezifisch. Verwenden Sie die Werte, die der jeweilige Modellanbieter empfiehlt, statt einer einheitlichen Einstellung für alle Modelle. Die folgende Tabelle gibt die Empfehlung des jeweiligen Anbieters wieder, mit Link zur Quelle. Ein Strich bedeutet, dass der Anbieter für diesen Parameter keinen Wert veröffentlicht. Wo keine Empfehlung vorliegt, gehen Sie von den API-Standardwerten aus und optimieren Sie für Ihren eigenen Anwendungsfall. DeepSeek-V3.1 veröffentlicht keine Empfehlung im Fließtext, die mitgelieferte Generation-Config verwendet jedoch standardmäßig temperature 0.6 und top_p 0.95. Die Infercom API akzeptiert eine temperature zwischen 0 und 2. temperature=1.0 bedeutet nicht “maximale Zufälligkeit” - es bedeutet, dass die Wahrscheinlichkeitsverteilung des Modells exakt so verwendet wird, wie sie trainiert wurde. Werte unter 1.0 schärfen sie, Werte über 1.0 flachen sie ab. Passen Sie temperature, top_p oder top_k an, in der Regel jedoch nicht mehr als einen davon gleichzeitig.
Sehr niedrige Temperaturen können zu nicht endendem Reasoning führen. Reasoning-Modelle können in eine Wiederholungsschleife geraten und denselben Punkt wiederholen, bis max_tokens aufgebraucht ist. Sie erhalten dann finish_reason: "length" und keine brauchbare Antwort. Ein höheres max_tokens hilft nicht. Eine niedrige Temperatur bleibt eine legitime Wahl für reproduzierbare oder strukturierte Ausgaben - bewegen Sie sie jedoch zurück in Richtung des empfohlenen Werts, wenn Sie abgeschnittene Antworten sehen. Siehe Reasoning.

Standard-System-Prompt für MiniMax-M2.7

MiniMax veröffentlicht einen Standard-System-Prompt für MiniMax-M2.7. Verwenden Sie ihn unverändert, sofern Sie keinen Grund haben, ihn zu ersetzen (der Prompt bleibt auf Englisch, wie vom Anbieter veröffentlicht):

Modellregionen identifizieren

Sie können über die API oder den Playground feststellen, wo ein Modell gehostet wird.

Über die API

Der /v1/models-Endpunkt enthält ein sn_metadata-Objekt für jedes Modell. Verwenden Sie das region-Feld, um festzustellen, wo ein Modell gehostet wird: "EU" für souveräne Modelle auf Infercoms EU-Infrastruktur, oder eine Nicht-EU-Region (z.B. "US", "JP") für Modelle auf globaler Infrastruktur. Verwenden Sie den ?verbose=true-Abfrageparameter, um detaillierte Modell-Metadaten einschließlich Souveränitätsinformationen abzurufen:
Beispielantwort für ein EU-gehostetes Modell:
Beispielantwort für ein global geroutetes Modell:

Über den Playground

Im Infercom Playground werden Regionsflaggen neben jedem Modellnamen angezeigt, sodass Sie auf einen Blick sehen können, wo jedes Modell läuft.

Datensouveränität

EU-Souveränität gilt nur für EU-gehostete Modelle. Bei der Nutzung von Modellen aus dem Global Model Catalog, die nicht auf EU-Infrastruktur gehostet sind, werden Anfragen auf globaler Infrastruktur außerhalb der EU verarbeitet. Prüfen Sie immer die Region des Modells, bevor Sie sensible oder regulierte Daten verarbeiten.
Für EU-gehostete Modelle bietet Infercom:
  • EU-Datenresidenz — Inferenz läuft in unseren EU-Rechenzentren
  • DSGVO-Konformität — vollständige Einhaltung der EU-Datenschutzverordnung
  • Kein US CLOUD Act-Zugriff — Ihre Inferenzdaten unterliegen nicht der US-Gerichtsbarkeit
  • AI Act-Bereitschaft — konzipiert für die Einhaltung des EU AI Act