Infercom Router

Infercom in Claude und ChatGPT. EU-souverän, ein Klick.

Infercom Router ist ein Konnektor für Claude Desktop, Cowork, claude.ai und ChatGPT. Ihr Assistent delegiert die schwere Arbeit an offene Modelle auf Infercom in deutschen Rechenzentren: günstiger, mit Fähigkeiten wie Transkription und 192k Kontext, und mit Nachweis, welches Modell wo gerechnet hat. Der Router wählt das Modell, Sie sehen Tokens und Kosten in Echtzeit.

Kostenlos registrieren   So funktioniert es

Passendes Modell, automatisch

Coding, Analyse, Zusammenfassen, Bilder, Audio: Regeln plus Klassifikation wählen zwischen MiniMax, gpt-oss, Gemma und Whisper. EU-Modelle sind Standard.

Transparent bis zum Token

Jede Antwort nennt Modell, Begründung, Tokens und Kosten. Das Dashboard zeigt Verbrauch und Guthaben.

Schwere Arbeit nach Europa

Lange Dokumente, Transkriptionen und Massenverarbeitung laufen auf Infercom in Deutschland, ohne Speicherung (Zero Data Retention). Ihr Assistent erhält nur das Ergebnis. Was Sie direkt in Claude oder ChatGPT eingeben, sieht deren Anbieter weiterhin.

In zwei Minuten eingerichtet

  1. Registrieren und anmelden. Infercom-Mitarbeitende nutzen den Dienst kostenfrei.
  2. Guthaben laden (ab 25 €) oder eigenen Infercom-Key hinterlegen.
  3. Konnektor im Assistenten eintragen, Anleitung je Assistent unten.
  4. Loslegen: „Nutze Infercom und fass dieses Dokument zusammen.“
1Konto2Guthaben oder Key3Konnektor4Loslegen

So arbeitet der Router

Ihr Assistent Claude · ChatGPT · Gemini CLI erkennt: „Infercom nutzen“ ruft das Tool ask Infercom Router mcp.pioneerdesk.pro · STACKIT, Deutschland 1 Login prüfen, Guthaben oder eigener Key 2 Modell wählen: Regeln + Klassifikation 3 Tokens und Kosten verbuchen 4 Antwort + Begründung zurück Infercom EU · keine Speicherung MiniMax-M2.7 gpt-oss-120b gemma-4-31B-it Whisper · E5 + Global: DeepSeek, Llama Aufgabe Ergebnis Prompt Antwort Täglich: Katalog und Preise von Infercom abgleichen, Routing anpassen

Ihr Assistent bleibt das Cockpit und sieht Ihre Eingabe. Der Router übernimmt Auswahl, Ausführung auf Infercom und die Abrechnung, und liefert Ergebnis plus Begründung zurück. Inhalte werden weder bei uns noch bei Infercom gespeichert.

Einrichtung je Assistent

Claude Desktop, Cowork, claude.ai, Mobile (Pro, Max, Team, Enterprise; Free mit einem Konnektor)

  1. Customize → Connectors → Add custom connector.
  2. https://suveri.de/mcp eintragen: https://suveri.de/mcp. Keine weiteren Felder.
  3. Claude öffnet unsere Anmeldung. Registrieren oder anmelden, fertig.
  4. Im Chat: „Nutze Infercom und fass dieses Dokument zusammen.“ Claude ruft das Tool ask.

Team/Enterprise: Ein Owner fügt den Konnektor unter Organisationseinstellungen hinzu, Mitglieder aktivieren ihn selbst. Claude Code: claude mcp add --transport http infercom https://suveri.de/mcp

ChatGPT (Plus, Pro, Business, Enterprise, Edu; Web-App)

  1. Settings → Apps → Advanced settings → Developer mode einschalten. In Business/Enterprise muss ein Admin das erlauben.
  2. Apps → Add connector → https://suveri.de/mcp https://suveri.de/mcp, Authentifizierung OAuth.
  3. Anmeldung durchlaufen, Konnektor im Chat aktivieren.
  4. Im Chat oder in Deep Research nutzen. Für Deep Research stehen search und fetch bereit.

Entwickler: über die Responses API als Tool vom Typ mcp mit derselben URL.

Gemini

Die Gemini-App bietet derzeit keine eigenen Konnektoren. Der Router funktioniert dort über die Gemini CLI, die MCP-Server unterstützt:

  1. In ~/.gemini/settings.json unter mcpServers eintragen: {"infercom": {"httpUrl": "https://suveri.de/mcp"}}
  2. Gemini CLI starten, /mcp zeigt den Server, die Anmeldung öffnet sich im Browser.
  3. Aufgaben wie in Claude formulieren.

Sobald Google Konnektoren in der Gemini-App freigibt, funktioniert derselbe Endpunkt ohne Änderung.

Chat im Portal: souverän von Anfang bis Ende

Wer ganz ohne US-Anbieter arbeiten will, chattet direkt im Portal. Das steuernde Modell läuft bei Infercom in Deutschland, der Verlauf liegt verschlüsselt bei uns (30 Tage, jederzeit löschbar, „nicht speichern“ pro Unterhaltung).

Dateien verstehen

PDF, Word, Excel, PowerPoint, Markdown, Code, Bilder, Audio und Video hochladen. Gescannte PDFs werden gelesen, Bilder beschrieben, Ton transkribiert, alles bei Infercom.

Wissensbasis pro Unterhaltung

Große Dateien werden in Abschnitte zerlegt und eingebettet. Zu jeder Frage kommen die passenden Stellen ins Modell, mit Dateiname und Abschnitt als Quelle.

Web lesen und live recherchieren

Links in Ihrer Nachricht liest unser Server selbst. Mit „Recherche“ suchen wir live (eigene Metasuche, optional Google, nur die Suchanfrage geht hinaus) und geben die besten Seiten mit Quellenangabe und Stand ins Modell. Gelesene Seiten liegen versioniert im gemeinsamen Cache.

Verifact zuschaltbar

Verifiziertes deutsches Recht mit amtlichen Fundstellen, Vertrauenswert und Stand als belegte Grundlage. Pro Unterhaltung, 0,10 € je belegter Antwort, kostenfrei für Infercom-Mitarbeitende.

Qualitätsstufen

Standard: ein Modell, vom Router gewählt. Geprüft: gpt-oss-120b prüft jede Aussage gegen Belege und markiert Unbelegtes. Ensemble: zwei Modelle antworten, ein drittes prüft und verschmilzt. Kosten je Schritt sichtbar, alles auf EU-Modellen.

Souverän und transparent

Verlauf verschlüsselt bei uns, 30 Tage, jederzeit löschbar oder gar nicht speichern. Jede Antwort nennt Modelle, Tokens und Kosten. Kein US-Anbieter sieht Frage, Dateien oder Antwort.

Chat öffnen

Preise

Guthaben-Kunden zahlen pro Million Tokens die unten stehenden Preise, netto. Mit 25 € Guthaben erhalten Sie zum Beispiel rund 46.175.824 Ausgabe-Tokens bei gemma-4-31B-it. Mit eigenem Infercom-Key rechnet Infercom direkt mit Ihnen ab, der Konnektor ist dann kostenfrei.

ModellRegionFähigkeitenKontextEingabe / 1MAusgabe / 1M
gemma-4-31B-itEUvision131.0720.26 €0.46 €
gpt-oss-120bEUreasoning, tools131.0720.29 €0.77 €
MiniMax-M2.7EUtools196.6080.78 €3.12 €
Meta-Llama-3.3-70B-InstructGlobaltext131.0720.78 €1.56 €
DeepSeek-V3.1Globalreasoning, tools131.0723.90 €5.85 €
DeepSeek-V3.2Globalreasoning32.7683.90 €5.85 €
E5-Mistral-7B-InstructEUembedding4k0.17 €
Whisper-Large-v3EUaudio0.13 € / Std.

Alle 8 Modelle des Infercom-Katalogs (Stand: täglicher Abgleich mit api.infercom.ai). EU = Rechenzentren in Deutschland, Standard im Router. Global = Infrastruktur in USA/Japan, nur auf ausdrücklichen Wunsch. Preise netto zzgl. USt.; Whisper je Audiostunde, E5 nur Eingabe-Tokens. Aufladung ab 25 € brutto, Rechnung sofort per E-Mail.

Optional: Verifact-Antwort im Chat 0,10 € je Frage, netto, nur wenn der Schalter aktiv ist und Verifact eine belegte Antwort liefert. Für Infercom-Mitarbeitende kostenfrei.