Suveri
Infercom Solution Partner · Rechenzentren in Deutschland

KI für Ihr Unternehmen, die in Europa bleibt.

Fragen, Dokumente, Recherche und geprüftes Recht: Suveri beantwortet alles mit offenen Modellen auf Infercom in deutschen Rechenzentren. Keine Speicherung bei Dritten, jede Antwort mit Modell, Kosten und Quellen.

Kostenlos registrieren, dann direkt antworten lassen. Firmen-E-Mail genügt.
EU-Rechenzentren, Zero Data RetentionBelegte Antworten mit VerifactKosten je Antwort sichtbarAuch in Claude und ChatGPT nutzbar

Alles drin, was Teams täglich brauchen

Ein Arbeitsplatz für Fragen, Dokumente und Recherche, auf offenen Modellen, mit nachvollziehbaren Kosten.

Dokumente verstehen

PDF (auch gescannt), Word, Excel, PowerPoint, Bilder, Audio und Video. Große Dateien werden zur Wissensbasis der Unterhaltung, mit Quellenangabe je Antwort.

Live recherchieren

Links liest unser Server selbst, die Recherche sucht über eigene Metasuche und liest die besten Treffer. Quellen und Stand stehen unter jeder Antwort.

Geprüftes Recht

Verifact liefert deutsches Recht mit amtlichen Fundstellen und Vertrauenswert als Grundlage, zuschaltbar pro Unterhaltung.

Modell frei wählen oder routen lassen

MiniMax, gpt-oss, Gemma, Whisper und mehr. Der Router wählt je Aufgabe, oder Sie legen das Modell fest. Preis je Modell steht daneben.

Qualitätsstufen und Challenge me

Geprüft: ein zweites Modell markiert Unbelegtes. Ensemble: zwei Modelle antworten, ein drittes verschmilzt. Challenge me lässt Senior-Rollen widersprechen.

Schutz vor versteckten Anweisungen

Unsichtbarer Text in Dateien und Webseiten wird erkannt und entfernt, Links in Antworten geprüft. Gemessen im Red-Team-Eval: 0 von 130 Angriffen befolgt.

So funktioniert es

Drei Schritte, keine Installation.

1

Registrieren

Mit Firmen-E-Mail anmelden, Aktivierungslink klicken. Kein Passwort-Zoo, gelegentlich ein Code per E-Mail.

2

Fragen oder hochladen

Direkt im Chat schreiben, Dateien ziehen, Verifact oder Recherche zuschalten. Der Router wählt das passende Modell.

3

Zahlen, was Sie nutzen

Guthaben laden, jede Antwort zeigt Tokens und Kosten. Firmen erhalten Kontingente, darüber gilt der Tokenpreis.

Auch in Ihrem Assistenten

Suveri ist zugleich ein Konnektor: Claude, ChatGPT und Gemini CLI delegieren Aufgaben an dasselbe Konto, mit derselben Abrechnung.

Claude Desktop, Cowork, claude.ai, Mobile (Pro, Max, Team, Enterprise; Free mit einem Konnektor)

  1. Customize → Connectors → Add custom connector.
  2. https://suveri.de/mcp eintragen: https://suveri.de/mcp. Keine weiteren Felder.
  3. Claude öffnet unsere Anmeldung. Registrieren oder anmelden, fertig.
  4. Im Chat: „Nutze Infercom und fass dieses Dokument zusammen.“ Claude ruft das Tool ask.

Team/Enterprise: Ein Owner fügt den Konnektor unter Organisationseinstellungen hinzu, Mitglieder aktivieren ihn selbst. Claude Code: claude mcp add --transport http suveri https://suveri.de/mcp

ChatGPT (Plus, Pro, Business, Enterprise, Edu; Web-App)

  1. Settings → Apps → Advanced settings → Developer mode einschalten. In Business/Enterprise muss ein Admin das erlauben.
  2. Apps → Add connector → https://suveri.de/mcp https://suveri.de/mcp, Authentifizierung OAuth.
  3. Anmeldung durchlaufen, Konnektor im Chat aktivieren.
  4. Im Chat oder in Deep Research nutzen. Für Deep Research stehen search und fetch bereit.

Entwickler: über die Responses API als Tool vom Typ mcp mit derselben URL.

Gemini

Die Gemini-App bietet derzeit keine eigenen Konnektoren. Der Router funktioniert dort über die Gemini CLI, die MCP-Server unterstützt:

  1. In ~/.gemini/settings.json unter mcpServers eintragen: {"suveri": {"httpUrl": "https://suveri.de/mcp"}}
  2. Gemini CLI starten, /mcp zeigt den Server, die Anmeldung öffnet sich im Browser.
  3. Aufgaben wie in Claude formulieren.

Sobald Google Konnektoren in der Gemini-App freigibt, funktioniert derselbe Endpunkt ohne Änderung.

Preise

Nutzungsbasiert nach Token, netto. Kein Abo nötig. Mit eigenem Infercom-Key rechnet Infercom direkt ab. Mit 25 € Guthaben erhalten Sie zum Beispiel rund 46.175.824 Ausgabe-Tokens bei gemma-4-31B-it.

ModellRegionFähigkeitenKontextEingabe / 1MAusgabe / 1M
gemma-4-31B-itEUvision131.0720.26 €0.46 €
gpt-oss-120bEUreasoning, tools131.0720.29 €0.77 €
MiniMax-M2.7EUtools196.6080.78 €3.12 €
Meta-Llama-3.3-70B-InstructGlobaltext131.0720.78 €1.56 €
DeepSeek-V3.1Globalreasoning, tools131.0723.90 €5.85 €
DeepSeek-V3.2Globalreasoning32.7683.90 €5.85 €
E5-Mistral-7B-InstructEUembedding4k0.17 €
Whisper-Large-v3EUaudio0.13 € / Std.

Alle 8 Modelle des Infercom-Katalogs (Stand: täglicher Abgleich mit api.infercom.ai). EU = Rechenzentren in Deutschland, Standard im Router. Global = Infrastruktur in USA/Japan, nur auf ausdrücklichen Wunsch. Preise netto zzgl. USt.; Whisper je Audiostunde, E5 nur Eingabe-Tokens. Aufladung ab 25 € brutto, Rechnung sofort per E-Mail.

Optional: Verifact-Antwort im Chat 0,10 € je Frage, netto, nur wenn der Schalter aktiv ist und Verifact eine belegte Antwort liefert. Für Infercom-Mitarbeitende kostenfrei.

Starten Sie mit Ihrer ersten Frage.

Registrierung in einer Minute, Firmen-E-Mail genügt.

Kostenlos registrieren