KI für Ihr Unternehmen, die in Europa bleibt.
Fragen, Dokumente, Recherche und geprüftes Recht: Suveri beantwortet alles mit offenen Modellen auf Infercom in deutschen Rechenzentren. Keine Speicherung bei Dritten, jede Antwort mit Modell, Kosten und Quellen.
Alles drin, was Teams täglich brauchen
Ein Arbeitsplatz für Fragen, Dokumente und Recherche, auf offenen Modellen, mit nachvollziehbaren Kosten.
Dokumente verstehen
PDF (auch gescannt), Word, Excel, PowerPoint, Bilder, Audio und Video. Große Dateien werden zur Wissensbasis der Unterhaltung, mit Quellenangabe je Antwort.
Live recherchieren
Links liest unser Server selbst, die Recherche sucht über eigene Metasuche und liest die besten Treffer. Quellen und Stand stehen unter jeder Antwort.
Geprüftes Recht
Verifact liefert deutsches Recht mit amtlichen Fundstellen und Vertrauenswert als Grundlage, zuschaltbar pro Unterhaltung.
Modell frei wählen oder routen lassen
MiniMax, gpt-oss, Gemma, Whisper und mehr. Der Router wählt je Aufgabe, oder Sie legen das Modell fest. Preis je Modell steht daneben.
Qualitätsstufen und Challenge me
Geprüft: ein zweites Modell markiert Unbelegtes. Ensemble: zwei Modelle antworten, ein drittes verschmilzt. Challenge me lässt Senior-Rollen widersprechen.
Schutz vor versteckten Anweisungen
Unsichtbarer Text in Dateien und Webseiten wird erkannt und entfernt, Links in Antworten geprüft. Gemessen im Red-Team-Eval: 0 von 130 Angriffen befolgt.
So funktioniert es
Drei Schritte, keine Installation.
Registrieren
Mit Firmen-E-Mail anmelden, Aktivierungslink klicken. Kein Passwort-Zoo, gelegentlich ein Code per E-Mail.
Fragen oder hochladen
Direkt im Chat schreiben, Dateien ziehen, Verifact oder Recherche zuschalten. Der Router wählt das passende Modell.
Zahlen, was Sie nutzen
Guthaben laden, jede Antwort zeigt Tokens und Kosten. Firmen erhalten Kontingente, darüber gilt der Tokenpreis.
Auch in Ihrem Assistenten
Suveri ist zugleich ein Konnektor: Claude, ChatGPT und Gemini CLI delegieren Aufgaben an dasselbe Konto, mit derselben Abrechnung.
Claude Desktop, Cowork, claude.ai, Mobile (Pro, Max, Team, Enterprise; Free mit einem Konnektor)
- Customize → Connectors → Add custom connector.
https://suveri.de/mcpeintragen:https://suveri.de/mcp. Keine weiteren Felder.- Claude öffnet unsere Anmeldung. Registrieren oder anmelden, fertig.
- Im Chat: „Nutze Infercom und fass dieses Dokument zusammen.“ Claude ruft das Tool ask.
Team/Enterprise: Ein Owner fügt den Konnektor unter Organisationseinstellungen hinzu, Mitglieder aktivieren ihn selbst. Claude Code: claude mcp add --transport http suveri https://suveri.de/mcp
ChatGPT (Plus, Pro, Business, Enterprise, Edu; Web-App)
- Settings → Apps → Advanced settings → Developer mode einschalten. In Business/Enterprise muss ein Admin das erlauben.
- Apps → Add connector →
https://suveri.de/mcphttps://suveri.de/mcp, Authentifizierung OAuth. - Anmeldung durchlaufen, Konnektor im Chat aktivieren.
- Im Chat oder in Deep Research nutzen. Für Deep Research stehen search und fetch bereit.
Entwickler: über die Responses API als Tool vom Typ mcp mit derselben URL.
Gemini
Die Gemini-App bietet derzeit keine eigenen Konnektoren. Der Router funktioniert dort über die Gemini CLI, die MCP-Server unterstützt:
- In ~/.gemini/settings.json unter mcpServers eintragen:
{"suveri": {"httpUrl": "https://suveri.de/mcp"}} - Gemini CLI starten, /mcp zeigt den Server, die Anmeldung öffnet sich im Browser.
- Aufgaben wie in Claude formulieren.
Sobald Google Konnektoren in der Gemini-App freigibt, funktioniert derselbe Endpunkt ohne Änderung.
Preise
Nutzungsbasiert nach Token, netto. Kein Abo nötig. Mit eigenem Infercom-Key rechnet Infercom direkt ab. Mit 25 € Guthaben erhalten Sie zum Beispiel rund 46.175.824 Ausgabe-Tokens bei gemma-4-31B-it.
| Modell | Region | Fähigkeiten | Kontext | Eingabe / 1M | Ausgabe / 1M |
|---|---|---|---|---|---|
gemma-4-31B-it | EU | vision | 131.072 | 0.26 € | 0.46 € |
gpt-oss-120b | EU | reasoning, tools | 131.072 | 0.29 € | 0.77 € |
MiniMax-M2.7 | EU | tools | 196.608 | 0.78 € | 3.12 € |
Meta-Llama-3.3-70B-Instruct | Global | text | 131.072 | 0.78 € | 1.56 € |
DeepSeek-V3.1 | Global | reasoning, tools | 131.072 | 3.90 € | 5.85 € |
DeepSeek-V3.2 | Global | reasoning | 32.768 | 3.90 € | 5.85 € |
E5-Mistral-7B-Instruct | EU | embedding | 4k | 0.17 € | – |
Whisper-Large-v3 | EU | audio | – | 0.13 € / Std. | – |
Alle 8 Modelle des Infercom-Katalogs (Stand: täglicher Abgleich mit api.infercom.ai). EU = Rechenzentren in Deutschland, Standard im Router. Global = Infrastruktur in USA/Japan, nur auf ausdrücklichen Wunsch. Preise netto zzgl. USt.; Whisper je Audiostunde, E5 nur Eingabe-Tokens. Aufladung ab 25 € brutto, Rechnung sofort per E-Mail.
Optional: Verifact-Antwort im Chat 0,10 € je Frage, netto, nur wenn der Schalter aktiv ist und Verifact eine belegte Antwort liefert. Für Infercom-Mitarbeitende kostenfrei.
Starten Sie mit Ihrer ersten Frage.
Registrierung in einer Minute, Firmen-E-Mail genügt.
Kostenlos registrieren