Corti Models

Frontier-LLMs ausführen auf souveräner EU-Infrastruktur

Eine OpenAI-kompatible API auf EU-Infrastruktur, die wir von Grund auf selbst betreiben. 50 $ kostenloses Guthaben, erster Aufruf in fünf Minuten.

Kostenlos startenSo funktioniert es
Terminal
corti · v1.4.2 · models init ◆ Which models should Corti offer?  ranked; the top selected model is the default  ▸ ■ corti-s1               256K  default    ■ corti-s1-instant       256K    ■ corti-s1-mini          256K    ■ corti-s1-mini-instant  256K    ■ corti-s1-embedding      16K ✓ creds   model 2/5   tools  scope  plan
  • ISO 27001
  • ISO 42001
  • GDPR
  • NIS2
  • DORA
  • EU AI Act

Frontier-KI bedeutete bisher eine US-API, die Sie nicht kontrollieren können, oder Open Weights, die Sie nicht betreiben können.

Corti betreibt die stärksten Open Weights auf einer EU-Infrastruktur, die Sie auditieren können.

Corti Models, für Arbeit, die nicht scheitern darf.

Frontier-Modelle ohne Kompromisse. Open Weights auf souveräner EU-Hardware.

Bezahlen Sie nur für das, was läuft

Zahlen Sie für Token, nicht für Lizenzen. Ein Guthaben vom Prototyp bis zur Produktion.

Schnell genug für eine Schleife

180 ms bis zum ersten Token, 118,5 Token pro Sekunde auf corti-s1.

Nachweisbar, wo es ausgeführt wurde

Attestierung vor der Inferenz. Isolation wird durch Hardware erzwungen, nicht durch Richtlinien.

Besteht jede Prüfung

ISO 27001, ISO 42001, DSGVO, NIS2, DORA, EU AI Act. Keine US-Cloud im Request-Pfad.

Nicht überzeugt?

Corti Models wird selbst die schärfsten Kritiker überzeugen

Die Engine

Wie ein Modell zu einem Corti-Modell wird

Ein Open-Weight-Modell ist ein Ausgangspunkt, kein Produkt. Drei Dinge passieren vor Ihrem Request (Evaluieren, Härten, Bereitstellen), und Corti übernimmt alle drei.

  • 1Evaluieren

    Die stärksten Open Weights ändern sich alle paar Monate. Uns ist egal, aus welchem Labor sie stammen.

    • Jedes neue Modell bei Veröffentlichung verfolgen
    • An realen Aufgaben testen, nicht an Benchmarks
    • Behalten Sie die API. Das Modell im Hintergrund wird kontinuierlich verbessert.
  • 2Härten

    Ein Download ist kein Produkt. Wir tunen es, wir testen es bis an die Grenzen. Wenn es nicht standhält, wird es nicht ausgeliefert.

    • Inferenz optimiert auf Latenz, nicht nur auf Durchsatz
    • Optimiert für Coding und strukturierte Outputs
    • Jedes Release besteht unsere Evaluierungs-Suiten
  • 3Bereitstellen

    Hardware, Cluster, Serving-Stack, API: Ein Betreiber kontrolliert jede Schicht.

    • Eigene Hardware in Europa
    • Keine US-Cloud im Request-Pfad
    • Isolation durch Hardware erzwungen

Über 1 Mio. Interaktionen pro Woche

Zehn Jahre klinische KI, die nun Ihre Workloads unterstützt

Wir haben zehn Jahre lang KI für die klinische Arbeit entwickelt, bei der ein Modell, das in fünf Prozent der Fällen falsch liegt, ein unkalkulierbares Risiko darstellt. Derselbe Standard gilt für jeden Aufruf, den Sie an Corti Models richten.

  • Platz 1 im OpenAI HealthBench Professional
  • Veröffentlicht bei NeurIPS, ICML, ICLR, ACL und npj Digital Medicine
  • Ausgezeichnet als eines der „World's Top HealthTech Companies 2026“ vom TIME Magazine
  • Über 100 Mio. versorgte Patienten jährlich

Corti Models nutzen

In Ihrem Coding-Agenten oder in Ihrer App

  • Path 01

    Agentic Coding im Terminal

    Richten Sie OpenCode, Crush oder Pi über die CLI auf Corti Models aus. Gleicher Workflow.

    bash
    # run the setup wizardnpx @corti/cli models init # load credentials, then launch your agentset -a; . ~/.env; set +aopencode
    Dokumentation lesen →
  • Path 02

    Direkte API in Ihrem Produkt

    Richten Sie Ihr OpenAI-SDK mit einer neuen URL und einem neuen Key auf Corti Models aus. Gleicher Code.

    python
    client = OpenAI(    base_url="https://ai.eu.corti.app/v1",    api_key="<your-api-key>") r = client.chat.completions.create(    model="corti-s1", messages=msgs)
    Dokumentation lesen →

Das Lineup

Frontier-Modelle, gehostet in Europa.

ModellReasoningInputCached InputOutput
corti-s1-instant

Schnelles interaktives Coding und Inline-Completion

Nein$2.00 / MTok$0.20 / MTok$8.00 / MTok
corti-s1-mini

Hochvolumige Reviews, Tests und Refactorings

Ja$1.00 / MTok$0.10 / MTok$4.00 / MTok
corti-s1-mini-instant

Kostenbewusste Completion in großem Maßstab

Nein$1.00 / MTok$0.10 / MTok$4.00 / MTok
corti-s1-embedding

Codebase-Suche, Retrieval und Indizierung

n/a$0.03 / MTok—Keine Output-Kosten

Der Wechsel ist einfach

Ändern Sie den Endpoint. Behalten Sie den Rest.

SDK, Prompts und Evals bleiben. Eine neue Base-URL und ein neuer Key verlagern die Inferenz auf EU-Hardware. Die Kompatibilität, die den Einstieg günstig macht, macht auch den Ausstieg günstig.

switching.py
from openai import OpenAI
 
client = OpenAI(
− base_url="https://api.us-east/v1",
+ base_url="https://ai.eu.corti.app/v1",
api_key="<your-api-key>",
)
 
completion = client.chat.completions.create(
model="corti-s1",
messages=[{"role": "user", "content": prompt}],
)

Preisgestaltung

Zahlen Sie für Token, nicht für Lizenzen

Coding-Assistenten mit Lizenzmodell berechnen Kosten, unabhängig davon, ob Entwickler sie nutzen oder nicht. Wir berechnen nur das, was ausgeführt wird, zu europäischen Infrastrukturkosten.

  • Ein gemeinsames Guthaben für alle Corti-APIs
  • Gleiches Guthaben für Entwicklung, Testing und Produktion
  • Limits pro Team und Berichterstattung auf Request-Ebene
Richtwert
500
$39
5x
Lizenzen pro Nutzer$234,000 / yr
Corti Models$46,800 / yr

Differenz von $187,200 pro Jahr, noch vor dem Beschaffungs- und Compliance-Overhead, für den Sie nicht mehr bezahlen müssen.

Fünf Endpoints. corti-s1 ist das Flaggschiff-Reasoning-Modell. corti-s1-instant nutzt dieselben Gewichte, ist jedoch auf niedrige Latenz optimiert. corti-s1-mini und corti-s1-mini-instant sind die kleineren, günstigeren Varianten. Ein separater Endpoint verarbeitet Embeddings.

Ein Reseller ändert nur, wer Ihnen die Rechnung stellt. Die Inferenz läuft weiterhin unter US-Rechtsprechung. Corti betreibt die Hardware, sodass Ihr Request auf Maschinen verarbeitet wird, die wir in Europa und unter europäischem Recht betreiben.

Ja. Die meisten Teams tauschen lediglich eine Base-URL und einen API-Key aus und sind an einem Nachmittag einsatzbereit. Die Kompatibilität, die die Einführung günstig macht, macht auch den Ausstieg günstig.

Bei manchen Aufgaben ist das der Fall, und wir sagen Ihnen, wo. Für das meiste Produktionsvolumen (Coding, Extraktion, Klassifizierung, Routing) hat sich die Lücke geschlossen, die wirtschaftlichen Vorteile jedoch nicht. Die meisten Teams nutzen beides und leiten das Volumen an uns weiter.

Ein Open-Weight-Modell ist ein Ausgangspunkt, kein Produkt. Bevor Ihr Request es erreicht, passieren drei Dinge: Wir evaluieren Modellkandidaten anhand definierter Test-Suiten, härten diejenigen, die bestehen, durch Tuning, Komprimierung und Grading, und stellen sie auf einer von uns betriebenen Infrastruktur bereit. Wären Auswahl, Tuning, Bereitstellung und Hardware einfach, würde Self-Hosting funktionieren. Meistens ist das nicht der Fall. Teams, die es versuchen, verbringen Monate damit und liefern am Ende dennoch ein Modell, das bei realen Aufgaben scheitert. Genau diese Ebene übernimmt Corti.

Nein. Prompts und Completions werden niemals gespeichert, protokolliert oder für das Training verwendet. Die Hardware-Attestierung verifiziert die Isolation vor jeder Inferenz. Wenn der Request abgeschlossen ist, sind die Daten gelöscht.

Sie rufen weiterhin corti-s1 auf. Wir aktualisieren die Gewichte hinter dieser ID, wenn ein stärkeres Modell unsere Anforderungen erfüllt. Keine Codeänderung erforderlich. Wir informieren Sie darüber, was sich geändert hat.

Eine Base-URL und ein Key. Teams haben in der Regel an einem Nachmittag eine funktionierende Integration und in wenigen Wochen ein Governance-Modell.

Der Wechsel weg von Corti erfordert dieselbe Änderung der Base-URL wie der Wechsel zu uns. Wir speichern Ihre Prompts, Completions oder Tuning-Daten nicht. Die Kompatibilität, die die Einführung günstig macht, macht auch den Ausstieg günstig.

Bei Souveränität geht es darum, wer die Infrastruktur betreibt, nicht darum, wo die Forschung durchgeführt wurde. Open Weights sind ein statisches Artefakt. Es gelangen keine Daten zum ursprünglichen Entwickler.

Führen Sie Ihren nächsten Workload aus
auf evaluierten Modellen, bereitgestellt in Europa.

Installieren Sie die CLI, behalten Sie den Agenten, den Sie bereits nutzen. Erster Aufruf in fünf Minuten, 50 $ kostenlos.