Corti Models

Kør frontier LLM'er på suveræn EU-infrastruktur

Frontier open-weight modeller på europæisk hardware, verificérbar ned til GPU'en. Prompts og completions bliver i EU.

Start gratisSe hvordan det virker
Terminal
corti · v1.4.2 · models init ◆ Which models should Corti offer?  ranked; the top selected model is the default  ▸ ■ corti-s1               256K  default    ■ corti-s1-instant       256K    ■ corti-s1-mini          256K    ■ corti-s1-mini-instant  256K    ■ corti-s1-embedding      16K ✓ creds   model 2/5   tools  scope  plan
  • ISO 27001
  • ISO 42001
  • GDPR
  • NIS2
  • DORA
  • EU AI Act

Frontier modeller, EU-suverænitet, bevis ned til GPU'en

Betal for hvad der kører

Betal for tokens, ikke seats. Én credit-saldo fra prototype til produktion. Ingen per-seat-licens for noget halvdelen af holdet ikke åbner.

Hurtigt nok til en loop

180 ms til første token, 118 tokens per sekund på corti-s1. Hurtigt nok til en agent der kalder det fyrre gange per opgave.

Beviseligt hvor det kørte

Hardware-attestation før hver request. Isolation håndhæves af maskinen, ikke af et afsnit i en MSA.

Består review

ISO 27001, ISO 42001, GDPR, NIS2, DORA, EU AI Act. Ingen amerikansk cloud i request-path. Intet bevares, nogensinde.

Sådan bliver en model til en Corti-model

En open-weight-model er et udgangspunkt, ikke et produkt. Tre ting sker, før din anmodning (evaluér, hærd, servér), og Corti ejer alle tre.

  • Et produkt, ikke en model.

    Et download er ikke et produkt. Vi tuner og ødelægger det. Hvis det ikke holder, udgives det ikke.

  • Fra metal til API, én operatør.

    Hardware, cluster, serving-stack, API: én operatør ejer hvert lag.

  • Rigtig belastning, ikke et leaderboard.

    De stærkeste open weights skifter hver par måneder. Vi er ligeglade med, hvilket lab.

Håndterer 1M+ interaktioner om ugen

Ti års klinisk AI, nu bag dine workloads

Vi brugte ti år på at bygge AI til klinisk arbejde, hvor en model, der tager fejl fem procent af tiden, er et ansvar. Den samme standard ligger bag hvert kald, du laver til Corti Models.

  • #1 på OpenAI HealthBench Professional
  • Publiceret på NeurIPS, ICML, ICLR, ACL og npj Digital Medicine
  • Navngivet en af TIME's World's Top HealthTech Companies, 2026
  • 100M+ patienter betjent årligt

Corti Models tilfredsstiller den strengeste kritiker

  • 01

    Legal godkender ikke dette.

    Det virkede. Så spurgte nogen, hvor dataen går hen, og nu er det en transfer impact assessment, der stille dør i review.

    Dine anmodninger kører på Corti-styret europæisk infrastruktur, under europæisk lov. Der er ingen US-cloud-udbyder i anmodningsstien. Ingen forhandler, ingen gennemgang. Hardware-attestation verificerer isolation før hver inference. Prompts og completions opbevares, logges eller bruges aldrig til træning. Anmodningen afsluttes; dataen er væk. Din DPO får et lige svar.

  • 02

    Vi prøvede self-hosting. Kvaliteten var der ikke.

    Du kvantiserede for at få plads på de GPU'er, du kunne få. Modellen, der toppede hvert leaderboard, begyndte at fejle på rigtigt arbejde.

    At køre en frontier-model i produktion betyder snesevis af beslutninger (kvantisering, batching, caching, serving-konfiguration), der hver bytter kvalitet for hastighed. Få én forkert, og modellen, der toppede hvert leaderboard, begynder at fejle på rigtigt arbejde. Corti træffer disse beslutninger til daglig, tuner inference for de workloads, du har brug for, og offentliggør, hvad hvert kompromis koster i kvalitet. Du får frontier-weights, optimeret og hærdet, uden at eje det operationelle lag under.

  • 03

    Vi betaler per seat for noget, halvdelen af teamet ikke åbner.

    Per-seat assistenter fakturerer, om udviklerne bruger dem eller ej. Regningen følger headcount, ikke arbejde.

    Én credit-saldo dækker udvikling, test og produktion. Du faktureres for tokens, der kører, ikke folk, der ikke gør. Per-team-grænser holder omkostningen, hvor arbejdet er. Anmodningsniveau-rapportering gør regningen sporbart. Den følger forbrug.

  • 04

    Vi kan ikke bevise, at det er rigtigt.

    Nogen i risk spørger, hvordan du ved, at modellen er god nok. Du har en demo og en fornemmelse, ikke et tal, nogen vil underskrive.

    Hver model bedømmes mod definerede eval-suites, før den bliver den anbefalede version: nøjagtighed, reasoning, kodning, instruktionsopfølgning, tool-brug, struktureret output, latency og sikkerhed. Du får harnessen og tallene. Dit risk-team får noget, det kan godkende.

  • 05

    Modellen ændrede sig under os.

    En udbyder opdaterer lydløst. En prompt, der holdt i seks måneder, knækker. Ingen fortalte dig det.

    Model-ID'er er en stabil kontrakt. Corti opgraderer weights bag corti-s1 kun, når en stærkere model klarer vores eval-bar. Du får forvarsel og et overlæbsvindue på den forrige version. Intet ændrer sig under en kørende workload, fordi en udbyder udgav en ny standard. Du vælger, hvornår du vil flytte.

  • 06

    Den demonstrerer smukt og styrter i produktion.

    Agenten virker i notebooken. Så har den brug for live data, den ikke kan nå, så den gætter. Noget går galt, og der er intet trace.

    Agenter styrter i produktion, når de rækker ud efter data, de ikke kan røre sikkert. Corti Agentic Framework giver dem typestyrede connectors, tool-skemaer, godkendelsesporte og genafspilbare traces. Så et fejlslag er en hændelse, du kan se, ikke et gæt, ingen bemærkede.

To måder at bruge det på

Brug Corti Models i din coding agent, eller i din app

  • Path 01

    Agentic coding i terminalen

    Peg OpenCode, Crush eller Pi mod Corti Models med CLI. Samme workflow.

    bash
    # kør setup-wizardennpx @corti/cli models init # indlæs credentials, start din agentset -a; . ~/.env; set +aopencode
    Læs docs →
  • Path 02

    Direkte API i dit produkt

    Peg din OpenAI SDK mod Corti Models med en ny URL og nøgle. Samme kode.

    python
    client = OpenAI(    base_url="https://ai.eu.corti.app/v1",    api_key="<din-api-nøgle>") r = client.chat.completions.create(    model="corti-s1", messages=msgs)
    Læs docs →

Modellerne

Frontier-modeller, hostet i Europa

ModelReasoningInputCached inputOutput
corti-s1-instant

Hurtig interaktiv coding og inline completion

Nej$2.00 / MTok$0.20 / MTok$8.00 / MTok
corti-s1-mini

High-volume review, tests og refactors

Ja$1.00 / MTok$0.10 / MTok$4.00 / MTok
corti-s1-mini-instant

Prisfølsom completion stordrift

Nej$1.00 / MTok$0.10 / MTok$4.00 / MTok
corti-s1-embedding

Codebase-søgning, retrieval og indeksering

n/a$0.03 / MTok—ingen output-afgift

Prissætning

Betal for tokens, ikke sæder

Per-seat coding assistants tager betaling, uanset om udviklerne bruger dem eller ej. Governed consumption tager betaling for det der kører, til europæisk infrastrukturpris.

  • Én credit-balance på tværs af Corti APIs
  • Samme credits til udvikling, test og produktion
  • Per-team grænser og request-level rapportering
Vejledende estimat
500
$39
5x
Per-seat licenser$234,000 / yr
Corti Models$46,800 / yr

Forskel på $187,200 om året, før det indkøbs- og compliance-arbejde du holder op med at betale for.

Fem endpoints. corti-s1 er flagskibs-reasoning-modellen. corti-s1-instant er de samme weights tunet til lav latency. corti-s1-mini og corti-s1-mini-instant er de mindre, billigere varianter. Et separat endpoint håndterer embeddings.

En videresælger ændrer hvem der fakturerer dig. Inferensen kører stadig på infrastruktur under amerikansk jurisdiktion og overførslen sker stadig. Corti driver hardwaren, så din request behandles på maskiner vi driver, i en europæisk facilitet, under europæisk lovgivning.

Ja. De fleste teams skifter en base-URL og en API-nøgle og er i gang på en eftermiddag. Den kompatibilitet, der gør adoption billig, gør også udtrækning billig.

På noget arbejde er den det, og vi fortæller dig hvor. For det meste produktionsvolumen (kodning, ekstraktion, klassifikation, routing) er gabene lukket, og økonomien er det ikke. De fleste teams kører begge og sender os volumenet.

En open-weight-model er et udgangspunkt, ikke et produkt. Før din anmodning rører den, sker tre ting: vi evaluerer kandidatmodeller mod definerede suites, hærder dem, der består gennem tuning, komprimering og bedømmelse, og serverer dem på infrastruktur, vi opererer. Hvis selektion, tuning, serving og hardware var nemt, ville self-hosting virke. Det gør det for det meste ikke. De teams, der prøver, bruger måneder på det og udgiver stadig en model, der fejler på rigtigt arbejde. Det er det lag, Corti ejer.

Nej. Prompts og completions opbevares, logges eller bruges aldrig til træning. Hardware-attestation verificerer isolation før hver inference. Når anmodningen afsluttes, er data væk.

I bliver ved med at kalde corti-s1. Corti opgraderer vægtene bag det ID når en stærkere open model er klar. Ingen kodeændring.

Til direkte API-brug, en base URL og en nøgle. Til terminal coding agents, installation af Corti CLI og peg en eksisterende agent mod den. Teams har typisk en fungerende integration på en eftermiddag og en governance-model aftalt på et par uger.

API'et er OpenAI-kompatibelt, så at flytte væk fra Corti Models er den samme base URL-ændring som at flytte til. Vi opbevarer ikke dine prompts, completions eller tuning-data. Kompatibiliteten der gør adoption billig er det der gør exit billig.

Suverænitet handler om hvem der driver infrastrukturen og hvis lovgivning der gælder, ikke hvor forskningen er udført. Open weights er et statisk artefakt. Corti deployerer dem på hardware vi driver i Europa, og ingen data når den oprindelige udvikler. Du får kapabiliteten uden afhængigheden, hvilket ikke er muligt med en lukket model du kun kan nå gennem ejers API.

Kør din næste coding-opgave
på europæisk hardware

Installér CLI'en, behold agenten dit team allerede bruger, og peg den mod modeller hostet i EU.