Stemmegaffel Logg inn

Aliaser

reasoning · Tenker grundig

Når svaret er verdt å vente på: treningsprogram, quizbank, Ro-gjennomgang, vanskelige uttrekk.

openai/gpt-6-luna slår openai/gpt-5.5 for reasoning: første token -24 %, kost -98 %.

Definisjonen

Krav: tenker, json
Bruk: uten verktøy, resonnering middels, tak 4000 tokens
Kvalitet: resonnering
Vekter: kvalitet 0.7, fart 0.1, kost 0.2. Fart er første token i «kort»; kost er et typisk kall på 6 000 tokens inn og 1500 ut.

Rangering

ModellPoengKvalitetTTFT p50Total p50Per kallMangler
0,880,83635 ms1,20 s$0.0014
0,760,92720 ms2,25 s$0.038
0,660,83833 ms1,93 s$0.077
0,640,831,82 s3,06 s$0.027
0,630,751,06 s1,84 s$0.027
––––$0.010resonnering, json
––––$0.010json
–0,33614 ms1,15 s$0.0018resonnering
–0,50670 ms1,22 s$0.030resonnering

Poeng 0–1: vektet sum av kvalitet, fart og kost, der fart og kost er på logaritmisk skala mellom beste og dårligste kandidat. Bare kandidater uten mangler rangeres. Et bytte foreslås når beste kandidat slår dagens modell med minst 0,05, uten å være mer enn 0,02 dårligere på kvalitet.

Det appene får

GET /api/v1/aliaser/reasoning – modellen, ruten og de parameterne som er målt å virke for denne bruken.

{
  "model": "gpt-5.5",
  "baseURL": "https://api.openai.com/v1",
  "params": {
    "reasoning_effort": "medium",
    "max_completion_tokens": 4000
  }
}

Historikk

Aliaset har pekt på openai/gpt-5.5 siden 8. okt. 2026.

Tidligere anbefalinger

apen: openai/gpt-6-luna slår openai/gpt-5.5 for reasoning: første token -24 %, kost -98 %.1 t siden