reasoning · Tenker grundig
Når svaret er verdt å vente på: treningsprogram, quizbank, Ro-gjennomgang, vanskelige uttrekk.
openai/gpt-6-luna slår openai/gpt-5.5 for reasoning: første token -24 %, kost -98 %.
Definisjonen
Krav: tenker, json
Bruk: uten verktøy, resonnering middels, tak 4000 tokens
Kvalitet: resonnering
Vekter: kvalitet 0.7, fart 0.1, kost 0.2. Fart er første token i «kort»; kost er et typisk kall på 6 000 tokens inn og 1500 ut.
Rangering
| Modell | Poeng | Kvalitet | TTFT p50 | Total p50 | Per kall | Mangler |
|---|---|---|---|---|---|---|
| openai/gpt-6-luna | 0,88 | 0,83 | 635 ms | 1,20 s | $0.0014 | |
| openai/gpt-5.4 | 0,76 | 0,92 | 720 ms | 2,25 s | $0.038 | |
| openai/gpt-5.5nå | 0,66 | 0,83 | 833 ms | 1,93 s | $0.077 | |
| openai/gpt-6.1-sol | 0,64 | 0,83 | 1,82 s | 3,06 s | $0.027 | |
| openai/gpt-6-sol | 0,63 | 0,75 | 1,06 s | 1,84 s | $0.027 | |
| google/gemini-3.8-flash | – | – | – | – | $0.010 | resonnering, json |
| google/gemini-3.7-flash | – | – | – | – | $0.010 | json |
| openai/gpt-4o-mini | – | 0,33 | 614 ms | 1,15 s | $0.0018 | resonnering |
| openai/gpt-4o | – | 0,50 | 670 ms | 1,22 s | $0.030 | resonnering |
Poeng 0–1: vektet sum av kvalitet, fart og kost, der fart og kost er på logaritmisk skala mellom beste og dårligste kandidat. Bare kandidater uten mangler rangeres. Et bytte foreslås når beste kandidat slår dagens modell med minst 0,05, uten å være mer enn 0,02 dårligere på kvalitet.
Det appene får
GET /api/v1/aliaser/reasoning – modellen, ruten og de parameterne som er målt å virke for denne bruken.
{
"model": "gpt-5.5",
"baseURL": "https://api.openai.com/v1",
"params": {
"reasoning_effort": "medium",
"max_completion_tokens": 4000
}
} Historikk
Aliaset har pekt på openai/gpt-5.5 siden 8. okt. 2026.
Tidligere anbefalinger
apen: openai/gpt-6-luna slår openai/gpt-5.5 for reasoning: første token -24 %, kost -98 %.1 t siden