GPT-6.1 Sol vs. Sonnet 5.5 im Test: Codex oder Claude Code!?
Kapitel
- 0:00 Gleicher Preis, dreifache Rechnung
- 0:40 GPT-6.1 Sol und Sonnet 5.5
- 1:32 Der Preis pro Token
- 1:58 Die Denkstufe dreht alles
- 2:44 Woher der Preisunterschied kommt
- 3:09 Was andere gemessen haben
- 3:47 Was in den Prüfberichten steht
- 4:37 Mein Testaufbau
- 5:14 Test 1: Bugjagd
- 6:08 Test 2: Hält es sich an die Regeln?
- 6:38 Test 3: Refactoring in echtem Code
- 7:42 Mein Bauchgefühl
- 8:51 Ergebnis: echtes Unentschieden
- 9:09 Der Unterschied liegt in der Rechnung
- 9:30 Wie ehrlich sind sie?
- 9:51 Fazit: Welches Modell für wen?
- 10:19 Deine Meinung
Quellen aus dem Video
- OpenAI zu GPT-6.1 Sol openai.com ↗
- Anthropic zu Claude Sonnet 5.5 anthropic.com ↗
- Artificial Analysis, Coding Agent Index artificialanalysis.ai ↗
- Artificial Analysis zu Sonnet 5.5 artificialanalysis.ai ↗
- Artificial Analysis, Artikel zum Token-Verbrauch artificialanalysis.ai ↗
- Bug Hunt Bench von Pawel Huryn bughunt.productcompass.pm ↗
- paddo.dev, 20 Läufe an echten Änderungen paddo.dev ↗
- GPT-6.1 Sol System Card (S. 16 und 21) deploymentsafety.openai.com ↗
- Claude Sonnet 5.5 System Card (S. 56 und 82) anthropic.com ↗