Claude Sonnet 5 ist Anthropics neues Sonnet-Modell für Coding, Agenten, Tool-Use und professionelle Wissensarbeit. Der offizielle API-Modellname lautet claude-sonnet-5. Die Schreibweise anthropic/claude-sonnet-5 ist keine native Anthropic-ID, sondern eine typische Router-/Provider-ID, etwa bei Multi-Model-Plattformen wie OpenRouter. Für Mac-Nutzer ist Sonnet 5 ein Cloud-/API-Modell: Es läuft nicht lokal in Ollama, LM Studio oder MLX, lässt sich aber auf dem Mac mit Claude Code, API-Workflows und lokalen Modellen kombinieren.
Anthropic hat Claude Sonnet 5 am 30. Juni 2026 vorgestellt. Laut Anthropic ist es das bisher agentischste Sonnet-Modell: Es kann planen, Tools wie Browser und Terminal nutzen und autonome Aufgaben auf einem Niveau ausführen, das vor kurzer Zeit eher größeren und teureren Modellen vorbehalten war. (1)
Was ist Claude Sonnet 5?
Claude Sonnet 5 ist die neue Generation der Sonnet-Familie. Sonnet war bei Anthropic traditionell die Modellklasse zwischen günstiger Haiku-Klasse und teurer Opus-/Fable-Klasse: stark genug für anspruchsvolle Arbeit, aber günstiger und schneller als die Top-Modelle.
Mit Sonnet 5 verschiebt Anthropic diese Rolle deutlich in Richtung Agenten. Das Modell soll nicht nur kurze Chatantworten schreiben, sondern Aufgaben über mehrere Schritte verfolgen: Code lesen, Tests ausführen, Fehler suchen, Tools verwenden, Zwischenergebnisse prüfen und bei Bedarf selbst nachbessern.
Für Mac-Nutzer ist die wichtigste Einordnung:
Claude Sonnet 5 ist kein lokales Mac-Modell. Es ist ein Cloud-/API-Modell, das du auf dem Mac als Client nutzt.
Dein Mac führt nicht die Modellinferenz aus. Dein Mac sendet Prompts, Dateien oder Tool-Kontext an Claude, und Anthropic beziehungsweise ein Plattformanbieter verarbeitet die Anfrage in der Cloud.
Offizieller Modellname vs. Router-Schreibweise
Bei Claude Sonnet 5 gibt es zwei Schreibweisen, die man sauber trennen sollte.
| Schreibweise | Bedeutung |
|---|---|
claude-sonnet-5 | offizieller Anthropic-API-Modellname |
anthropic/claude-sonnet-5 | typische Router-/Provider-Schreibweise, z. B. bei OpenRouter |
anthropic.claude-sonnet-5 | Bedrock-nahe Schreibweise beziehungsweise Anbieterformat |
claude-sonnet-5 auf Google Cloud | Google-Cloud-Modell-ID laut Anthropic-Dokumentation2 |
Anthropic nennt in der Dokumentation ausdrücklich claude-sonnet-5 als Modell-ID und beschreibt es als „best combination of speed and intelligence“. Das Modell unterstützt standardmäßig ein 1M-Token-Kontextfenster, bis zu 128K Output-Tokens und adaptive Thinking. (3)
Wenn du also direkt die Anthropic API nutzt, verwendest du:
model="claude-sonnet-5"
Wenn du über OpenRouter oder einen ähnlichen Router gehst, kann die ID anders aussehen:
anthropic/claude-sonnet-5
Das ist dann die Modellkennung des Routers, nicht die native Anthropic-ID.
Die wichtigsten Fakten zu Claude Sonnet 5
| Eigenschaft | Claude Sonnet 5 |
|---|---|
| Anbieter | Anthropic |
| Offizielle API-ID | claude-sonnet-5 |
| Veröffentlichung | 30. Juni 2026 |
| Modellklasse | Sonnet |
| Hauptfokus | Coding, Agenten, Tool-Use, Wissensarbeit |
| Eingabe | Text und Bild |
| Ausgabe | Text |
| Kontextfenster | 1M Tokens |
| Maximaler Output | 128K Tokens |
| Thinking | Adaptive Thinking |
| Standard-Effort | high standardmäßig; low/medium/high/xhigh/max explizit setzbar (4) |
| Lokale Mac-Nutzung | Nein |
| Ollama / LM Studio / MLX | Nein |
| Claude Code | Ja |
| Claude API | Ja |
| AWS / Google Cloud / Microsoft Foundry | Ja, je nach Plattform |
| Zero Data Retention | Unterstützt für Organisationen mit ZDR-Vereinbarung |
| Priority Tier | Nicht verfügbar auf Sonnet 5 laut Anthropic-Dokumentation |
Anthropic beschreibt Sonnet 5 als Drop-in-Upgrade für Sonnet 4.6. Wichtig ist aber: Beim Wechsel ändern sich mehrere technische Details. Adaptive Thinking ist standardmäßig aktiv; manuelles Extended Thinking mit thinking.type: "enabled" wird mit 400 abgelehnt, ebenso nicht-standardmäßige temperature-, top_p- und top_k-Werte. Der neue Tokenizer erzeugt für denselben Text ungefähr 30 Prozent mehr Tokens. (34)
Was Claude Sonnet 5 auf dem Mac ermöglicht
Ein Apple-Silicon-Mac beschleunigt Claude Sonnet 5 nicht direkt. Die Inferenz läuft nicht auf M1, M2, M3 oder M4. Sonnet 5 kann trotzdem in Mac-Workflows eingesetzt werden, weil viele moderne Mac-Workflows eigentlich Client-Workflows sind:
- Claude Code im Terminal
- Repository-Analyse
- lokale Dateien mit Cloud-Agenten kombinieren
- Browser- und Tool-Workflows
- Dokumentation schreiben
- Fehlerlogs analysieren
- Refactoring planen
- UI- und Frontend-Prototyping
- Tests generieren
- lange technische Texte auswerten
Der Mac ist dabei die Arbeitsumgebung. Claude Sonnet 5 ist die Cloud-Intelligenz, die über API, Claude Code oder Apps eingebunden wird.
Für Mac-Nutzer lautet die praktische Einordnung:
Sonnet 5 ist kein lokales Modell für den Mac, sondern ein Cloud-Modell für Mac-Workflows.
Läuft Claude Sonnet 5 lokal mit Ollama?
Nein.
Claude Sonnet 5 ist kein Open-Weight-Modell. Es gibt keine offiziellen Gewichte zum Download, keinen Ollama-Tag für lokale Inferenz, keine MLX-Portierung und keine LM-Studio-Datei. Wenn du Sonnet 5 nutzt, nutzt du Anthropic oder einen Plattformanbieter.
Das ist ein wichtiger Unterschied zu lokalen Modellen wie Gemma, Qwen, Llama, Mistral oder kleineren Vision-Modellen. Lokale Modelle laufen mit Quantisierung auf deinem Mac. Claude Sonnet 5 läuft als Cloud-Modell.
| Frage | Antwort |
|---|---|
Kann ich ollama run claude-sonnet-5 ausführen? | Nein |
| Gibt es Claude Sonnet 5 als GGUF? | Nein |
| Gibt es Claude Sonnet 5 für MLX? | Nein |
| Läuft Sonnet 5 offline? | Nein |
| Kann ich es auf dem Mac nutzen? | Ja, über Claude, Claude Code, API oder Router |
| Ist es für sensible lokale Dateien ideal? | Nur nach Datenschutz-/Compliance-Abwägung |
Preise
Anthropic nennt für Claude Sonnet 5 aktuell 2 US-Dollar pro 1M Input Tokens und 10 US-Dollar pro 1M Output Tokens. Der zunächst bis 31. August 2026 geplante Einführungspreis wurde zum Standardpreis; die angekündigte Erhöhung auf 3 und 15 US-Dollar ab 1. September findet nicht statt. (5)
| Preisstand | Input | Output |
|---|---|---|
| aktuell | $2 / 1M Tokens | $10 / 1M Tokens |
Prompt Caching ist ebenfalls wichtig. In der offiziellen Preistabelle nennt Anthropic für Sonnet 5 $2.50 / 1M Tokens für 5-Minuten-Cache-Writes, $4 / 1M Tokens für 1-Stunden-Cache-Writes und $0.20 / 1M Tokens für Cache-Hits. Diese Cache-Preise gelten zusammen mit dem aktuellen $2/$10-Tokenpreis. (5)
Für Batch-Verarbeitung gibt es 50 Prozent Rabatt: Anthropic nennt aktuell $1 / 1M Input Tokens und $5 / 1M Output Tokens für Sonnet 5. (5)
Mini-Kostenrechnung
Ein Beispiel:
Du schickst 100.000 Input Tokens und bekommst 5.000 Output Tokens zurück.
Beim aktuellen Preis:
| Teil | Rechnung | Kosten |
|---|---|---|
| Input | 0,1 × $2 | $0,20 |
| Output | 0,005 × $10 | $0,05 |
| Gesamt | — | $0,25 |
Eine einzelne große Anfrage bleibt in diesem Beispiel überschaubar; Agentenläufe können viele Tool-Calls, Wiederholungen, Suchschritte und Zwischenausgaben erzeugen. Gerade bei Claude Code oder Browser-Agenten zählt nicht nur ein einzelner Prompt, sondern der gesamte Lauf.
1M Kontext: stark, aber nicht kostenlos
Claude Sonnet 5 unterstützt laut Anthropic standardmäßig ein 1M-Token-Kontextfenster. Es gibt keine kleinere Kontextvariante: 1M ist Standard und Maximum. (3)
Das ist besonders wichtig für:
- große Repositories
- lange Dokumentationen
- viele Logdateien
- umfangreiche Spezifikationen
- mehrstufige Agentenläufe
- große Markdown-/MDX-Projekte
- Artikelpaare in DE/EN
- Codebase-weite Refactorings
Aber 1M Kontext bedeutet nicht, dass du immer 1M Tokens nutzen solltest. Mehr Kontext heißt:
- mehr Kosten
- mehr Latenz
- mehr irrelevante Informationen
- mehr Risiko für unklare Aufgabenstellung
- größere Tokenbudgets bei Output und Thinking
Besser ist: Nur die Dateien und Informationen einfügen, die für die konkrete Aufgabe wirklich relevant sind.
Neuer Tokenizer: warum deine Kosten anders wirken können
Claude Sonnet 5 nutzt einen neuen Tokenizer. Anthropic schreibt, dass derselbe Text ungefähr 30 Prozent mehr Tokens erzeugen kann als bei Claude Sonnet 4.6. Die API-Form bleibt gleich, aber Tokenzählung, Kosten, Kontextkapazität in natürlicher Sprache und max_tokens-Budgets können sich ändern. (3)
Wenn du bisher mit Sonnet 4.6 gearbeitet hast, solltest du:
- Prompts neu zählen.
max_tokensneu setzen.- Kosten mit echten Logs prüfen.
- Lange Systemprompts mit Prompt Caching testen.
- Agentenläufe nicht blind mit alten Limits übernehmen.
Zur Einführung erklärte Anthropic, dass der Preis den Übergang ungefähr kostenneutral machen sollte, weil der neue Tokenizer mehr Tokens erzeugen kann. (1)
Adaptive Thinking: was sich ändert
Claude Sonnet 5 nutzt Adaptive Thinking. Auf Sonnet 4.6 liefen Requests ohne thinking-Feld ohne Thinking. Auf Sonnet 5 laufen dieselben Requests standardmäßig mit Adaptive Thinking. (3)
Das bedeutet:
- Das Modell entscheidet dynamischer, wie viel Denkaufwand eine Aufgabe braucht.
max_tokenszählt für die gesamte Ausgabe, also Thinking plus finale Antwort.- Für längere Agentenläufe muss man Output-Limits großzügiger planen.
- Man sollte den
effort-Parameter bewusst setzen, wenn Kosten und Latenz wichtig sind.
Anthropic empfiehlt, beim Migrieren auf Sonnet 5 Tokenbudgets, Extended Thinking und Sampling-Parameter zu prüfen. (3)
Sampling-Parameter: Temperatur nicht mehr einfach setzen
Ein wichtiger API-Fix: Claude Sonnet 5 akzeptiert keine nicht-standardmäßigen Werte für temperature, top_p oder top_k. Wenn du diese Parameter auf abweichende Werte setzt, gibt die API einen 400-Fehler zurück. Anthropic empfiehlt stattdessen Systemprompt-Anweisungen, um Stil, Länge oder Verhalten zu steuern. (3)
Das betrifft viele alte Codebeispiele.
Nicht mehr ideal:
temperature=0.2
top_p=0.9
Besser:
Schreibe knapp, deterministisch und ohne kreative Ausschmückungen.
Beispiel: Sonnet 5 mit der Anthropic API nutzen
import anthropic
client = anthropic.Anthropic()
message = client.messages.create(
model="claude-sonnet-5",
max_tokens=4000,
messages=[
{
"role": "user",
"content": "Erkläre mir in fünf Abschnitten, wann Claude Sonnet 5 für Mac-Workflows sinnvoller ist als ein lokales Ollama-Modell."
}
],
)
print(message.content[0].text)
Wenn du von Sonnet 4.6 migrierst, reicht nicht immer nur der Modellname. Entferne alte Sampling-Parameter, prüfe Thinking-Konfigurationen und zähle lange Prompts neu.
Beispiel: OpenRouter-Schreibweise
Wenn du einen Router nutzt, kann die Modell-ID so aussehen:
anthropic/claude-sonnet-5
Das ist praktisch, wenn du mehrere Anbieter über eine OpenAI-kompatible API nutzen willst. Es ändert aber nichts an der eigentlichen Einordnung: Die native Anthropic-ID bleibt claude-sonnet-5.
Ein Router kann eigene Preise, Limits, Header, Fallbacks und Datenschutzbedingungen haben. Für sensible Daten solltest du Modell und Anbieterweg gemeinsam prüfen.
Sonnet 5 vs. Sonnet 4.6
Claude Sonnet 5 ist ein klares Upgrade gegenüber Sonnet 4.6. Anthropic nennt besonders Coding, Agentenaufgaben, Tool-Use, Reasoning und Wissensarbeit als Bereiche mit deutlichen Verbesserungen. (1)
| Punkt | Sonnet 4.6 | Sonnet 5 |
|---|---|---|
| Kontext | 1M | 1M |
| Max Output | 128K | 128K |
| Thinking | nicht automatisch bei Requests ohne Thinking-Feld | Adaptive Thinking standardmäßig |
| Sampling | alte Workflows teils mit Parametern | nicht-standardmäßige Sampling-Parameter werden abgelehnt |
| Tokenizer | vorheriger Tokenizer | neuer Tokenizer |
| Hauptrolle | starkes Allround-/Agentenmodell | stärkeres Agenten-/Coding-Modell |
| Migration | bestehende Workflows | Drop-in, aber mit Checks |
Sonnet 5 ist also nicht einfach „Sonnet 4.6 plus bessere Benchmarks“. Es verändert auch, wie du API-Aufrufe sauber konfigurierst.
Sonnet 5 vs. Opus 4.8
Claude Opus 4.8 bleibt laut Anthropic die Wahl für höhere Genauigkeit bei schwierigen Agenten- und Computer-Use-Aufgaben. Sonnet 5 bietet aber deutlich bessere Preis-Leistung als frühere Sonnet-Modelle und nähert sich Opus 4.8 in mehreren agentischen Workflows an. (1)
| Aufgabe | Eher Sonnet 5 | Eher Opus 4.8 |
|---|---|---|
| tägliches Coding | ja | manchmal |
| viele Agentenläufe | ja | bei kritischen Aufgaben |
| Kostenkontrolle | ja | nein |
| höchste Genauigkeit | teils | ja |
| komplexe Architekturentscheidungen | teils | ja |
| schnelle Prototypen | ja | selten nötig |
| schwierige Cybersecurity-Arbeit | eher nein | eher ja, aber mit Policy-/Safeguard-Kontext |
Anthropic selbst empfiehlt Opus 4.8 für Cybersecurity-Arbeit, bei der reduzierte Guardrails erforderlich sind. (1)
Sonnet 5 vs. lokale Mac-KI
Ob Sonnet 5 oder ein lokales Modell passt, hängt vor allem von Datenschutz, Offline-Fähigkeit und Aufgabentyp ab.
| Aufgabe | Lokales Modell auf Mac | Claude Sonnet 5 |
|---|---|---|
| private Notizen offline | besser | nur mit Cloud-Abwägung |
| lokale Transkription | besser mit Whisper/MLX | nicht Hauptzweck |
| kleine Chatfragen | oft ausreichend | stärker, aber Cloud |
| große Codebase verstehen | begrenzt durch RAM/Kontext | sehr stark |
| Agenten mit Tool-Use | möglich, aber schwieriger | Hauptstärke |
| 1M Kontext | lokal selten realistisch | Standard |
| keine Datenübertragung | ja, wenn wirklich lokal | nein |
| beste Coding-Qualität | modellabhängig | sehr stark |
| Kosten pro Anfrage | Strom/Zeit | API-Kosten |
Eine praktische Aufteilung ist:
Lokale Modelle für private, schnelle und offline nutzbare Aufgaben. Claude Sonnet 5 für große, schwierige und agentische Aufgaben, bei denen Cloud-Verarbeitung akzeptabel ist.
Datenschutz und Datenverarbeitung
Claude Sonnet 5 ist ein Cloud-Modell. Deshalb solltest du nicht dieselben Datenschutzannahmen treffen wie bei einem lokalen Ollama-Modell.
Für normale Mac-Nutzer heißt das:
- keine vertraulichen Kundendaten ohne Rechtsgrundlage hochladen
- keine privaten Dokumente blind in Agentenläufe geben
- bei Unternehmen ZDR, Workspace-Regeln und Plattformanbieter prüfen
- bei OpenRouter zusätzlich dessen Datenverarbeitung prüfen
- lokale Modelle für sensible Offline-Aufgaben behalten
Positiv: Anthropic nennt für Sonnet 5 Unterstützung für Zero Data Retention für Organisationen mit entsprechender Vereinbarung. (3)
Das ersetzt keine eigene Compliance-Prüfung. Besonders bei Code, Kundendaten, Forschungsdaten oder personenbezogenen Informationen sollte man genau entscheiden, was lokal bleibt und was in die Cloud darf.
Safety: mehr Agentenfähigkeit, aber mit Cyber-Safeguards
Sonnet 5 ist stärker als Sonnet 4.6, aber Anthropic betont zugleich Sicherheitsgrenzen. Laut Anthropic zeigte Sonnet 5 in Safety-Evaluierungen insgesamt niedrigere unerwünschte Verhaltensraten als Sonnet 4.6 und niedrigere gefährliche Cyber-Fähigkeiten als Opus-Modelle. Gleichzeitig startet Sonnet 5 mit Cyber-Safeguards, die riskante Cyber-Anfragen in Echtzeit erkennen und blockieren können. (1)
Das ist relevant für Entwickler, weil Refusals nicht zwingend als klassischer Fehler auftreten. In der API können Ablehnungen als erfolgreiche Antwort mit stop_reason: "refusal" erscheinen. (3)
Wer produktive Tools baut, sollte solche Fälle sauber behandeln:
- Refusal erkennen
- Nutzer verständlich informieren
- keine endlosen Retry-Schleifen bauen
- bei erlaubten Aufgaben Prompt präzisieren
- Fallback-Modell nur bewusst nutzen
Für wen passt Claude Sonnet 5?
Claude Sonnet 5 passt besonders, wenn du:
- regelmäßig mit Claude Code arbeitest
- größere Repositories analysierst
- mehrstufige Refactorings planst
- lange Dokumentationen verarbeiten willst
- Browser-/Terminal-Agenten nutzt
- Tool-Use wichtiger ist als reine Chatantworten
- Opus zu teuer ist
- lokale Modelle bei Qualität oder Kontext nicht reichen
Claude Sonnet 5 ist eher nicht die richtige Wahl, wenn du:
- komplett offline arbeiten musst
- sensible Daten nicht hochladen darfst
- nur kurze Standardfragen stellst
- sehr günstige Massenklassifikation brauchst
- ein kleines lokales Modell für einfache Aufgaben reicht
Empfehlung für Mac-Nutzer
Für einen realistischen Mac-Workflow eignet sich Sonnet 5 so:
- Lokale Modelle für private Notizen, kleine Zusammenfassungen, schnelle Entwürfe und Offline-Arbeit.
- Claude Sonnet 5 für Coding-Agenten, große Codebases, schwierige Debugging-Aufgaben und lange Dokumente.
- Claude Opus 4.8 oder Fable 5 nur für die anspruchsvollsten Fälle, bei denen höhere Kosten akzeptabel sind.
- Prompt Caching für wiederkehrende Projektkontexte.
- Batch API für große, nicht zeitkritische Verarbeitungen.
- OpenRouter nur bewusst, wenn du Multi-Provider-Routing brauchst und die Datenschutzbedingungen geprüft hast.
Fazit: Starkes Cloud-Agentenmodell, lokal nicht verfügbar
Claude Sonnet 5 ist für Mac-Nutzer kein lokales KI-Modell. Für produktive Mac-Workflows sprechen der 1M-Kontext, 128K Output, adaptive Thinking, Coding- und Agentenfähigkeiten sowie deutlich niedrigere Kosten als bei Opus 4.8.
Die wichtigste Grenze bleibt Datenschutz: Wer vollständige Offline-Kontrolle braucht, bleibt bei Ollama, MLX, LM Studio oder lokalen Whisper-/Vision-Workflows. Wer dagegen komplexe Codebases, Browser-Agenten, lange technische Dokumente oder echte Tool-Use-Aufgaben bearbeiten will, bekommt mit Sonnet 5 ein sehr starkes Preis-Leistungs-Modell.
Nutze für private Daten zuerst lokale KI. Für schwierige Agenten- und Coding-Aufgaben ist Claude Sonnet 5 die Cloud-Option, wenn externe Verarbeitung in Ordnung ist.
Footnotes
-
https://www.anthropic.com/news/claude-sonnet-5 “Introducing Claude Sonnet 5 | Anthropic” ↩ ↩2 ↩3 ↩4 ↩5 ↩6
-
https://platform.claude.com/docs/en/models/overview “Models overview - Claude Platform Docs” ↩
-
https://platform.claude.com/docs/en/about-claude/models/whats-new-sonnet-5 “What’s new in Claude Sonnet 5 - Claude Platform Docs” ↩ ↩2 ↩3 ↩4 ↩5 ↩6 ↩7 ↩8 ↩9
-
https://platform.claude.com/docs/en/build-with-claude/effort “Effort - Claude Platform Docs” ↩ ↩2
-
https://docs.anthropic.com/en/docs/about-claude/pricing “Pricing - Claude Platform Docs” ↩ ↩2 ↩3
Häufig gestellte Fragen
Ist `anthropic/claude-sonnet-5` der offizielle Modellname?
Nein. Der offizielle Anthropic-API-Modellname lautet `claude-sonnet-5`. `anthropic/claude-sonnet-5` ist eine Router-/Provider-Schreibweise, die bei Plattformen wie OpenRouter verwendet wird.
Läuft Claude Sonnet 5 lokal auf dem Mac?
Nein. Claude Sonnet 5 ist kein Open-Weight-Modell und läuft nicht lokal über Ollama, LM Studio oder MLX.
Wie viel Kontext hat Claude Sonnet 5?
Claude Sonnet 5 unterstützt standardmäßig ein 1M-Token-Kontextfenster und bis zu 128K Output-Tokens in der synchronen Messages API.
Was kostet Claude Sonnet 5?
Aktuell kostet Sonnet 5 $2 pro 1M Input Tokens und $10 pro 1M Output Tokens. Die ursprünglich für den 1. September 2026 angekündigte Erhöhung auf $3 und $15 findet nicht statt.
Ist Claude Sonnet 5 besser als Opus 4.8?
Nicht grundsätzlich. Sonnet 5 ist günstiger und deutlich stärker als Sonnet 4.6, aber Opus 4.8 bleibt laut Anthropic für höhere Genauigkeit bei schwierigen Agenten- und Computer-Use-Aufgaben die stärkere Wahl.
Ist Sonnet 5 gut für Claude Code?
Ja. Anthropic nennt Claude Code ausdrücklich als Verfügbarkeitsfläche für Sonnet 5 und positioniert das Modell stark für Coding, Tool-Use und Agentenaufgaben.
Was muss ich beim Migrieren von Sonnet 4.6 beachten?
Aktualisiere den Modellnamen zu `claude-sonnet-5`, entferne nicht-standardmäßige Sampling-Parameter, prüfe Adaptive Thinking, zähle lange Prompts neu und passe `max_tokens` an den neuen Tokenizer an.
Transparenz
Quellen und Prüfgrundlage
Diese Primär- und Referenzquellen bilden die Grundlage der technischen Einordnung. Herstellerangaben und externe Benchmarks werden im Artikel als solche gekennzeichnet.