Cloud-Referenz
Opus 5
Cloud-Referenz
- Hardware
- Cloud-Referenz—
- Speicher
- —
- Aufgaben
- Moorhuhn
- Quantisierungen
- —
Beschreibung des Modells
Kontextfenster von 1 Million Token, zugleich Standardwert und Maximum, eine kleinere Kontextvariante gibt es laut Dokumentation nicht. Eingabe sind Text und Bilder, Ausgabe ist Text, synchron bis 128.000 Token und über die Message Batches API mit dem Beta-Header output-300k-2026-03-24 bis 300.000 Token. Adaptives Denken ist ab Werk aktiv und wird über den Parameter effort in fünf Stufen von low bis max gesteuert, Vorgabe ist high, bei xhigh und max lässt sich das Denken nicht abschalten. Anthropic nennt in der Modelldokumentation weder Parameterzahl noch Schichtzahl oder Architekturtyp, dokumentiert sind Modell-ID claude-opus-5, Veröffentlichung am 24. Juli 2026 sowie Trainingsdaten-Stichtag und verlässlicher Wissensstand Mai 2026.
- Modell-ID
- claude-opus-5
- Kontextfenster
- 1 Mio. Token (Standard und Maximum)
- Maximale Ausgabe (Messages API)
- 128K Token
- Maximale Ausgabe (Message Batches API, Beta)
- 300K Token
- Modalitäten
- Text und Bilder rein, Text raus
- Reasoning
- Adaptives Denken, standardmäßig aktiv
- Effort-Stufen
- low, medium, high, xhigh, max
- Standard-Effort
- high
Angaben des Herstellers: Quelle · Modellkarte · Hersteller
Die Zahlen auf einen Blick
Der Lauf ging über Claude Code. Es gibt kein Serverprotokoll, nur das Sitzungsprotokoll. Daraus stammen Arbeitszeit und Tokenzahl, eine Geschwindigkeit lässt sich nicht ausweisen.
Laufzeit
3,6 h
112 Minuten Arbeitszeit und 102 Minuten Wartezeit am Sitzungslimit des Abos
Cloud-Referenz in Claude Code mit Effort high, nicht im ULTRACODE-Modus: Das Sitzungsprotokoll zeigt Effort high in allen 230 Anfragen und keine Ultracode-Aktivierung. Arbeitszeit und Token sind aus dem Protokoll gerechnet.
Einordnung
noch nicht bewertet
Die Note ist eine persönliche also subjektive Einschätzung.
Für diesen Lauf liegt kein bewertbares Artefakt vor, deshalb steht hier keine Note.
Was schiefging
Keine Selbstkorrekturen protokolliert.
Cloud-Referenz in Claude Code mit Effort high, nicht im ULTRACODE-Modus: Das Sitzungsprotokoll zeigt Effort high in allen 230 Anfragen und keine Ultracode-Aktivierung. Arbeitszeit und Token sind aus dem Protokoll gerechnet.
Quellen
- Modellkartedocs.anthropic.com/en/docs/about-claude/models
- Herstellerseitewww.anthropic.com
- Messdaten-Repogithub.com/KaiFelixBennett/local-ai-amd-benchmark
Selbst ausprobieren
- Gewichte laden
- llama-server mit der Startzeile oben starten
- Den Endpunkt in VS Code als eigenes Modell eintragen und den Agenten wählen
Auftrag, Agentdateien und Werkzeuge: Agent Test Harness
Zitieren: Kai Felix Bennett, „Nutzbarkeitstest von lokaler KI auf AMD-Hardware", benchmark.securesight.ai, Lauf opus5-moorhuhn. Messdaten CC-BY-4.0.
Messdaten CC-BY-4.0, Code MIT.