Zum Inhalt springen
benchmark.securesight.ai
Star auf GitHub
DEEN

Cloud-Referenz

Opus 5

Cloud-Referenz

Hardware
Cloud-Referenz—
Speicher
—
Aufgaben
Moorhuhn
Quantisierungen
—

Beschreibung des Modells

Kontextfenster von 1 Million Token, zugleich Standardwert und Maximum, eine kleinere Kontextvariante gibt es laut Dokumentation nicht. Eingabe sind Text und Bilder, Ausgabe ist Text, synchron bis 128.000 Token und über die Message Batches API mit dem Beta-Header output-300k-2026-03-24 bis 300.000 Token. Adaptives Denken ist ab Werk aktiv und wird über den Parameter effort in fünf Stufen von low bis max gesteuert, Vorgabe ist high, bei xhigh und max lässt sich das Denken nicht abschalten. Anthropic nennt in der Modelldokumentation weder Parameterzahl noch Schichtzahl oder Architekturtyp, dokumentiert sind Modell-ID claude-opus-5, Veröffentlichung am 24. Juli 2026 sowie Trainingsdaten-Stichtag und verlässlicher Wissensstand Mai 2026.

Modell-ID
claude-opus-5
Kontextfenster
1 Mio. Token (Standard und Maximum)
Maximale Ausgabe (Messages API)
128K Token
Maximale Ausgabe (Message Batches API, Beta)
300K Token
Modalitäten
Text und Bilder rein, Text raus
Reasoning
Adaptives Denken, standardmäßig aktiv
Effort-Stufen
low, medium, high, xhigh, max
Standard-Effort
high

Angaben des Herstellers: Quelle · Modellkarte · Hersteller

Die Zahlen auf einen Blick

Der Lauf ging über Claude Code. Es gibt kein Serverprotokoll, nur das Sitzungsprotokoll. Daraus stammen Arbeitszeit und Tokenzahl, eine Geschwindigkeit lässt sich nicht ausweisen.

Laufzeit

3,6 h

112 Minuten Arbeitszeit und 102 Minuten Wartezeit am Sitzungslimit des Abos

Cloud-Referenz in Claude Code mit Effort high, nicht im ULTRACODE-Modus: Das Sitzungsprotokoll zeigt Effort high in allen 230 Anfragen und keine Ultracode-Aktivierung. Arbeitszeit und Token sind aus dem Protokoll gerechnet.

Einordnung

noch nicht bewertet

Die Note ist eine persönliche also subjektive Einschätzung.

Für diesen Lauf liegt kein bewertbares Artefakt vor, deshalb steht hier keine Note.

Was schiefging

Keine Selbstkorrekturen protokolliert.

Cloud-Referenz in Claude Code mit Effort high, nicht im ULTRACODE-Modus: Das Sitzungsprotokoll zeigt Effort high in allen 230 Anfragen und keine Ultracode-Aktivierung. Arbeitszeit und Token sind aus dem Protokoll gerechnet.

Selbst ausprobieren

  1. Gewichte laden
  2. llama-server mit der Startzeile oben starten
  3. Den Endpunkt in VS Code als eigenes Modell eintragen und den Agenten wählen

Auftrag, Agentdateien und Werkzeuge: Agent Test Harness

Zitieren: Kai Felix Bennett, „Nutzbarkeitstest von lokaler KI auf AMD-Hardware", benchmark.securesight.ai, Lauf opus5-moorhuhn. Messdaten CC-BY-4.0.

Messdaten CC-BY-4.0, Code MIT.