GPT-4o
GPT-4o Modell-Übersicht
GPT-4o (Omni) ist OpenAIs multimodales Allround-Modell, das schnelle Inferenzzeiten bietet und für viele Anwendungsfälle genutzt werden kann. Das Update vom November 2024 verbesserte Schreibstil, Dateianalyse und Reasoning-Fähigkeiten erheblich. GPT-4o ist 2x schneller und 50% günstiger als GPT-4 Turbo und unterstützt bis zu 128K Input-Tokens als Kontext.
Features & Modalitäten
GPT-4o Benchmark Scores
Technologie & Daten
Technische Spezifikationen
| Architektur | Multimodaler Transformer |
|---|---|
| Input Kontextlänge | 128k |
| Output Kontextlänge | 16,38k |
| Tokenizer | Hybrid Reasoning Transformer |
Besonderheiten
| Native Multimodalität | Text, Bilder |
|---|---|
| Structured Outputs | Ja, JSON |
| Function Calling | Ja |
Vorteile & Nachteile
Vorteile
- Multimodales ModellGPT-4o kann verschiedene Modalitäten verarbeiten. Im Gegensatz zu anderen Versionen, kann die heir vorgestellte Version vom 20.11.2024 allerdings keinen Audio-Input verarbeiten.
- Hohe Inferenz-GeschwindigkeitGPT-4o ist doppelt so schnell wie GPT-4 Turbo und erzeugt gleichzeitig deutlich bessere Output-Qualität bei geringeren Kosten.
- Großes Kontextfenster mit 128k TokensGPT-4o kann bis zu 128.000 Tokens im Input verarbeiten und eignet sich somit auch für die Verarbeitung langer Dokumente.
- Strukturierte Ausgabe von JSONÜber GPT-4o lassen sich strukturierte JSON-Daten ausgeben, was eine wichtige Funktion für Entwickler ist.
Nachteile
- Veraltete TrainingsdatenGPT-4o hat einen Knowledge Cutoff im Oktober 2023. Das bedeutet, dass alle zeitlich darauf folgenden Informationen über externe Quellen und Websuche bezogen werden müssen.
- Proprietäres ModellGPT-4o ist nur über die OpenAI API verfügbar und lässt sich nicht über andere Inferenz-Anbieter oder als lokales Modell abrufen.
- Kein natives ReasoningGPT-4o ist kein Reasoning Modell. Wer komplexe Aufgaben mit GPT-4o lösen möchte, sollte dementsprechend manuelles Chain-of-Thought Prompting verwenden.
Vergleiche GPT-4o mit anderen LLMs
Vergleiche GPT-4o mit anderen Sprachmodellen anhand wichtiger Metriken wie Kontextgröße, Preisen und Benchmark-Leistung.
GPT-4o ausprobieren
Du musst kein Entwickler sein: GPT-4o ist auch direkt in ChatGPT nutzbar.
Provider & APIs
Du kannst OpenAI GPT-4o über die API folgender Anbieter nutzen.
Häufige Fragen zu GPT-4o
Kann ich GPT-4o kostenlos nutzen?
Ja, GPT-4o ist in ChatGPT auch mit einem kostenlosen Konto nutzbar — allerdings meist mit Nutzungslimits.
Ist GPT-4o Open Source?
Nein, GPT-4o ist proprietär. Es gibt keine offenen Gewichte, die Nutzung läuft über Apps oder die API von OpenAI.
Welche Eingabeformate versteht GPT-4o?
GPT-4o verarbeitet folgende Eingabeformate: Text, Bild.
Was kostet GPT-4o über die API?
Über die API kostet GPT-4o 2,50 $ pro 1 Mio. Input-Token und 10,00 $ pro 1 Mio. Output-Token.
Wie groß ist das Kontextfenster von GPT-4o?
GPT-4o verarbeitet bis zu 128k Token in einer Anfrage.
Wie schnell ist GPT-4o?
Über die APIs der bei Byte gelisteten Anbieter erreicht GPT-4o im Median rund 167 Token pro Sekunde (gemessen über 1 Provider). Die tatsächliche Geschwindigkeit hängt vom Anbieter und der Auslastung ab.
Wie aktuell ist das Wissen von GPT-4o?
Der Wissensstand (Knowledge Cutoff) von GPT-4o reicht bis Oktober 2023. Über die integrierte Websuche kann das Modell zusätzlich aktuelle Informationen abrufen.