GPT-4 Turbo

GPT-4 Turbo

OpenAIÆldre generation

GPT-4 Turbo er en optimeret version af GPT-4 med større kontekstvindue, nyere træningsdata og lavere pris. Modellen tilbyder bedre værdi for penge uden at gå på kompromis med kvalitet.

Foto: Immo Wegmann / Unsplash

~1.76T

Parametre

128K

Kontekst

$0.01

Input/1K

$0.03

Output/1K

Hvad modellen var

GPT-4 Turbo udkom 6. november 2023 som en optimeret udgave af GPT-4. Den beholdt kvaliteten fra den oprindelige model, men gjorde den billigere at bruge og bedre til lange input. Prisen på 0,01 USD per 1K input-tokens og 0,03 USD per 1K output-tokens flyttede en del opgaver fra prototype til drift.

Det vigtigste skift var kontekstvinduet på 128.000 tokens. Det gjorde det praktisk at sende hele kontrakter, kodebaser eller mødereferater ind i én prompt uden først at skære dem i stykker. Mange RAG-opsætninger blev enklere, fordi du kunne acceptere større og mindre præcist afgrænsede tekstuddrag.

Modellen var også et skridt mod at bruge sprogmodeller som byggeklods i software frem for som chatgrænseflade. Struktureret output og function calling gjorde det muligt at få svar tilbage i et format, som resten af systemet kunne læse direkte. Træningsdata frem til april 2023 var på udgivelsestidspunktet nyere end det, der ellers var tilgængeligt fra OpenAI.

Hvorfor den er blevet overhalet

Udviklingen efter 2023 gik hurtigt på tre fronter. Prisen per token faldt markant hos alle store udbydere, inference blev hurtigere, og multimodalitet blev standard frem for tilvalg. En tekstmodel uden billedforståelse i basisudgaven passer dårligt til den måde, mange systemer bygges på i dag.

Samtidig kom en ny kategori af modeller, der bruger mere beregning under selve svaret til at arbejde sig gennem et problem i flere trin. De klarer matematik, planlægning og længere kodeopgaver bedre end en model fra 2023 gør. Også på almindelig instruktionsfølgning og struktureret output er de senere generationer mere pålidelige.

Træningsdata frem til april 2023 er desuden blevet et reelt problem. Modellen kender ikke biblioteker, API-ændringer eller begivenheder fra de efterfølgende år. Det kan afhjælpes med RAG, men det lægger arbejde og latenstid oveni.

Har den stadig en rolle

For nye projekter er svaret reelt nej. GPT-4 Turbo er en lukket model, der kun findes via API, så den kan ikke køres lokalt eller bruges til den slags forskning, hvor ældre open source-vægte stadig har værdi. Alt hvad den kan, kan nyere modeller fra samme udbyder også, typisk billigere og hurtigere.

Den ene undtagelse er eksisterende systemer, der er testet og valideret mod netop denne model. Her kan det give mening at blive, indtil du har tid til at køre dine evalueringer igennem igen på en nyere model. Læg en plan for migrering frem for at udskyde den, da legacy-modeller på et tidspunkt bliver taget ud af drift.

Historisk er GPT-4 Turbo værd at kende, fordi den markerer overgangen til store kontekstvinduer som noget almindeligt. Meget af den arkitektur, du finder i produktionssystemer i dag, blev formet af de muligheder, den åbnede.

Capabilities

Opgaver

TekstgenereringKodegenereringAnalyse af lange dokumenterReasoningKreativ skrivningJSON modeFunction calling

Sprog Support

DanskEngelskSpanskFranskTyskItalienskPortugisiskNederlandsk+3 flere

Styrker

  • Meget stort kontekstvindue (128K tokens)
  • Nyere træningsdata end GPT-4
  • Væsentlig billigere end standard GPT-4
  • JSON mode for struktureret output
  • Glimrende til lange dokumenter
  • Indbygget function calling

Begrænsninger

  • !Stadig relativt dyr sammenlignet med 3.5
  • !Kan være mindre kreativ end standard GPT-4
  • !Ingen billedforståelse i basis version

Use Cases

Analyse af lange dokumenter
Kodegenerering med stor kontekst
Chatbots med hukommelse
API integrationer
Dataekstraktion fra store tekster
Opsummering af lange artikler

Benchmarks

86.4%
MMLU
95.3%
HellaSwag
67%
HumanEval
92%
GSM8K

Tekniske Detaljer

Release Dato
6.11.2023
Provider
OpenAI
Parametre
~1.76T
Kontekstvindue
128,000 tokens
Træningsdata
Data frem til april 2023