GPT-3.5 Turbo

GPT-3.5 Turbo

OpenAIÆldre generation

GPT-3.5 Turbo er OpenAI's hurtige og omkostningseffektive model, der tilbyder fremragende ydeevne til de fleste almindelige opgaver. Perfekt balance mellem kvalitet og pris.

Foto: Zulfugar Karimov / Unsplash

~175B

Parametre

16K

Kontekst

$0.0005

Input/1K

$0.0015

Output/1K

Hvad modellen var

GPT-3.5 Turbo blev udgivet 30. november 2022 og var modellen bag den første offentlige version af ChatGPT. Den gjorde samtalebaseret brug af sprogmodeller til noget mange mennesker prøvede selv, i stedet for noget der blev læst om. For de fleste udviklere var den også den første model der var billig nok til at bygge rigtige produkter oven på.

Teknisk er den en instruktionsjusteret model med omkring 175 milliarder parametre og et context window på 16.385 tokens. Træningsdata går frem til september 2021. Den håndterer tekstgenerering, oversættelse, opsummering, enklere kodeopgaver og function calling, og den fungerer på dansk såvel som på en lang række andre sprog.

Prisen var en stor del af betydningen. Med 0,0005 USD per 1K input-tokens og 0,0015 USD per 1K output-tokens kunne du køre chatbots, FAQ-systemer og batch-opsummering i et volumen der tidligere var urealistisk. Meget af det mønster for API-brug som senere modeller arvede, blev etableret her.

Hvorfor den er blevet overhalet

Senere modelgenerationer er blevet markant bedre til flertrinsopgaver. De holder bedre styr på lange instruktioner, laver færre logiske spring og er mere pålidelige når en opgave kræver flere afhængige delresultater. GPT-3.5 Turbo klarer stadig enkle opgaver fint, men bliver skrøbelig når kompleksiteten stiger.

Context window er også vokset kraftigt i de generationer der kom efter. Det ændrer hvad du overhovedet kan gøre, for eksempel RAG over større dokumentsamlinger eller analyse af hele kodebaser i ét kald. Samtidig er multimodalitet blevet standard i de nyere modeller, mens GPT-3.5 Turbo kun håndterer tekst.

Dertil kommer at prisen på nyere og stærkere modeller er faldet. Det økonomiske argument, som var modellens vigtigste, holder ikke længere på samme måde. Endelig er træningsdata fra september 2021 nu langt tilbage, hvilket giver forældet viden om alt der er sket siden.

Har den stadig en rolle

Til nye projekter er svaret reelt nej. OpenAI's nyere modeller i den billige ende dækker de samme opgavetyper bedre, med større context window og nyere træningsdata, og migrationen kræver sjældent andet end at skifte modelnavn i API-kaldet.

Den tilbageværende brug er praktisk snarere end teknisk. Kører du et system der har været i produktion længe, og hvor prompts er tunet præcist til modellens adfærd, kan der være grund til at udskyde skiftet indtil du kan teste ordentligt. Er du afhængig af en fine-tuned variant, gælder det samme.

Historisk har modellen fortsat interesse. Den er referencepunktet for hvad instruktionsjusterede sprogmodeller kunne i slutningen af 2022, og den bruges i den rolle i en del ældre benchmarks og faglitteratur. Det er et argument for at kende den, ikke for at bygge på den.

Capabilities

Opgaver

TekstgenereringKodegenereringOversættelseOpsummeringSpørgsmål og svarChatbotsFunction calling

Sprog Support

DanskEngelskSpanskFranskTyskItalienskPortugisiskNederlandsk+3 flere

Styrker

  • Meget billig sammenlignet med GPT-4
  • Hurtige responstider
  • God til de fleste standard opgaver
  • Fremragende værdi for pengene
  • Stabil og pålidelig

Begrænsninger

  • !Mindre avanceret reasoning end GPT-4
  • !Kan fejle ved meget komplekse opgaver
  • !Mindre kreativ end GPT-4
  • !Ingen billedforståelse

Use Cases

Kundeservice chatbots
Indholdsgenerering
E-mail automatisering
Enkel kodegenerering
Oversættelse
Tekstopsummering
FAQ systemer

Benchmarks

70%
MMLU
85.5%
HellaSwag
48.1%
HumanEval
57.1%
GSM8K

Tekniske Detaljer

Release Dato
30.11.2022
Provider
OpenAI
Parametre
~175B
Kontekstvindue
16,385 tokens
Træningsdata
Data frem til september 2021