Marketplace
MarketplaceMobil mega-meny för innehåll, tjänster och konto.

Huvudspår

Köp & säljAnnonserBoendeBostadObjektObjektBe om prisOffertFöretagsregisterFöretagLånBanklånLokaltHittaKarriärJobbDestinationerResorCoinsKryptoDiskussionForumKunskapWiki
AI-nyheter

GPT-4 lanseras – modellen som gjorde ChatGPT multimodalt

Person interagerar med en virtuell AI-assistent, som illustration till GPT-4:s multimodala lansering 2023
GPT-4 lanseras 2023Bildkälla:Frolopiaton Palm | Magnific | Magnific premiumMagnific premium

GPT-4 lanseras – modellen som gjorde ChatGPT multimodalt

Den 14 mars 2023 presenterade OpenAI GPT-4, nästa stora generation efter modellerna bakom den första ChatGPT-versionen. Modellen kunde ta emot både text och bilder som indata och gav mer tillförlitliga, kreativa och nyanserade svar än GPT-3.5 i många svåra uppgifter.

Marketplace sammanfattar lanseringen i efterhand. GPT-4 var inte felfri och bildfunktionen släpptes först begränsat, men modellen markerade övergången från en uppmärksammad chatbot till en bredare AI-plattform för professionellt arbete, utbildning, programmering och analys.

GPT-4 i korthet

| Punkt | Uppgift vid lanseringen |
|---|---|
| Lanseringsdatum | 14 mars 2023 |
| Företag | OpenAI |
| Modaliteter | Text och bild som indata, text som utdata |
| ChatGPT-tillgång | ChatGPT Plus med användningstak |
| API | Väntelista och gradvis utrullning |
| Kontext | 8 192 token samt en begränsad 32 768-tokenversion |
| Viktig förbättring | Starkare på komplexa instruktioner, kod och professionella prov |
| Viktig begränsning | Hallucinationer och kunskapsgräns kvarstod |

Vad innebar multimodal AI?

Den första breda ChatGPT-versionen arbetade huvudsakligen med text. GPT-4 kunde även analysera bilder tillsammans med textinstruktioner. Användaren kunde exempelvis visa ett diagram, ett fotografi, en skiss eller ett dokument och be modellen förklara innehållet.

Vid lanseringen var bildindata fortfarande en forskningsförhandsvisning och inte allmänt tillgänglig för alla. Men funktionen visade vart utvecklingen var på väg: en AI-assistent skulle inte längre vara begränsad till det användaren kunde beskriva med ord.

Multimodaliteten öppnade för uppgifter som:

  • läsa diagram och tabeller
  • tolka handritade skisser
  • beskriva fotografier
  • hjälpa personer med synnedsättning
  • analysera dokument med text och bilder
  • förklara vad som händer i ett visuellt problem

Senare modeller byggde vidare med ljud, realtidsröst och video. Läs även vår historiska artikel om ChatGPTs lansering den 30 november 2022.

Starkare resultat på svåra uppgifter

OpenAI testade GPT-4 på flera standardiserade prov som ursprungligen utformats för människor. Företaget lyfte bland annat fram ett simulerat amerikanskt juristprov där GPT-4 hamnade ungefär bland de tio procent bästa deltagarna, medan GPT-3.5 låg nära de tio procent svagaste.

Sådana resultat var uppseendeväckande, men behövde tolkas försiktigt. Ett prov mäter en avgränsad förmåga och visar inte automatiskt hur modellen fungerar i ett verkligt juridiskt ärende. GPT-4 kunde fortfarande fabricera rättsfall, missa nya regler och ge en övertygande men felaktig analys.

Skillnaden blev tydligast när uppgiften krävde:

  1. flera sammanhängande resonemangssteg
  2. noggrann instruktionsföljning
  3. hantering av motstridiga krav
  4. längre och mer strukturerade svar
  5. kod och teknisk problemlösning

I enkla vardagsfrågor kunde skillnaden mot GPT-3.5 ibland vara mindre märkbar.

Mer styrbar och kreativ

OpenAI beskrev GPT-4 som mer styrbar, vilket innebar att modellen bättre kunde anpassa ton, roll och format. En användare kunde be om ett svar som en handledare, en redaktör eller en teknisk analytiker och få ett mer konsekvent resultat.

För företag gjorde det modellen användbar för återkommande format:

  • sammanfattningar enligt en mall
  • klassificering av supportärenden
  • rapportutkast
  • kodgranskning
  • produkttexter med bestämd tonalitet
  • svar baserade på intern dokumentation

Styrbarhet var dock inte samma sak som kontroll. Modellen kunde bryta format, missförstå en regel eller följa en manipulerande instruktion i materialet den analyserade.

GPT-4 i ChatGPT Plus

GPT-4 gjordes tillgänglig för betalande ChatGPT Plus-användare med ett användningstak som kunde ändras beroende på kapacitet. Gratisversionen fortsatte i huvudsak använda GPT-3.5.

För utvecklare öppnades API-åtkomst gradvis via en väntelista. Den första standardversionen hade ett kontextfönster på 8 192 token. En större 32 768-tokenversion var planerad för begränsad åtkomst.

Ett större kontextfönster gjorde det möjligt att skicka längre texter och instruktioner, men löste inte automatiskt problemen med noggrannhet. Modellen kunde tappa viktiga detaljer, blanda ihop avsnitt eller dra fel slutsats även om allt material fick plats.

Säkerhetsarbetet tog sex månader

OpenAI uppgav att företaget ägnade sex månader åt att göra GPT-4 säkrare och mer anpassad. Arbetet omfattade mänsklig återkoppling, expertgranskning och testning inom områden som cybersäkerhet, kemiska risker, påverkan och modellautonomi.

Enligt OpenAI:s egna utvärderingar var GPT-4:

  • mindre benägen än GPT-3.5 att svara på förbjudna frågor
  • mer benägen att ge faktamässigt korrekta svar i interna tester
  • bättre på att följa säkerhetsregler i känsliga situationer

Det var leverantörens egna mätningar och inte en garanti i varje verkligt användningsfall. Modellen behöll kända risker och OpenAI betonade behovet av försiktighet i medicinska, juridiska och andra viktiga sammanhang.

Hallucinationer försvann inte

GPT-4 minskade vissa fel jämfört med tidigare modeller, men kunde fortfarande skriva påhittade fakta med hög säkerhet. Den hade dessutom begränsad kunskap om händelser efter större delen av träningsmaterialets slutpunkt och lärde sig inte automatiskt av varje samtal.

Vanliga feltyper var:

  • fabricerade källor och citat
  • felaktiga datum
  • missade detaljer i långa dokument
  • kod med säkerhetsproblem
  • överdrivet säkra slutsatser
  • godtrogenhet inför felaktiga premisser

För en användare kunde den förbättrade språkförmågan paradoxalt göra felen svårare att upptäcka. Ett välstrukturerat svar såg mer trovärdigt ut även när en central uppgift var fel.

Så förändrade GPT-4 programmering

GPT-4 blev snabbt populär bland programmerare. Modellen kunde förklara kod, hitta möjliga fel, skriva tester och föreslå implementationer i flera språk.

Ett säkert arbetsflöde var att:

  1. ge modellen ett avgränsat problem
  2. be om antaganden och risker
  3. låta den skriva tester före större ändringar
  4. köra koden i en separat miljö
  5. genomföra mänsklig kodgranskning
  6. kontrollera licenser och beroenden

Det var olämpligt att kopiera kod direkt till produktion utan testning. Modellen kunde introducera subtila sårbarheter, använda föråldrade bibliotek eller anta att funktioner fanns när de inte gjorde det.

Tillgänglighet genom Be My Eyes

Ett av de tydligaste tidiga användningsfallen var samarbetet med Be My Eyes. GPT-4:s bildförståelse kunde hjälpa personer som är blinda eller har nedsatt syn att få beskrivningar av föremål och situationer.

Exemplet visade både nyttan och ansvaret. En bildmodell kan hjälpa någon läsa en etikett eller förstå ett rum, men ett felaktigt svar om läkemedel, trafik eller säkerhet kan få allvarliga konsekvenser.

AI-baserad tillgänglighet behöver därför kombinera snabb hjälp med tydliga varningar och möjlighet att eskalera till en mänsklig volontär eller annan säker källa.

Företagens nya AI-frågor

Efter GPT-4-lanseringen började fler företag utvärdera generativ AI på allvar. Frågorna handlade inte längre bara om experiment, utan om drift och ansvar:

  • Får personal ladda upp kunddata?
  • Hur skyddas företagshemligheter?
  • Vem ansvarar för ett felaktigt AI-svar?
  • Hur testas modelluppdateringar?
  • Ska användaren informeras om att AI har använts?
  • Hur mäts kvalitet och faktisk tidsbesparing?

De organisationer som lyckades bäst började med begränsade arbetsflöden där resultatet kunde kontrolleras, i stället för att ge modellen generell åtkomst till känsliga system.

GPT-4 och vägen mot AI-agenter

GPT-4 kunde använda externa verktyg när en utvecklare byggde rätt integration. Det lade grunden för senare system där AI:n inte bara skriver ett svar utan söker information, kör kod eller genomför steg i andra appar.

Den utvecklingen ökade kraven på behörigheter. En felaktig text kan korrigeras. En agent som skickar ett meddelande, raderar en fil eller genomför en betalning kan skapa omedelbara konsekvenser.

Marketplace har senare följt utvecklingen mot ChatGPT Agent och andra agentiska arbetsflöden, där isolering, loggning och mänskligt godkännande blivit centrala frågor.

Vanliga frågor

När lanserades GPT-4?

OpenAI presenterade GPT-4 den 14 mars 2023.

Kunde GPT-4 se bilder från början?

Modellen var tekniskt multimodal, men bildindata började som en begränsad forskningsförhandsvisning och rullades inte ut till alla direkt.

Var GPT-4 gratis i ChatGPT?

Vid lanseringen fick ChatGPT Plus-användare tillgång med ett användningstak. Gratisversionen använde i huvudsak GPT-3.5.

Var GPT-4 alltid bättre än GPT-3.5?

GPT-4 var tydligt starkare på många komplexa uppgifter, men kunde vara långsammare och gjorde fortfarande fel. För enkla frågor kunde skillnaden vara mindre viktig.

Hur långt sammanhang kunde GPT-4 hantera?

Standardversionen hade 8 192 token och en större 32 768-tokenversion erbjöds initialt mer begränsat.

Försvann hallucinationerna med GPT-4?

Nej. OpenAI rapporterade förbättrad faktamässig träffsäkerhet, men modellen kunde fortfarande fabricera fakta, citat och källor.

Sammanfattning

GPT-4:s lansering den 14 mars 2023 gjorde ChatGPT starkare på resonemang, kod och komplexa instruktioner och introducerade en multimodal modell som kunde förstå både text och bilder.

Modellen bidrog till att flytta generativ AI från en viral konsumenttjänst till ett seriöst verktyg för företag och utvecklare. Samtidigt blev det tydligt att bättre språk och högre provresultat inte tog bort behovet av källkontroll, säker testning och mänskligt ansvar.

Faktaunderlag: OpenAI, ”GPT-4”, publicerad 14 mars 2023. Artikeln är en historisk sammanfattning publicerad i efterhand.

Utvalda vägar vidare

Jämför och välj med bättre underlag

Tydligt märkta partnererbjudanden, placerade nära rätt beslut.

Partnererbjudande · Banklån

Räkna på banklån innan du ansöker

Se ungefärlig månadskostnad, löptid och villkor på ett ställe.

Räkna på lån

Marketplace kan få ersättning om du går vidare.

Partnererbjudande · Casino · 18+

Casino bonus 2026 – jämför villkor

Se svensk licens, omsättningskrav och aktuell bonusstatus.

Öppna jämförelsen

18+ · Spela ansvarsfullt · Annonslänk · Villkor gäller.

Kommentarer

Kommentarer

Diskutera artikeln i tråden nedan.

Inga omdömen ännu0 omdömen
Fortsätt diskussionen i ForumEn gemensam tråd skapas för artikeln. Har du redan konto kan du logga in och fortsätta direkt.
Diskutera i Forum
Lägg till kommentar

Kommentaren granskas innan den publiceras.

Ditt omdöme