esports

En ny generasjon fra OpenAI

OpenAI har lansert GPT-Live. Den nye stemmeteknologien for ChatGPT gjør samtaler langt mer naturlige fordi den nye modellen kan lytte og snakke samtidig. Den håndtere pauser bedre også, og den kan vise visuelle kort underveis og bruke GPT-5.5 i bakgrunnen når spørsmål krever nettsøk eller mer avansert resonnering.

" data-large-file="https://static.itavisen.no/wp-content/uploads/2026/07/Screenshot-2026-07-08-at-19.57.31_result-1264x720.webp" />

OpenAI har annonsert GPT-Live, som er intet mindre enn en ny generasjon stemmeteknologi som skal gjøre samtaler med ChatGPT mer naturlige. Vi har hørt dette før, men denne gang inkluderer OpenAI videodemoer, så får vi håpe at det faktisk fungerer like bra hele tiden i den virkelige verdenen.

OpenAI beskriver dette som starten på en ny fase for menneske-AI-interaksjon

Den nye teknologien erstatter dagens stemmemodus med en modell som både kan lytte og snakke samtidig, uten de kunstige pausene som nå preger AI-samtaler. Dette er en stor forbedring om det fungerer.

For i stedet for å vente til brukeren er ferdig med å snakke, kan GPT-Live følge samtalen kontinuerlig. Det betyr at ChatGPT kan gi små bekreftelser underveis, vente dersom du tar en tenkepause eller avbryte naturlig når det passer, omtrent slik mennesker gjør i en vanlig samtale. Vil dette fungere bra selv om man mister perfekt nettforbindelse? Vi får se, men det er store endringer.

For i tidligere versjoner av ChatGPT Voice behandlet samtaler i separate steg: først ble stemmen gjort om til tekst, deretter genererte språkmodellen et svar, før svaret igjen ble gjort om til tale.

GPT-Live introduserer i stedet en såkalt full-dupleks-arkitektur. Det innebærer at modellen kontinuerlig analyserer lyd samtidig som den genererer tale. Resultatet er betydelig lavere forsinkelser og langt mer flytende dialog.

GPT-5.5 jobber i bakgrunnen

Selv om GPT-Live håndterer selve samtalen, bruker den fortsatt selskapets kraftigste språkmodeller når oppgavene blir mer krevende.

Hvis brukeren ber om nettsøk, avansert resonnering eller komplekse analyser, sender GPT-Live oppgaven videre til GPT-5.5 i bakgrunnen. Samtidig kan stemmesamtalen fortsette uten at brukeren må vente på stillhet mens modellen tenker.

OpenAI opplyser at GPT-Live automatisk vil oppgraderes til fremtidige toppmodeller etter hvert som disse lanseres.

Den nye stemmeopplevelsen kan også vise informasjon på skjermen mens samtalen pågår

Det inkluderer værmeldinger, aksjekurser, sportsresultater og kart kan ChatGPT nå vise interaktive kort samtidig som den forklarer informasjonen muntlig. Voice støtter som alltid funksjoner som nettsøk, hukommelse, filopplasting og bildegjenkjenning.

Ifølge selskapet foretrakk testpersonene GPT-Live klart oftere når det gjaldt:

  • naturlig samtaleflyt
  • færre avbrytelser
  • mer menneskelig dialog
  • bedre turtaking
  • total brukeropplevelse

Modellen skal også levere bedre resultater innen vitenskapelig resonnering, avanserte nettsøk og komplekse kundeservicesamtaler.

Ekstra sikkerhet for stemmesamtaler

OpenAI har samtidig innført egne sikkerhetssystemer spesielt utviklet for stemmebruk, på den måten at om modellen oppdager at en samtale beveger seg inn på risikoområder som selvskading, psykose, vold eller seksuelt innhold, så kan systemet styre samtalen mot tryggere svar, vise ekstra informasjon eller avslutte samtalen dersom situasjonen vurderes som alvorlig.

Selskapet opplyser også at GPT-Live ikke er utviklet for å etterligne ekte menneskers stemmer, og at kun forhåndsdefinerte stemmer kan brukes.

GPT-Live ut fra i dag

GPT-Live rulles ut globalt fra i dag på iPhone, Android og ChatGPT på nett. Betalende Go-, Plus- og Pro-brukere får GPT-Live-1 som standard stemmemodell, mens gratisbrukere får GPT-Live-1 mini.

Ved lansering støttes foreløpig ikke videosamtaler eller skjermdeling. Disse funksjonene kommer heldigivis senere, mens de eldre stemmemodusene fortsatt vil være tilgjengelige for brukere som trenger dem.

GPT-5.6 lanseres i 9. juli.

Originalquelle: www.itavisen.no →