OpenAI CEO og medgründer Sam Altman avslørte på X (tidligere Twitter) torsdag at Advanced Voice-funksjonen vil begynne å rulle ut «neste uke», men bare for noen få utvalgte ChatGPT-Plus-abonnenter.
Selskapet planlegger å «starte alfaen med en liten gruppe brukere for å samle tilbakemeldinger og utvide basert på det vi lærer.»
alfa-utrullingen begynner å øke abonnenter neste uke!
— Sam Altman (@sama) 25. juli 2024
Advanced Voice, som fjerner tekstmeldingen og gjør det mulig for brukere å snakke direkte med AI på samme måte som et annet menneske, ble opprinnelig annonsert i mai sammen med utgivelsen av GPT-4o under selskapets Spring Update-arrangement. I motsetning til eksisterende digitale assistenter som Siri og Google Assistant, som bare gir hermetiske svar på brukerforespørsler, gir ChatGPTs Advanced Voice menneskelignende svar, nesten uten ventetid og på flere språk.
GPT-4o-modellen er i stand til å reagere på lydinnganger på 320 millisekunder i gjennomsnittsom er på nivå med hvor raskt mennesker reagerer på vanlig samtale. Som du kan se i demovideoen nedenfor, kan modellen snakke med flere brukere samtidig, improvisere samtalepunkter og spørsmål på både engelsk og portugisisk, samt formidle dem med menneskelige følelser, inkludert «latter».
Det er ennå ingen ord om hvordan selskapet vil velge deltakere for alfaprøve, bortsett fra at de er 20 USD/måned ChatGPT Plus-tier-abonnenter. Alfa-utgivelsen var opprinnelig planlagt til juni, selv om denne datoen ble skjøvet tilbake «for å nå baren vår for å lansere» og forbedre evnen til å oppdage og avvise forbudte former for innhold, samt støtte selskapets IT-infrastruktur for å imøtekomme den forventede brukerbelastningen øke.
Som selskapet kunngjorde i juni, vil funksjonens fulle utrulling ikke skje før i det minste denne høsten, og den nøyaktige timingen vil igjen avhenge av at den «oppfyller vår høye sikkerhets- og pålitelighetsbar.»
Å gi ChatGPT muligheten til å snakke naturlig med brukerne er et stort fremskritt. Ved å eliminere behovet for et kontekstvindu reduseres brukernes maskinvarekrav og utvider potensielle integrasjoner og brukstilfeller for AI (som å øke tilgangen til brukere med kroppsmobilitet eller fingerferdighetsbegrensninger).
Det kan også bidra til å øke hastigheten på teknologiens adopsjon av offentligheten ved å redusere adgangsbarrieren for mindre teknologisk kunnskapsrike brukere som er komfortable med å samhandle med datamaskinene sine via «hei Siri», men som blancherer ved utsiktene til rask utvikling.
Støtt vårt arbeid ❤️
Hvis du likte denne artikkelen, vurder å gi en tips for å hjelpe oss med å fortsette å publisere kvalitetsinnhold.




















