Tagasi
8. mai 2026, kell 09:05 AI OpenAI Voice AI API Agents OpenAI; 9to5Mac; Wikimedia Commons

OpenAI andis rakendustele reaalajas hääle: mudelid arutlevad, tõlgivad ja kirjutavad lennult

OpenAI andis rakendustele reaalajas hääle: mudelid arutlevad, tõlgivad ja kirjutavad lennult

OpenAI andis rakendustele reaalajas hääle: mudelid arutlevad, tõlgivad ja kirjutavad lennult

OpenAI tõi Realtime API-sse uue audiomudelite rea — ja see on üks neist väljalasetest, mis näib ainult pealispinnal tehniline. Praktikas püüab ettevõte muuta hääle mitte vestlusroboti lisandiks, vaid tavaliseks viisiks programme juhtida: rääkida, täpsustada, katkestada, tõlkida, dikteerida ja tegevusi käivitada ilma klaviatuurita.

Väljalaskes on kolm mudelit. GPT-Realtime-2 on mõeldud elavaks hääldialoogiks ning OpenAI sõnul sai see GPT-5 tasemel arutlemise, kindlama töö tööriistadega ja parema käitumise paranduste või katkestuste korral. GPT-Realtime-Translate tõlgib kõnet reaalajas: üle 70 sisendkeele ja 13 väljundkeelt. GPT-Realtime-Whisper teeb voogedastavat transkriptsiooni — tekst ilmub kõne ajal, mitte pärast faili üleslaadimist.

Lühidalt: OpenAI nihutab taas harjumuspärast liidest. Pärast tekstivestlust ja pildigeneratsiooni on järgmine rinne häälerakendused, mis ei vasta lihtsalt valjusti, vaid viivad ülesannet päriselt edasi.

Mida OpenAI täpselt käivitas

GPT-Realtime-2 on mõeldud hääleagentidele. See ei ole klassikaline vastuse ettelugemine, kus mudel kirjutab kõigepealt teksti ja sünteeskõne loeb selle ette. Jutt käib elavast vestlusest, kus mudel peab hoidma konteksti, mõistma parandusi, kutsuma väliseid tööriistu ja selgitama kasutajale, mis toimub.

OpenAI rõhutab eraldi mitut võimekust: lühikesed vahefraasid nagu „kohe kontrollin“, paralleelsed tööriistakutsed, täpsem taastumine vigadest, kuni 128 000 tokenini laiendatud kontekstiaken ja seadistatav arutlemistase minimal’ist xhigh’ni. Häälliidese puhul on see oluline: kasutaja ei näe logisid ega taha vaikuses oodata, kuni taustal mõni API töötab.

Teine mudel, GPT-Realtime-Translate, on mõeldud elavateks mitmekeelseteks vestlusteks. OpenAI räägib enam kui 70 sisendkeele ja 13 väljundkeele toest. Sellist toodet pole vaja ainult ilusate reisidemode jaoks. See puudutab kliendituge, veebiharidust, üritusi, müüki, meditsiini, migratsiooniteenuseid ja kõiki olukordi, kus tõlke viivitus muudab tähenduse kaduma.

Kolmas mudel — GPT-Realtime-Whisper — katab igavama, kuid massilise ülesande: voogedastava kõnetuvastuse. Subtiitrid, koosolekumärkmed, elavad protokollid, häälevormid, kõnede transkriptsioon ja liidesed inimestele, kellel on raske trükkida. Just sellised „igavad“ funktsioonid muutuvad tihti päris äriks.

Miks see on tähtsam kui tavaline hääleassistent

Hääleassistendid on aastaid revolutsiooni lubanud, kuid takerduvad sageli ühte probleemi: nad kõlavad loomulikult, aga tegutsevad rumalalt. Ilma küsida saab, keerulisemat ülesannet juhtida on juba valus. Kasutaja räägib ebatäiuslikult, muudab mõtet poole pealt, katkestab, nimetab tellimusi ja nimesid, palub „tee nagu eelmisel korral“, ning süsteem laguneb.

OpenAI üritab sulgeda just seda lõhet. Ettevõte kirjeldab kolme stsenaariumi: voice-to-action, kus inimene sõnastab ülesande häälega ja agent kasutab tööriistu tulemuse saavutamiseks; systems-to-voice, kus rakendus ise loeb kasulikku konteksti ette; ning voice-to-voice, kus vestlus ületab keele- ja tööpiire.

Näide väljalaskest puudutab kinnisvara: kasutaja palub leida kodud eelarve piires, vältida mürarikkaid tänavaid ja leppida vaatamine kokku laupäevaks. See pole enam „räägi minuga“, vaid häälekiht keerulisele digitaalsele protsessile. Teine näide on reisimine: rakendus võib öelda, et saabuv lend hilineb, ümberistumine on veel võimalik, uus värav leitud, teekond lennujaamas koostatud ja pagas peaks jõudma.

Sellises loogikas muutub hääl mitte meelelahutuskanaliks, vaid teenuse juhtimiskihiks. See muudab turgu: võidavad mitte need, kes lisavad lihtsalt meeldiva hääle, vaid need, kes seovad hääle päris tegevuste, andmebaaside, kalendrite, maksete, broneeringute ja toega.

Hind näitab juba, kus OpenAI nõudlust ootab

OpenAI sõnul on kõik kolm mudelit saadaval Realtime API kaudu. 9to5Maci andmetel maksab GPT-Realtime-2 $32 miljoni sisend-audiotokeni eest, $0,40 miljoni vahemällu salvestatud sisend-audiotokeni eest ja $64 miljoni väljund-audiotokeni eest. GPT-Realtime-Translate maksab $0,034 minutis, GPT-Realtime-Whisper $0,017 minutis.

See detail on tähtis. Hääle-AI lakkab olemast ainult demode preemiumfunktsioon: arendajatel on selge minutihind ja ettevõtetel võimalus arvutada toe, tõlgete, subtiitrite ja hääleagentide majandust. Kui automaatse tõlke või transkriptsiooni minut muutub inimtöötlusest odavamaks ja piisavalt usaldusväärseks, algab juurutus mitte vaimustusest, vaid Exceli tabelist.

GPT-Realtime-2 jääb samal ajal kalliks komponendiks. See on loogiline: agent, mis peab reaalajas arutlema, kuulama, rääkima ja tööriistu kutsuma, nõuab rohkem arvutust. Seetõttu jaguneb lähiturg tõenäoliselt kaheks: odavad voogedastavad transkriptsioonid ja tõlked levivad laialt, keerulised hääleagendid ilmuvad esmalt sinna, kus üks edukas sessioon on rahaliselt väärtuslik — tugi, müük, meditsiin, rahandus, reisimine ja ettevõtteprotsessid.

Kellel sellest esimesena kasu on

Kõige ilmsemad kasutajad on rakendused, kus trükkimine segab ülesannet. Takso, kullerteenused, pangatugi, broneerimine, CRM, arsti aja broneerimine, keeleõpe, koosolekumärkmed ja navigeerimine suurtes teenustes. Hääl on seal hea mitte sellepärast, et see on „inimlik“, vaid sest kasutaja käed ja tähelepanu on sageli hõivatud.

Ärile on see järgmine samm front-office’i automatiseerimisel. Osa kõnesid, pöördumisi ja sisepäringuid saab töödelda mitte menüüga „vajutage 1“, vaid vestlusega, kus agent mõistab eesmärki, küsib täpsustusi ja kasutab tööriistu. Siin tekib ka risk: halb hääleagent ärritab rohkem kui halb vestlusrobot, sest ta kulutab aega reaalajas ja loob mõistmise illusiooni.

Tavakasutajale on mõju vähem dramaatiline, kuid igapäevasem. Subtiitrid muutuvad kiiremaks. Tõlge läheneb elavale vestlusele. Rakenduste häälefunktsioonid lakkavad olemast mänguasi ja hakkavad tegema konkreetseid asju: muutma broneeringut, vormistama taotlust, selgitama liidest, pidama koosolekuprotokolli või aitama nägemis- või motoorikapiiranguga inimest.

Mida see trendi kohta ütleb

Suured mudelid liiguvad eraldi vestlusaknast toodete sisse. Alguses kirjutasid nad tekste. Siis hakkasid otsima, koodima, pilte nägema ja tööriistu juhtima. Nüüd panustab OpenAI selgelt kõnele kui veel ühele „pordile“ agentide juurde.

See ei tähenda, et klaviatuur kaob. Hääl sobib halvasti kõigele, mis nõuab privaatsust, täpsust ja rahulikku redigeerimist. Kuid seal, kus ülesanne on vestluslik, kiire või füüsiliselt ebamugav, võib hääle-AI muutuda vaikimisi liideseks.

Põhiküsimus pole enam, kas mudel oskab ilusasti rääkida. Oskab. Küsimus on selles, kas ettevõtted suudavad selle ehitada nii, et hääleagent oleks kasulik, turvaline ega muutuks lobisevaks seinaks inimese ja lahenduse vahel.

Neuro.ee toimetuse arvamus

OpenAI uus väljalase on tähtis mitte mudelinimede, vaid suuna pärast. Hääle-AI küpseb: „assistent vastab valjusti“ liigub mudeliks „rakendus mõistab kõnet, tõlgib, kirjutab, arutleb ja tegutseb“. See on praktilisem agentluse kiht kui paljud valjud demod.

Aga on ka kainem pool. Hääl teeb vead kallimaks: kasutaja kuuleb enesekindlust isegi siis, kui süsteem eksib. Seetõttu võidavad mitte kõige jutukamad agendid, vaid kõige distsiplineeritumad — need, mis oskavad täpsustada, tegevusi näidata, piire hoida ja mitte teeselda mõistmist seal, kus on vaja kontrolli.

Veel uudiseid

Reddit võrdles AI-hoiatusi filmiga „Ärge vaadake üles“ – ja arutelu väljus meemi raamidest
9. august 2026
Reddit võrdles AI-hoiatusi filmiga „Ärge vaadake üles“ – ja arutelu väljus meemi raamidest

Redditi r/singularity-kogukonnas avaldatud postitus võrdles AI-riskide üle peetud telearutelu stseeniga filmist „Ärge vaadake üles“, kus murettekitav sõnum kaob saateformaati. Meemi taustal on tegelik uudislugu: endine OpenAI teadlane Daniel Kokotajlo selgitab taas, miks peab 2027. aastat AI arengu järsu kiirenemise võimalikuks pöördepunktiks. Oluline pole paanika, vaid lõhe tehnoloogia arengu kiiruse ja ühiskonna suutlikkuse vahel sellest rääkida.

Jeff Dean lahkub Google'ist, et asutada oma idufirma, ja DeepMind eemaldub tipptasemel mudelite võidujooksust: Google valib mudelite asemel pilve
9. august 2026
Jeff Dean lahkub Google'ist, et asutada oma idufirma, ja DeepMind eemaldub tipptasemel mudelite võidujooksust: Google valib mudelite asemel pilve

5. augustil teatas Google DeepMindi ümberkorraldustest: Demis Hassabis taandus operatiivjuhtimisest ning Jeff Dean, üks Google'i insenerikultuuri rajajaid, lahkub koos kolme veteraniga, et asutada Discovery Loop – teaduse ja inseneeria automatiseerimisele keskenduv idufirma. Analüütikud tõlgendavad seda signaalina: Google ei panusta tipptasemel mudelite võidujooksus liidripositsioonile, vaid AI-pilvele ja tehnoloogiate levikule.

Taani kehtestab kodus kirjutatavate eksamitööde suulise kaitsmise, et ei peaks oletama, kas need kirjutas AI
9. august 2026
Taani kehtestab kodus kirjutatavate eksamitööde suulise kaitsmise, et ei peaks oletama, kas need kirjutas AI

Taani käivitab gümnaasiumides kiireloomulised meetmed AI abil petmise vastu. Kodus kirjutatud eksamitöid tuleb nüüd suuliselt kaitsta ning koolid saavad rohkem kontrollivahendeid. Põhiidee on lihtne: kontrollida mitte teksti päritolu, vaid õpilase arusaamist.

Anthropic muudab Claude Code’i autonoomse režiimi vaikeseadeks: AI-agent otsustab ise, mida teha
9. august 2026
Anthropic muudab Claude Code’i autonoomse režiimi vaikeseadeks: AI-agent otsustab ise, mida teha

Alates 14. augustist saab autonoomsest režiimist Claude Code’i vaikeseade Pro, Maxi ja Teami pakettides. Anthropic väidab, et agent tuvastab nüüd ohtlikud tegevused inimesest paremini: 1053 arendajaga testis blokeeris autonoomne režiim 89% pahatahtlikest käskudest, inimesed aga vaid 13,6%. See muudab mängureegleid kõigi jaoks, kes töötavad koodi kallal AI-agentidega.

Meditsiinilised andmed ei tohiks jõuda AI-sse muutmata kujul: OpenClawi oskus Redacta peidab patsiendinimed enne mudelisse saatmist
8. august 2026
Meditsiinilised andmed ei tohiks jõuda AI-sse muutmata kujul: OpenClawi oskus Redacta peidab patsiendinimed enne mudelisse saatmist

Arendaja avaldas Redacta – OpenClawi avatud lähtekoodiga oskuse, mis asendab nimed, kuupäevad ja patsiendinumbrid pseudonüümidega enne teksti jõudmist keelemudelisse. Tööriist töötab lokaalselt, ei edasta isikuandmeid väljapoole ning on ClawHubil kogunud juba 1400 allalaadimist. See on praktiline vastus peamisele hirmule, mis kaasneb AI kasutamisega meditsiinis: kuidas kasutada mudeleid isikuandmeid lekitamata.

37 inimest lahkusid 2026. aastal OpenAI-st ja Anthropicust, et asutada oma AI-idufirmad
8. august 2026
37 inimest lahkusid 2026. aastal OpenAI-st ja Anthropicust, et asutada oma AI-idufirmad

2026. aastal lahkus OpenAI-st ja Anthropicust 37 endist töötajat, et asutada oma AI-ettevõtted. See pole üksikute lahkumiste jada, vaid püsiv laine: kahe tähtsaima labori endised töötajad kujundavad AI-ökosüsteemi järgmist kihti – Thinking Machines Labist Mirendili ja Humans&-ini. Tavalugeja jaoks tähendab see, et konkurents AI-vallas ei piirdu enam kahe hiiglase duelliga.

$400 000 suuruste boonustega kiibitehase töötajad tõrjuvad arste ja juriste kõrvale: AI-kiipide buum kirjutab Lõuna-Korea sotsiaalse hierarhia ümber
8. august 2026
$400 000 suuruste boonustega kiibitehase töötajad tõrjuvad arste ja juriste kõrvale: AI-kiipide buum kirjutab Lõuna-Korea sotsiaalse hierarhia ümber

AI-buum on teinud Samsungi ja SK Hynixi töötajatest Lõuna-Korea uue eliidi: kuni $476 000 suurused boonused ühe töötaja kohta tõstsid nende reitingu abieluagentuurides peaaegu arstide ja juristide tasemele. Kiibitöötajatest said riigi ihaldatuimad pruudid ja peigmehed, samal ajal kui majandusteadlased hoiatavad ühiskonna kasvava kihistumise eest.

Väikeettevõtte omanik nimetas DeepSeek V4 Flashi „super-töötajaks” ja tellis veel paar serverit
8. august 2026
Väikeettevõtte omanik nimetas DeepSeek V4 Flashi „super-töötajaks” ja tellis veel paar serverit

Väikeettevõtte omanik rääkis r/LocalLLaMAs, et uuendatud DeepSeek V4 Flash 0731 võtab enda kanda kodeerimise, dokumendid ja klienditoe ning ta tellis veel paar DGX Spark serverit. See on üks ilmekamaid näiteid sellest, kuidas odav lokaalne mudel muutub väikeettevõtte täisväärtuslikuks töötajaks.

Nvidia investeerib kuni $3 miljardit Lanciumisse – ettevõttesse, mis rajab Texases Stargate’i AI-kampuse energiataristut
8. august 2026
Nvidia investeerib kuni $3 miljardit Lanciumisse – ettevõttesse, mis rajab Texases Stargate’i AI-kampuse energiataristut

Nvidia investeerib kuni $3 miljardit Lanciumisse – Texases asuva Stargate’i AI-kampuse taga seisvasse energiataristu arendajasse. Esimesed $2 miljardit annavad kiibitootjale ettevõttes umbes 20% osaluse, veel $1 miljard lisandub tingimuste täitmisel, näiteks elektrivõrguga ühendamise edenemise korral. Nii siseneb Nvidia esimest korda otse energiataristusse, mis varustab elektriga ka tema enda AI-andmekeskusi.

Musk muudab SpaceX-i AI-taristuks: 10 GW arvutusvõimsust ja kuni $300 miljardi suurune käive 2027. aastaks
8. august 2026
Musk muudab SpaceX-i AI-taristuks: 10 GW arvutusvõimsust ja kuni $300 miljardi suurune käive 2027. aastaks

SemiAnalysise analüütikud kirjutavad, et SpaceX võib 2027. aasta lõpuks rajada umbes 10 GW AI-arvutusvõimsust, mille potentsiaalne käive ulatuks kuni $300 miljardini. Esimesel IPO-järgsel tulemuskõnel teatas Muski ettevõte, et rajab tulevased võimsused eranditult Nvidia Vera Rubini kiipidele, ning praeguse arvutuspargi maht on juba 1,4 GW.

AI tegi Maci ja iPadi kallimaks: mälupuudus jõudis Apple'ini
25. juuni 2026
AI tegi Maci ja iPadi kallimaks: mälupuudus jõudis Apple'ini

Apple tõstis Macide, iPadide ja osa koduseadmete hindu, põhjendades seda mälu ja andmekandjate hinna järsu tõusuga AI-andmekeskuste tõttu. WSJ ja Bloombergi andmetel kallines MacBook Neo 599 dollarilt 699 dollarile ning osa Maci ja iPadi mudeleid lisas hinnale sadu dollareid. Ostjate jaoks on see hetk, kus AI-buum ei ole enam ainult pilvede ja GPU-de lugu: see mõjutab juba tavalise elektroonika hinda.

OpenAI ja Anthropic panustasid plaani päästa töökohad AI eest
25. juuni 2026
OpenAI ja Anthropic panustasid plaani päästa töökohad AI eest

USAs käivitati RAISE US: parteideülene organisatsioon, millel on üle 500 miljoni dollari töötajate ettevalmistamiseks AI-majanduseks. Partnerite seas on OpenAI Foundation, Anthropic, Amazon, Microsoft, IBM, Bank of America ja teised suured tööandjad. Turule on see märk, et automatiseerimisvaidlus liigub prognoosidelt pilootidele: osariigid ja ettevõtted hakkavad kontrollima, millised meetmed aitavad inimestel päriselt tööst mitte välja kukkuda.