Tagasi
22. mai 2026, kell 05:45 AI OpenAI Codex Agents AI Coding OpenAI Developers; cover: OpenAI Developers

Codex õpib hoidma eesmärki mitmetunnise töö jaoks

Codex õpib hoidma eesmärki mitmetunnise töö jaoks

OpenAI arendab Codexi jaoks stsenaariumi Follow a goal ehk autonoomse töö režiimi, kus agendile ei anta järgmist väikest käsku, vaid mitmetunnine eesmärk. Dokumentatsioonis kirjeldab ettevõte käsku /goal: see hoiab Codexi ühel kursil, kuni ülesanne on valmis, blokeeritud või inimese poolt peatatud.

See on oluline nihe selles, kuidas OpenAI Codexit programmeerijatele pakendab. Varem nägi tüüpiline agentlik töövoog sageli välja nagu pikk vestlus: „loe failid läbi“, „nüüd paranda testid“, „nüüd käivita build“, „nüüd kontrolli uuesti“. /goal püüab muuta selle ahela üheks lepinguks: siin on plaan, siin on etapid, siin on kontrollid ja siin on koht, kus tuleb peatuda.

Mis muutus

Follow a goali põhiidee on püsiv eesmärk. See elab üle ühe vastuse ega kao pärast esimest vaheparandust. Codex peab mäletama, millise tulemuseni ta liigub, millised failid ja dokumendid on olulised, milliseid piiranguid ei tohi rikkuda ja milline tingimus loetakse lõplikuks.

OpenAI seob /goal ülesannetega, kus on selge edukriteerium ja kontrollitsükkel. Agendile ei piisa lausest „paranda projekti“. Talle tuleb selgitada, millega töö lõpeb: testid läbivad, vana import on kadunud, uus integratsioon on ühendatud, prototüüp käivitub või raport sisaldab riske.

Siin on lihtne unustada võtmeasi: plaan peab olema täidetav. Kui PLAN.md on lihtsalt soovide nimekiri, muutub mitmetunnine autonoomsus kiiresti vestlusest oletamiseks. Hea plaan jagab töö etappideks, määrab iga etapi jaoks kontrollid ja kirjeldab eraldi visuaalset valideerimist, kui tulemus on kasutajaliideses näha.

Miks see on oluline

Arendajate jaoks on väärtus käsitsi mikromanageerimise vähenemises. Kui ülesanne võtab mitu tundi, ei kaota inimene aega ainult koodi peale, vaid ka pidevale agendi juurde naasmisele: konteksti meeldetuletamine, järgmise sammu täpsustamine, testide uuesti käivitamise palumine ja liiga laiaks paisuva refaktori peatamine.

/goal nihutab osa sellest distsipliinist algsesse ülesandepüstitusse. Codex saab liikuda kontrollpunktide kaupa: kõigepealt inventuur, siis koodimuudatus, siis testid, siis puhastus ja lõpuks lõpparuanne. Inimene jääb samal ajal otsuse omanikuks: ta seab failides lepingu ja saab sekkuda, kui agent liigub vales suunas.

See on eriti nähtav töödes, kus vahepealne müra on vähem oluline kui tõendatav lõpp. „Rakenda PLAN.md, loo iga etapi jaoks testid ja kontrolli ekraani Playwright interactive’iga“ sobib /goal jaoks paremini kui „vaata, mida saaks parandada“. Teisel juhul hakkab Codex edukriteeriumi ära arvama.

Kuidas /goal’i kasutada

Praktiliselt parim stsenaarium näeb välja nagu /goal Implement PLAN.md. Kõigepealt paneb inimene reposse PLAN.md: millist tulemust on vaja, millised etapid tuleb läbida, millised testid tuleb igas etapis kirjutada, milliseid kontrolle käivitada, kus on vaja reference screen’e ja mida lugeda valmis seisuks.

Pärast seda ei peaks /goal plaani asendama. See peaks sundima Codexit hoidma seda lepingut mitu tundi: lugema faile, tegema muudatusi, looma iga etapi jaoks teste, käivitama kontrolle ja pöörduma vahepealsete vigade järel eesmärgi juurde tagasi.

Näidisülesanne:

/goal Implement PLAN.md, creating tests for each milestone and verifying the output with playwright interactive.
Use the reference screens in docs/reference-screens/ where relevant.
Before coding, read PLAN.md, docs/new-client.md, src/settings/* and existing settings tests.
Do not change auth or global design outside the plan.
For each milestone, add or update tests first, then implement the code, then run npm test -- settings and npm run typecheck.
For UI milestones, open the result with Playwright interactive and compare it with the reference screens.
Stop when every milestone in PLAN.md is complete, tests and typecheck pass, Playwright verification is done,
and the final report lists changed files, checks run and remaining risks.

Selles näites pole olulised pikad sõnastused, vaid kontrollitavus. „Kood sai paremaks“ ei ole peatumistingimus. „Build läbib, testid on rohelised ja vana API-d ei esine enam vajalikus kaustas“ on.

OpenAI kirjeldab ka lihtsaid juhtkäske. /goal ilma argumentideta näitab praegust staatust. /goal pause peatab töö ajutiselt, kui on vaja muudatusi üle vaadata või oodata välist otsust. /goal resume jätkab sama jooksu. /goal clear kustutab eesmärgi, kui ülesanne on valmis, blokeeritud või enam ebaoluline.

Kus režiim töötab kõige paremini

Parimad kandidaadid /goal jaoks on ülesanded, mis on suuremad kui üks prompt, kuid väiksemad kui lõputu backlog, eriti kui neid saab kirjeldada PLAN.md failis etappide ja kontrollidega. Näiteks ühe mooduli migratsioon, ühe klassi testikukkumiste parandamine, selge demoga prototüübi ehitamine või prompti optimeerimine konkreetse eval-juhtumite komplekti järgi.

Halvad kandidaadid on hägused palved ja omavahel sidumata ülesannete nimekirjad. „Tee rakendus korda“ tuleks kõigepealt muuta konkreetseks eesmärgiks. „Tee kümme eri parandust“ on parem jagada mitmeks eraldi jooksuks. Muidu ei hoia agent eesmärki, vaid soovide kotti.

Uuenduse mõte ei ole selles, et Codexit saab nüüd terveks päevaks järelevalveta lahti lasta. OpenAI panustab režiimile, kus inimene sõnastab kontrollitava tulemuse ja Codex hoiab mitu tundi kurssi selle poole: mitte „tee midagi kasulikku“, vaid „jõua sellesse seisu ja tõesta, et jõudsid“.

Veel uudiseid

Reddit võrdles AI-hoiatusi filmiga „Ärge vaadake üles“ – ja arutelu väljus meemi raamidest
9. august 2026
Reddit võrdles AI-hoiatusi filmiga „Ärge vaadake üles“ – ja arutelu väljus meemi raamidest

Redditi r/singularity-kogukonnas avaldatud postitus võrdles AI-riskide üle peetud telearutelu stseeniga filmist „Ärge vaadake üles“, kus murettekitav sõnum kaob saateformaati. Meemi taustal on tegelik uudislugu: endine OpenAI teadlane Daniel Kokotajlo selgitab taas, miks peab 2027. aastat AI arengu järsu kiirenemise võimalikuks pöördepunktiks. Oluline pole paanika, vaid lõhe tehnoloogia arengu kiiruse ja ühiskonna suutlikkuse vahel sellest rääkida.

Jeff Dean lahkub Google'ist, et asutada oma idufirma, ja DeepMind eemaldub tipptasemel mudelite võidujooksust: Google valib mudelite asemel pilve
9. august 2026
Jeff Dean lahkub Google'ist, et asutada oma idufirma, ja DeepMind eemaldub tipptasemel mudelite võidujooksust: Google valib mudelite asemel pilve

5. augustil teatas Google DeepMindi ümberkorraldustest: Demis Hassabis taandus operatiivjuhtimisest ning Jeff Dean, üks Google'i insenerikultuuri rajajaid, lahkub koos kolme veteraniga, et asutada Discovery Loop – teaduse ja inseneeria automatiseerimisele keskenduv idufirma. Analüütikud tõlgendavad seda signaalina: Google ei panusta tipptasemel mudelite võidujooksus liidripositsioonile, vaid AI-pilvele ja tehnoloogiate levikule.

Taani kehtestab kodus kirjutatavate eksamitööde suulise kaitsmise, et ei peaks oletama, kas need kirjutas AI
9. august 2026
Taani kehtestab kodus kirjutatavate eksamitööde suulise kaitsmise, et ei peaks oletama, kas need kirjutas AI

Taani käivitab gümnaasiumides kiireloomulised meetmed AI abil petmise vastu. Kodus kirjutatud eksamitöid tuleb nüüd suuliselt kaitsta ning koolid saavad rohkem kontrollivahendeid. Põhiidee on lihtne: kontrollida mitte teksti päritolu, vaid õpilase arusaamist.

Anthropic muudab Claude Code’i autonoomse režiimi vaikeseadeks: AI-agent otsustab ise, mida teha
9. august 2026
Anthropic muudab Claude Code’i autonoomse režiimi vaikeseadeks: AI-agent otsustab ise, mida teha

Alates 14. augustist saab autonoomsest režiimist Claude Code’i vaikeseade Pro, Maxi ja Teami pakettides. Anthropic väidab, et agent tuvastab nüüd ohtlikud tegevused inimesest paremini: 1053 arendajaga testis blokeeris autonoomne režiim 89% pahatahtlikest käskudest, inimesed aga vaid 13,6%. See muudab mängureegleid kõigi jaoks, kes töötavad koodi kallal AI-agentidega.

Meditsiinilised andmed ei tohiks jõuda AI-sse muutmata kujul: OpenClawi oskus Redacta peidab patsiendinimed enne mudelisse saatmist
8. august 2026
Meditsiinilised andmed ei tohiks jõuda AI-sse muutmata kujul: OpenClawi oskus Redacta peidab patsiendinimed enne mudelisse saatmist

Arendaja avaldas Redacta – OpenClawi avatud lähtekoodiga oskuse, mis asendab nimed, kuupäevad ja patsiendinumbrid pseudonüümidega enne teksti jõudmist keelemudelisse. Tööriist töötab lokaalselt, ei edasta isikuandmeid väljapoole ning on ClawHubil kogunud juba 1400 allalaadimist. See on praktiline vastus peamisele hirmule, mis kaasneb AI kasutamisega meditsiinis: kuidas kasutada mudeleid isikuandmeid lekitamata.

37 inimest lahkusid 2026. aastal OpenAI-st ja Anthropicust, et asutada oma AI-idufirmad
8. august 2026
37 inimest lahkusid 2026. aastal OpenAI-st ja Anthropicust, et asutada oma AI-idufirmad

2026. aastal lahkus OpenAI-st ja Anthropicust 37 endist töötajat, et asutada oma AI-ettevõtted. See pole üksikute lahkumiste jada, vaid püsiv laine: kahe tähtsaima labori endised töötajad kujundavad AI-ökosüsteemi järgmist kihti – Thinking Machines Labist Mirendili ja Humans&-ini. Tavalugeja jaoks tähendab see, et konkurents AI-vallas ei piirdu enam kahe hiiglase duelliga.

$400 000 suuruste boonustega kiibitehase töötajad tõrjuvad arste ja juriste kõrvale: AI-kiipide buum kirjutab Lõuna-Korea sotsiaalse hierarhia ümber
8. august 2026
$400 000 suuruste boonustega kiibitehase töötajad tõrjuvad arste ja juriste kõrvale: AI-kiipide buum kirjutab Lõuna-Korea sotsiaalse hierarhia ümber

AI-buum on teinud Samsungi ja SK Hynixi töötajatest Lõuna-Korea uue eliidi: kuni $476 000 suurused boonused ühe töötaja kohta tõstsid nende reitingu abieluagentuurides peaaegu arstide ja juristide tasemele. Kiibitöötajatest said riigi ihaldatuimad pruudid ja peigmehed, samal ajal kui majandusteadlased hoiatavad ühiskonna kasvava kihistumise eest.

Väikeettevõtte omanik nimetas DeepSeek V4 Flashi „super-töötajaks” ja tellis veel paar serverit
8. august 2026
Väikeettevõtte omanik nimetas DeepSeek V4 Flashi „super-töötajaks” ja tellis veel paar serverit

Väikeettevõtte omanik rääkis r/LocalLLaMAs, et uuendatud DeepSeek V4 Flash 0731 võtab enda kanda kodeerimise, dokumendid ja klienditoe ning ta tellis veel paar DGX Spark serverit. See on üks ilmekamaid näiteid sellest, kuidas odav lokaalne mudel muutub väikeettevõtte täisväärtuslikuks töötajaks.

Nvidia investeerib kuni $3 miljardit Lanciumisse – ettevõttesse, mis rajab Texases Stargate’i AI-kampuse energiataristut
8. august 2026
Nvidia investeerib kuni $3 miljardit Lanciumisse – ettevõttesse, mis rajab Texases Stargate’i AI-kampuse energiataristut

Nvidia investeerib kuni $3 miljardit Lanciumisse – Texases asuva Stargate’i AI-kampuse taga seisvasse energiataristu arendajasse. Esimesed $2 miljardit annavad kiibitootjale ettevõttes umbes 20% osaluse, veel $1 miljard lisandub tingimuste täitmisel, näiteks elektrivõrguga ühendamise edenemise korral. Nii siseneb Nvidia esimest korda otse energiataristusse, mis varustab elektriga ka tema enda AI-andmekeskusi.

Musk muudab SpaceX-i AI-taristuks: 10 GW arvutusvõimsust ja kuni $300 miljardi suurune käive 2027. aastaks
8. august 2026
Musk muudab SpaceX-i AI-taristuks: 10 GW arvutusvõimsust ja kuni $300 miljardi suurune käive 2027. aastaks

SemiAnalysise analüütikud kirjutavad, et SpaceX võib 2027. aasta lõpuks rajada umbes 10 GW AI-arvutusvõimsust, mille potentsiaalne käive ulatuks kuni $300 miljardini. Esimesel IPO-järgsel tulemuskõnel teatas Muski ettevõte, et rajab tulevased võimsused eranditult Nvidia Vera Rubini kiipidele, ning praeguse arvutuspargi maht on juba 1,4 GW.

AI tegi Maci ja iPadi kallimaks: mälupuudus jõudis Apple'ini
25. juuni 2026
AI tegi Maci ja iPadi kallimaks: mälupuudus jõudis Apple'ini

Apple tõstis Macide, iPadide ja osa koduseadmete hindu, põhjendades seda mälu ja andmekandjate hinna järsu tõusuga AI-andmekeskuste tõttu. WSJ ja Bloombergi andmetel kallines MacBook Neo 599 dollarilt 699 dollarile ning osa Maci ja iPadi mudeleid lisas hinnale sadu dollareid. Ostjate jaoks on see hetk, kus AI-buum ei ole enam ainult pilvede ja GPU-de lugu: see mõjutab juba tavalise elektroonika hinda.

OpenAI ja Anthropic panustasid plaani päästa töökohad AI eest
25. juuni 2026
OpenAI ja Anthropic panustasid plaani päästa töökohad AI eest

USAs käivitati RAISE US: parteideülene organisatsioon, millel on üle 500 miljoni dollari töötajate ettevalmistamiseks AI-majanduseks. Partnerite seas on OpenAI Foundation, Anthropic, Amazon, Microsoft, IBM, Bank of America ja teised suured tööandjad. Turule on see märk, et automatiseerimisvaidlus liigub prognoosidelt pilootidele: osariigid ja ettevõtted hakkavad kontrollima, millised meetmed aitavad inimestel päriselt tööst mitte välja kukkuda.