Codex õpib hoidma eesmärki mitmetunnise töö jaoks
OpenAI arendab Codexi jaoks stsenaariumi Follow a goal ehk autonoomse töö režiimi, kus agendile ei anta järgmist väikest käsku, vaid mitmetunnine eesmärk. Dokumentatsioonis kirjeldab ettevõte käsku /goal: see hoiab Codexi ühel kursil, kuni ülesanne on valmis, blokeeritud või inimese poolt peatatud.
See on oluline nihe selles, kuidas OpenAI Codexit programmeerijatele pakendab. Varem nägi tüüpiline agentlik töövoog sageli välja nagu pikk vestlus: „loe failid läbi“, „nüüd paranda testid“, „nüüd käivita build“, „nüüd kontrolli uuesti“. /goal püüab muuta selle ahela üheks lepinguks: siin on plaan, siin on etapid, siin on kontrollid ja siin on koht, kus tuleb peatuda.
Mis muutus
Follow a goali põhiidee on püsiv eesmärk. See elab üle ühe vastuse ega kao pärast esimest vaheparandust. Codex peab mäletama, millise tulemuseni ta liigub, millised failid ja dokumendid on olulised, milliseid piiranguid ei tohi rikkuda ja milline tingimus loetakse lõplikuks.
OpenAI seob /goal ülesannetega, kus on selge edukriteerium ja kontrollitsükkel. Agendile ei piisa lausest „paranda projekti“. Talle tuleb selgitada, millega töö lõpeb: testid läbivad, vana import on kadunud, uus integratsioon on ühendatud, prototüüp käivitub või raport sisaldab riske.
Siin on lihtne unustada võtmeasi: plaan peab olema täidetav. Kui PLAN.md on lihtsalt soovide nimekiri, muutub mitmetunnine autonoomsus kiiresti vestlusest oletamiseks. Hea plaan jagab töö etappideks, määrab iga etapi jaoks kontrollid ja kirjeldab eraldi visuaalset valideerimist, kui tulemus on kasutajaliideses näha.
Miks see on oluline
Arendajate jaoks on väärtus käsitsi mikromanageerimise vähenemises. Kui ülesanne võtab mitu tundi, ei kaota inimene aega ainult koodi peale, vaid ka pidevale agendi juurde naasmisele: konteksti meeldetuletamine, järgmise sammu täpsustamine, testide uuesti käivitamise palumine ja liiga laiaks paisuva refaktori peatamine.
/goal nihutab osa sellest distsipliinist algsesse ülesandepüstitusse. Codex saab liikuda kontrollpunktide kaupa: kõigepealt inventuur, siis koodimuudatus, siis testid, siis puhastus ja lõpuks lõpparuanne. Inimene jääb samal ajal otsuse omanikuks: ta seab failides lepingu ja saab sekkuda, kui agent liigub vales suunas.
See on eriti nähtav töödes, kus vahepealne müra on vähem oluline kui tõendatav lõpp. „Rakenda PLAN.md, loo iga etapi jaoks testid ja kontrolli ekraani Playwright interactive’iga“ sobib /goal jaoks paremini kui „vaata, mida saaks parandada“. Teisel juhul hakkab Codex edukriteeriumi ära arvama.
Kuidas /goal’i kasutada
Praktiliselt parim stsenaarium näeb välja nagu /goal Implement PLAN.md. Kõigepealt paneb inimene reposse PLAN.md: millist tulemust on vaja, millised etapid tuleb läbida, millised testid tuleb igas etapis kirjutada, milliseid kontrolle käivitada, kus on vaja reference screen’e ja mida lugeda valmis seisuks.
Pärast seda ei peaks /goal plaani asendama. See peaks sundima Codexit hoidma seda lepingut mitu tundi: lugema faile, tegema muudatusi, looma iga etapi jaoks teste, käivitama kontrolle ja pöörduma vahepealsete vigade järel eesmärgi juurde tagasi.
Näidisülesanne:
/goal Implement PLAN.md, creating tests for each milestone and verifying the output with playwright interactive.
Use the reference screens in docs/reference-screens/ where relevant.
Before coding, read PLAN.md, docs/new-client.md, src/settings/* and existing settings tests.
Do not change auth or global design outside the plan.
For each milestone, add or update tests first, then implement the code, then run npm test -- settings and npm run typecheck.
For UI milestones, open the result with Playwright interactive and compare it with the reference screens.
Stop when every milestone in PLAN.md is complete, tests and typecheck pass, Playwright verification is done,
and the final report lists changed files, checks run and remaining risks.
Selles näites pole olulised pikad sõnastused, vaid kontrollitavus. „Kood sai paremaks“ ei ole peatumistingimus. „Build läbib, testid on rohelised ja vana API-d ei esine enam vajalikus kaustas“ on.
OpenAI kirjeldab ka lihtsaid juhtkäske. /goal ilma argumentideta näitab praegust staatust. /goal pause peatab töö ajutiselt, kui on vaja muudatusi üle vaadata või oodata välist otsust. /goal resume jätkab sama jooksu. /goal clear kustutab eesmärgi, kui ülesanne on valmis, blokeeritud või enam ebaoluline.
Kus režiim töötab kõige paremini
Parimad kandidaadid /goal jaoks on ülesanded, mis on suuremad kui üks prompt, kuid väiksemad kui lõputu backlog, eriti kui neid saab kirjeldada PLAN.md failis etappide ja kontrollidega. Näiteks ühe mooduli migratsioon, ühe klassi testikukkumiste parandamine, selge demoga prototüübi ehitamine või prompti optimeerimine konkreetse eval-juhtumite komplekti järgi.
Halvad kandidaadid on hägused palved ja omavahel sidumata ülesannete nimekirjad. „Tee rakendus korda“ tuleks kõigepealt muuta konkreetseks eesmärgiks. „Tee kümme eri parandust“ on parem jagada mitmeks eraldi jooksuks. Muidu ei hoia agent eesmärki, vaid soovide kotti.
Uuenduse mõte ei ole selles, et Codexit saab nüüd terveks päevaks järelevalveta lahti lasta. OpenAI panustab režiimile, kus inimene sõnastab kontrollitava tulemuse ja Codex hoiab mitu tundi kurssi selle poole: mitte „tee midagi kasulikku“, vaid „jõua sellesse seisu ja tõesta, et jõudsid“.













