Tagasi
5. mai 2026, kell 19:35 AI LLM Long Context RAG Agents Infrastructure Subquadratic; The New Stack; SiliconANGLE

SubQ lubab keelemudelitele 12 miljoni tokeni kontekstiakent

SubQ lubab keelemudelitele 12 miljoni tokeni kontekstiakent

SubQ lubab keelemudelitele 12 miljoni tokeni kontekstiakent

Subquadratic esitles SubQ-d — keelemudelit, mis ettevõtte väitel põhineb subkvadraatilisel tähelepanuarhitektuuril ja on mõeldud väga pika konteksti jaoks: kuni 12 miljonit tokenit. Lihtsustatult on see katse anda mudelile võimalus lugeda ühe läbimisega mitte üksikuid fragmente, vaid terveid koodibaase, suuri dokumendiarhiive või agendi pikka tööajalugu.

See on tugev strateegiline avaldus ühe tänapäeva keelemudelite peamise kitsaskoha kohta. Kuid seda tasub lugeda ettevaatlikult: Subquadratic räägib suletud beetast, lubab tehnilise raporti hiljem avaldada ning pole veel andnud turule piisavalt avalikke sõltumatuid teste, et nimetada SubQ-d tõestatud revolutsiooniks.

Mis on kontekstiaken ja miks kõik tokenite otsa jooksevad

Kontekstiaken on teksti ja andmete hulk, mida keelemudel saab ühes päringus „silme ees“ hoida. Seda mõõdetakse mitte sõnades, vaid tokenites — tinglikes tekstijuppides, millest mudel lause kokku paneb. Üks token võib olla sõna, sõnaosa, number või kirjavahemärk.

Kasutajale kõlab see lihtsalt: mida suurem aken, seda rohkem dokumente, koodi või kirjavahetust saab mudelile korraga anda. Arendaja jaoks on kõik keerulisem. Isegi kui mudel võtab formaalselt miljon tokenit vastu, ei leia ta alati sama hästi olulisi detaile selle mahu seest ning päringu hind ja viivitus kasvavad kiiresti.

Põhjus on tähelepanumehhanism. Klassikalises transformer’is võrdleb mudel tokeneid omavahel, et mõista, millised teksti osad on seotud. Just see aitab tal tabada, et ühes failis olev muutuja seostub teises failis oleva funktsiooniga või dokumendi alguses olev argument on lõpu järelduse jaoks tähtis. Kuid tihe tähelepanu võrdleb peaaegu kõike kõigega.

Sellest tuleb kvadraatne keerukus: kui sisend muutub kaks korda pikemaks, muutub töö umbes neli korda suuremaks. Lühikeste päringute puhul on see talutav. Miljonite tokenite juures hakkab majandus lagunema: kallis, aeglane ja raske skaleerida.

Mida SubQ lubab teha teisiti

Subquadratic väidab, et SubQ kasutab sparse attention’it ehk hõredat tähelepanu. Idee on lihtne: selle asemel et võrrelda iga tokenit iga tokeniga, peaks mudel valima ainult need seosed, mis on praeguse päringu jaoks päriselt tähtsad. Seetõttu nimetatakse arhitektuuri subkvadraatiliseks: arvutuskoormus kasvab aeglasemalt kui klassikalises kvadraatses stsenaariumis.

Ettevõtte enda andmetel näitab SubQ 1M-Preview konkurentsivõimelisi tulemusi pikkkonteksti testides ning uurimiskonfiguratsioon töötab kuni 12 miljoni tokenini. Subquadraticu saidil lubatakse umbes 150 tokenit sekundis, ligi viiendikku juhtivate mudelite hinnast ning peaaegu 1000-kordset tähelepanuarvutuste vähendamist 12 miljoni tokeni juures võrreldes tiheda tähelepanuga. SiliconANGLE lisab, et 12 miljonit tokenit on umbes 9 miljonit sõna — pigem saja raamatu kui „natuke pikema dokumendi“ mõõtkava.

The New Stack toob välja olulise detaili: Subquadratic nimetab arhitektuuri Subquadratic Selective Attentioniks ning räägib arvutuse ja mälu lineaarsest skaleerumisest konteksti pikkuse suhtes. Väljaanne meenutab ka, et sarnaseid katseid on varem olnud: Longformer, Mamba, hübriidarhitektuurid, DeepSeeki hõre tähelepanu ja muud lähenemised. Ajalooline probleem ei ole olnud ökonoomse tähelepanu väljamõtlemine, vaid see, kuidas mitte kaotada kvaliteeti ja täpset detailide leidmist.

Miks see agentide jaoks oluline oleks

Pikk kontekst on agentide jaoks eriti ahvatlev. Praegune praktiline lahendus on sageli RAG: süsteem otsib andmebaasist või failidest relevantseid juppe ja annab mudelile ainult valitud fragmendid. See töötab, kuid lisab keerukust ja vigu. Kui otsing ei leia õiget lõiku, ei saa mudel seda kasutada. Kui lõik on kontekstist väljas, võib vastus olla enesekindel, kuid vale.

12 miljoni tokeni aken lubab teistsugust tööviisi: mudel võiks näha tervet projekti, dokumentatsiooni, pikki logisid või kliendisuhtluse ajalugu korraga. Koodiagent võiks paremini mõista sõltuvusi, juriidiline tööriist tervet lepingukogu, uurimisagent suurt materjalikausta. See ei kaota tingimata RAG-i vajadust, kuid nihutab piiri, kus otsingust saab mudeli mälu asendaja.

Siin on aga suur „kui“. Pikk aken ei tähenda automaatselt head mõistmist. Mudel peab suutma leida väikese olulise detaili tohutu müramassi seest, mitte ainult mahutada teksti sisendisse. Just seetõttu vajavad SubQ väited sõltumatuid teste päris ülesannetes: kas mudel oskab 12 miljoni tokeni seest leida õige faili, õige erandi, õige numbri ja õige vastuolu?

Mida praegu uskuda

SubQ on praegu kõige ausamalt vaadates tugev lubadus, mitte valmis standard. 29 miljoni dollari rahastus, avalik positsioneerimine ja tehnilised väited teevad sellest tähelepanuväärse startup’i. Kuid ilma tehnilise raporti, avalike mudelite ja sõltumatute benchmark’ideta on mõistlik hoida vaimustus kontrolli all.

Kui Subquadraticu väited peavad vastu, võib see muuta pikkkonteksti majandust. Suured sisendid muutuksid odavamaks, agentide töö lihtsamaks ja paljud RAG-torud vähem hapraks. Kui ei pea, jääb SubQ järjekordseks meeldetuletuseks, et kontekstiakna number on ainult üks osa probleemist.

AI-turu jaoks on signaal igal juhul selge: järgmine suur võitlus ei käi ainult selle üle, kui tark mudel on lühikeses vestluses, vaid selle üle, kui palju maailma ta suudab korraga usaldusväärselt hoida. 12 miljonit tokenit on selles võitluses väga suur lubadus — nüüd tuleb näidata, kas see on ka päris tööriist.

Veel uudiseid

Reddit võrdles AI-hoiatusi filmiga „Ärge vaadake üles“ – ja arutelu väljus meemi raamidest
9. august 2026
Reddit võrdles AI-hoiatusi filmiga „Ärge vaadake üles“ – ja arutelu väljus meemi raamidest

Redditi r/singularity-kogukonnas avaldatud postitus võrdles AI-riskide üle peetud telearutelu stseeniga filmist „Ärge vaadake üles“, kus murettekitav sõnum kaob saateformaati. Meemi taustal on tegelik uudislugu: endine OpenAI teadlane Daniel Kokotajlo selgitab taas, miks peab 2027. aastat AI arengu järsu kiirenemise võimalikuks pöördepunktiks. Oluline pole paanika, vaid lõhe tehnoloogia arengu kiiruse ja ühiskonna suutlikkuse vahel sellest rääkida.

Jeff Dean lahkub Google'ist, et asutada oma idufirma, ja DeepMind eemaldub tipptasemel mudelite võidujooksust: Google valib mudelite asemel pilve
9. august 2026
Jeff Dean lahkub Google'ist, et asutada oma idufirma, ja DeepMind eemaldub tipptasemel mudelite võidujooksust: Google valib mudelite asemel pilve

5. augustil teatas Google DeepMindi ümberkorraldustest: Demis Hassabis taandus operatiivjuhtimisest ning Jeff Dean, üks Google'i insenerikultuuri rajajaid, lahkub koos kolme veteraniga, et asutada Discovery Loop – teaduse ja inseneeria automatiseerimisele keskenduv idufirma. Analüütikud tõlgendavad seda signaalina: Google ei panusta tipptasemel mudelite võidujooksus liidripositsioonile, vaid AI-pilvele ja tehnoloogiate levikule.

Taani kehtestab kodus kirjutatavate eksamitööde suulise kaitsmise, et ei peaks oletama, kas need kirjutas AI
9. august 2026
Taani kehtestab kodus kirjutatavate eksamitööde suulise kaitsmise, et ei peaks oletama, kas need kirjutas AI

Taani käivitab gümnaasiumides kiireloomulised meetmed AI abil petmise vastu. Kodus kirjutatud eksamitöid tuleb nüüd suuliselt kaitsta ning koolid saavad rohkem kontrollivahendeid. Põhiidee on lihtne: kontrollida mitte teksti päritolu, vaid õpilase arusaamist.

Anthropic muudab Claude Code’i autonoomse režiimi vaikeseadeks: AI-agent otsustab ise, mida teha
9. august 2026
Anthropic muudab Claude Code’i autonoomse režiimi vaikeseadeks: AI-agent otsustab ise, mida teha

Alates 14. augustist saab autonoomsest režiimist Claude Code’i vaikeseade Pro, Maxi ja Teami pakettides. Anthropic väidab, et agent tuvastab nüüd ohtlikud tegevused inimesest paremini: 1053 arendajaga testis blokeeris autonoomne režiim 89% pahatahtlikest käskudest, inimesed aga vaid 13,6%. See muudab mängureegleid kõigi jaoks, kes töötavad koodi kallal AI-agentidega.

Meditsiinilised andmed ei tohiks jõuda AI-sse muutmata kujul: OpenClawi oskus Redacta peidab patsiendinimed enne mudelisse saatmist
8. august 2026
Meditsiinilised andmed ei tohiks jõuda AI-sse muutmata kujul: OpenClawi oskus Redacta peidab patsiendinimed enne mudelisse saatmist

Arendaja avaldas Redacta – OpenClawi avatud lähtekoodiga oskuse, mis asendab nimed, kuupäevad ja patsiendinumbrid pseudonüümidega enne teksti jõudmist keelemudelisse. Tööriist töötab lokaalselt, ei edasta isikuandmeid väljapoole ning on ClawHubil kogunud juba 1400 allalaadimist. See on praktiline vastus peamisele hirmule, mis kaasneb AI kasutamisega meditsiinis: kuidas kasutada mudeleid isikuandmeid lekitamata.

37 inimest lahkusid 2026. aastal OpenAI-st ja Anthropicust, et asutada oma AI-idufirmad
8. august 2026
37 inimest lahkusid 2026. aastal OpenAI-st ja Anthropicust, et asutada oma AI-idufirmad

2026. aastal lahkus OpenAI-st ja Anthropicust 37 endist töötajat, et asutada oma AI-ettevõtted. See pole üksikute lahkumiste jada, vaid püsiv laine: kahe tähtsaima labori endised töötajad kujundavad AI-ökosüsteemi järgmist kihti – Thinking Machines Labist Mirendili ja Humans&-ini. Tavalugeja jaoks tähendab see, et konkurents AI-vallas ei piirdu enam kahe hiiglase duelliga.

$400 000 suuruste boonustega kiibitehase töötajad tõrjuvad arste ja juriste kõrvale: AI-kiipide buum kirjutab Lõuna-Korea sotsiaalse hierarhia ümber
8. august 2026
$400 000 suuruste boonustega kiibitehase töötajad tõrjuvad arste ja juriste kõrvale: AI-kiipide buum kirjutab Lõuna-Korea sotsiaalse hierarhia ümber

AI-buum on teinud Samsungi ja SK Hynixi töötajatest Lõuna-Korea uue eliidi: kuni $476 000 suurused boonused ühe töötaja kohta tõstsid nende reitingu abieluagentuurides peaaegu arstide ja juristide tasemele. Kiibitöötajatest said riigi ihaldatuimad pruudid ja peigmehed, samal ajal kui majandusteadlased hoiatavad ühiskonna kasvava kihistumise eest.

Väikeettevõtte omanik nimetas DeepSeek V4 Flashi „super-töötajaks” ja tellis veel paar serverit
8. august 2026
Väikeettevõtte omanik nimetas DeepSeek V4 Flashi „super-töötajaks” ja tellis veel paar serverit

Väikeettevõtte omanik rääkis r/LocalLLaMAs, et uuendatud DeepSeek V4 Flash 0731 võtab enda kanda kodeerimise, dokumendid ja klienditoe ning ta tellis veel paar DGX Spark serverit. See on üks ilmekamaid näiteid sellest, kuidas odav lokaalne mudel muutub väikeettevõtte täisväärtuslikuks töötajaks.

Nvidia investeerib kuni $3 miljardit Lanciumisse – ettevõttesse, mis rajab Texases Stargate’i AI-kampuse energiataristut
8. august 2026
Nvidia investeerib kuni $3 miljardit Lanciumisse – ettevõttesse, mis rajab Texases Stargate’i AI-kampuse energiataristut

Nvidia investeerib kuni $3 miljardit Lanciumisse – Texases asuva Stargate’i AI-kampuse taga seisvasse energiataristu arendajasse. Esimesed $2 miljardit annavad kiibitootjale ettevõttes umbes 20% osaluse, veel $1 miljard lisandub tingimuste täitmisel, näiteks elektrivõrguga ühendamise edenemise korral. Nii siseneb Nvidia esimest korda otse energiataristusse, mis varustab elektriga ka tema enda AI-andmekeskusi.

Musk muudab SpaceX-i AI-taristuks: 10 GW arvutusvõimsust ja kuni $300 miljardi suurune käive 2027. aastaks
8. august 2026
Musk muudab SpaceX-i AI-taristuks: 10 GW arvutusvõimsust ja kuni $300 miljardi suurune käive 2027. aastaks

SemiAnalysise analüütikud kirjutavad, et SpaceX võib 2027. aasta lõpuks rajada umbes 10 GW AI-arvutusvõimsust, mille potentsiaalne käive ulatuks kuni $300 miljardini. Esimesel IPO-järgsel tulemuskõnel teatas Muski ettevõte, et rajab tulevased võimsused eranditult Nvidia Vera Rubini kiipidele, ning praeguse arvutuspargi maht on juba 1,4 GW.

AI tegi Maci ja iPadi kallimaks: mälupuudus jõudis Apple'ini
25. juuni 2026
AI tegi Maci ja iPadi kallimaks: mälupuudus jõudis Apple'ini

Apple tõstis Macide, iPadide ja osa koduseadmete hindu, põhjendades seda mälu ja andmekandjate hinna järsu tõusuga AI-andmekeskuste tõttu. WSJ ja Bloombergi andmetel kallines MacBook Neo 599 dollarilt 699 dollarile ning osa Maci ja iPadi mudeleid lisas hinnale sadu dollareid. Ostjate jaoks on see hetk, kus AI-buum ei ole enam ainult pilvede ja GPU-de lugu: see mõjutab juba tavalise elektroonika hinda.

OpenAI ja Anthropic panustasid plaani päästa töökohad AI eest
25. juuni 2026
OpenAI ja Anthropic panustasid plaani päästa töökohad AI eest

USAs käivitati RAISE US: parteideülene organisatsioon, millel on üle 500 miljoni dollari töötajate ettevalmistamiseks AI-majanduseks. Partnerite seas on OpenAI Foundation, Anthropic, Amazon, Microsoft, IBM, Bank of America ja teised suured tööandjad. Turule on see märk, et automatiseerimisvaidlus liigub prognoosidelt pilootidele: osariigid ja ettevõtted hakkavad kontrollima, millised meetmed aitavad inimestel päriselt tööst mitte välja kukkuda.