6. juulil 2026 arXivisse postitatud hindamine lasi 302 kvaliteedikontrolli läbinud Kubernetese intsidenti läbi otsingupõhiselt täiendatud mudelite ja hindas kahte võimet eraldi. Algpõhjuse teenuse nimetamine: õige 91,4% kuni 99,7% juhtudest. Kehtiva taastetegevuse valimine intsidendile, mille ta oli just diagnoosinud: 36,8% kuni 60,3%. Nende kahe veeru vahele jääb nelikümmend kuni viiskümmend viis punkti ja see vahemaa on kõige kasulikum number, mis sel aastal AIOpsi kohta avaldatud on.

See on väide tööliikide, mitte mudeli kvaliteedi kohta. Mudel loeb hästi ja otsustab halvasti ning see jagab turu kaheks hunnikuks. Osa operatiivtööst kukub läbi nähtavalt, seda hoidva inimese silme all. Osa kukub läbi nii, et sellest saab tegevus tootmiskeskkonna vastu. AIOps teenib oma raha esimest liiki töös ja teises on ta praegu risk, ning suurem osa pettumusest sellel turul tuleb selle ostmisest teise jaoks pärast esimese demot.

Häirete korreleerimine, deduplitseerimine ja loo esimene mustand

PagerDuty turundab oma AIOpsi toodet häiremüra kuni 91% vähendajana. Lugege seda 2026. aasta veebruari uuringu kõrval, milles osales 1039 SRE-, DevOps- ja IT-operatsioonide spetsialisti, mida sponsoreeris NeuBird ja kus 44% teatas viimase aasta jooksul katkestusest, mis oli seotud summutatud või ignoreeritud häiretega. Korreleerimine, mis voldib nelikümmend teavitust üheks intsidendiks, on tõeline võit. Korreleerimine, mis vaikselt otsustab, milliseid teavitusi te kunagi ei näe, ongi see, kuidas need 44% tekivad, ja neid eristab see, kas rühmitust saab üle vaadata.

Kõige tugevamad juhtumid on need, mida inimene saab sekunditega kontrollida. Mudel, mis loeb juurutuste ajalugu, mõõdiku nihet ja kolme logivoogu ning koostab intsidendi narratiivi mustandi, teeb tööd, mida muidu teeb kell 3 öösel keegi, kelle mälu on kehv, ja kui ta eksib, siis tõendid asuvad samas lõigus. Selgitada, miks arve liikus, on sama liiki ülesanne, täis korrelatsioone, mida inimene märkab kuu aega hiljem, ja FinOps Foundationi State of FinOps 2026, mis avaldati 19. veebruaril 2026 ja hõlmas 1192 vastajat, kes haldavad üle 83 miljardi dollari aastasest kulust, leidis, et 98% neist haldab nüüd tehisintellekti kulu, võrreldes 31%-ga kaks aastat varem. Lahendatud intsidendi muutmine kirjalikuks runbookiks on veelgi parem: faktid on paigas ja halvim tulemus on see, et inimene parandab ühe lause.

AI koodiülevaatus infrastruktuuril tabab üht liiki vigu ja on teise suhtes pime

Veracode'i 2026. aasta GenAI Code Security Report, mis avaldati 28. juulil 2026, testis üle 100 mudeli ja leidis, et keskmine turvalisuse läbimismäär jäi pidama 56% juures, ühe punkti võrra kõrgemal kui 55%. Umbes 44% genereerimisülesannetest tõi sisse riskantse haavatavuse, kui keegi ei küsinud spetsiifiliselt turvalisust. Parim, GPT-5.5, jõudis 68%-ni, kukkudes ikka läbi ühes turvaülesandes kolmest.

Ebaühtlane osa ongi kasulik osa. Need mudelid läbisid SQL-i süstimise ülesanded 83% ja krüptograafia 87% juhtudest, kuid saididevahelise skriptimise ainult 15% ja logisüstimise 12%. AI ülevaataja on tugev selles, mida ta on tuhat korda märgistatuna näinud, ja peaaegu pime mujal, ning ta ei ütle teile, kummas režiimis ta parasjagu on. Infrastruktuurikoodi muudatuse puhul kasutage teda teise lugejana vigade jaoks, mis on tagantjärele ilmsed: 0.0.0.0/0 peale avatud turvarühm, muudatus, mis on pigem asendus kui uuendus. Ärge tehke temast väravat: klassid, mis tal kahe silma vahele jäävad, on need, mille kohta keegi reeglit ei kirjutanud.

Autonoomne parandustegevus on koht, kus tõendid müügijuttu enam ei toeta

Sama uuring kannab leidu, mis peaks isetervenemise vestluse veel aastaks lõpetama. Isegi siis, kui mudel tuvastas õigesti nii algpõhjuse teenuse kui ka vea tüübi, valis ta kehtetu paranduse 39,5% kuni 62,0% neist õigesti diagnoositud intsidentidest. Diagnoos ei kandu üle tegevusse. Gartneri 2025. aasta juuni ennustus, et üle 40% agentse tehisintellekti projektidest tühistatakse 2027. aasta lõpuks, nimetas kulu kõrval ebapiisavaid riskikontrolle ja just see on see, mis puudu on.

Võimsuse planeerimine kukub läbi seotud põhjusel: mudel toodab õhukesest tõendist enesekindla numbri ja planeerimiskoosolek tahabki enesekindlat numbrit. ELi tehisintellektimääruse artikkel 14 on kirjutatud täpselt selle vastu, nõudes, et inimjärelevalvaja saaks suure riskiga süsteemi katkestada ja viia selle ohutus olekus seisma, ning nimetades automatiseerimiskallutatust asjana, millele järelevalve peab vastu seisma.

Kulude ülemmäär peab asuma teenusepakkuja arvelduskonsoolist kõrgemal

2026. aasta mais anti autonoomsele agendile piiramata AWS-i kredentsiaalid ja kästi tal skaneerida porte võrgus DN42, mida hallatakse hobikorras. Ta provisioneeris viis m8g.12xlarge instantsi, igaüks 48 vCPU-ga, pluss koormusjaoturid ja Lambda funktsioonid, ning hakkas siis sama CloudFormationi malli ikka ja jälle uuesti rakendama. Operaator sai umbes 24 tundi hiljem krediitkaardi arvetest teada, mille summa oli 6531,30 dollarit, töökoormuse eest, mis kogukonna hinnangul oleks mahtunud 5 dollarit kuus maksvale VPS-ile. AWS vähendas arvet hiljem 1894 dollarile. Kaitse, mis toimis, oli hea tahte krediit.

Ükski suur teenusepakkuja poleks seda oma eelarvetööriistadega peatanud ja kõik kolm ütlevad seda kirjalikult. Amazon dokumenteerib, et AWS Budgets värskendub kuni kolm korda päevas, iga uuendus tavaliselt 8 kuni 12 tundi eelmisest maas, tempo, mis on mõeldud inimestele, kes teevad kalleid vigu ükshaaval. Microsoft ütleb, et ületatud Azure'i eelarvelävi ei mõjuta ressursse ega peata tarbimist, kusjuures kuluandmed on tavaliselt saadaval 8 kuni 24 tunni jooksul. Google Cloud ütleb, et ainult häiretega eelarve ei piira automaatselt kasutust ega kulu. AWS tarnib avatud lähtekoodiga lahenduse Budget Controls, mis tegutseb 90% juures eelarvest, katab neli teenust ühes regioonis ja tunnistab, et salvestus ja võrguühendus koguvad tasusid edasi. Kolmeliikmeline agentuur, millest kirjutati 2026. aasta juulis, sai 14 000 dollari suuruse ühe päeva AWS-i arve tavapärase 10 kuni 15 dollari suuruse kuuarve asemel pärast seda, kui ründajad võtsid instantsilt staatilised võtmed ja kulutasid need Bedrocki mudelikõnedele.

Meie vastus on panna piirang sinna, kus kredentsiaalid välja antakse, mitte sinna, kus arve kokku pannakse. Kulu Sencais jälgitakse jooksvalt teenusepakkuja, projekti ja keskkonna kaupa, ülemmäärade ja eelarvetega, mis hoiatavad kulu kogunemise ajal, mitte 8 kuni 24 tunnise arveldustsükliga. Ületatud ülemmäära peale automaatselt tegutsemine on meie teekaardil ja ei ole tarnitud, nii et täna tõmbab kredentsiaali ikka inimene. Tehisintellekt on ainus eelarve, mida saame ette piirata: seda ostetakse krediitides ja krediit on kindel rahasumma, mitte tokenite arv, nii et mudeli hinnamuutus muudab seda, mitu tokenit üks krediit ostab, ja mitte kunagi seda, mida see väärt on. Igal tasulisel isiklikul paketil on kuine maht ja kõva ülemmäär, mis on seatud selle kordsena, nii et käest läinud skript ei saa toota piiramatut arvet. Runbookid on kinnitusväravaga samal põhjusel: mudel teeb ettepaneku, nimeline inimene täidab.

Auditijälg, mis oskab öelda, kas seda tegi inimene või mudel

ELi tehisintellektimääruse artikli 12 lõige 1 nõuab, et suure riskiga süsteemid võimaldaksid tehniliselt sündmuste automaatset salvestamist süsteemi eluea jooksul, ja artikli 26 lõige 6 nõuab, et juurutajad säilitaksid neid logisid vähemalt kuus kuud, kui muu õigus pikemat aega ei nõua. Kui te planeerite 2026. aasta augusti kuupäeva vastu, parandage see ära. Määrus (EL) 2026/1744, digitaalne koondmäärus tehisintellekti kohta, mis jõustus 27. juulil 2026, nihutas III lisa eraldiseisvad suure riskiga süsteemid 2. detsembrile 2027 ja I lisa toodetesse sisseehitatud süsteemid 2. augustile 2028. Kuupäevad nihkusid; kohustused mitte.

Operatiivne põhjus seda ehitada ei ole tähtajaga üldse seotud. Kuus kuud pärast intsidenti on küsimus selles, kas muudatuse tegi inimene või mudel, ja seadistus, mis salvestab tehisintellekti tegevused ühte süsteemi ja inimeste omad teise, ei suuda sellele vastata ilma ühendpäringuta, mida keegi ei usalda. Me keeldusime pidamast kahte kirjet: mudeli tegevused ja inimeste tegevused jõuavad ühte ja samasse lisamisele orienteeritud jälge. Sencai ekspordib selle CSV-na, kus igal real on entry_hash ja prev_hash, nii et lugeja, kes meid sõnalt ei usu, saab ahela ise uuesti arvutada. Väli, mis oma koha välja teenib, on see väike tegutseja kõrval, mis ütleb, kas muudatus tuli inimeselt või mudelilt, kes kulutab inimese mahtu.

Tõenditest tulenev reegel on tagasihoidlik ja peab vastu. Laske mudelil lugeda kõike, sealhulgas asju, mida ta halvasti loeb, sest halb lugemine on nähtav lõigus, mille ta kirjutas. Laske tal kirjutada ainult seal, kus nimeline inimene muudatuse allkirjastab ja kredentsiaali piirang asub all juhuks, kui ka see inimene eksib. Teenusepakkuja teavituse vahel 8 kuni 24 tunnise tsükliga ja inimese vahel, kes loeb e-kirju tööpäeviti, on suitsuandur, aga mitte ühtegi sprinklerit. DN42 operaatoril oli suitsuandur.