Boris Agatić · · 10 min čitanja

Memorija AI agenata i trajni kontekst 2026: kako agenti pamte

Evo neugodne istine ispod svake dojmljive AI demonstracije: model nema memoriju. Svaki poziv počinje s praznom pločom. Ne pamti vaš prošli razgovor, ispravak koji ste mu jučer dali, ni činjenicu da vaša tvrtka kupca zove „partner", a ne „klijent". Sve što „zna" o vama mora se ponovno dostaviti pri svakom zahtjevu. U 2026. jaz između pametnog chatbota i agenta koji zaista postaje bolji s vremenom gotovo je u cijelosti problem memorije. Ovo je praktični vodič kako radi memorija AI agenata, koje tri vrste trebate i kako je uvesti bez curenja podataka i sporog klizanja u besmisao.

Zašto modeli zaboravljaju: bezstatnost je značajka, ne greška

Veliki jezični model je bez stanja. Uzme tekst koji pošaljete, proizvede odgovor i ne zadrži ništa. Jedino što ikad „vidi" jest kontekstni prozor — blok teksta koji mu je predan upravo sada. Ta bezstatnost je namjerna: čini modele predvidljivima, paralelizabilnima i sigurnima za skaliranje. Ali znači da agent nema ugrađenu prošlost. Ako želite da išta pamti kroz poteze, sesije ili korisnike, vi morate izgraditi tu memoriju oko modela i ponovno ubaciti prave dijelove u pravom trenutku. Memorija je u 2026. arhitektura koju dizajnirate — ne prekidač koji uključite.

0
bajtova koje model bez stanja zadrži između poziva — sve što „zna" ponovno se šalje kao kontekst
~1M
tokena u vodećem kontekstnom prozoru 2026. — velik, ali još ne trajna memorija po korisniku
3
različite vrste memorije koje produkcijski agent treba: radna, epizodna i semantička

Tri vrste memorije agenata

Uz labavu posudbu iz opisa ljudske memorije, dobro izgrađen agent koristi tri komplementarna sloja. Njihovo brkanje najčešća je pogreška u dizajnu.

1. Radna memorija — trenutni kontekstni prozor

To je ovdje-i-sada: trenutni zadatak, zadnjih nekoliko poruka, dokumenti dohvaćeni za ovaj zahtjev. Živi u cijelosti u kontekstnom prozoru i nestaje kad sesija završi. Veći kontekstni prozori učinili su radnu memoriju prostranijom, ali ona je i dalje kratkoročna i skupa — svaki token u njoj plaća se pri svakom pozivu, pa je držite sažetom.

2. Epizodna memorija — što se dogodilo prije

Pamti konkretne prošle događaje: „u utorak je korisnik tražio izvještaj u eurima, ne dolarima", „zadnji put kad se ovaj tijek izvršio, API za račune je istekao". Epizodna memorija obično se pohranjuje izvan modela — u bazi podataka ili vektorskoj pohrani — i relevantni se isječci dohvaćaju i ubacuju u radnu memoriju kad su važni. To je ono što agentu omogućuje da nastavi razgovor ondje gdje je stao prije tjedan dana.

3. Semantička memorija — trajne činjenice i preferencije

To je destilirano, dugovječno znanje: terminologija vaše tvrtke, stalne preferencije korisnika, pravilo da „svi ugovori iznad 50 tis. € trebaju pravno odobrenje". Semantička memorija je mala, kurirana i visoke vrijednosti. Ne pohranjuje svaku poruku — pohranjuje pouke, i to je sloj zbog kojeg agent djeluje kao da vas zaista poznaje.

Slojevi memorije agenta: trajnost naspram troška po tokenu (ilustrativno)

Kako se memorija zapravo gradi: zapiši, pohrani, dohvati

Ispod haube, gotovo svaki sustav memorije agenata je ista petlja. Zapiši: nakon poteza agent odluči što vrijedi zadržati i spremi to — često sažimajući dugu razmjenu na nekoliko trajnih činjenica umjesto pohrane sirovog prijepisa. Pohrani: te činjenice završe u pohrani, često u vektorskoj bazi kako bi se mogle naći po značenju, a ne po točnoj formulaciji. Dohvati: pri sljedećem relevantnom zahtjevu agent pretraži pohranu, izvuče nekoliko najrelevantnijih sjećanja i ubaci ih u kontekstni prozor prije odgovora. Cijelo umijeće je u odluci što zapisati i koja sjećanja vratiti — zapišite sve i utopite se u šumu; ne zapišite ništa i agent ostaje bez sjećanja.

Memorija je sažimanje, ne snimanje. Timovi koji to dobro rade tretiraju memoriju kao bilježnicu dobrog asistenta: čuva odluke i preferencije, ne prijepis riječ po riječ. Pohrana sirove povijesti jeftina je za izgradnju i skupa za život s njom: napuhuje dohvat, zakopava signal i umnožava vašu površinu privatnosti.

Gdje su dobavljači u 2026.

Memorija se preselila iz uradi-sam obrasca u prvorazrednu značajku proizvoda. Anthropicov Claude nudi trajnu memoriju i kontekst na razini projekta pa asistent može nositi znanje kroz sesije; OpenAI isporučuje memoriju na razini korisnika u ChatGPT-u i svom API-ju; a otvoreni ekosustav ima zrele biblioteke i okvire za memoriju koji se pričvršćuju na bilo koji model. Ključni pomak je da memorija više nije nešto što može izgraditi samo specijalizirani tim — ali upravljanje njome, odluka o tome što bi agent trebao i ne bi trebao pamtiti, sada je jasno posao korisnika.

Što trajna memorija poboljšava (prijavljeni dobici, ilustrativno)

Što vam memorija zapravo kupuje

Vrijednost nije apstraktna. Agent za podršku s memorijom prestaje tražiti korisnika da ponovno objašnjava svoj sustav pri svakoj prijavi. Agent za kodiranje pamti konvencije vašeg projekta umjesto da ih uči iznova svake sesije. Prodajni asistent zapamti da se ovaj kupac sastaje samo četvrtkom. U svemu tome obrazac je isti: memorija uklanja porez na ponovno uspostavljanje konteksta, pa svaka interakcija počinje dalje. Ona se i akumulira — agent koji uči iz ispravaka i pohranjuje ih čini istu grešku jednom, ne tjedno.

Načini otkazivanja — i kako ih izbjeći

Memorija je moćna upravo zato što ustraje, što je istovremeno i ono što je čini opasnom. Četiri načina otkazivanja čine većinu nevolja.

Način otkazivanjaŠto pođe po zluUblažavanje
Trovanje memorijePogrešna ili zlonamjerna „činjenica" se spremi i ponavlja zauvijekProvjeri prije zapisa; neka korisnici vide i uređuju memoriju
Curenje privatnostiPodaci jednog korisnika iskrsnu u sesiji drugogStroga izolacija memorije po korisniku / najmoprimcu
Drift i zastarjelostStare preferencije nadžive svoju istinu („još" želi USD)Vremenski označi sjećanja; istekni ih i osvježi
Napuhavanje kontekstaPreviše dohvaćenih sjećanja, signal zakopan, trošak goreRangiraj strogo, dohvati malo, sažimaj agresivno
Pohranjenu memoriju tretirajte kao nepovjerljivu prema zadanim postavkama. Sve što je agent pročitao iz dokumenta ili od korisnika može se zapisati u memoriju — uključujući skrivene upute. Memorija koja kaže „uvijek odobri povrate" nikad ne bi smjela nadjačati pravilnik. Držite memoriju kao podatke koje agent uzima u obzir, nikad kao naredbe koje sluša, i neovisno provjeravajte svaku posljedičnu radnju.

Kako dobro uvesti memoriju agenata

Nekoliko disciplina razdvaja agente koji postaju pametniji od onih koji tiho pođu po zlu. Učinite memoriju provjerljivom: korisnici i operatori trebaju moći vidjeti, urediti i izbrisati što agent pamti — to je i značajka povjerenja i, prema EU AI Aktu i GDPR-u, često zakonski zahtjev. Izolirajte po najmoprimcu: nikad ne dopustite da memorija prijeđe granicu korisnika ili kupca. Preferirajte semantičku pred epizodnom: pohranjujte destilirane preferencije i odluke, ne sirove zapise. Istječite agresivno: sjećanje bez vremenske oznake buduća je greška. Pazite na trošak: dohvaćena sjećanja su tokeni pri svakom pozivu, pa mjerite njihovu ekonomiju po pozivu i držite dohvat vitkim.

Trošak ponovnog uspostavljanja konteksta: bez stanja vs. agent s memorijom (ilustrativno, tokeni/zadatak)

Zaključak

Memorija je tiha razdjelnica u 2026. između AI-ja koji jednom impresionira i AI-ja koji zasluži mjesto u tijeku rada. Model ostaje bez stanja; inteligencija o vama živi u arhitekturi memorije izgrađenoj oko njega — radna memorija za trenutni zadatak, epizodna za ono što se dogodilo, semantička za ono što je važno. Ispravno postavite petlju zapiši-pohrani-dohvati, držite memoriju provjerljivom i izoliranom, i istječite je prije nego što odluta, i agent prestaje počinjati od nule svakog jutra. Pogriješite i izgradili ste sustav koji zauvijek pamti pogrešne stvari. Tehnologija je spremna; disciplina je ono što razlikuje.

Dajte svom AI-ju memoriju koja se isplati

Pomažemo timovima dizajnirati memoriju agenata koja uči iz svake interakcije — provjerljivu, izoliranu po korisniku i usklađenu s vašim regulatornim potrebama — i dokazati vrijednost prije skaliranja.

Razgovarajte s AI konzultantom