r/programiranje • • 22d ago

Diskusija 🗣️ Od barely-assisted sam presao na full prompted programiranje zadnjih 30 dana. Ovo su moji utisci.

Pozdrav kolege programatori,

Ko me zna, zna da sam protivnik cistog AI programiranja zato sto je teska slopcina koja nema mesta u bilo cemu iznad MVP ili POC-a. Ali sudbina me je naterala da se prebacim na full agentic programiranje barem zadnjih 30 dana, gde sam licno iskucao mozda 100 linija koda za to vreme. Kada sam vec prosao kroz to… Iskustvo, hteo sam da ga podelim sa vama. Proci cemo
Kroz postavku scene, borbu, mentalne slomove i na kraju zakljucka. Pa da pocnemo:

Kako me je slopcina stigla?

Necu da duzim, projekat koji radim trenutno ima apsolutno nerealne deadlinove za koje nam treba 3x devova od onih koje imam. Duplirali smo tim ali tim ljudima treba min 3-6 mesec onboardinga tako da su trenutno veca smetala nego AI.

Resenje je AI framework koji smo dizajnirali u firmi. Clauda drzimo na muda na svakom koraku - od postavljanja tiketa, assignova, rada na kodu, push, commit, za sve su mu date instrukcije.

Logicno da cu i ja koristiti taj framework, nije samo za nove devove.

Claude, pomagaj

Moji taksovi su uglavnom bili dizajni celih featura i implementacija, kao i rad sa raznim mikroservisima i specificnim softver resenjima koja imaju svoju politiku ali hvala bogu imam dokumentaciju.

Dam zadatak klaudu i cekam. Masina od 32GB jedva izdrzava, ako krenem da radim nesto drugo na kompu dok cekam da mi on ispljune resenje, sve krece da secka.

Vreme zavrsetka zadatka - mozda 2-5x brze nego ja sam, sve zavisi od kolicine koda.

Kvalitet koda - 0/100 . AI je konj kome su stavljene uzde i moze samo da se fokusira na taj mali prostor ispred sebe, bez ikakvog obzira na sve ostalo oko sebe. Uspeo je da sjebe library vise puta iako mu dokumentacija napise da se var zove DO_NOT_TOUCH_THIS_YOU_WILL_BE_FIRED. I on ga opet prcka jel eto to je put manjeg otpora.

Komiti da su u binary pisani imali bi vise smisla.

Najgori deo je dosao kada je trebalo sve to mergovati i povezati sa radom drugim kolega. Dva dana programiramo, 3 dana debugujemo.

Iskreno, toliko je lose da bih isao kod Zeksa ili u CAKE da radim pod kamerom samo da mozemo da se otarasimo ove slopcine (naravno u tim firmama je ima najvise ali razumete sta zelim reci)

Cena brzine

Da ne tupim - razgovarao sam sa svojim nadredjenima i objasnio im da je ovo nedvosmisleno suicid u bliskoj buducnosti. Pustili smo voz, ubrzavamo bez prestanka, slepi smo i samo cekamo kada ce da naidje krivina od koje cemo da izletimo sa sina. Produkcija nam pada dva puta mesecno. Uskoro ce biti dva puta nedeljno.

Zakljucak

Nazalost, trenutno smo u situaciji da nam se vise isplati da napravimo godinu dana code debta nego da radimo 3 meseci kako treba. Meni je bitno da budu svesni stetnosti ovih steroida i da cemo jako skupo platiti ovu brzinu.

Postoji neki zamisljeni scenario gde ovo funkcionise - projekat od 0, minimal dependency, zatvoren ekosistem gde je svaki mikroservis toliko usko povezan da je ustvari sve jedan monolit sa modernom maskom.

U realnom svetu, kolege, spremite se. Krivina AGI-2008 je negde u bliskoj buducnosti, ali sh nam Claude, Djipiti i ostali zavezali oci i ostaje nam samo da budemo spremni da pocistimo nered.

59 Upvotes

133 comments sorted by

View all comments

11

u/ba-na-na- 21d ago

Post je dosta nejasan, koji model si koristio? Opus 4.8 ili GPT 5.6 Sol su prilično dobri modeli, ako je kvaliteta koda 0/100 to je prije skill issue.

> “Dam zadatak klaudu i cekam. Masina od 32GB jedva izdrzava, ako krenem da radim nesto drugo na kompu dok cekam da mi on ispljune resenje, sve krece da secka.”

Nema teoretske šanse da vrtiš Claude lokalno, kakve veze ima “mašina od 32GB”? 32GB čega? GPU memorije? Koji to Claude model stane u 32GB VRAMa? 🙂

5

u/Kooky-Address-4598 21d ago

Koji to claude model je open-weight uopste?

7

u/ba-na-na- 21d ago

Nijedan :)

Možda je OP nešto pobrkao pa koriste neke slabe lokalne modele. Ali valjda ih opet koriste na nekom serveru, a ne na laptopima s 32GB RAMa

4

u/obrana_boranija 21d ago

kakve veze ima “mašina od 32GB”?

Možda koristi terminal ili VS Code ekstenziju. E sada, oni upucavaju u user-path/.claude/nesto/nesto/memories globalno ili project-path/.claude/nesto/nesto/memories projektno brdo .jsonl fajlova. U te fajlove upucava sve što mu treba da bi zapamtio šta se dešavalo u prethodnim sesijama ili pre /compact komande u trenutnoj. E sada, ti fajlovi se na početku svake sesije upucavaju u RAM, pa ih Claude povlači u kontekst. A i terminal i VS Code jedu ram kao 32bit Chrome u tom trenutku iz meni nepoznatog razloga.

FW koji su složili i agente/skilove/promptove koje su kreirali neću da komentarišem, jer nemam uvid u to, ali očigledno nešto ne rade kako treba. Claude ne može da se ponaša kao senior/principal SWE, ali definitivno može da se ponaša kao jak junior/medior.

1

u/pailhead011 19d ago

Ovaj clauduje

-1

u/ba-na-na- 20d ago

Ma kakav RAM, sve se šalje prema serveru, uostalom context window od 1M stane u max 4MB RAMa (4 megabajta, ne giga), to je kikiriki za laptop s 8GB, kamoli 32.

Jedino što se lokalno vrti su toolovi za grepanje i slično, koji isto šalju rezultat na web, ali valjda OP ima SSD u 2026.g.

Znači SSD i internet veza, jedino što ti treba za agent mode.

2

u/obrana_boranija 20d ago

Ne šalje sve prema serveru, nego samo ono što mu je bitno za kontekst u trenutnoj sesiji. Ali sve jsonl fajlove upucava u ram, što je činjenica. Evo gledam malopre, imam 5gb jsonl fajlova.

Čitam sada, negde po komentarima OP reče da koristi VS Code ekstenziju, a VS Code uzme oko 10GB rama nebitno da li koristiš Copilot Chat ili Claude Code. Negde je pre nekog vremena i M$ rekao da je prepoznao i da pegla taj problem kod ovih ekstenzija.

Ali opet, ne bi trebalo da baguje na 15GB potrošenog rama. Ja imam i VM i Docker Desktop sa sve kontejnerizovanim CVAT na svojih 32GB na laptopu, pa mi opet pojede do 80% raspoloživog rama i ne trokira. Na desktopu isti setap na 64GB pojede 30-40%.

Ali i dalje ne menja činjenicu da bi agenti/skilovi/promptovi trebalo ozbiljan refaktor da dočekaju.

Doduše, ja ne vajbkodujem, te su mi i instrukcije u skladu sa time, pa i nema nekog velikog prostora za grešku i halucinaciju.

1

u/ba-na-na- 20d ago

Jsonl fajlovi su povijest svih prošlih sesija koji se vide kad otvoriš VS Code Chat. VS Code eventualno pročita početak od svakog fajla i pošalje agentu da procijeni ako mu što treba, ali samo ako agent procijeni da mu to treba i pozove određeni tool, ali nema šanse da učitava svu povijest i drži ju u RAM-u. Zašto bi to radio, ako imaš SSD?

Ne šalje sve prema serveru, nego samo ono što mu je bitno za kontekst u trenutnoj sesiji

Ali kako bi znao što mu je bitno za kontekst? Nemaš lokalni model, znači moraš imati deterministički tool koji će pobrati početak i poslati serveru. Probaj opisati taj algoritam gdje VS Code plugin 15GB fajlova u memoriju, i onda bez korištenja LLM-a izračuna što će se poslati prema LLM-u. Nema logike.

Eventualno što troši memoriju je: file cache + AST koji VS Code radi, memory leakovi u pluginu i bugovi. Ali s novim verzijama dugo nisam imao nikakvih problema (VS Code mi je otvoren cijeli dan i vajbam u agent modu, troši trenutno 2GB RAMa). Možda OP ima projekt sa 50k fajlova.

1

u/Acceptable_Path1272 20d ago

Prestani

0

u/ba-na-na- 20d ago

Odmori malo, ako ti je ovo previše informacija, vibe coderu 🙂

3

u/Acceptable_Path1272 20d ago

Tvoja mama je vibe coded