Za koga
Za programere
Za inženjere koji grade s LLM API-jima i AI alatima za kodiranje.
Za koga
Za inženjere koji grade s LLM API-jima i AI alatima za kodiranje.
Qwen je objavio 27B vision-language model pod čistom Apache 2.0 licencom, bez acceptable-use dodatka i bez granice po broju korisnika. Licenca je jedino što možete provjeriti sami: tehničkog izvještaja nema, a ni jedan benchmark nije nezavisno reproduciran.
Mistral je objavio open weights za Shieldstral 1.0, classifier s 3 milijarde parametara koji tekst i slike ocjenjuje prema policy-ju zadatom u promptu. Licenca je Apache 2.0, a na 3 od 9 objavljenih benchmarka model gubi od konkurencije.
Praktičan vodič za developere: hardver, izbor modela, kvantizacija i alati (Ollama, llama.cpp, LM Studio, vLLM) za pokretanje open-weight LLM-ova na vlastitom računaru, uz korak-po-korak setup i provjeru pouzdanosti.
Produkcijski sistem danas se ne dizajnira samo tako da ga developer razumije, nego tako da ga AI agent može koristiti u cjelini. Šta to konkretno mijenja u arhitekturi i gdje ta logika prestaje da vrijedi.
Moonshot AI najavio Kimi K3 – MoE model od 2.8T parametara s milion tokena konteksta i ugrađenim vizuelnim ulazom. Weights su obećane za 27. Juli, ali status modela za sada počiva na tvrdnjama proizvođača: licenca nije imenovana, a svi benchmark rezultati su vendorovi.
Mistral je 8. Jula 2026. predstavio Robostral Navigate, model od 8B parametara koji navigira robote iz jedne RGB kamere bez LiDAR-a – uz rezultate koji za sada dolaze isključivo iz simulacije.
Svih sedam agentnih obrazaca svode se na jedno pitanje: ko drži kontrolu toka, kod ili model? Vodič kroz izbor obrasca, uz jasan stav da je agent trošak, a ne odredište.
Prvi instinkt je da dodate reranker ili povećate top-k. Prije nego što bilo šta promijenite: sedam mehanički različitih tačaka kvara u RAG pipeline-u, i redoslijed kojim ih provjeravate.
Alibaba će 10. jula isključiti Qwenove antropomorfne interaktivne agente pred kineski rok od 15. jula za usklađivanje s novim propisima o antropomorfnim AI uslugama – bez najavljenog perioda za izvoz podataka.
Gemini 3.5 Pro navodno kasni prema jednom nepotvrđenom insajderskom izvještaju, dok Google DeepMind u razmaku od jednog dana gubi Gemini ko-vođu Noama Shazeera i potpredsjednika Johna Jumpera.
Mistral je objavio Leanstral 1.5, open weights model za formalno dokazivanje teorema i verifikaciju Lean 4 koda – sa benchmark rezultatima koji zavise od budžeta tokena više nego što headline brojka pokazuje.
OpenAI najavljuje porodicu modela GPT-5.6 (Sol, Terra, Luna) s vladom koordinisanim, ograničenim pristupom prije šire dostupnosti – presedan koji mijenja kako programeri dobijaju pristup novim modelima.
Anthropic je, zajedno sa Amazonom, Microsoftom i Googleom, predstavio rani nacrt okvira za ocjenjivanje ozbiljnosti jailbreak napada – Cyber Jailbreak Severity – i detaljno opisao klasifikatore koji štite Fable 5.
Claude Science objedinjuje alate, baze podataka i pristup računarskim resursima za naučnike u jednu aplikaciju – plus program koji do 50 istraživačkih projekata finansira sa do 30.000 dolara u compute credits.
GitHub je od 1. juna 2026. zamijenio kvote za premium zahtjeve novim sistemom AI Credits, gdje se potrošnja mjeri direktno po tokenu prema objavljenoj tablici cijena po modelu.
Google je integrirao computer use kao ugrađeni alat u standardni model gemini-3.5-flash, eliminirajući potrebu za zasebnim modelom za upravljanje grafičkim sučeljima.
Prodavač kaže milijun tokena. Model ignoriše upravo onu informaciju iz sredine. Nije bug – to je osnovna karakteristika transformera. Kako to oblikuje arhitekturalne odluke.
Agentni loop je kontrolni obrazac koji LLM-u daje sposobnost iterativnog izvršavanja višefaznih zadataka - pozivanjem alata, primanjem rezultata, i ponovnim razmišljanjem - sve do uvjeta za zaustavljanje.
Qwen-Robot Suite donosi tri foundation modela za embodied AI - otvorene težine za navigaciju i manipulaciju, world model samo kao tehnički rad bez weighta.
Ako gradite softver za bosanskogovornu publiku i koristite LLM API-je, vaš model troši 1,8 do 2,5 puta više tokena po bosanskoj riječi nego po engleskoj - i to je samo početak problema.
Istraživači iz Shanghai AI Lab-a objavili su Self-Harness – trostepeni framework u kojemu LLM agent autonomno identificira vlastite slabosti i mijenja harness bez dotaknuća težina modela. Na Terminal-Bench 2.0 relativni pomak kreće se od 33% do 60%, ovisno o modelu.
Mistral AI je 23. juna 2026. objavio OCR 4, model za ekstrakciju dokumenata koji vraća granične okvire, ocjene pouzdanosti po riječima i block klasifikaciju – dostupan i kao single-container za lokalno hostovanje.
Svaka Claude Code sesija počinje ispočetka - osim ako niste postavili CLAUDE.md. Šta je taj fajl, čemu služi AGENTS.md i kako ih podesiti za tim koji koristi više alata.
Karpathy-ev LLM Wiki obrazac: tri sloja, tri operacije, i zašto mali knowledge base ne treba RAG. Praktični vodič s bosanskim prijevodima promptova.
Svako jutro jedan kratak, praktičan članak na bosanskom. Bez buzzworda. Bez spama.