🏥 U praksi

192 vijesti

🟡 🏥 U praksi 10. srpnja 2026. · 2 min čitanja

AWS: SageMaker donosi serverless fine-tuning NVIDIA Nemotron 3 modela s SFT, RLVR i RLAIF tehnikama

Editorial ilustracija: modularni model koji se dotjeruje kroz tri automatizirana kanala bez servera

Amazon SageMaker AI uveo je serverless prilagodbu NVIDIA Nemotron 3 modela, bez upravljanja infrastrukturom. Dostupne su tri tehnike: SFT (nadzirano fino-tuniranje), RLVR (učenje potkrepljivanjem s provjerljivim nagradama) i RLAIF (učenje potkrepljivanjem iz AI povratne informacije), čime napredne RL metode postaju dostupne enterprise timovima bez ML infrastrukturnog znanja.

🟡 🏥 U praksi 10. srpnja 2026. · 2 min čitanja

GitHub: bolji alati pogoršali Copilot code review — prepisivanje uputa vratilo kvalitetu uz 20% niži trošak

Editorial ilustracija: povećalo usmjereno na obojeni diff umjesto na cijeli repozitorij

GitHub je otkrio da je migracija Copilot code reviewa na bolje održavane alate isprva pogoršala rezultate — uzrok nisu bili alati nego zastarjele upute agentu. Prepisivanjem uputa na diff-first pristup (batch pretraga prije čitanja datoteka, analiza usidrena na PR diff) postigli su oko 20% niži prosječni trošak review-a uz istu kvalitetu.

🟡 🏥 U praksi 10. srpnja 2026. · 2 min čitanja

OpenAI: Deutsche Telekom kreće u AI-native transformaciju — partnerstvo pokriva podršku, mrežu i glasovni AI za ~245 milijuna korisnika

Editorial ilustracija: telekomunikacijski toranj iz kojeg zrače AI signali nad Europom

Deutsche Telekom i OpenAI sklopili su partnerstvo za pretvaranje operatera u AI-native telco, s primjenom u korisničkoj podršci, alatima za zaposlenike, mrežnim operacijama i glasovnom AI-ju. Deutsche Telekom jedan je od najvećih europskih operatera s oko 245 milijuna korisnika globalno, čime je ovo jedan od najvećih AI dealova u telekomunikacijama.

🟢 🏥 U praksi 10. srpnja 2026. · 2 min čitanja

Anthropic: Claude Code v2.1.206 donosi /cd s prijedlozima putanja, /doctor savjete za CLAUDE.md i automatski git push u /commit-push-pr

Editorial ilustracija: terminalski prozor s naredbama i strelicom koja gura granu u remote

Claude Code v2.1.206 je novo izdanje Anthropicova CLI alata koje uvodi naredbu /cd s prijedlozima putanja, /doctor provjeru koja predlaže skraćivanje CLAUDE.md datoteka i automatsko odobravanje git pusha na konfigurirani remote u /commit-push-pr. Pozadinski agenti sada se ažuriraju odmah nakon nadogradnje, bez sporog upgradea pri sljedećem povezivanju.

🟢 🏥 U praksi 10. srpnja 2026. · 2 min čitanja

AWS: Henry Schein One provjerava kvalitetu dentalnih rendgena AI-jem u realnom vremenu — 11 milijuna snimaka tjedno uz 1,4 sekunde latencije

Editorial ilustracija: dentalni rendgen kroz koji prolazi AI mreža s oznakom kvalitete

Henry Schein One razvio je 'Image Verify', AI sustav na Amazon SageMakeru za provjeru kvalitete dentalnih rendgenskih snimaka u realnom vremenu. Sustav je uveden na više od 10.000 lokacija, obrađuje preko 11 milijuna rendgena tjedno uz prosječnu latenciju od 1,4 sekunde, s ciljem smanjenja odbijanja zahtjeva za osiguranje zbog loše kvalitete snimaka.

🟡 🏥 U praksi 9. srpnja 2026. · 2 min čitanja

GitHub: Copilot sada nudi AI pregled repozitorija — automatski sažetak svrhe, tehnologija i načina doprinošenja

Editorial ilustracija: otvorena mapa repozitorija s AI lupom koja izvlači sažetak

GitHub Copilot repository overview je nova mogućnost koja pri prvom posjetu nepoznatom repozitoriju automatski generira sažetak: čemu projekt služi, koje tehnologije koristi i kako mu doprinijeti. Radi na github.com kroz Copilot chat, dostupna je na svim Copilot planovima i ne zahtijeva nikakvu konfiguraciju.

🟢 🏥 U praksi 9. srpnja 2026. · 2 min čitanja

Anthropic: Reflect — dashboard koji pokazuje kako koristiš Claude, s tihim satima i pitanjima za samorefleksiju

Editorial ilustracija: ogledalo u obliku ekrana s grafovima navika korištenja

Reflect je Anthropicov beta dashboard za analizu vlastitih navika korištenja Claudea: prikazuje dominantne teme, kategorije zadataka i vremenske obrasce za razdoblja od 1 do 12 mjeseci. Korisnici mogu postaviti tihe sate i podsjetnike za pauze, a dostupan je na Free, Pro i Max planovima uz uključen Memory.

🟢 🏥 U praksi 9. srpnja 2026. · 2 min čitanja

Mistral: Studio dobiva version control za promptove i skillove — nepromjenjive verzije, audit tragovi i rollback

Editorial ilustracija: arhivski ormar s verzioniranim karticama promptova i git granama

Mistral Studio uvodi sustav zapisa za AI promptove i skillove: nepromjenjivo verzioniranje s potpunom poviješću, vlasništvo i audit tragove, klasifikacijske oznake te brzi rollback. Skillovi su integrirani kao MCP serveri, a razvojni i produkcijski tokovi su razdvojeni — promjene u produkciji idu kroz CI/CD.

🟡 🏥 U praksi 8. srpnja 2026. · 4 min čitanja

AWS uvodi Claude Apps Gateway: centralno upravljanje Claude alatima za enterprise timove

Editorial ilustracija: AWS samohostirana upravljačka ravnina za Claude Code i Desktop aplikacije u poduzećima

Amazon Web Services predstavio je Claude Apps Gateway for AWS, self-hosted control plane koji enterprise timovima omogućava centralno upravljanje pristupom, troškovima i politikama za Claude Code i Claude Desktop bez distribucije dugoživućih kredencijala developerima.

🟡 🏥 U praksi 8. srpnja 2026. · 3 min čitanja

OpenAI preispituje SWE-Bench Pro: vodeći benchmark za AI kodiranje ima probleme s pouzdanošću

Editorial ilustracija: OpenAI kritika pouzdanosti SWE-Bench Pro mjerila za evaluaciju sposobnosti kodiranja

OpenAI objavljuje analizu koja dovodi u pitanje pouzdanost SWE-Bench Pro — jednog od dominantnih benchmarkova za procjenu AI coding-asistenata u 2026. godini. Budući da benchmark ocjene snažno utječu na odluke o kupnji i usvajanju modela, ovo upozorenje ima izravne praktične posljedice za industriju.

🟢 🏥 U praksi 8. srpnja 2026. · 3 min čitanja

Claude Code v2.1.205: sigurnost sesija, popravci i ušteda od 400 MB RAM-a

Editorial ilustracija: Anthropic Claude Code v2.1.205 novo izdanje CLI razvojnog alata s poboljšanjima

Anthropic je 8. srpnja 2026. objavio Claude Code v2.1.205 s novim sigurnosnim pravilom koje sprječava manipulaciju datotekama transkripta sesija, nizom ispravaka uključujući tihomarne JSON i Windows worktree bugove, te optimizacijom auto-updatea koji sada streama binarij na disk umjesto u memoriju — čime se štedi oko 400 MB vršnog RAM-a.

🟢 🏥 U praksi 8. srpnja 2026. · 3 min čitanja

Flint — Microsoftov open-source jezik koji kompajlira vizualizacije za AI agente

Editorial ilustracija: Microsoft Flint jezik specifikacija vizualizacija za AI agente i podatkovne prikaze

Microsoft Research objavio je Flint, open-source jezik za specifikaciju grafova koji rješava kompromis između kratkih i opširnih vizualizacijskih specifikacija kompajliranjem u Vega-Lite, Apache ECharts i Chart.js iz jednog kompaktnog zapisa, uz semantičke tipove podataka koji automatski izvode skale, formatiranje i sheme boja.

🟢 🏥 U praksi 7. srpnja 2026. · 4 min čitanja

Kako je Schneider Electric izgradio LLMOps temelje za 60+ AI agenata s LangSmithom

Editorial ilustracija: Schneider Electric uvodi enterprise LLMOps praćenje s LangSmithom

Schneider Electric, s 160.000 zaposlenih u 107 zemalja, deployao je self-hosted LangSmith na AWS EKS za upravljanje 60+ AI agenata. Arhitektura počiva na tri stupa — opservabilnosti, evaluaciji i deploymentu — uz oko 200 aktivnih korisnika. Interni asistent One Jo opslužuje cijelu organizaciju, a quotation workflow skraćen je s dana na 15 minuta.

🟡 🏥 U praksi 6. srpnja 2026. · 3 min čitanja

Alberta skenirala 466 milijuna linija koda za 20 sati: vlada koristi Claude za kibernetičku sigurnost

Editorial ilustracija: Anthropic otkriva sigurnosne ranjivosti u velikom vladinom izvornom kodu

Vlada kanadske provincije Alberta koristila je Claude Code s ~50 paralelnih AI agenata za skeniranje 466 milijuna linija koda u 20 sati — posao koji bi tradicionalnim metodama trajao 6,5 godina. Projekt je obuhvatio 1.280 aplikacija i 3.400 repozitorija kroz 27 ministarstava, od kojih nijedno nikad nije prošlo sustavnu sigurnosnu reviziju.

🟢 🏥 U praksi 6. srpnja 2026. · 4 min čitanja

AWS automatizira redigiranje PII-ja u slikama s Nova 2 Lite i SAM 3

Editorial ilustracija: AWS Nova redaktira osobne podatke iz slika radi usklađenosti i zaštite privatnosti

Amazon Web Services objavio je šesterostupanjski pipeline za automatsko uklanjanje osobnih podataka (PII) iz slika, kombiniranjem Amazon Nova 2 Lite, Meta SAM 3 i Amazon Textract servisa. Rješenje cilja regulatornu usklađenost s GDPR-om i PCI DSS standardom bez potrebe za treniranjem vlastitih modela.

🟡 🏥 U praksi 3. srpnja 2026. · 4 min čitanja

PASE: neuro-simbolički sustav skraćuje oporavak cloud kvarova za više od 40 posto

Editorial ilustracija: autonomni oporavak cloud infrastrukture neuro-simboličkom sintezom

Kineski istraživači predlažu PASE — Planning-Aware Semantic self-healing engine koji kombinira LLM planiranje, simboličku verifikaciju i deep RL optimizaciju promptova. Rezultat: više od 40 posto smanjenje prosječnog vremena oporavka od kvarova u oblaku u usporedbi s dosadašnjim pristupima.

🟢 🏥 U praksi 3. srpnja 2026. · 3 min čitanja

Kako PyTorch generira tisuće testova iz nekoliko template klasa — vodič kroz test-infrastrukturu

Editorial ilustracija: PyTorch alati za automatsko testiranje i optimizaciju CI infrastrukture

PyTorch blog autorice Riye Punia (Red Hat) objašnjava zašto CI padovi nose čudna imena poput TestMatmulCUDA.test_basic_cuda_float32 umjesto izvornog TestMatmul.test_basic — testovi se generiraju u trenutku importa kroz kombinacije uređaja i dtype-ova.

🟡 🏥 U praksi 2. srpnja 2026. · 4 min čitanja

AWS SageMaker vodič: u multi-turn RL nagrada i evaluacija važniji od algoritma

Editorial ilustracija: AWS SageMaker agentic fine-tuning radni tokovi i pojačano učenje u više okreta

AWS SageMaker AI vodič za multi-turn reinforcement learning stavlja kvalitetu nagradne funkcije i neovisnost evaluacije ispred algoritmičkog izbora. Guste nagrade sprječavaju kolaps varijance, a reward hacking nastaje kad agent optimizira metriku bez rješavanja stvarnog zadatka. Na SOP-Bench benchmarku ispravno postavljeni trening postigao je 13 posto bolji Task Success Rate i oko 16 posto bolju točnost po polju.

🟢 🏥 U praksi 2. srpnja 2026. · 3 min čitanja

GitHub Copilot u CI/CD-u: bez osobnih tokena i s kontrolom troškova po timu

Editorial ilustracija: GitHub Copilot kontrola troškova i AI kreditni bazeni za enterprise timove

GitHub je istog dana objavio dva enterprise ažuriranja za Copilot: CLI u GitHub Actions više ne zahtijeva osobni pristupni token, a cost centeri sada podržavaju AI credit poolove s automatskim limitima koji štite timove jedne od drugih.

🟢 🏥 U praksi 2. srpnja 2026. · 3 min čitanja

Kako obuzdati eksploziju troškova coding-agenata: četverofazni pristup LangSmithom

Editorial ilustracija: LangSmith platforma za unified observability i praćenje troškova coding agenata

LangChain opisuje kako coding-agenti generiraju nekontrolirane troškove zbog fragmentacije alata i mentaliteta tokenmaxxinga, a kao rješenje predlaže četverofazni pristup putem platforme LangSmith koji pokriva vidljivost, normalizaciju, optimizaciju i upravljanje.

🟢 🏥 U praksi 1. srpnja 2026. · 3 min čitanja

Anthropic uvodi kontrolu pristupa modelima za enterprise administratore

Editorial ilustracija: Anthropic enterprise upravljanje pristupom modelima za administratore organizacija

Anthropic u beti lansira enterprise model entitlements: administratori organizacija sada mogu odrediti kojim Claude modelima korisnici imaju pristup i konfigurirati postavke razine truda po korisniku ili grupi.

🟡 🏥 U praksi 30. lipnja 2026. · 3 min čitanja

Claude Science: Anthropicov samostalni radni stol za znanstvenike u life sciences

Editorial ilustracija: Anthropic Claude Science radna okolina za genomiku i bioznanstvena istraživanja

Anthropic je u beta objavio Claude Science — zasebnu desktop aplikaciju (macOS/Linux) za istraživače u genomici, proteomici i srodnim poljima, s više od 60 kuriranih vještina, nativnom integracijom NVIDIA BioNeMo modela i reviewerom koji validira citate i izračune.

🟡 🏥 U praksi 30. lipnja 2026. · 4 min čitanja

OECD: Upotreba GenAI chatbota narasla s 18% na 28% populacije u jednoj godini

Editorial ilustracija: OECD studija o korištenju generativnih AI chatbota u 37 zemalja svijeta

Analiza OECD-a temeljena na podacima SimilarWeba za 37 GPAI zemalja pokazuje da je upotreba generativnih AI chatbota narasla s oko 18% na 28% populacije između siječnja 2025. i siječnja 2026. Singapur vodi s 63% usvajanja, dobna skupina 25–34 prelazi 50%, a korisnici Claudea i Copilota gravitiraju profesionalnim alatima.

🟡 🏥 U praksi 29. lipnja 2026. · 2 min čitanja

AWS: Nova 2 Lite i Claude — cost-optimizirani pipeline za obradu skeniranih dokumenata

Editorial ilustracija: Nova 2 Lite i Claude — cost-optimizirani pipeline za obradu skeniranih dokumenata, bez teksta i lica

AWS demonstrira dvostepeni (two-stage) pipeline za masovnu digitalizaciju skeniranih dokumenata na Amazon Bedrocku. Amazon Nova 2 Lite obavlja inicijalnu ekstrakciju brzo i jeftino, a Claude preuzima prostorno zahtjevno razumijevanje — hibridni pristup koji košta dvije trećine manje od single-model alternativa.

🟡 🏥 U praksi 28. lipnja 2026. · 2 min čitanja

GitHub: Copilot agentic harness dostiže razinu vendor-harnessa uz manju potrošnju tokena kroz 20+ frontier modela

Editorial ilustracija: usporedne trake performansi i tokena na zaslonu, bez teksta i lica

GitHub Copilot agentic harness je sloj koji modelu daje alate i petlju izvršavanja za autonomno kodiranje. GitHub ga je testirao na modelima Claude Sonnet 4.6, Claude Opus 4.7, GPT-5.4 i GPT-5.5 kroz pet benchmarka te utvrdio da postiže stope dovršavanja zadataka na razini harnessa proizvođača uz nižu potrošnju tokena, uz podršku za više od 20 frontier modela.

🟡 🏥 U praksi 27. lipnja 2026. · 2 min čitanja

Anthropic: Economic Index otkriva ritmove i obrasce korištenja AI-ja kroz dan

Editorial illustration: grafikoni vremenskih obrazaca AI korištenja kroz dan s uzlaznim krivuljama u jutarnjim i večernjim satima

Treći Anthropic Economic Index izvještaj analizira kada i kako ljudi koriste Claude — od jutarnjih vijesti do kasnovečernih recepata. Autonomy score Claudea Code-a je 0,37 bodova viši od chata, a razgovori u visokoplaćenim zanimanjima troše 2,5× više tokena.

🟡 🏥 U praksi 27. lipnja 2026. · 2 min čitanja

arXiv:2606.27009: Semantičko rano zaustavljanje smanjuje trošak agentskih petlji za 38%

Editorial illustration: dijagram agentske petlje s točkom zaustavljanja temeljenom na konvergenciji vektora, bez teksta i lica

Semantic Early-Stopping for Iterative LLM Agent Loops predlaže metodu koja zaustavlja agentsku iteracijsku petlju čim embedding uzastopnih nacrta prestane semantički mijenjati — bez fiksnog broja koraka — i tako smanjuje potrošnju tokena za 38% uz identičnu kvalitetu.

🟡 🏥 U praksi 26. lipnja 2026. · 2 min čitanja

arXiv:2606.25519: Kvantizacija napuhuje zaključivanje — skriveni trošak niskobitnih modela

Editorial illustration: shematski prikaz komprimiranog mozga koji ispušta dug lanac misaonih mjehurića, simbolizirajući token inflaciju kod kvantiziranih AI modela

Kvantizacija jezičnih modela na INT4/INT3 čuva točnost odgovora, ali produljuje lanac razmišljanja i poništava očekivano ubrzanje inferencije. Microsoftovi istraživači uveli su metriku CoT Token Inflation Ratio i testirali je na matematici, kodu, znanosti i agentic zadacima.

🟢 🏥 U praksi 26. lipnja 2026. · 1 min čitanja

arXiv:2606.25524: Cliff Tokens — pojedinačni tokeni koji okidaju neuspjeh u matematičkom reasoningu

Editorial illustration: abstract graph showing sharp probability drop at a single token in a mathematical reasoning chain

Cliff tokeni su pojedinačni tokeni u izlazu LLM-a gdje vjerojatnost uspješnog matematičkog zaključivanja naglo pada. Istraživači su razvili metodu detekcije i pokazali da uklanjanje prvog cliff tokena vraća točnost gotovo na savršenu razinu, a Cliff-DPO trening daje +6,6 postotnih bodova.

🟢 🏥 U praksi 26. lipnja 2026. · 1 min čitanja

Microsoft: Generative Causal Testing — AI hipoteze o mozgu koje se testiraju skenerom

Editorial illustration: AI neural network overlaid on abstract brain scan imagery showing highlighted cortical regions

Generative Causal Testing (GCT) je dvofazni AI okvir koji pretvara neprozirne modele za predviđanje aktivnosti mozga u testabilne hipoteze — a zatim ih provjerava pravim fMRI eksperimentima na ljudskim ispitanicima.

🟡 🏥 U praksi 25. lipnja 2026. · 2 min čitanja

AWS: Huntington Bank redaktirao PII iz 400 milijuna dokumenata uz 95% točnost

Editorial illustration: digitalni dokumenti s prikrivenim tekstualnim blokovima i AWS cloud infrastrukturom u pozadini

Huntington Bank je uz AWS stack (Textract, SageMaker, Step Functions) redaktirao osobne podatke iz više od 400 milijuna dokumenata uz točnost višu od 95%, oborivši izvornu procjenu troška na samo 5% i skrativši rokove s godina na mjesece.

🟡 🏥 U praksi 25. lipnja 2026. · 2 min čitanja

Microsoft: Talos — open-source automatska ponovna analiza genoma za rijetke bolesti

Editorial illustration: genomic data pipeline s DNA helixom i medicinskim grafikonima na tamnoj pozadini, bez lica

Talos je open-source sustav koji automatski iterativno ponovno analizira genome pacijenata s rijetkim bolestima. Na 4.735 nedijagnosticiranih pacijenata pronašao je 241 novu dijagnozu (+5,1%), uz osjetljivost od 90% i trošak anotacije od samo 11 USD po 1.000 genoma.

🟡 🏥 U praksi 24. lipnja 2026. · 2 min čitanja

AWS: Bedrock AgentCore pool-model multi-tenancy — dijeljena infra, izolirani tenanti

Editorial illustration: cloud infrastructure diagram showing layered tenant isolation tiers with data flow arrows

AWS Bedrock AgentCore donosi pool-model multi-tenancy arhitekturu s trorazinskom izolacijom (Tier → Tenant → User), Cedar politikama za granice alata i Token Vending Machineom za izolaciju memorije — referentni SaaS dizajn za produkcijske AI agente.

🟢 🏥 U praksi 24. lipnja 2026. · 2 min čitanja

OpenAI: GPT-5 Pro pomogao riješiti 3-godišnju imunološku misteriju o T-stanicama

Editorial illustration: glowing T-cell structure with abstract neural network pattern in laboratory setting

GPT-5 Pro je pomogao imunologu Deryi Unutmazu iz Jackson Laboratoryja razriješiti trogodišnju znanstvenu misteriju o ponašanju T-stanica — imunosnih stanica ključnih za obranu organizma — otvarajući nove mogućnosti u istraživanju raka i autoimunih bolesti.

🟢 🏥 U praksi 23. lipnja 2026. · 2 min čitanja

AWS: semantičko pretraživanje zračnih snimaka uz Amazon Nova Multimodal Embeddings (Vexcel)

Editorial illustration: aerial photograph grid with semantic search query overlay and highlighted detected pools and roads

Vexcel i AWS demonstrirali su semantičko pretraživanje aerofotografija pomoću Amazon Nova Multimodal Embeddings. Nakon testiranja ~100 konfiguracija, LLM-generirani opisi poboljšali su F1 rezultat za bazene za 11% i za ceste za 13%, što je preraslo u komercijalni proizvod Vexcel Intelligence dostupan u 45+ zemalja.

🟢 🏥 U praksi 23. lipnja 2026. · 2 min čitanja

CNCF: zašto klasična observability ne radi za agentic i LLM sustave

Editorial illustration: pipelines of AI data flowing through monitoring dashboards in a cloud-native environment, abstract nodes and graphs

CNCF blog objašnjava zašto klasični pristup praćenju sustava ne funkcionira za AI agente i LLM modele koji rade probabilistički — isti upit može dati potpuno različite rezultate, a greške su semantičke, ne tehničke.

🟢 🏥 U praksi 21. lipnja 2026. · 2 min čitanja

arXiv:2606.20474: UltraQuant smanjuje latenciju KV predmemorije za 3,47× s 4-bitnom preciznošću

Urednička ilustracija: UltraQuant smanjuje latenciju KV predmemorije za 3,47× s 4-bitnom preciznošću

UltraQuant je tehnika kompresije KV predmemorije na 4-bitnu preciznost za višeokretne LLM agente. Razvijen na AMD, UCLA i Purdue, postiže 3,47× brže P50 TTFT u kasnim rundama s visokim pritiskom konteksta i 1,63× veću propusnost izlaza u usporedbi s FP8 baznom linijom.

🟡 🏥 U praksi 20. lipnja 2026. · 2 min čitanja

Anthropic: Claude Code v2.1.183 blokira destruktivne git i infrastrukturne naredbe u auto modu

Urednička ilustracija: terminalni prozor sa štitom koji zaustavlja crvene naredbe

Claude Code v2.1.183 je nova verzija Anthropicovog CLI alata objavljena 19. lipnja 2026. koja u auto modu blokira destruktivne git naredbe (git reset --hard, git clean -fd, git stash drop) i infrastrukturne naredbe (terraform, pulumi i cdk destroy) bez izričitog korisničkog zahtjeva. Verzija donosi i popravke za WebSearch u subagentima, korupciju fullscreen sučelja te MCP autentikaciju.

🟡 🏥 U praksi 20. lipnja 2026. · 2 min čitanja

AWS: SageMaker dobiva preko 100 detaljnih inference metrika i Insights nadzornu ploču na CloudWatchu

Urednička ilustracija: nadzorna ploča s grafovima latencije i protoka tokena

Amazon SageMaker je AWS-ova platforma za strojno učenje koja sada emitira više od 100 detaljnih metrika za generativni AI inference u CloudWatch, dostupnih kroz novu Insights nadzornu ploču. Ploča prikazuje token-level latenciju (TTFT, latenciju među tokenima), praćenje KV cachea i dijagnostiku hladnog starta, a kompatibilna je s Grafanom i Datadogom preko PromQL endpointa.

🟢 🏥 U praksi 20. lipnja 2026. · 1 min čitanja

GitHub: Copilot gasi Opus 4.6 (fast) 29. lipnja, dodaje AGENTS.md u code review i polje ai_credits_used u API

Urednička ilustracija: kalendar s istaknutim datumom i Copilot ikonom uz mjerač kredita

GitHub je kroz changelog objavio tri promjene za Copilot. Model Opus 4.6 (fast) gasi se 29. lipnja 2026. na svim Copilot površinama uz preporuku prelaska na Opus 4.8 (fast), Copilot code review sada čita repozitorijske AGENTS.md datoteke, a Copilot Usage Metrics API dobiva polje ai_credits_used koje prati potrošnju AI kredita po korisniku.

🟡 🏥 U praksi 19. lipnja 2026. · 2 min čitanja

arXiv:2606.19245: TxBench-PP — AI agenti u potrazi za novim lijekovima

Editorial ilustracija: 2606.19245: TxBench-PP — AI agenti u potrazi za novim lijekovima

TxBench-PP je benchmark koji testira AI agente u pretkliničkoj farmakologiji malih molekula kroz 4.800 trajektorija i 11 modela. Claude Opus 4.8 postiže 59,3% uspješnosti i vodi ispred GPT-5.5 s 55,3%, no nijedan model ne dostiže razinu pouzdanu za medicinsku primjenu.

🟡 🏥 U praksi 19. lipnja 2026. · 2 min čitanja

GitHub: MAI-Code-1-Flash dostupan na 8 razvojnih površina unutar Copilota

Editorial ilustracija: MAI-Code-1-Flash dostupan na 8 razvojnih površina unutar Copilota

MAI-Code-1-Flash, Microsoftov kompaktni coding model pozicioniran kao best-in-class za svoju veličinu, sada je dostupan na 8 razvojnih površina unutar GitHub Copilota — od CLI-ja do mobilnih platformi — u svim planovima od free do max tiera.

🟡 🏥 U praksi 19. lipnja 2026. · 2 min čitanja

OpenAI: AI pomaže liječnicima dijagnosticirati rijetke genetske bolesti kod djece

Editorial ilustracija: AI pomaže liječnicima dijagnosticirati rijetke genetske bolesti kod djece

OpenAI-jev reasoning model identificirao je 18 novih dijagnoza u prethodno neriješenim slučajevima rijetkih genetskih bolesti kod djece, surađujući s liječnicima i istraživačkim institucijama. Rezultati otvaraju nova pitanja o ulozi AI-a u kliničkoj dijagnostici.

🟢 🏥 U praksi 19. lipnja 2026. · 1 min čitanja

PyTorch: LLM-ovi smanjuju optimizaciju GPU kernela s minuta na sekunde

Editorial ilustracija: LLM-ovi smanjuju optimizaciju GPU kernela s minuta na sekunde

PyTorch core tim objavio je LLM-vođeno autotuniranje za Helion kernele koje optimizaciju GPU koda ubrzava s minuta na sekunde. Umjesto iscrpne pretrage svih konfiguracija, veliki jezični modeli inteligentno vode pretragu prostora parametara.

🟡 🏥 U praksi 18. lipnja 2026. · 1 min čitanja

GitHub: Copilot desktop aplikacija u općoj dostupnosti — paralelne sesije i cloud automacije

Editorial ilustracija: desktop aplikacija za AI programskog pomoćnika

GitHub je objavio da je Copilot desktop aplikacija za macOS, Windows i Linux u općoj dostupnosti. Aplikacija donosi paralelne sesije, canvas sučelje, cloud automacije te integraciju vlastitih modela i alata. Objedinjuje GitHub Spark, Copilot Chat i Copilot CLI u jedinstveno desktop iskustvo. Izdanje je dio šireg vala Copilot najava istog dana, uključujući HyDRA usmjeravanje modela i Auto mode dostupan svim korisnicima.

🟡 🏥 U praksi 18. lipnja 2026. · 2 min čitanja

IBM: Studija otkriva da 91% organizacija nema punu vidljivost AI ovisnosti, lock-in ozbiljan

Editorial ilustracija: poslovna ovisnost o AI dobavljačima i rizik lock-ina

IBM-ova studija pokazuje da 91% organizacija nema punu vidljivost vlastitih AI ovisnosti o dobavljačima, modelima i infrastrukturi. Čak 71% teško bi promijenilo primarnog AI dobavljača, a 81% navodi da bi sedmodnevni ispad dobavljača izazvao tešku ili kritičnu disrupciju. Samo 7% ima napredne sposobnosti kontrole AI-ja, no te organizacije 55% bolje štite operativni profit od disrupcija. Čak 72% bi platilo 20% više za fleksibilnost izbora dobavljača.

🟢 🏥 U praksi 18. lipnja 2026. · 1 min čitanja

Anthropic: Claude Code v2.1.181 uvodi /config sintaksu i Bun 1.4 te auto-retry pri padu API-ja

Editorial ilustracija: konfiguracija i pouzdanost razvojnog AI alata

Anthropic je objavio Claude Code v2.1.181 s novom sintaksom /config key=value za postavljanje konfiguracije izravno iz prompta i nadogradnjom Bun runtimea na verziju 1.4. Izdanje dodaje automatski ponovni pokušaj pri padu API konekcije tijekom faze 'thinking', skriva neaktivne subagente nakon 30 sekundi i ubrzava pokretanje za 120 ms u svježim okruženjima. Popravljen je i prompt caching s prilagođenim ANTHROPIC_BASE_URL i Foundryjem.

🟡 🏥 U praksi 17. lipnja 2026. · 2 min čitanja

Anthropic: Studija o agentskom kodiranju — korisnici donose 70% planskih, Claude 80% izvedbenih odluka

Editorial ilustracija: podjela odluka između čovjeka i AI agenta pri programiranju

Anthropic je objavio ekonomsku studiju o agentskom kodiranju s Claude Codeom. Korisnici donose oko 70% odluka o planiranju, dok Claude preuzima oko 80% izvedbenih odluka. Stručni korisnici dobivaju 12 akcija i 3.200 riječi po promptu naspram 5 akcija i 600 riječi kod početnika, uz uspješnost provjerenih zadataka 28–33% naspram 15%. Udio debugging sesija pao je s 33% na 19% između listopada 2025. i travnja 2026., dok je prosječna vrijednost zadatka porasla oko 25%.

🟡 🏥 U praksi 17. lipnja 2026. · 1 min čitanja

AWS: Keširanje kontejnera u SageMaker AI skraćuje skaliranje inferencije do 50%

Editorial ilustracija: brže skaliranje AI inferencije keširanjem kontejnera

AWS je u Amazon SageMaker AI uveo predmemoriju kontejnerskih slika koja uklanja povlačenje iz ECR-a pri skaliranju, automatski i bez uključivanja. Za Qwen3-8B latencija pokretanja pala je s 525 na 258 sekundi, oko 51%. Korisnici bilježe 38–65% manju P50 latenciju i do 2× brže skaliranje s kraja na kraj. Značajka je dostupna na svim akceleratorskim tipovima instanci u svim komercijalnim AWS regijama.

🟡 🏥 U praksi 17. lipnja 2026. · 1 min čitanja

Google DeepMind: AI alat za britansko planiranje cilja 50% brže odluke i 1,5 milijuna novih domova

Editorial ilustracija: AI ubrzava obradu građevinskih dozvola i urbano planiranje

Google DeepMind, britanska vlada, Google Cloud i Faculty AI razvijaju AI prototip koji cilja 50% kraće vrijeme odlučivanja o građevinskim dozvolama. Cilj vlade je 1,5 milijuna novih domova do 2029. Zahtjevi vlasnika kuća čine gotovo 70% svih godišnjih zahtjeva, a procjenjuje se ušteda od oko 255 sati godišnje po vijeću. Alat se trenutno testira u Barnetu, Camdenu i Dorsetu, uz planirano nacionalno uvođenje 2027.

Pogledaj cijelu arhivu →