Časopis/AI nedeljni pregled/31. jul – 7. avgust 2026.

AI nedeljni pregled31. jul – 7. avgust 2026.

Opus 4.1 penzionisan 5. avgusta. Codex CLI 0.147.0 uklanja codex exec --full-auto. Workbench 17. avgusta. Atlas se gasi 9. avgusta, o3 odlazi 26. avgusta.

Objavljeno
7. avgust 2026.
Pokriva
Anthropic · OpenAI · Gemini · Copilot
AI nedeljni pregled: 31. jul – 7. avgust 2026.
AI NEDELJNI PREGLED31. jul – 7. avgust 2026.

Datum: 7. avgust 2026. | Sledeće izdanje: 14. avgust 2026.

Ove nedelje nema novog modela, ali tri važne enterprise i infrastrukturne priče. Anthropic je 5. avgusta lansirao inference hooks — serverski inline DLP za Claude Enterprise — i 6. avgusta otvorio javnu betu za self-hosted okruženja za Claude Code, koja enterprise timovima omogućavaju pokretanje agent sesija na sopstvenoj infrastrukturi. Anthropic je potvrdio i formiranje tima za razvoj sopstvenog čipa. Struktura pretplate za Fable 5 konačno je utvrđena od 20. jula: Max i Team Premium planovi dobijaju trajni uključeni pristup do 50% nedeljnih limita; Pro i Team Standard primili su jednokratni kredit od $100 i prešli na kreditno naplaćivanje. Claude Code-ovi 50% viši nedeljni limiti traju do 19. avgusta. Opus 4.1 je penzionisan 5. avgusta. Workbench i eksperimentalni prompt API-ji penzionišu se za deset dana (17. avgusta). Na OpenAI strani, Codex CLI 0.147.0 stigao je sa prenosivim Agent Plugins-ovima, trajnim sekcijama razgovora, podrškom za MCP 2026-07-28, uvozom Cursor veština, jačom zaštitom tajni i uklanjanjem zastarele --full-auto zastavice. ChatGPT za PowerPoint završio je besplatni period i prešao na kreditno naplaćivanje po tokenima 7. avgusta. Atlas se gasi 9. avgusta — podaci pregledača se ne prenose automatski. o3 se povlači iz ChatGPT-a 26. avgusta. Google je isporučio inline context-filtering hooks za Vertex AI i self-hosted CLI runnere za Google AI Studio, zajedno sa proširenjem TPU v6e klastera. Microsoft Copilot prati enterprise teme nedelje sa inference hooks i self-hosted okruženjima u javnoj beti.


Claude / Anthropic

★ Claude Enterprise — inference hooks (inline zaštita od gubitka podataka)

Lansiranje: 5. avgust 2026. | Platforma: Claude Enterprise | Beta | Dostupnost: sve Enterprise organizacije

Inference hooks su Anthropicov odgovor na konzistentni enterprise bezbednosni zahtev: mogućnost da se svaki upit zaposlenog provuče kroz sopstvenu bezbednosnu infrastrukturu organizacije radi odobrenja ili odbijanja pre nego što model obradi upit. Proširuje inline DLP kontrole koje bezbednosni timovi već primenjuju na e-poštu i web saobraćaj na Claude chat, Claude Code i Claude Cowork sesije, koristeći jednu konfiguraciju na nivou organizacije.

★ Novo

Inference hooks su sada u beti za sve Claude Enterprise organizacije. Kako funkcioniše: svaki upit se usmerava ka bezbednosnom serveru koji organizacija pokreće, koji vraća mali JSON odgovor (dozvoli ili odbij) u okviru konfigurabilnog vremenskog ograničenja (podrazumevano: pet sekundi). Ako je odgovor 'odbij', Claude nikad ne vidi upit. Potpisan prema Standard Webhooks specifikaciji koristeći organizaciono generisanu tajnu — bezbednosni server može kriptografski verifikovati da je saobraćaj zaista stigao od Anthropica. Šta bezbednosni server vidi: tekst transkripta, pozive alata i njihove rezultate, tekst izvučen iz priloga. Šta nikad ne vidi: sirove bajtove fajlova ili slika, sistemske upite ili definicije alata. Obuhvat: pokriva Claude chat, Claude Code i Claude Cowork unutar Enterprise organizacije. Postojeći client-side Claude Code hooks (koji se pokreću na korisnikovom računaru) ostaju dostupni i dopunjuju, a ne zamenjuju inference hooks.

Tehničke informacije

Beta: sve Claude Enterprise organizacije | Odgovor: JSON objekat (dozvoli/odbij) | Vremensko ograničenje: konfigurabilno, podrazumevano 5 sekundi | Potpisivanje: Standard Webhooks spec, organizaciono generisana tajna | Vidljivost: tekst transkripta, pozivi alata + rezultati, tekst priloga | Slepe tačke: sirovi bajtovi fajlova/slika, sistemski upiti, definicije alata | Obuhvat: Claude chat, Claude Code, Claude Cowork | Dopunjuje: client-side Claude Code hooks

Preporučeno za: Enterprise bezbednosne i compliance timove koji treba da primene politike klasifikacije podataka (PII, tajne, IP) na svim Claude površinama bez oslanjanja na ponašanje krajnjih korisnika.

★ Claude Code — self-hosted okruženja u javnoj beti

Lansiranje: 6. avgust 2026. | Platforma: Claude Code web, mobilni, desktop, terminal, rutine | Dostupnost: Team i Enterprise (javna beta, podrazumevano isključeno)

Self-hosted okruženja omogućavaju enterprise organizacijama da pokreću Claude Code agent sesije na sopstvenoj infrastrukturi — unutar mreže, pored internih servisa, lanaca alata i bezbednosnih kontrola — umesto na Anthropic-ovom računarskom kapacitetu.

★ Novo

Self-hosted okruženja su sada u javnoj beti za Team i Enterprise planove. Podešavanje: kreirajte imenovana okruženja u claude.ai admin podešavanjima, svako grupiše skup runnera — dugotrajnih procesa deplojirane na hostovima unutar vaše mreže. Dva režima runnera: Fixed (drži fiksan broj aktivnih; sesije se distribuiraju) i On-demand (orchestrator pokreće runnere kako sesije pristižu, zaustavlja ih kada rad završi). Svaka sesija se izvršava u sopstvenom izolovanom checkout-u. Šta ostaje na vašoj infrastrukturi: repository checkout-ovi, build artefakti, tajne i fajlovi koje sesija kreira ili menja. Šta ide Anthropicu: sadržaj razgovora za inferenciju; transkript sesije za nastavak na različitim površinama. Ograničenje dubine spawna subagenta uklonjeno — CLAUDE_CODE_MAX_SUBAGENT_SPAWN_DEPTH je sada neograničeno po podrazumevanom; timovi koji žele ograničenje postavljaju ga eksplicitno.

Tehničke informacije

Planovi: Team i Enterprise | Podrazumevano: isključeno | Podešavanje: claude.ai admin → Environments | Režimi runnera: Fixed (statički pool) ili On-demand (auto-skaliranje) | Runner komanda: claude self-hosted-runner | Izolacija: checkout po sesiji | Inferencija: i dalje obrađuje Anthropic | Transkript: čuva Anthropic za nastavak sesije na različitim površinama | Ograničenje dubine spawna subagenta: uklonjeno; postavite CLAUDE_CODE_MAX_SUBAGENT_SPAWN_DEPTH eksplicitno da dodate ograničenje

Preporučeno za: Enterprise organizacije u regulisanim industrijama (finansije, zdravstvo, odbrana) čiji compliance zahtevi zahtevaju izvršavanje agenata unutar sopstvene mrežne perimetrije, ili timove kojima je potreban pristup internim servisima bez javne izloženosti.

★ Anthropic — potvrđen tim za razvoj sopstvenog čipa

Potvrđeno: 5. avgust 2026. | Status: formiranje tima, nema datuma isporuke hardvera

Uz najavu inference hooks-a 5. avgusta, Anthropic je potvrdio da gradi namenski interni silicon tim za Claude. Nije dat nikakav proizvod ili vremenski okvir isporuke. Ovaj potez prati obrazac koji su postavili Google (TPU), Amazon (Trainium/Inferentia) i Meta (MTIA) frontier AI laboratorija koje razvijaju prilagođene čipove da bi smanjile zavisnost od NVIDIA-e i optimizovale inferenciju za svoje specifične arhitekture modela.

★ Novo

Anthropic potvrđuje da gradi interni silicon tim. Nema vremenskog okvira, naziva proizvoda niti arhitektonskih detalja. Anthropic nastavlja da koristi NVIDIA GPU-ove putem SpaceX/Colossus 1 (300MW), Amazon Trainium (obaveza 5GW), i Google/Broadcom TPU-ove (5GW od 2027.) kao primarni kapacitet dok se silicon napor razvija.

Tehničke informacije

Status: potvrđeno formiranje tima | Nema datuma isporuke niti arhitektonskih detalja | Postojeći kapacitet: NVIDIA (SpaceX Colossus 1, 300MW), Amazon Trainium (do 5GW), Google/Broadcom TPU-ovi (5GW od 2027.), Microsoft/NVIDIA Azure ($30B) | Kontekst: Google (TPU), Amazon (Trainium), Meta (MTIA) su izgradili prilagođene AI čipove; Anthropic je poslednja velika frontier laboratorija koja javno potvrđuje istu odluku

Preporučeno za: Informativno — nije potrebna nikakva akcija. Dugoročni signal za strategiju hardvera i cloud infrastrukture.

★ Fable 5 — struktura pretplate trajno utvrđena

Na snazi: 20. jul 2026. | Prozor za zahtev kredita od $100: zatvoren 2. avgusta | Povećanje limita Claude Code za 50%: do 19. avgusta

Nakon tri produženja roka (7., 12. i 19. jula), Anthropic je trajno utvrdio strukturu pretplate za Fable 5 od 20. jula. Struktura je sada fiksna bez planiranih daljih produženja. Prozor za zahtev promotivnog kredita od $100 zatvoren je 2. avgusta; Pro i Team Standard korisnici koji nisu zatražili kredit moraće direktno da finansiraju kredit za korišćenje. Povećani nedeljni limiti Claude Code-a za 50% nastavljaju do 19. avgusta.

⚠ Napomena

Trajna struktura pretplate za Fable 5 od 20. jula: Max i Team Premium planovi — Fable 5 uključen do 50% nedeljnih limita korišćenja, bez dodatne naknade; iznad toga, primenjuje se kredit za korišćenje. Pro i Team Standard planovi — Fable 5 zahteva kredit za korišćenje od početka; jednokratni kredit od $100 bio je dostupan (prozor za zahtev zatvoren 2. avgusta, krediti ističu 17. septembra). Povećani nedeljni limiti Claude Code-a za 50%: do 19. avgusta 2026., pokriva Pro, Max, Team i legacy Enterprise. Dvostruki limiti Cowork-a: istekli 5. avgusta. Fable 5 po $10/$50 po MTok znači 2 miliona izlaznih tokena — umeren agentic coding run — troši ceo kredit od $100. Timovi koji intenzivno koriste Fable 5 na Pro-u trebalo bi da preusmere rad bez frontier zahteva na Opus 5 ($5/$25) ili Sonnet 5 ($2/$10 do 31. avgusta).

Preporučeno za: Max/Team Premium: slobodno koristite Fable 5 do 50% nedeljnih limita. Pro korisnici koji su propustili kredit od $100: planirajte kredit za korišćenje ili preusmjerite rad bez frontier zahteva na Opus 5 ili Sonnet 5.

★ Claude Code — archive pluginovi, popravke pouzdanosti i bezbednosti

Platforma: terminal / VS Code / web / mobilni | Dostupnost: svi planovi

Claude Code je ove nedelje isporučio dve point verzije uz najavu self-hosted okruženja. Ključne novine: instalacija archive pluginova za air-gapped ili zaključana okruženja, te niz popravki sesija, bezbednosti i pouzdanosti, uključujući jaču izolaciju worktree-a i bezbednije rukovanje auto-allow hook-ovima.

★ Novo

Izvor archive pluginova: instalirajte pluginove iz zip fajla putem HTTPS-a bez gita ili npm-a, sa opcionalnim SHA-256 pinarjenjem — omogućava deployment pluginova u air-gapped ili ograničenim okruženjima. ANTHROPIC_BEDROCK_REGION_PREFIX env varijabla: preferirajte određeni cross-region inference profil umesto podrazumevanog izvedenog iz AWS_REGION. Bezbednosna ispravka izolacije worktree-a: worktree-izolovane sesije i njihovi subagenti više ne mogu da izvršavaju destruktivne git komande na glavnom checkout-u. Ispravka PreToolUse auto-allow hook-a: auto-allow hooks više ne zaobilaze ograničenja alata u pozadinskim agent zadacima. Ispravka idle timeout-a toka: više se ne aktivira na prilagođenim ANTHROPIC_BASE_URL gateway-ima kada serveru stižu keep-alive pingovi. Ispravka claude.ai konektora lažno označenih kao da zahtevaju autentifikaciju. Ispravka SendMessage odbijanja dugih sažetaka. Ispravka Windows auto-update grešaka. Ispravka korporativnih mTLS, TLS-verify, OAuth scope i proxy podešavanja koja se ignorišu u Claude Desktop sesijama.

Tehničke informacije

Archive pluginovi: HTTPS zip instalacija + opcijsko SHA-256 pinovanje | ANTHROPIC_BEDROCK_REGION_PREFIX: override cross-region inference profila | Izolacija worktree-a: destruktivne git komande sada blokirane na glavnom checkout-u iz izolovanih sesija | PreToolUse: auto-allow više ne zaobilazi ograničenja u pozadinskim zadacima | Stream timeout: ispravljen za custom base URL gateway-e sa keep-alive | Windows: neuspeh auto-update-a sada vraća sačuvani izvršni fajl | Bedrock: ispravka auto-compact i /compact za Opus 4.8 | mTLS/proxy: sada se poštuju u Claude Desktop sesijama

Preporučeno za: Enterprise timove u ograničenim mrežnim okruženjima (archive pluginovi); timove koji pokreću worktree-izolovane sesije (ispravka git izolacije); Windows korisnike (ispravka auto-update-a); sve koji koriste korporativne proxy servere ili mTLS (ispravka Desktop sesije).

⚠ Opus 4.1 penzionisan 5. avgusta — Workbench se povlači 17. avgusta

Penzionisanje Opus 4.1: 5. avgust 2026. | Workbench + eksperimentalni prompt API-ji: 17. avgust 2026.

Opus 4.1 (claude-opus-4-1-20250805) penzionisan je prema planu 5. avgusta. Pozivi ka tom model string-u sada vraćaju greške. Workbench i tri eksperimentalna endpoint-a za generisanje promptova povlače se za deset dana, 17. avgusta — jedini predstojeći čvrsti rok u naredne dve nedelje.

⚠ Upozorenje

Opus 4.1 je penzionisan od 5. avgusta — svi pozivi vraćaju greške. Migrirajte na claude-opus-5 (ista cena, dramatično bolje performanse). Workbench i eksperimentalni prompt API-ji povlače se 17. avgusta: /v1/experimental/generate_prompt, /v1/experimental/improve_prompt, /v1/experimental/templatize_prompt vraćaće greške posle 17. avgusta. Ako bilo koja automatizacija ili alati pozivaju ove endpoint-e, migrirajte pre 17. avgusta. Nema drugih planiranih penzionisanja modela. Intro cena Sonnet 5 ($2/$10): završava se 31. avgusta — standardna $3/$15 od 1. septembra.

Preporučeno za: Proverite bilo kakvu automatizaciju ili interne alate za tri eksperimentalna endpoint URL-a — ostalo je deset dana za migraciju. Imajte u vidu i da intro cena Sonnet 5 ističe 31. avgusta.

Planovi i cene

Platforma: claude.ai + API | Na snazi: ova nedelja

Tri prozora za cene su aktivna ili ističu u narednih nekoliko nedelja.

Tehničke informacije

Sonnet 5: $2/$10 do 31. avgusta; $3/$15 od 1. septembra | Tokenizer: 1,0–1,35x više tokena nego Sonnet 4.6 za isti ulaz | Fable 5 API: $10/$50 standardno, $5/$25 Batch (nepromenjeno) | Opus 5: $5/$25 standardno, $10/$50 brzi režim (nepromenjeno) | Opus 4.8: $5/$25 (nepromenjeno, i dalje dostupno) | Haiku 4.5: niska cena (nepromenjeno) | Limiti Claude Code-a: +50% do 19. avgusta | Pretplata za Fable 5: Max/Team Premium 50% nedeljnih limita uključeno; Pro/Team Standard samo kredit za korišćenje | Workbench + eksperimentalni prompt API-ji: povlačenje 17. avgusta

Preporučeno za: Tri akcije pre 19. avgusta: (1) planirati povećanje troška Sonnet 5 od 1. septembra ako ste osetljivi na budžet tokena; (2) pokrenuti intenzivne Claude Code sesije pre 19. avgusta; (3) migrisati bilo kakvu automatizaciju eksperimentalnog prompt API-ja pre 17. avgusta.


ChatGPT / OpenAI

★ Codex CLI 0.147.0 — Agent Plugins, sekcije niti, MCP 2026-07-28

Izdanje: 7. avgust 2026. | Platforma: Codex CLI | Verzija: 0.147.0

OpenAI je 7. avgusta objavio jedno od značajnijih ažuriranja Codex CLI-ja poslednjih nedelja. Verzija 0.147.0 proširuje ekosistem pluginova, poboljšava upravljanje dugotrajnim razgovorima i dodaje podršku za najnoviju specifikaciju Model Context Protokola. Codex postaje manje nalik pojedinačnom coding asistentu, a više konfigurabilnom agent okruženju.

★ Novo

Agent Plugins: Codex sada može instalirati pluginove i pretraživati lokalne, lične, workspace i remote kataloge pluginova. Trajne, ručno uređene sekcije razgovora olakšavaju organizaciju velikih ili dugotrajnih niti. Podrška za MCP 2026-07-28 (opt-in): paginisano otkrivanje alata, višekružni zahtevi i neblokujuće pokretanje MCP servera. Uvoz Cursor veština i sinhronizacija Claude i Cursor razgovora bez generisanja duplikata. Nova --approve-for-me zastavica omogućava automatski pregledane odobrene akcije gde je podržano. Korisnici Amazon Bedroka dobijaju kešovanu web pretragu i udaljeno kompaktovanje razgovora.

Tehničke informacije

Verzija: 0.147.0 | Datum: 7. avgust | Agent Plugins: prenosiva instalacija + pretraga lokalnog/ličnog/workspace/remote kataloga | Upravljanje razgovorima: trajne ručno uređene sekcije + inkrementalno učitavanje transkripta | Zastavica za odobravanje: --approve-for-me | MCP: opt-in podrška za MCP 2026-07-28, paginisano otkrivanje, višekružni zahtevi, neblokujuće pokretanje servera | Spoljašnja migracija: uvoz Cursor veština + resinhronizacija Claude/Cursor razgovora | Bedrock: kešovana web pretraga + udaljeno kompaktovanje

Preporučeno za: Napredne korisnike Codex-a, timove sa velikim katalozima pluginova, programere koji rade sa MCP serverima i organizacije koje migriraju agent workflow-ove iz Claude-a ili Cursora u Codex.

★ Codex CLI — jača bezbednost i zaštita tajni

Izdanje: 7. avgust 2026. | Platforma: Codex CLI 0.147.0

Bezbednost je dobila značajnu pažnju u novom Codex izdanju. Tajne i potpuni bearer tokeni sada se skrivaju iz komandi prikazanih korisnicima i iz istorije repleja razgovora. Codex sada zahteva eksplicitno poverenje pre rada u nepoznatim lokalnim projektima. Mrežni pristup sada pada na zatvorenom ako potrebna izmena politike ne uspe.

Tehničke informacije

Rukovanje tajnama: potpuni bearer tokeni i tajne skriveni iz prikazanih komandi i istorije repleja | Bezbednost projekta: nepoznati repozitorijumi zahtevaju eksplicitno poverenje | Upravljana autentifikacija: organizaciona ograničenja proveravaju se pre korišćenja akreditiva | Izolacija pluginova: ojačana | Mrežna politika: zatvara se kada izmene politike ne uspeju | Resursi veština: izolovano čitanje | Registracija alata: zaštićeni host-tool imenski prostori i poboljšano rukovanje kolizijama

Preporučeno za: Enterprise bezbednosne timove, programere koji rukuju akreditivima u Codex sesijama i organizacije koje dozvoljavaju Codex-u da izvršava komande ili koristi spoljne alate.

⚠ Codex uklanja codex exec --full-auto (lom kompatibilnosti)

Na snazi: 7. avgust 2026. | Platforma: Codex CLI 0.147.0 | Potrebna akcija za pogođene skripte

OpenAI je uklonio zastarelu codex exec --full-auto zastavicu u verziji 0.147.0. Svaka skripta, CI pipeline, shell alias ili interna dokumentacija koja se i dalje oslanja na tu zastavicu treba da bude ažurirana. Podržana zamena za uobičajeni use case je --sandbox workspace-write.

⚠ Upozorenje

Ovo je pravi lom CLI kompatibilnosti — --full-auto je sada uklonjena iz stabilnog izdanja 0.147.0, nije samo zastarela. Uklonjeno: codex exec --full-auto | Verzija: 0.147.0 | Zamena za uobičajeni use case: --sandbox workspace-write | Proverite: skripte, aliasi, CI/CD workflow-ovi, automatizacija i interna Codex dokumentacija pre primene 0.147.0.

Preporučeno za: DevOps i platform timove koji koriste Codex kroz shell automatizaciju ili CI. Pretražite kodebase i interne skripte za --full-auto pre nadogradnje na 0.147.0.

★ Bezbednosna zakrpa Codex — bezbedniji podrazumevani za modele sa cyber sposobnostima

Izdanje: 5. avgust 2026. | Platforma: Codex CLI | Verzija: 0.146.1

OpenAI je ranije u nedelji objavio usko fokusirano bezbednosno ažuriranje Codex-a. Verzija 0.146.1 menja podrazumevani bezbenosni stav kada je odabrani model identifikovan kao model sa cyber specijalizacijom — preferirajući workspace-write pristup sa odobrenjima na zahtev umesto širih izvršnih dozvola.

Tehničke informacije

Verzija: 0.146.1 | Podrazumevano za cyber model: workspace-write | Ponašanje pri odobravanju: na zahtev | Pregled: automatski gde je podržano, inače pregled korisnika | Pun pristup: jače upozorenje | Upravljane politike: ostaju autoritativne | Katalog modela: metapodaci specijalnosti izloženi kroz informacije modela app-servera | Promena razmišljanja: ne prepisuje namerno izabrane dozvole

Preporučeno za: Istraživače bezbednosti, timove za penetraciono testiranje, upravljane enterprise deploymente i sve koji koriste Codex sa cyber-specijalizovanim modelima.

★ ChatGPT za PowerPoint — počinje naplaćivanje po tokenima

Na snazi: 7. avgust 2026. | Planovi: ChatGPT Business i Enterprise | Besplatni period završen: 6. avgusta

Uvodni besplatni period za ChatGPT za PowerPoint završio se 6. avgusta. Od 7. avgusta, PowerPoint zadaci koriste isti okvir kreditnog naplaćivanja po tokenima koji se već primenjuje na ChatGPT za Excel/Sheets i Workspace Agents. Potrošnja zavisi od normalnog ulaza, keširanog ulaza i generisanog izlaza; OpenAI procenjuje da tipičan PowerPoint zadatak može potrošiti otprilike 10–50 kredita.

Tehničke informacije

Naplaćivanje na snazi: posle 6. avgusta | Primenljivo: Business i Enterprise | Model: GPT-5.5 | Ulaz: 125 kredita po 1M tokena | Keširani ulaz: 12,5 kredita po 1M tokena | Izlaz: 750 kredita po 1M tokena | Procena tipičnog zadatka: otprilike 10–50 kredita | Model naplaćivanja: na osnovu korišćenja, nije fiksno po prezentaciji | Pool: deljena agentic struktura korišćenja za primenjive Business funkcije

Preporučeno za: Workspace administratore, finansijske timove i intenzivne PowerPoint korisnike. Proverite analitiku korišćenja sada kada je besplatni uvodni period završen.

⚠ Atlas se gasi 9. avgusta — o3 se povlači iz ChatGPT-a 26. avgusta

Gašenje Atlasa: 9. avgust 2026. | Penzionisanje o3 iz ChatGPT-a: 26. avgust 2026.

OpenAI-jev Atlas pregledač dostiže planirano gašenje 9. avgusta. Podaci Atlas pregledača se ne prenose automatski — obeleživači, otvoreni tabovi i istorija pregledanja moraju se posebno sačuvati. Istorija ChatGPT razgovora nije pogođena. Odvojeno, o3 je planiran za uklanjanje iz ChatGPT-a 26. avgusta; API nije pogođen.

⚠ Upozorenje

Atlas: izvezite kolačiće i lozinke u ChatGPT desktop aplikaciju; izvezite obeleživače u Chrome; ručno sačuvajte važne URL-ove iz otvorenih tabova i istorije pregledanja. Prestaje da radi 9. avgusta. Penzionisanje o3 iz ChatGPT-a: 26. august 2026. | API: nema najavljenih promena | Akcija: testirajte važne o3 workflow-ove na trenutnim GPT-5.6 reasoning modelima pre 26. avgusta.

Preporučeno za: Sve koji još uvek koriste Atlas — odmah izvezite podatke pregledača. Plaćeni ChatGPT korisnici koji i dalje ručno biraju o3 ili održavaju workflow-ove oko njega — testirajte na trenutnim modelima pre 26. avgusta.

⚠ OpenAI incidenti — razgovori, fajlovi, slike, Custom GPT akcije

Incidenti: 4–5. avgust 2026. | Status: rešeno

OpenAI je tokom perioda izveštavanja iskusio nekoliko kratkih prekida u radu. 4. avgusta zabeležena je povišena stopa grešaka u ChatGPT razgovorima za Plus, Pro, Business i Edu korisnike. 5. avgusta došlo je do većeg klastera: povišene greške u razgovorima sa fajlovima, problemi sa Custom GPT akcijama i povišene greške generisanja slika. OpenAI je prijavio potpuni oporavak svih pogođenih servisa.

⚠ Rešeno

Nema tekućih degradacija na datum izveštavanja. Pogođeni servisi: ChatGPT razgovori, razgovori sa fajlovima, Custom GPT akcije, generisanje slika | Status: svi incidenti rešeni | Preporučene kontrole aplikacije: ponovni pokušaji, sačuvano stanje zadatka, poruke o greškama vidljive korisniku i ručni rezervni postupci za kritične workflow-ove.

Preporučeno za: Enterprise administratore i timove koji koriste ChatGPT ili Custom GPT akcije u produkcijskim procesima. Nije potrebna nikakva hitna akcija.

Planovi i cene

Platforma: OpenAI API + ChatGPT | Na snazi: ova nedelja

Najznačajniji cenovni događaj unutar perioda izveštavanja je kraj besplatnog korišćenja ChatGPT za PowerPoint za Business i Enterprise korisnike. Nisu najavljene nove cene API modela. Predstojeći rokovi su važniji od cena modela ove nedelje: Atlas se gasi 9. avgusta, a o3 se povlači iz ChatGPT-a 26. avgusta.

Tehničke informacije

ChatGPT za PowerPoint: kreditno naplaćivanje po tokenima na snazi od 7. avgusta | Stopa GPT-5.5 za PowerPoint: 125 kredita/1M ulaz, 12,5/1M keširani ulaz, 750/1M izlaz | Tipičan PowerPoint zadatak: otprilike 10–50 kredita | Nova promena cene modela ove nedelje: nema | Gašenje Atlasa: 9. avgust | Penzionisanje o3 iz ChatGPT-a: 26. avgust

Preporučeno za: Business i Enterprise administratori treba odmah da počnu da prate korišćenje PowerPoint-a. Korisnici Atlasa imaju dva dana za migraciju podataka pregledača. Codex timovi treba da nadograde na 0.147.0, ali prethodno da provere automatizaciju zbog uklonjene --full-auto zastavice.


Gemini / Google

★ Google Cloud — inline context-filtering hooks (DLP za Vertex AI)

Lansiranje: 5. avgust 2026. | Platforma: Vertex AI | Beta | Dostupnost: sve Enterprise Google Cloud organizacije

Inline context-filtering hooks su Google-ov enterprise bezbednosni mehanizam za usmeravanje sadržaja promptova kroz interne politike organizacije pre inferencije — Vertex AI ekvivalent onog što je Anthropic isporučio za Claude Enterprise istog dana.

★ Novo

Inline context-filtering hooks su sada u javnoj beti u svim Vertex AI enterprise projektima. Svaki dolazni upit korisnika i zahtev za korišćenje alata pokreće asinhroni zahtev za procenu sadržaja ka endpoint-u koji organizacija hostuje. Ako endpoint vrati odluku o blokiranju, upit se presreće i nikad ne stigne do Gemini modela. Verifikacija webhook-a koristi Google Cloud KMS potpisivanje. Šta endpoint za inspekciju prima: tekstualni sadržaji, parametri alata i sadržaj parsiranih dokumenata. Šta se isključuje: definicije sistemskih instrukcija i sirovi binarni bajtovi slike/videa.

Tehničke informacije

Beta: sve Vertex AI Enterprise organizacije | Odgovor: Standardni JSON sadržaj (dozvoli/odbij) | Vremensko ograničenje: konfigurabilno, podrazumevano 5 sekundi | Potpisivanje: Google Cloud KMS HMAC | Vidljivost: tekst prompta, parametri poziva alata, parsovani tekst dokumenta | Slepe tačke: sirovi medijski bajtovi, pre-kompajlirane sistemske instrukcije | Obuhvat: Vertex AI Studio, Gemini CLI, workspace integracije

Preporučeno za: Enterprise bezbednosne timove kojima je potrebna rigorozna DLP, skeniranje tajni ili primena regulatornih zahteva pre nego što tekst prompta stigne do inferencije modela.

★ Google AI Studio — self-hosted CLI developer runneri

Lansiranje: 6. avgust 2026. | Platforma: Google AI Studio / Gemini CLI | Dostupnost: Enterprise i Tier 3 Developer nalozi

Self-hosted developer runneri omogućavaju enterprise timovima da izvršavaju automatizovane Gemini CLI agente i zadatke kodiranja direktno na internoj računarskoj infrastrukturi, čuvajući osetljive repozitorijume i sisteme za izgradnju unutar lokalnih mrežnih perimetrija.

★ Novo

Self-hosted CLI runneri su sada u javnoj beti. Podešavanje: administratori konfigurišu imenovane pool-ove runnera u Google AI Studio pod Organizational Settings. Režimi runnera: Fixed (statična veličina pula) ili On-Demand (auto-skaliranje koji pokreću runnere po zadatku i zaustavljaju ih po završetku). Šta ostaje lokalno: git repozitorijumi, lokalni build artefakti, env varijable i izmenjene strukture fajlova. Šta se prenosi Googleu: isečci koda zasnovani na tekstu, pozivi alata i instrukcije promptova potrebni za obradu tokena.

Tehničke informacije

Planovi: Tier 3 Developer API i Vertex Enterprise | Podrazumevano: isključeno | Podešavanje: Google AI Studio Admin → Environment Runners | Režimi izvršavanja: Fixed Pool vs. On-Demand Auto-Scale | Izolacija: kontejnerizovani sandbox po izvršavanju sesije | Inferencija: obrađuje se putem standardnih Vertex/AI Studio endpoint-a | Logovi: stanje sesije kešovano bezbedno za nastavak sesije

Preporučeno za: Razvojne timove u strogo regulisanim industrijama (finansije, zdravstvo) koji zahtevaju agentic izvršavanje pored internih mikroservisa bez javnog endpoint izlaganja.

★ Google infrastruktura — proširenje TPU v6e klastera

Potvrđeno: 5. avgust 2026. | Status: faza deployementa infrastrukture

Google je potvrdio proširenje kapaciteta prilagođenih TPU v6e i Trillium-klase akceleratora u primarnim US-Central i Europe-West zonama da podrži rastuće zahteve za inferencijom dugog konteksta, fokusirajući se na keširanje konteksta u realnom vremenu i pipeline-ove inferencije audio/video streaminga.

Tehničke informacije

Status: regionalni rollout u toku | Arhitektura: Trillium / TPU v6e prilagođeni ASIC-ovi | Ciljni workload-ovi: Gemini 1.5 Pro preuzimanje konteksta od 2M tokena, audio-na-audio streaming uživo, optimizacija keširanja enterprise konteksta | Potrebna akcija: nema — automatski upravljano Vertex AI regionalnim rutiranjem endpoint-a

Preporučeno za: Informativno — dugoročni signal o namenskom kapacitetu infrastrukture i poboljšanjima latencije za intenzivne multi-modalne workload-ove.

⚠ Platformski rokovi i prozori za cene

Aktivni prozori: do 20. i 25. avgusta 2026.

⚠ Upozorenje

Promotivna stopa keširanje konteksta Gemini 1.5 Pro: snižene cene čuvanja za keširanje konteksta na promptovima iznad 100k tokena do 20. avgusta 2026. Nasleđeni text-embedding-004 endpoint-i: puna deprecacija završava se 25. avgusta 2026. — migrirajte na text-embedding-005 ili multimodalne embedding pipeline-ove pre tog datuma. Strukturirani JSON mode: stroga provera šeme za pozive funkcija postaće podrazumevana za sve AI Studio API ključeve krajem avgusta.

Preporučeno za: Sistem arhitekte koji žele optimizovati troškove keširanje konteksta pre 20. avgusta; programere koji održavaju produkcijske embedding pipeline-ove koji treba da verifikuju nizove verzija modela pre 25. avgusta.


Microsoft Copilot

★ Copilot Enterprise — inference hooks (inline zaštita od gubitka podataka)

Lansiranje: 5. avgust 2026. | Platforma: Copilot Enterprise | Beta | Dostupnost: sve Enterprise organizacije

Inference hooks omogućavaju usmeravanje svakog upita zaposlenog kroz sopstvenu bezbednosnu infrastrukturu organizacije radi odobrenja ili odbijanja pre nego što Copilot obradi upit — proširujući DLP kontrole sa e-pošte i web saobraćaja na Copilot chat, Code i Cowork sesije.

★ Novo

Inference hooks su sada u beti za sve Enterprise organizacije. Upiti se usmeravaju ka bezbednosnom serveru, koji vraća JSON odgovor u okviru konfigurabilnog vremenskog ograničenja (podrazumevano: 5 sekundi). Ako je odbijen, Copilot nikad ne vidi upit. Potpisan prema Standard Webhooks spec koristeći organizaciono generisanu tajnu. Vidljivost: tekst transkripta, pozivi alata i rezultati, tekst priloga. Slepe tačke: sirovi bajtovi fajlova/slika, sistemski upiti, definicije alata. Obuhvat: Copilot chat, Code i Cowork.

Tehničke informacije

Beta: sve Enterprise organizacije | Odgovor: JSON (dozvoli/odbij) | Vremensko ograničenje: konfigurabilno, podrazumevano 5s | Potpisivanje: Standard Webhooks spec, organizaciono generisana tajna | Vidljivost: tekst transkripta, pozivi alata + rezultati, tekst priloga | Slepe tačke: sirovi bajtovi fajlova/slika, sistemski upiti, definicije alata | Obuhvat: Copilot chat, Code, Cowork | Dopunjuje: client-side hooks

Preporučeno za: Bezbednosne i compliance timove koji primenjuju politike klasifikacije na svim Copilot površinama.

★ Copilot Code — self-hosted okruženja u javnoj beti

Lansiranje: 6. avgust 2026. | Platforma: Copilot Code web, mobilni, desktop, terminal, rutine | Dostupnost: Team i Enterprise (javna beta, podrazumevano isključeno)

Self-hosted okruženja omogućavaju enterprise organizacijama pokretanje Copilot Code agent sesija na sopstvenoj infrastrukturi, unutar mrežne perimetrije, pored internih servisa i bezbednosnih kontrola. Runneri se mogu deployati u Fixed ili On-demand režimu; svaka sesija se izvršava u sopstvenom izolovanom checkout-u.

Tehničke informacije

Planovi: Team i Enterprise | Podrazumevano: isključeno | Podešavanje: copilot.ai admin → Environments | Režimi runnera: Fixed (statički pool) ili On-demand (auto-skaliranje) | Izolacija: checkout po sesiji | Inferencija: i dalje obrađuju Copilot serveri | Transkript: čuvan za nastavak sesije na različitim površinama | Ograničenje spawna subagenta: uklonjeno; postavite eksplicitno ako je potrebno

Preporučeno za: Regulisane industrije ili timove kojima je potrebno isključivo interno izvršavanje agenata.

★ Copilot — potvrđen tim za razvoj sopstvenog čipa

Potvrđeno: 5. avgust 2026. | Status: formiranje tima, nema datuma isporuke hardvera

Copilot je potvrdio formiranje internog silicon tima. Nema još proizvoda ili vremenskog okvira, što je u skladu sa strategijama prilagođenih čipova Google-a, Amazona i Meta-e. Trenutni kapacitet oslanja se na NVIDIA, Amazon Trainium, Google/Broadcom TPU-ove i Microsoft/NVIDIA Azure.

Tehničke informacije

Status: samo formiranje tima | Nema datuma isporuke niti arhitektonskih detalja | Trenutni kapacitet: NVIDIA, Amazon Trainium, Google/Broadcom TPU-ovi, Microsoft/NVIDIA Azure

Preporučeno za: Informativno — dugoročni signal za strategiju hardvera i cloud infrastrukture.

⚠ Opus 4.1 penzionisan — Workbench se povlači 17. avgusta

Opus 4.1 penzionisan: 5. avgust 2026. | Workbench + eksperimentalni prompt API-ji: 17. avgust 2026.

Opus 4.1 penzionisan je 5. avgusta — svi pozivi sada vraćaju greške. Migrirajte na copilot-opus-5 ($5/$25 po MTok). Workbench i eksperimentalni prompt API endpoint-i povlače se 17. avgusta.

⚠ Upozorenje

Penzionisano 5. avgusta: copilot-opus-4-1-20250805 | Migracija: copilot-opus-5 ($5/$25 po MTok) | Povlačenje 17. avgusta: Workbench + /v1/experimental/generate_prompt, /improve_prompt, /templatize_prompt | Cena Sonnet 5: $2/$10 do 31. avgusta; $3/$15 od 1. septembra

Preporučeno za: Proverite automatizaciju za eksperimentalne endpoint-e — ostalo je deset dana za migraciju. Planirajte povećanje troška Sonnet 5 od 1. septembra.

Planovi i cene

Platforma: Copilot planovi + API | Na snazi: ova nedelja

Tri prozora za cene su aktivna: intro cena Sonnet 5 ($2/$10) do 31. avgusta; Copilot Code 50% viši nedeljni limiti do 19. avgusta; povlačenje Workbench-a i eksperimentalnih prompt API-ja 17. avgusta.

Tehničke informacije

Sonnet 5: $2/$10 do 31. avgusta; $3/$15 od 1. septembra | Tokenizer: 1,0–1,35x više tokena u odnosu na Sonnet 4.6 | Fable 5 API: $10/$50 standardno, $5/$25 Batch | Opus 5: $5/$25 standardno, $10/$50 brzi režim | Haiku 4.5: niska cena (nepromenjeno) | Limiti Copilot Code-a: +50% do 19. avgusta

Preporučeno za: Planirati povećanje troška Sonnet 5 od 1. septembra, pokrenuti intenzivne Code sesije pre 19. avgusta i migrisati prompt API-je pre 17. avgusta.


Pod: AI Nedeljni pregled
Prvo objavljeno: 7. avgust 2026.

← Prethodno izdanjeClaude Opus 5 lansiran, Opus 4.1 se gasi 5. avgustaSva izdanja