AI Vesti | Opšte vesti
Anthropic je objavio Claude Opus 5.5 model koji izaziva OpenAI-jeve modele GPT-6 Sol i GPT-6 Luna
Veštačka inteligencija je ove nedelje pojeftinila, ali testovi otkrivaju složeniju priču. OpenAI i Anthropic predstavili su modele čija vrednost zavisi od zadatka. Alibaba je najavila čip za narednu generaciju svojih modela, dok je Anthropicov AI pomogao da se otkrije biološki sistem čiju funkciju naučnici još ne znaju. Vlade u međuvremenu postavljaju pitanje ko treba da proverava najmoćnije modele pre nego što stignu do korisnika.
24. septembar 2026.
klarapelhe.rs/ai-news
Anthropic je objavio Claude Opus 5.5 model koji izaziva OpenAI-jeve modele GPT-6 Sol i GPT-6 Luna
Ključne poruke
- OpenAI je prepolovio cene API tokena za nove modele GPT-6 Sol i Luna; nezavisna ispitivanja potvrđuju uštedu, ali pokazuju neujednačene promene u kvalitetu.
- Anthropic je predstavio Claude Opus 5.5 po nižoj ceni, uz bolje rezultate na nezavisnim proverama; METR nalazi umeren, a ne dramatičan napredak u sposobnosti modela za istraživanje VI.
- Alibaba je najavila novi akcelerator i veće buduće modele Qwen, dok je Anthropic prijavio otkriće biološkog sistema čija funkcija još nije utvrđena.
- Lideri iz Evrope i drugih regiona pozvali su na nezavisno testiranje najmoćnijih modela i razmatranje međunarodnog nadzornog tela; njihova izjava ne uvodi obavezujuća pravila.
OpenAI je objavio nove modele GPT-6 Sol i Luna koji koštaju manje od Astre
OpenAI je objavio GPT-6 Sol i Luna kao jeftinije članove porodice GPT-6, čiji je vodeći model Astra predstavljen ranije ovog meseca. API cena modela Sol iznosi dva dolara za milion ulaznih i deset dolara za milion izlaznih tokena; za Lunu su odgovarajuće cene 0,10 i 0,50 dolara. To je približno polovina prethodnih cena za GPT-5.6 Sol i Lunaq modele. OpenAI navodi da je koristio metode obuke srodne Astrinim i da su poboljšanja u programiranju, radu na računaru i pouzdanosti činjenica preneta u pristupačnije modele. ((Oba su dostupna kroz API, kao i u ChatGPT Work i Codex okruženju za korisnike plaćenih paketa(()); korisnici besplatnog i Go paketa dobijaju Lunu u desktop aplikaciji. Uvođenje je najavljeno kao postepeno i eksperimentalnoSa druge str.¹
Za development i marketing timove sniženje cene je jasno, ali promena sposobnosti zavisi od samog posla. Artificial Analysis je modele proverio u sopstvenom okruženju i našao da su ukupni rezultati na indeksima inteligencije i programerskih agenata uglavnom ostali na nivou prethodnih modela GPT-5.6. Sol je na indeksu programerskih agenata, pri najvišem nivou razmišljanja, dobio dva poena, a Luna izgubila dva. Izmereni trošak po zadatku na indeksu inteligencije pao je sa 1,99 na 1,06 dolara za Sol i sa 0,18 na 0,07 dolara za Lunu. To su troškovi konkretnog testa, a ne obećanje o računima svake aplikacije.²
Ispitivanje je otkrilo kompromis koji zbirni rezultat prikriva. U proveri znanja Sol je ređe halucinirao delom zato što je češće odbijao da odgovori: udeo pitanja na koja je pokušao da odgovori pao je sa 99 na 83 odsto, a tačnost na tom testu za pet procentnih poena. Oba nova modela ostvarila su slabiji rezultat i u proveri profesionalnih zadataka, gde su kraći odgovori češće izostavljali tražene delove. OpenAI ističe uspehe na svojim testovima agenata i programiranja, ali se uslovi tih testova, uključujući alate i nivo razmišljanja, mogu razlikovati od rada korisničkih sistema.¹,²
Tim koji obrađuje veliki broj jasno određenih zadataka sada može da ispita jedan isti postupak po nižoj ceni tokena. Za poslove u kojima su presudni temeljnost odgovora i dug rad sa alatima treba meriti stvarne izlaze, greške i trošak po uspešno obavljenom zadatku. Suština ovog izdanja je niža cena uz neujednačenu promenu kvaliteta, a ne ujednačen napredak na svakom poslu.²
Anthropic je predstavio Claude Opus 5.5 koji spaja niže cene i bolje rezultate
Anthropic je predstavio Claude Opus 5.5, prvi model iz nove serije, po ceni od četiri dolara za milion ulaznih i 20 dolara za milion izlaznih tokena, umesto pet i 25 dolara za Opus 5. Čitanje keširanog ulaza pojeftinilo je sa 0,50 na 0,20 dolara za milion tokena. Kompanija tvrdi da manja potrošnja tokena u tipičnim zadacima spušta ukupan trošak za oko 40 odsto i da model ispisuje odgovor više od 30 odsto brže. Povećana su i petočasovna ograničenja korišćenja za nekoliko pretplatničkih paketa. Ušteda kod pojedinačnih korisnika zavisiće od udela keširanog ulaza, dužine izlaza i broja ponovljenih pokušaja.³
Nezavisna merenja potvrđuju važan pomak, ali pokazuju i njegove granice. Artificial Analysis je Opus 5.5 na najvišem nivou razmišljanja stavio na prvo mesto svog indeksa inteligencije, sa rezultatom 58; prednjačio je na šest od deset sastavnih provera. Na testu profesionalnog rada AA-Briefcase dostigao je 1.822 Elo poena, 143 više od modela Claude Fable 5.1. Isti evaluator je, međutim, izmerio oko 119.000 izlaznih tokena po zadatku, naspram oko 73.000 kod modela Opus 5. Zato niža cena po tokenu ne donosi nužno istu uštedu za svaku vrstu posla.⁴
Anthropic posebno naglašava dugotrajne programerske zadatke i navodi da izdanje uključuje proveru radnji pre izvršavanja, izolovano okruženje koje se može pregledati i snažniju otpornost na zlonamerna uputstva ubačena u sadržaj. U internom ogledu prevođenja programa HAProxy u drugi programski jezik Opus 5.5 je završio posao brže i jeftinije od modela Fable 5.1, dok su oba rešenja prošla gotovo sve regresione testove projekta. To je primer koji je sprovela sama kompanija, ne dokaz da je rad bez nadzora bezbedan u svakom programskom projektu.³
Sa druge strane, METR, koji je model procenjivao pre objavljivanja, izveo je uži zaključak o njegovoj sposobnosti da ubrza istraživanje. Ova organizacija smatra da je napredak u odnosu na Fable 5.1 verovatno umeren i da nema dokaza o velikom skoku u istraživačkom prosuđivanju potrebnom za potpuno autonoman rad. Uočila je i slabosti u teškim, dugotrajnim zadacima. METR je procenu sproveo po neplaćenom sporazumu; Anthropic je mogao da pregleda i menja sažetak, a METR je odobrio konačni tekst.⁵ Za organizacije koje koriste agente, Opus 5.5 je ozbiljan kandidat za zahtevne poslove, ali odluku treba zasnovati na proveri vlastitih zadataka i zaštiti od teško povratnih radnji.
Alibaba je prezentovao novi čip dok je obučavao Qwen 4 model
Na konferenciji Apsara u Hangdžouu kompanija Alibaba je saopštila da je obuka modela Qwen 4 u toku, a da za buduće serije Qwen 4.5 i Qwen 5 planira između pet i deset biliona parametara. Predstavila je i Zhenwu V900, akcelerator svoje jedinice T-Head namenjen obuci i izvođenju već obučenih modela. Prema kompaniji, V900 ima trostruko veće performanse od modela M890 iz maja, 216 GB memorije i međučipni protok od 1.200 GB u sekundi. Masovna proizvodnja i komercijalna prodaja predviđene su za prvi kvartal 2027. Sve navedene specifikacije i poređenja potiču od kompanije; čip još nije široko dostupan proizvod sa nezavisno potvrđenim učinkom.⁶
Najava povezuje razvoj modela sa domaćom računarskom infrastrukturom. Alibaba kaže da postojeći Zhenwu čipovi opslužuju više od 650 klijenata, a da novi sistem povezanih servera može da podrži klastere do 500.000 kartica. Postavila je i cilj da kapacitet njenih centara podataka širom sveta do 2032. pređe 20 gigavata. Ni planirana veličina modela ni cilj za infrastrukturu ne dokazuju da će sistemi biti isporučeni na vreme. Broj parametara govori o razmeri modela, ali sam po sebi ne meri njegovu upotrebljivost.⁶
Na konferenciji je opisan i ogled u kojem je Qwen3.8-Max tokom mesec dana završio 33 automatizovana ciklusa optimizacije obuke, uz rast rezultata na indeksu Artificial Analysis sa 40 na 45. Reč je o prijavljenom internom postupku i rezultatu; javno saopštenje ne daje dovoljno podataka da bi se utvrdilo da li se dobitak prenosi na druge zadatke. Associated Press je najavu smestio u kontekst kineskog razvoja alternativa Nvidijinim čipovima pod američkim izvoznim ograničenjima. Analitičari koje je agencija konsultovala upozoravaju da sam dizajn čipa nije dovoljan bez proizvodnih kapaciteta i napretka u lancu snabdevanja.⁶,⁷
Claude je napravio značajan naučni napredak
Anthropic je saopštio da su Claude agenti, pretražujući baze DNK sekvenci, uočili neobičan sistem u bakteriofagima, virusima koji napadaju bakterije. Nalaz potiče iz nove laboratorije za biološka istraživanja, koja povezuje računarsku pretragu i eksperimente koje izvode ljudi. Kompanija ga naziva reverzne transkriptaze povezane s nizovima ponavljanja, odnosno ART. Sama reverzna transkriptaza bila je ranije poznata; prema Anthropicu, novost je prepoznavanje kombinacije enzima, susednog pomoćnog proteina i ponavljajućih sekvenci DNK.⁸
Prema kompaniji, oko 950 agenata je za 21 sat obradilo 210 miliona tokena. Pregledali su više od 200.000 reverznih transkriptaza, izdvojili oko 3.500 kandidata i suzili izbor na 20 izveštaja za detaljniju analizu. Jedan agent je zatim uočio niz ponavljanja pored neobičnog gena. Naučnici Anthropica su kandidata proverili u laboratoriji i ustanovili da se iz tog niza stvaraju različite kratke molekule RNK. Fizičke eksperimente izveli su ljudi; agenti su postavljali i istraživali hipoteze.⁸
Anthropic pominje CRISPR zato što oba sistema imaju ponavljajuće sekvence i povezane molekularne delove. Sličnost u građi ne utvrđuje funkciju ART-a. Kompanija izričito kaže da još ne zna šta taj sistem radi, a The Verge naglašava da nije pokazana nikakva praktična primena. Anthropic navodi da je objavio preprint, ali prateći tehnički izveštaj nije bio dostupan tokom ovog pregleda. Zato opis metoda i ogleda ovde počiva na javnom saopštenju kompanije, a ne na neposrednom uvidu u preprint.⁸,⁹
Međunarodni lideri traže nezavisno testiranje najmoćnijih AI modela
Izjava koju su pokrenule Finska i Norveška, a koja je 22. septembra objavljena na sajtu holandske vlade, poziva kompanije da uvedu transparentne bezbednosne protokole. Oni bi obuhvatili testiranje pre objavljivanja modela i nezavisnu procenu, uz dovoljan pristup za kvalifikovane ocenjivače. Od vlada se traže zajednički standardi i razmena podataka o ozbiljnim incidentima, dok se članicama UN predlaže da razmotre instituciju koja bi postavljala standarde i omogućavala proveru kada se pređu određeni pragovi sposobnosti. U tekstu se traži da najmoćniji modeli ostanu pod ljudskim nadzorom i u okvirima međunarodnog prava.¹⁰,¹¹
Među potpisnicima su lideri iz Evrope, Azije, Afrike, sa Bliskog istoka i iz Severne Amerike; objavljena lista uključuje predstavnike Evropske komisije, Nemačke, Kanade, Kenije, Singapura, Južne Afrike i Ujedinjenih Arapskih Emirata. Finnish AI Region navodi da je deklaracija usvojena uz zasedanje Generalne skupštine UN 21. septembra i da je nisu potpisale SAD ni Kina. Dokument ostaje otvoren za nova pristupanja.¹⁰,¹¹
Ako vlade budu sprovele ove predloge, za razvojne laboratorije spoljašnji pristup modelima, provere pre izdavanja i prijavljivanje incidenata postali bi važniji deo odluke o puštanju proizvoda. Izjava traži i da države iz svih regiona imaju naučne kapacitete i pouzdane načine provere: nadzor teško može biti ravnopravan ako samo najveće sile imaju sredstva da ispituju vodeće modele. Zasad su to predlozi. Dokument ne određuje obavezujući prag testiranja, rok, kaznu ni već uspostavljeno telo.¹⁰
Izvori
- OpenAI. Introducing GPT-6 Sol and Luna. 22. septembar 2026.
- Artificial Analysis. GPT-6 Sol and Luna push the cost efficiency frontier. 22. septembar 2026.
- Anthropic. Claude Opus 5.5. 22. septembar 2026.
- Artificial Analysis. Claude Opus 5.5 takes the top spot on the Artificial Analysis Intelligence Index. 22. septembar 2026.
- METR. Summary of METR's predeployment evaluation of Claude Opus 5.5. 22. septembar 2026.
- Alibaba Cloud. Alibaba Unveils Roadmap on Full-Stack AI Strategy from Chips, Cloud Infrastructure, Models to Agents. 22. septembar 2026.
- Chan Ho-Him. China's Alibaba unveils new powerful chip and ambitious AI model plans. 22. septembar 2026. Associated Press.
- Anthropic. Claude discovers a novel enzyme system with CRISPR-like repeats. 23. septembar 2026.
- Robert Hart. Anthropic's biolab made a discovery it's comparing to Crispr. 23. septembar 2026. The Verge.
- Vlada Holandije. A Call for Control of Frontier AI Models. 22. septembar 2026.
- Martti Asikainen. Finland and Norway lead 22-nation call for global AI oversight body, as US and China stay out. 22. septembar 2026. Finnish AI Region.