• Apgrejdovali smo forum na XenForo 2.1.1, ukoliko imate predloga vezanih za izgled ili funkcionalnost foruma, ili ukoliko naletite na neki problem, javite nam OVDE

    DEFINISALI SMO PRAVILA FORUMA. Pročitajte ih, pojaviće se automatski kada krenete da čitate nešto!

AI, Mašinsko Učenje, Duboko Učenje: Resursi, Alati i Diskusija

Cika_Kure

PCAXE Addicted
Učlanjen(a)
29.05.2024.
Poruka
2.056
Rezultat reagovanja
2.571
Moja konfiguracija
CPU & cooler:
AMD Ryzen 7 5700x 3D, ID Cooling SE-225-XT BLACK
Motherboard:
Asus TUF Gaming B550
RAM:
KINGSTON Fury 32GB (2 x 16GB) DDR4 3200MHz
VGA & cooler:
Biostar RX6700XT 12GB GDDR6
Klasični muljator. Ako si mu platio preko PP, vratićeš pare za sekund...
 
Učlanjen(a)
11.11.2017.
Poruka
863
Rezultat reagovanja
489
Moja konfiguracija
CPU & cooler:
Ryzen 9 7950x + Arctic III 360
Motherboard:
MSI B650 MAG Tomahawk Wifi
RAM:
2x32GB Kingston DDR5 6000MHz
VGA & cooler:
RTX 5090 Gigabyte Aorus Master
Display:
AOC 31.5" U32U3CV
HDD:
KC3000 2TB + 1TB + Crucial P3 500, 2 HDD od po 4TB (WD - RED i Blue) Kingston SSD 240GB
Sound:
Microlab Solo 6c+Audient ID14 MKII
Case:
Lian Li Lancool 216 argb
PSU:
FSP 1350W Platinum
Mice & keyboard:
Redragon/Logitech
Internet:
Optika
OS & Browser:
Win 11/Ubuntu
Other:
Logitech C270 Epson L386
Anthropic je devetog juna 2026. godine predstavio Claude Fable 5 kao Mythos-class model koji je prilagođen širokoj, opštoj upotrebi.
Kompanija ga opisuje kao najmoćniji Claude model koji je do tada javno ponudila, sa naročito velikom prednošću na dugim, složenim i višefaznim zadacima.
Fable 5 je, prema objavi, posebno jak u softverskom inženjerstvu, analitičkom radu, obradi vizuelnih informacija, naučnom istraživanju, dugom kontekstu i autonomnom rešavanju problema.
U ranim testovima model je prikazan kao sistem sposoban da ubrza zahtevne inženjerske i istraživačke procese, uključujući migracije velikih kodnih baza, rad sa naučnim figurama i složene zadatke iz oblasti finansija.
Međutim, Anthropic naglašava da ovakav nivo sposobnosti donosi ozbiljne rizike, naročito u oblastima sajberbezbednosti, biologije, hemije i pokušaja kopiranja sposobnosti modela.
Zbog toga Fable 5 koristi dodatne zaštitne klasifikatore koji prepoznaju potencijalno rizične zahteve i u takvim slučajevima odgovor preusmeravaju na Claude Opus 4.8.
Kompanija priznaje da su zaštite namerno podešene konzervativno, pa mogu povremeno zahvatiti i bezopasne zahteve, iako se preusmeravanje u proseku dešava u manje od pet procenata sesija.
Istovremeno je predstavljen i Claude Mythos 5, isti osnovni model kao Fable 5, ali sa uklonjenim zaštitama u određenim oblastima za ograničenu grupu poverljivih korisnika.
Mythos 5 je namenjen pre svega sajberbraniocima, infrastrukturnim partnerima i odabranim istraživačima u biomedicini, jer Anthropic smatra da njegove sposobnosti mogu značajno pomoći u zaštiti softvera i razvoju novih terapija.
Oba modela koštaju 10 dolara za milion ulaznih i 50 dolara za milion izlaznih tokena, pri čemu je Fable 5 dostupan odmah, dok Mythos 5 ostaje pod režimom strogo kontrolisanog pristupa.



 
Učlanjen(a)
11.11.2017.
Poruka
863
Rezultat reagovanja
489
Moja konfiguracija
CPU & cooler:
Ryzen 9 7950x + Arctic III 360
Motherboard:
MSI B650 MAG Tomahawk Wifi
RAM:
2x32GB Kingston DDR5 6000MHz
VGA & cooler:
RTX 5090 Gigabyte Aorus Master
Display:
AOC 31.5" U32U3CV
HDD:
KC3000 2TB + 1TB + Crucial P3 500, 2 HDD od po 4TB (WD - RED i Blue) Kingston SSD 240GB
Sound:
Microlab Solo 6c+Audient ID14 MKII
Case:
Lian Li Lancool 216 argb
PSU:
FSP 1350W Platinum
Mice & keyboard:
Redragon/Logitech
Internet:
Optika
OS & Browser:
Win 11/Ubuntu
Other:
Logitech C270 Epson L386
66746



"Ubiću dva muškarca jednim kamenom" !!!! Da li je ovo real, rođaci.... Podešen je maximalno strogo i profesionalno da odogvara. Nov chat, prva poruka. 5.5 High, Extended. Tok misli je jeziv. Da je napisao "Dve muve jednim udarcem"... ne znam da li ovakva formulacija postoji u stranim jezicima?
 

Cika_Kure

PCAXE Addicted
Učlanjen(a)
29.05.2024.
Poruka
2.056
Rezultat reagovanja
2.571
Moja konfiguracija
CPU & cooler:
AMD Ryzen 7 5700x 3D, ID Cooling SE-225-XT BLACK
Motherboard:
Asus TUF Gaming B550
RAM:
KINGSTON Fury 32GB (2 x 16GB) DDR4 3200MHz
VGA & cooler:
Biostar RX6700XT 12GB GDDR6
Naravno da ne. Dont mix frogs and grandmothers što bi rekao Vuk Drašković
 

CA_RIA

PCAXE Apprentice
Učlanjen(a)
22.05.2026.
Poruka
47
Rezultat reagovanja
25
Moja konfiguracija
Pogledajte prilog 66746


"Ubiću dva muškarca jednim kamenom" !!!! Da li je ovo real, rođaci.... Podešen je maximalno strogo i profesionalno da odogvara. Nov chat, prva poruka. 5.5 High, Extended. Tok misli je jeziv. Da je napisao "Dve muve jednim udarcem"... ne znam da li ovakva formulacija postoji u stranim jezicima?
Вероватно ујутру ради добро а увече брљави.
Треба имати среће
 
Učlanjen(a)
11.11.2017.
Poruka
863
Rezultat reagovanja
489
Moja konfiguracija
CPU & cooler:
Ryzen 9 7950x + Arctic III 360
Motherboard:
MSI B650 MAG Tomahawk Wifi
RAM:
2x32GB Kingston DDR5 6000MHz
VGA & cooler:
RTX 5090 Gigabyte Aorus Master
Display:
AOC 31.5" U32U3CV
HDD:
KC3000 2TB + 1TB + Crucial P3 500, 2 HDD od po 4TB (WD - RED i Blue) Kingston SSD 240GB
Sound:
Microlab Solo 6c+Audient ID14 MKII
Case:
Lian Li Lancool 216 argb
PSU:
FSP 1350W Platinum
Mice & keyboard:
Redragon/Logitech
Internet:
Optika
OS & Browser:
Win 11/Ubuntu
Other:
Logitech C270 Epson L386
Špijuni su među nama...

66808
 

Pinocio

PCAXE Addicted
Učlanjen(a)
15.02.2021.
Poruka
1.347
Rezultat reagovanja
3.422
Moja konfiguracija
CPU & cooler:
AMD Ryzen 5 5600X-SCFM 2000 Fuma 2
Motherboard:
Gigabyte X570 Aorus Master/rev 1.2
RAM:
G.Skill Trident Z Neo 32 (2x16) 3600 (16-19-19-39)
VGA & cooler:
RX 6800 XT Sapphire Nitro+ SE
Display:
Gigabyte M32U
HDD:
Samsung 980 Pro (500GB)-Samsung 970EVO (1TB)
Case:
Corsair 5000D Airflow/ Noctua NF-F12 PWM Cromax Black Swap (x6)
PSU:
Seasonic PRIME GX-850
Mice & keyboard:
MX Master 3 - MX Keys PLUS
Evo jedno pocetnicko :)
Probao sam Tripo Ai da mi na osnovu slike napravi model i sasvim pristojno je to odradio, ali... nema exporta bez pretplate (ili sam nesto pogresno razumeo) pa me zanima postoji li nacin da nekako maznem model a da ne platim :D
 
Učlanjen(a)
11.11.2017.
Poruka
863
Rezultat reagovanja
489
Moja konfiguracija
CPU & cooler:
Ryzen 9 7950x + Arctic III 360
Motherboard:
MSI B650 MAG Tomahawk Wifi
RAM:
2x32GB Kingston DDR5 6000MHz
VGA & cooler:
RTX 5090 Gigabyte Aorus Master
Display:
AOC 31.5" U32U3CV
HDD:
KC3000 2TB + 1TB + Crucial P3 500, 2 HDD od po 4TB (WD - RED i Blue) Kingston SSD 240GB
Sound:
Microlab Solo 6c+Audient ID14 MKII
Case:
Lian Li Lancool 216 argb
PSU:
FSP 1350W Platinum
Mice & keyboard:
Redragon/Logitech
Internet:
Optika
OS & Browser:
Win 11/Ubuntu
Other:
Logitech C270 Epson L386
ako je enkriptovana, teško da možeš da izvučeš full kvalitet. pretpostavljam da si probao već desni klik pa save as što logično ne daju za džabe.
Ako je 2D slika a ne 3d da ti treba model, probaj
skini najobičniji ShareX - The best free and open source screenshot tool for Windows, printscreenuj, pa uveličaj Sa Wonder v3 od Gigapixela (lošija varijanta), ili ako imaš noviju Nvidia kartu, zamoli nekog da ti podesi OMGSR-Flux. GitHub - wuer5/OMGSR: Offical repo for "OMGSR: You Only Need One Mid-timestep Guidance for Real-World Image Super-Resolution" za 8x (64xviše piksela) zum. Ili mi pošalji printscreen pa ti šaljem apskejl. ili koristi neku lakšu za podesiti light, verziju poput Upscayl - AI Image Upscaler = Ako je mala sličica i ne možeš da zumiraš.

Možda možeš da nađeš originalni link do slike sa servera preko developer konzole, stisni F12 u browseru, možda se i snađeš :D Neki URLovi rade javno, nekim imaš pristup kada platiš, a neke slike možda scrapuje i sa free nalogom, probaj.

npr.
66876

66877
66878
 
Poslednja izmena:

Pinocio

PCAXE Addicted
Učlanjen(a)
15.02.2021.
Poruka
1.347
Rezultat reagovanja
3.422
Moja konfiguracija
CPU & cooler:
AMD Ryzen 5 5600X-SCFM 2000 Fuma 2
Motherboard:
Gigabyte X570 Aorus Master/rev 1.2
RAM:
G.Skill Trident Z Neo 32 (2x16) 3600 (16-19-19-39)
VGA & cooler:
RX 6800 XT Sapphire Nitro+ SE
Display:
Gigabyte M32U
HDD:
Samsung 980 Pro (500GB)-Samsung 970EVO (1TB)
Case:
Corsair 5000D Airflow/ Noctua NF-F12 PWM Cromax Black Swap (x6)
PSU:
Seasonic PRIME GX-850
Mice & keyboard:
MX Master 3 - MX Keys PLUS
Možda možeš da nađeš originalni link do slike sa servera preko developer konzole, stisni F12 u browseru, možda se i snađeš :D Neki URLovi rade javno, nekim imaš pristup kada platiš, a neke slike možda scrapuje i sa free nalogom, probaj.

npr.
Sta mi naprica :D
Snasao sam se pre tvoje pomoci (u svakom slucaju hvala) sa F12, skinuo (3D) model u jednom formatu, pa posto ne moze nigde da se ucita, konvertovao ga u drugi, i za sad je super, sve ide svojim tokom, sad samo jos da naucim da ga editujem... i da sacekam printer :first::ziveli:
 

Pinocio

PCAXE Addicted
Učlanjen(a)
15.02.2021.
Poruka
1.347
Rezultat reagovanja
3.422
Moja konfiguracija
CPU & cooler:
AMD Ryzen 5 5600X-SCFM 2000 Fuma 2
Motherboard:
Gigabyte X570 Aorus Master/rev 1.2
RAM:
G.Skill Trident Z Neo 32 (2x16) 3600 (16-19-19-39)
VGA & cooler:
RX 6800 XT Sapphire Nitro+ SE
Display:
Gigabyte M32U
HDD:
Samsung 980 Pro (500GB)-Samsung 970EVO (1TB)
Case:
Corsair 5000D Airflow/ Noctua NF-F12 PWM Cromax Black Swap (x6)
PSU:
Seasonic PRIME GX-850
Mice & keyboard:
MX Master 3 - MX Keys PLUS
Učlanjen(a)
11.11.2017.
Poruka
863
Rezultat reagovanja
489
Moja konfiguracija
CPU & cooler:
Ryzen 9 7950x + Arctic III 360
Motherboard:
MSI B650 MAG Tomahawk Wifi
RAM:
2x32GB Kingston DDR5 6000MHz
VGA & cooler:
RTX 5090 Gigabyte Aorus Master
Display:
AOC 31.5" U32U3CV
HDD:
KC3000 2TB + 1TB + Crucial P3 500, 2 HDD od po 4TB (WD - RED i Blue) Kingston SSD 240GB
Sound:
Microlab Solo 6c+Audient ID14 MKII
Case:
Lian Li Lancool 216 argb
PSU:
FSP 1350W Platinum
Mice & keyboard:
Redragon/Logitech
Internet:
Optika
OS & Browser:
Win 11/Ubuntu
Other:
Logitech C270 Epson L386

Veselin

PCAXE Addicted
Učlanjen(a)
15.07.2018.
Poruka
2.253
Rezultat reagovanja
3.386
Moja konfiguracija
PC / Laptop Name:
PC / Laptop Name
CPU & cooler:
CPU & cooler
Motherboard:
Motherboard
RAM:
RAM
VGA & cooler:
VGA & cooler
Display:
Display
HDD:
HDD
Sound:
Sound
Case:
Case
PSU:
PSU
Optical drives:
Optical drives
Mice & keyboard:
Mice & keyboard
Internet:
Internet
OS & Browser:
OS & Browser
Other:
Other
U koje komponente treba ulagati ako se koristi AI van mreže, da li je bitna grafička ili CPU, RAM, SSD i sl?

Ponekad mi treba da prevede tekst na strani jezik ili da pretvori PDF u tekst i to je to, ne treba mi za audio, video, fotografije, programiranje...
 
Učlanjen(a)
11.11.2017.
Poruka
863
Rezultat reagovanja
489
Moja konfiguracija
CPU & cooler:
Ryzen 9 7950x + Arctic III 360
Motherboard:
MSI B650 MAG Tomahawk Wifi
RAM:
2x32GB Kingston DDR5 6000MHz
VGA & cooler:
RTX 5090 Gigabyte Aorus Master
Display:
AOC 31.5" U32U3CV
HDD:
KC3000 2TB + 1TB + Crucial P3 500, 2 HDD od po 4TB (WD - RED i Blue) Kingston SSD 240GB
Sound:
Microlab Solo 6c+Audient ID14 MKII
Case:
Lian Li Lancool 216 argb
PSU:
FSP 1350W Platinum
Mice & keyboard:
Redragon/Logitech
Internet:
Optika
OS & Browser:
Win 11/Ubuntu
Other:
Logitech C270 Epson L386
Za AI bih prioritete postavio ovako: prvo GPU, zatim dovoljno RAM-a, pa solidan procesor i brz SSD. AMD može da posluži, a sada postoji i nativna PyTorch/ROCm podrška na Windowsu, ali samo za određene Radeon i Ryzen modele. Kompatibilnost je i dalje uža, podešavanje često komplikovanije, a pojedini projekti, optimizacije i ekstenzije ne rade jednako dobro kao na NVIDIA karticama. ComfyUI podržava AMD, ali dosta zavisi od konkretne kartice, verzije softvera i načina instalacije. NVIDIA je zato i dalje najbezbolniji i najsigurniji izbor za AI, prvenstveno zbog zrelog CUDA ekosistema koji se razvija još od 2006. godine. Za stvari koje si naveo, PyTorch može da radi i samo na procesoru, ali kod ozbiljnijih modela očekuj da bude višestruko, često desetine puta sporiji nego sa modernom grafičkom karticom. Kod težih diffusion i generativnih modela razlika može biti i znatno veća. Za ONNX modele na Windowsu možeš da koristiš ONNX Runtime sa DirectML backendom i dobiješ hardversko GPU ubrzanje na praktično svakoj DirectX 12 kompatibilnoj kartici - AMD, Intel ili NVIDIA. Ipak, brzina i kompatibilnost zavise od samog modela i operatora, a DirectML obično nije toliko optimizovan kao CUDA ili drugi namenski backendovi proizvođača. PyTorch je jedan od centralnih frameworka za razvoj, trening i pokretanje open-source AI modela, tako da ćeš na njega nailaziti gotovo svuda. Vredi da kreneš makar malo da eksperimentišeš sa open-source scenom. Verovatno bi te brzo zainteresovala i uvukla u celu priču. Ja sam u tome još od otprilike 2008. godine i neverovatno je koliko je sve napredovalo - ovo što se danas dešava zaista je ludilo.
 
Poslednja izmena:
Učlanjen(a)
11.11.2017.
Poruka
863
Rezultat reagovanja
489
Moja konfiguracija
CPU & cooler:
Ryzen 9 7950x + Arctic III 360
Motherboard:
MSI B650 MAG Tomahawk Wifi
RAM:
2x32GB Kingston DDR5 6000MHz
VGA & cooler:
RTX 5090 Gigabyte Aorus Master
Display:
AOC 31.5" U32U3CV
HDD:
KC3000 2TB + 1TB + Crucial P3 500, 2 HDD od po 4TB (WD - RED i Blue) Kingston SSD 240GB
Sound:
Microlab Solo 6c+Audient ID14 MKII
Case:
Lian Li Lancool 216 argb
PSU:
FSP 1350W Platinum
Mice & keyboard:
Redragon/Logitech
Internet:
Optika
OS & Browser:
Win 11/Ubuntu
Other:
Logitech C270 Epson L386
ovaj novi Grok mi ne deluje loše za sada, po metrikama je pravo dobar, da li je do xAI hajpa ili....
67458
 
Učlanjen(a)
11.11.2017.
Poruka
863
Rezultat reagovanja
489
Moja konfiguracija
CPU & cooler:
Ryzen 9 7950x + Arctic III 360
Motherboard:
MSI B650 MAG Tomahawk Wifi
RAM:
2x32GB Kingston DDR5 6000MHz
VGA & cooler:
RTX 5090 Gigabyte Aorus Master
Display:
AOC 31.5" U32U3CV
HDD:
KC3000 2TB + 1TB + Crucial P3 500, 2 HDD od po 4TB (WD - RED i Blue) Kingston SSD 240GB
Sound:
Microlab Solo 6c+Audient ID14 MKII
Case:
Lian Li Lancool 216 argb
PSU:
FSP 1350W Platinum
Mice & keyboard:
Redragon/Logitech
Internet:
Optika
OS & Browser:
Win 11/Ubuntu
Other:
Logitech C270 Epson L386
Od onog posta o Groku 4.6 prošle su tek tri nedelje, a stanje se već dovoljno promenilo da benchmark tabela od 12. avgusta izgleda skoro kao arhiva. Grok 4.6 je i dalje ozbiljan model. Na izlasku je imao 61 na Artificial Analysis Intelligence Indexu, praktično rame uz rame sa tadašnjim GPT-5.6 Sol, uz API cenu od $2/$6 za milion ulaznih/izlaznih tokena. Posebno je zanimljiv zbog dugotrajnih agentnih zadataka, rada kroz velike codebase-ove i sopstvenog testiranja rezultata. Dakle, nije bio samo xAI hajp. Ali konkurencija je u međuvremenu ponovo pomerila granicu.
Anthropic je 1. septembra izbacio Claude Fable 5.1 i Mythos 5.1. Ovo nije običan ".1" refresh. Fable 5.1 je trenutno na vrhu Artificial Analysis Intelligence Indexa sa rezultatom 66 na maksimalnom reasoning nivou, a najveći skok mu je upravo tamo gde se cela industrija trenutno seli: višesatni agentni rad, coding, rad sa alatima i naučno istraživanje. Anthropic navodi 52,6% na Terminal-Bench-Science naspram 24,7% kod Fable 5 i 31,4% na AutomationBenchu naspram 17,1% prethodnika. Zanimljivo je i da su smanjili broj lažnih blokiranja legitimnog cyber rada za oko 60%. Osnovna cena ostaje visokih $10/$50, ali su cache read troškovi oboreni toliko da Anthropic procenjuje oko 25% niži tipičan račun, a kod izrazito agentnih workloadova i do oko 45%.
Google je bukvalno dan kasnije odgovorio sa Gemini 3.8 Flash i posebnom 3.8 Flash Cyber varijantom. Ovde je meni možda još zanimljiviji odnos brzine, cene i sposobnosti nego apsolutni benchmark. Artificial Analysis meri 3.8 Flash High na 59 poena, oko 305 izlaznih tokena u sekundi, uz cenu od $0,75/$3,75 i kontekst od milion tokena. Drugim rečima, više nije neophodno koristiti najskuplji "flagship" za ozbiljan agentni posao. Google je uz to uveo agentic video analizu gde model sam bira koje delove videa treba detaljno pregledati, umesto da slepo procesuira sve frejmove. U njihovim testovima to smanjuje potrošnju tokena do 88%, cenu do 66%, uz istovremeno poboljšanje kvaliteta do 7%. To je mnogo važniji pravac razvoja nego još 2% na nekom izolovanom benchmarku.
A onda je 3. septembra OpenAI izbacio GPT-6 Astra. Ovo je trenutno verovatno najveća vest. OpenAI ga pozicionira kao model za kompletan rad na računaru, browseru, kodu, istraživanju i višefaznim profesionalnim zadacima. Astra je u početku pušten ograničenom broju organizacija, uz šire puštanje korisnicima i API-ju u narednim danima. Ono što je zanimljivo jeste da nezavisni rezultati daju mnogo nijansiraniju sliku od marketinga. Artificial Analysis za Astra High meri Intelligence Index 60, dakle nema nekog čudesnog odvajanja od prethodne generacije, a cena je vrlo visoka, $10/$50. Sa druge strane, na njihovom Coding Agent Indexu Astra pravi znatno veći pomak i izjednačava sam vrh uz bolju efikasnost po završenom zadatku. Drugim rečima, napredak se sve manje vidi kroz pitanje "koliko je model pametan u chatu", a sve više kroz "šta može samostalno da završi od početka do kraja".
Kod Astre postoji još jedna stvar koja je možda važnija od benchmarka. OpenAI je prvi put neki svoj javno plasiran model klasifikovao kao "Critical" po pitanju cyber sposobnosti. Po njihovom sistemskom izveštaju, sa odgovarajućim alatima Astra može da pronalazi prethodno nepoznate ranjivosti i razvija nove načine njihove eksploatacije kroz ozbiljno zaštićene sisteme, bez potrebe da čovek vodi svaki korak. Zbog toga su uvedeni stroža izolacija, monitoring kompletnih agentnih putanja i dodatne kontrole. To je prilično velika promena u odnosu na vreme kada smo AI bezbednost svodili na pitanje da li će chatbot napisati nešto nedozvoljeno.
Ni open model scena ne stoji. DeepSeek je 13. avgusta pustio završnu verziju V4-Pro sa znatno jačim agentnim sposobnostima, a 21. avgusta i eksperimentalni V4-Flash-Vision koji tekstualnim sposobnostima prati V4-Flash, ali dodaje vizuelno razumevanje za multimodalne agente. Posebno je interesantna cena: V4-Pro van špica ide na $0,66 za milion nekeshiranih ulaznih i $1,98 za milion izlaznih tokena, dok je V4-Flash još višestruko jeftiniji. Kada se takve cene stave pored $10/$50 kod najskupljih zatvorenih modela, postaje jasno zašto se tržište neće svesti na jednog ili dva pobednika.
I za nas ovde možda najzanimljivija vest: lokalni AI ponovo ozbiljno ubrzava. NVIDIA je na IFA 2026 predstavila nove optimizacije za llama.cpp i vLLM. Na RTX 5090 navode do 1,9x veći throughput za llama.cpp, a poboljšanja već ulaze u LM Studio i Ollama. Pokazali su i PAIR, besplatan open-source sistem koji može da raspoređuje agentne inference zadatke između više računara u lokalnoj mreži. Uz to Hermes i OpenClaw dobijaju jednostavnije automatsko podešavanje lokalnih modela na RTX mašinama. Dakle, ona priča od pre par meseci "koliko VRAM-a mi treba za lokalni AI" polako prerasta u "koliko računara i GPU-ova mogu da dam lokalnom timu agenata". Naravno, onih 1,9x je NVIDIA-in sopstveni maksimum iz konkretne konfiguracije, ne univerzalno ubrzanje svakog modela.
Meni je zato trenutno najzanimljiviji zaključak da se AI trka vidljivo promenila. Više nije toliko bitno ko će da napravi chatbot koji na benchmarku ima dva poena više. OpenAI, Anthropic, Google, xAI, Meta, DeepSeek i Mistral guraju u istom smeru: modeli dobijaju računar, browser, terminal, memoriju, vizuelni ulaz, više agenata i mogućnost da satima rade bez čoveka. Paralelno, inference postaje jeftiniji i sve više toga može lokalno.
Ako se ovakav tempo nastavi, "najbolji model" uskoro možda neće ni biti naročito korisna kategorija. Mnogo važnije će biti koji sistem može najpouzdanije da završi konkretan posao, koliko košta taj završen posao i koliko kontrole nad njim ostaje korisniku. To mi deluje kao mnogo veća promena od još jedne smene na vrhu leaderboarda.
 
Učlanjen(a)
11.11.2017.
Poruka
863
Rezultat reagovanja
489
Moja konfiguracija
CPU & cooler:
Ryzen 9 7950x + Arctic III 360
Motherboard:
MSI B650 MAG Tomahawk Wifi
RAM:
2x32GB Kingston DDR5 6000MHz
VGA & cooler:
RTX 5090 Gigabyte Aorus Master
Display:
AOC 31.5" U32U3CV
HDD:
KC3000 2TB + 1TB + Crucial P3 500, 2 HDD od po 4TB (WD - RED i Blue) Kingston SSD 240GB
Sound:
Microlab Solo 6c+Audient ID14 MKII
Case:
Lian Li Lancool 216 argb
PSU:
FSP 1350W Platinum
Mice & keyboard:
Redragon/Logitech
Internet:
Optika
OS & Browser:
Win 11/Ubuntu
Other:
Logitech C270 Epson L386
@peja81, za nick ću ipak malo da sačekam. Ovim tempom bih za mesec dana morao ponovo da ga menjam, ovog puta u "Veteran Agentnog Doba".

Od mog prethodnog posta 4. septembra do danas, 27. septembra, prošle su tek nešto više od tri nedelje, ali se priča ponovo dovoljno promenila da vredi napraviti presek. I zanimljivo, najveća promena ovog puta nije još jedan rekord na benchmark tabeli. Sve više izgleda da sam u prethodnom postu pogodio pravac: glavna trka se seli sa "ko ima najpametniji chatbot" na to ko ima najbolji kompletan sistem za izvršavanje posla.

Prvo jedna važna napomena oko Artificial Analysis rezultata, da brojke ne naprave više štete nego koristi. AA je 7. septembra prebacio Intelligence Index na v4.3, promenio Terminal-Bench na mnogo teži 4.0 i ubacio AutomationBench-AA. Zbog toga novi rezultati NISU direktno uporedivi sa onima koje sam naveo 4. septembra. Recimo, Fable 5.1 je tada imao 66, dok na novom indeksu ima 53. Grok 4.6 je sa tadašnjih 61 na novoj metodologiji oko 44. To nije masovno "zaglupljivanje" modela preko noći, već pomeranje lenjira kojim ih mere. Novi rezultati koje pominjem ispod zato treba porediti međusobno, a ne sa starom tabelom.

Već 8. septembra pojavila su se dva zanimljiva signala iz potpuno različitih pravaca.

Meta je pustila Muse, i meni je ovo možda važniji događaj nego još jedan model sa nekoliko poena više. Muse nije zamišljen kao chatbot već kao lični agent koji dobija sopstveni persistentni računar u cloudu, Muse Secure VM, sa browserom i podacima korisnika. Može da otvara sajtove, popunjava forme, šalje mail, rezerviše putovanje, kupuje, pregovara i nastavlja da radi kada zatvoriš aplikaciju. Za osetljive akcije traži potvrdu korisnika, a poseban Sentinel agent kontroliše šta Muse sme da pošalje na internet. Korisnik ima i audit trail urađenih i planiranih akcija. Za sada se pušta u SAD, ali je važnija sama arhitektura. Bukvalno smo od "AI ima pristup browseru" stigli do "svaki korisnik dobija virtuelni računar u kojem njegov agent živi".

Istog dana Inception je izbacio Mercury 2.5, što je zanimljivo iz sasvim drugog razloga. To nije klasičan autoregresivni LLM koji štancuje token po token, već diffusion language model koji paralelno rafiniše delove izlaza. Inception navodi 1.107 tokena/s na dostupnom NVIDIA hardveru, dok je Artificial Analysis kasnije izmerio oko 770 tokena/s. Dakle, marketinšku brojku treba uzeti sa rezervom, ali je i nezavisno izmerena brzina ogromna. Sam model nije ni blizu vrha po ukupnoj inteligenciji, ali kod search pipeline-a, voice agenata i rojeva subagenata gde jedan posao može da napravi desetine ili stotine LLM poziva, takva brzina postaje sposobnost sama po sebi. Ovo je prvi put da mi diffusion pristup za tekst ne deluje samo kao zanimljiv eksperiment, već kao ozbiljna alternativna grana inference-a.

Dva dana kasnije OpenAI je uradio još nešto što direktno potvrđuje priču iz prethodnog posta. Agents API je 10. septembra ušao u public beta. Ovde se više ne prodaje samo model, nego praktično kompletan Codex agent harness kao servis. OpenAI vodi agent loop, context management, tool use, subagente i višednevne sesije, a agent dobija okruženje za rad sa fajlovima, izvršavanje koda i čuvanje međurezultata. Može se koristiti njihov sandbox ili sopstvena infrastruktura. Za sam Agents API nema posebne doplate mimo modela, alata i eventualnih sandbox resursa. Drugim rečima, "harness" koji je do juče bio ono što svako sklapa sam oko LLM-a sada postaje proizvod podjednako važan kao i sam LLM.

DeepSeek je istog 10. septembra izbacio V4.1-Flash i tu ima dosta tehnički zanimljivih stvari. U pitanju je 552B MoE sa novom Causal Encoder-Decoder arhitekturom, ali sa samo 8B aktivnih parametara tokom inputa i 16B tokom generisanja. Ima nativni vision, kontekst do milion tokena, težine su objavljene pod MIT licencom, a DeepSeek tvrdi da KV cache traži samo četvrtinu HBM-a i osminu SSD prostora prethodne generacije. V4.1-Flash je praktično preuzeo mesto starog Flasha, a po njihovim testovima prelazi i V4-Pro uz nižu cenu i veći throughput.

Ovde samo jedna bitna ograda za lokalni AI: "8B aktivnih" ne znači da je to 8B model koji ćemo lepo ugurati u 24 ili 32 GB VRAM-a. Kompletne težine su i dalje ogromne. Aktivni broj parametara govori koliko modela učestvuje u pojedinom prolazu, a ne koliko memorije je potrebno da bi ceo MoE bio dostupan. Dakle, 5090 još nije preko noći postala mini data centar. :) Sa druge strane, baš 7. septembra OpenBMB je pustio MiniCPM5-2B, eksplicitno pravljen za on-device i resource-constrained rad. Lep primer kako se open scena istovremeno širi u dva smera: monstruozni sparse modeli na jednoj strani i sve sposobniji mali modeli koji stvarno staju na običan računar na drugoj.

Google je 15. septembra pustio Gemini 3.8 Live i 3.8 Live Extended Thinking kao GA modele. Extended Thinking je posebno zanimljiv zato što model može da nastavi reasoning i tool pozive u pozadini tokom live audio sesije. Live verzije prihvataju audio, sliku, video i tekst, imaju do 128K konteksta, a function calling je po defaultu asinhron. To je dosta drugačija stvar od klasičnog "speech-to-text -> LLM -> text-to-speech" sendviča. Real-time AI polako dobija isti agentni karakter koji već gledamo kod coding i computer-use sistema.

Onda 21. septembra stiže Grok 4.7. Da se vratim na moje pitanje od avgusta da li je Grok stvarno dobar ili je xAI hajp: sada imamo još bolji odgovor. Jeste stvarno dobar, ali mu je specijalnost sve jasnija. xAI navodi novi, veći base model, duži RL trening na višesatnim zadacima, bolje proveravanje sopstvenog rada i bolje upravljanje dugim kontekstom. Cena je ostala $2/$6 za milion input/output tokena ispod 200K prompta, uz 500K context window.

Nezavisni Artificial Analysis nalazi mnogo zanimljiviju sliku od prostog "4.7 je jači". Na novom Intelligence Indexu ide sa 44 kod Groka 4.6 na 46, dakle samo +2. Ali sa Grok Build harnessom Coding Agent Index skače sa 47 na 56, a na njihovom agentic knowledge-work testu AA-Briefcase dobija +111 Elo. To je već ozbiljan pomak. Kvaka je što 4.7 troši oko 81K izlaznih tokena po Intelligence Index zadatku, više nego duplo u odnosu na 4.6 i oko tri puta više od GPT-6 Astre. Znači, ista cena po tokenu nikako ne znači i istu cenu završenog posla. Ovo je odličan primer zašto će "koliko košta milion tokena" postajati sve manje korisna metrika.

A onda je 22. septembar bio praktično mali modelski obračun.

Anthropic je pustio Claude Opus 5.5. Na aktuelnom Artificial Analysis v4.3 indeksu Opus 5.5 Max ima 58, trenutno najviše što su izmerili, i vodi na šest od deset komponenti njihovog indeksa. Posebno je jak u agentic knowledge work zadacima. Međutim, ni ovde nema univerzalnog "kralja": Anthropic u svojim testovima ima 66,4% na Terminal-Bench 4.0 naspram Astrinih 57,9%, ali Astra i dalje vodi na njihovom Terminal-Bench-Science poređenju 64,6% prema 58,7%, kao i blago na AutomationBenchu 41,4% prema 40,0%. Dakle, još jednom zavisi šta tačno radite.

Možda je još bitnija ekonomija Opusa 5.5. Cena je pala na $4/$20, cache read na samo $0,20, Anthropic meri više od 30% veću brzinu generisanja od Opusa 5 i oko 40% manji tipičan trošak po workloadu. To je već ozbiljna promena za višesatne agente, gde se isti kontekst čita iznova i iznova. Frontier Anthropic više nije automatski sinonim za $10/$50.

I bukvalno istog dana OpenAI je pustio GPT-6 Sol i GPT-6 Luna. Sol je $2/$10, Luna neverovatnih $0,10/$0,50, oba imaju 1,05 miliona tokena konteksta i do 128K izlaza, uz kompletan Responses alatni ekosistem, uključujući web, fajlove, code interpreter, shell, computer use i MCP.

Ovde je najzanimljivije što nema velikog "IQ" skoka. Artificial Analysis kaže da su im ukupni Intelligence i Coding Agent rezultati uglavnom u rangu GPT-5.6 prethodnika, sa nekim poboljšanjima i nekim regresijama. Ali Sol Max im obara prosečan cost per Intelligence Index task sa $1,99 na $1,06, a Luna sa $0,18 na $0,07. Sol u Coding Agent Indexu ide dva poena gore, na 57, uz približno upola manji trošak zadatka. To mi je možda i najvažnija OpenAI vest ovog meseca: nisu napravili model koji je dvostruko pametniji, napravili su približno istu klasu inteligencije mnogo jeftinijom za masovno korišćenje.

Kad saberem šta se promenilo od 4. septembra, moj zaključak iz prethodnog posta bih sada samo još pojačao.

Model više nije proizvod sam za sebe.

Meta mu daje sopstveni persistentni računar. OpenAI prodaje kompletan agent harness. Google mu omogućava da tokom živog razgovora razmišlja i koristi alate u pozadini. Grok napreduje mnogo više kao agent nego kao "ispitivač na benchmarku". DeepSeek napada memorijski i inference trošak kroz novu arhitekturu. Anthropic i OpenAI istovremeno obaraju cenu ozbiljnog agentnog rada. A diffusion LLM-ovi poput Mercuryja pokazuju da čak ni autoregresivno generisanje token po token ne mora zauvek da ostane jedini ozbiljan pristup.

Zato bih danas, umesto jedne kolone "Intelligence score", mnogo radije gledao četiri stvari: koliko često sistem stvarno završi end-to-end posao, koliko taj završen posao košta, koliko vremena i tokena potroši i koliko kontrole, provere i audita ostavlja čoveku.

Benchmark i dalje vredi, samo više nije cela priča.

A @peja81 je izgleda ipak bio bliže istini nego što sam tada mislio. Još malo pa "Veteran Digitalnog Doba" stvarno postaje istorijski naziv.
 

PORSCHE

PCAXE Addicted
Učlanjen(a)
03.01.2019.
Poruka
3.244
Rezultat reagovanja
5.930
Moja konfiguracija
PC / Laptop Name:
Asus X503S
CPU & cooler:
Intel Core i5-12600K - Cooler Master MasterLiquid ML360 RGB
Motherboard:
ASUS PRIME Z790-A Wifi
RAM:
G.Skill 32GB 2x16 Trident Z5 DDR5 5600MHz CL36 KIT
VGA & cooler:
MSI RTX 4070 Ti SUPRIM X 12G
Display:
BenQ Mobiuz EX3210R i LG 43UM7600 4K TV
HDD:
SSD Samsung 850 EVO 250GB, SSD Samsung 1TB 860 EVO, WDC 500GB Black + WDRed 4TB + WDRed Plus 4TB
Sound:
CORSAIR VOID PRO RGB Wireless 7.1
Case:
Cooler Master Cosmos C700P
PSU:
Be Quiet! Straight Power 11 Platinum 1000W
Mice & keyboard:
Logitech G502 X White, Logitech G910 Orion Spectrum
Internet:
ADSL 20MBs
OS & Browser:
Win 10 64 bit, Opera
Other:
Sony Play Station One
Po pravilu foruma samo jednom moze promena imena, ako se dobro secam ti si vec jednom menjao ime.
 
Vrh