Aug 8, 2025 | LLM (AI)
Claude 4.1 Opus je najnovejši model umetne inteligence podjetja Anthropic, ki že povzroča veliko zanimanja na področju agentne umetne inteligence, prenove kode in zahtevnih nalog, ki zahtevajo poglobljeno razmišljanje. Ta model prinaša številne izboljšave in novosti, ki ga postavljajo v ospredje sodobnih AI orodij.

Ključne novosti in izboljšave
-
Najvišja ocena na področju kodiranja: Claude 4.1 dosega 74,5 % na testu SWE-bench Verified, kar je njegova najvišja ocena doslej in pomeni pomemben napredek v primerjavi s prejšnjimi različicami.
-
Zanesljivo iskanje in odpravljanje napak: Podjetje Rakuten poroča, da model učinkovito najde in odpravi napake v kodi, pri tem pa ohranja redko ravnovesje, ki ga pri AI orodjih pogosto pogrešamo.
-
Izboljšave za mlajše razvijalce: Windsurf je opazil izboljšanje za eno standardno deviacijo pri nalogah, ki jih običajno opravljajo manj izkušeni razvijalci, v primerjavi s prejšnjo različico Opus 4.
-
Natančnejša prenova več datotek: Claude 4.1 omogoča bolj natančno prenovo kode v več datotekah hkrati, pri čemer je število napak občutno manjše.
-
Napredna funkcija “razširjenega razmišljanja”: Ta funkcija omogoča modelu, da probleme rešuje postopoma, po korakih, kar bistveno izboljša natančnost in zanesljivost rezultatov.
-
Dostopnost: Model je že na voljo prek API-ja, Amazon Bedrock in Vertex AI, pri čemer cene ostajajo nespremenjene.
-
Prihodnje nadgradnje: Anthropic napoveduje še večje izboljšave v bližnji prihodnosti, s poudarkom na uporabi v resničnem svetu in agentnih rešitvah.
Pomembnost in vpliv
Claude 4.1 Opus ni zgolj še ena posodobitev – predstavlja pomemben korak naprej v razvoju praktičnih agentnih AI orodij. Prehod od “samodokončanja” (auto-complete) do “samorazmišljanja” (auto-reason) je zdaj realnost, kar pomeni, da umetna inteligenca postaja vse bolj uporabna in zanesljiva tudi pri kompleksnih nalogah.
Z modelom Claude 4.1 Opus se dviguje standard na področju umetne inteligence za razvijalce in podjetja. Njegove izboljšane sposobnosti reševanja problemov, natančnost pri prenovi kode in napovedane prihodnje nadgradnje kažejo, da agentna umetna inteligenca postaja ne le obetavna, temveč tudi praktična rešitev za vsakodnevne izzive v svetu programiranja in tehnologije.
Jul 10, 2025 | LLM (AI)
Ustanovitelj Soundslice je odkril, da ChatGPT halucunera – lažno obljublja – pretvorbo ASCII tabulatur, in namesto da bi to preprosto zavrnil, je razvil podporo za to halucinacijsko funkcijo.

V članku na svojem blogu https://www.holovaty.com/writing/chatgpt-fake-feature/ Adrian Holovaty opisuje nenavadno izkušnjo v podjetju Soundslice, kjer je njihov skener za notne zapise začel prejemati nepričakovane prenose zaslonskih posnetkov ASCII tabulatur od uporabnikov, ki jih je tja usmeril ChatGPT. Umetna inteligenca je uporabnikom napačno sporočala, da Soundslice podpira uvoz ASCII tabulatur za predvajanje zvoka, kar je povzročilo pritok nepomembnih prenosov in zmedo glede ponudbe podjetja. Po premisleku se je Holovatyjev tim odločil, da bo razvil funkcijo, ki bo zadovoljila to zahtevo, kljub temu da je bila nenamerna in izhajala iz napačnih informacij.
Ta situacija odpira zanimiva vprašanja o tem, kako naj podjetja odgovorijo na netočnosti, ki jih širijo AI orodja, kot je ChatGPT. Čeprav je ustvarjanje rešitev, ki ustrezajo potrebam uporabnikov, pomembno, Holovaty izraža ambivalentnost glede tega, da mora podjetje prilagoditi svoj izdelek na podlagi nesporazuma, in poudarja izzive pri usklajevanju pričakovanj potrošnikov, na katere vplivajo nezanesljivi viri.
Adrian Holovaty je tako opazil, da so se v dnevnikih napak (access logs) pojavljali zasloni seje ChatGPT z ASCII-tablaturami, ki so prihajali v njegov skener za notne liste. ChatGPT je uporabnikom samozavestno zagotavljal, da Soundslice lahko pretvori ASCII-tablature v slišno glasbo, s čimer je ustvarjal lažna pričakovanja. Namesto da bi po spletni strani razporedil opozorila, se je Holovaty odločil, da bo fukcionalnost tudi dejansko razširil, da bo lahko obdeloval ASCII-tablature.
To je morda prvi primer, da je podjetje dodalo funkcijo izključno zato, da bi popravilo razširjene napačne informacije posredovane od “umetne inteligence”. Halucinacije umetne inteligence torej ne le da lahko zavajajo uporabnike, ampak tudi pritiskajo na produktne ekipe, da ponovno premislijo o načrtih – ali naj podjetja sledijo vsakemu mitu, ki ga ustvari umetna inteligenca, ali naj ohranijo svojo vizijo
Jun 12, 2025 | LLM (AI)

OpenAI je predstavil O3 pro, novo zmogljivo različico svojega reasoning modela O3. To je zdaj najnaprednejši model, ki je na voljo v ChatGPT.
O3 pro bo od tega tedna nadomestil O1-pro za uporabnike Pro in Team.
Deluje korak za korakom skozi probleme in izboljšuje zmogljivost v matematiki, znanosti in programiranju.
Cena API je 20 USD na milijon vhodnih tokenov in 80 USD na milijon izhodnih tokenov.
Strokovni preizkuševalci so O3 pro pred O3 preferirali zaradi jasnosti, natančnosti in upoštevanja navodil.
Lahko išče po spletu, izvaja Python, obdeluje vizualne vnose in prikliče pretekle interakcije.
O3 pro je v glavnih primerjavah umetne inteligence prekašal Google Gemini 2.5 Pro in Claude 4 Opus.
Trenutne omejitve: zaenkrat ni mogoče ustvarjati slik, ni podpore za Canvas, začasni klepeti so onemogočeni.
OpenAI ne le premika meje modela, ampak na novo opredeljuje, kaj v praksi pomeni »splošna inteligenca«. Preskok v zmogljivosti na področju sklepanja in znanosti kaže, kam se AI razvija: ne le hitra in tekoča, ampak tudi resnično premišljena.
Jun 12, 2025 | LLM (AI)
https://www.youtube.com/watch?v=7fej5XgfBYQ
lep prikaz trenutne situacije, če uporabnik ne ve z čim ima opravka …
