MOJ TOP 5 LLM: Kateri “AI” ZA KATERI NAMEN ? NI VSAK ZA VSE …

Danes povprečen uporabnik v 90% za svoje potrebe uporablja napačen LMM oziroma napačno (ali pa vsaj ne optimizirano)  “umetno inteligenco”. Ker je danes na voljo na stotine modelov, je vse težje racionalno izbrati med ponudbo LMM.

Seveda lahko vedno uporabite večnamenski LLM (kot je ChatGPT), za katerikoli namen in bo solidno opravil svoje delo. Toda določeni modeli se odlikujejo na različnih področjih. Zato je za optimalne rezultate pametno uporabiti različne modele za različne naloge. Trenutno predlagam uporabo naslednjih LLM (stanje mesec Maj 2026):

1️⃣ChatGPT: univerzalen model za vse, vaš univerzalen pomočnik, soliden na vseh področjih a nikjer vrhunski (čakamo Codex!)

2️⃣ Claude: kreativni genij, izjemen za pisanje, programiranje, marketing, strategije …

3️⃣ Perplexity: podatkovne raziskave in analize spletnih podatkov (finančno modeliranje, poglobljene raziskave)

4️⃣ Grok: vse, kar je povezano z novicami in preverjanjem novic v realnem času ( zaradi X vgradnje je tu superioren)

5️⃣ Gemini: vse, kar je povezano z Google ekosistemom (Docs, Slides, Gmail itd.), stvarjanje slik/video posnetkov

Samsung načrtuje vlaganje v Mistral

– Samsung namerava vložiti do 1 milijarde evrov v francoski startup Mistral, vrednoten na okoli 20 milijard evrov. 
– Investicija krepi položaj Mistrala kot vodilnega evropskega AI podjetja in alternative OpenAI, Anthropic in Googlu. 
– Poudarek je na “suverenem AI” zaradi ameriških izvoznih omejitev naprednih modelov. 
– Mistral razvija odprte modele, ki jih lahko organizacije prilagodijo in nadzorujejo same. 
– Povezava med AI podjetji in proizvajalci čipov postaja ključna zaradi omejene računske moči. 
– Samsung kot največji proizvajalec pomnilniških čipov lahko postane strateški partner Mistrala. 
– Mistral ima močne partnerje, med njimi Microsoft, in vlaga v Nvidia podatkovne centre po Evropi. 
– Kitajska zvišuje konkurenco z nizkocenovnimi naprednimi modeli. 
– AI tekma se razvija v nadzor nad celotnim tehnološkim ekosistemom, ne le nad najboljšim modelom. 
– Poudarek bo na gradnji neodvisnih, odpornih tehnoloških ekosistemov in strateških partnerstev. 

Cisco Antares

image

– Cisco je predstavil Antares, družino odprtokodnih majhnih jezikovnih modelov, namenjenih iskanju znanih ranljivosti v velikih zbirkah kode. 
– Modeli Antares (350M in 1B parametrov) delujejo lokalno, kar ohranja zasebnost izvorne kode, in prekašajo številne večje modele na novem merilu za lokalizacijo ranljivosti. 
– Za razliko od splošnih AI modelov, Antares posnema človeške analitike z iskanjem, revidiranjem in zoževanjem sumljivih datotek, brez generiranja kode. 
– Modeli dopolnjujejo obstoječa varnostna orodja ter pomagajo pri razvrščanju priporočil, pregledih CI/CD in analizi repozitorijev. 
– Cisco si prizadeva zagotoviti cenovno dostopna AI varnostna orodja za univerze, javni sektor in manjše ekipe, kar kaže na premik k specializiranim in učinkovitih rešitvam za podjetja.

Izginil review / ocena na GMB ?

GBP Support Link:  https://support.google.com/business/gethelp

V zadnjem času so izginule ocene postale presenetljivo pogosta glavobol za lastnike podjetij. Dobra novica je, da manjkajoča ocena ne pomeni avtomatično, da je izginila za vedno, in v mnogih primerih obstaja način, kako jo ponovno pridobiti.

Če menite, da je bila legitimna ocena po pomoti odstranjena, je vaš prvi korak, da se obrnete na Google in zaprosite za pregled z namenom ponovne objave.

Pri oddaji zahtevka izberite svoje podjetje, v tekstno polje vpišite »Missing Review « in kot težavo izberite »Review Missing«, da se odklene obrazec za preiskavo. Za to morate vedeti le ime ocenjevalca, oceno, vsebino ocene in datum objave.

Univerzalni protokol trgovine Google za prodajo z umetno inteligenco

VIR: https://www.searchenginejournal.com/70-of-top-retailers-are-invisible-to-agentic-commerce-heres-why/581198/

BISTVO:

Članek obravnava premik od “traffic-first” e-trgovine k agentičnemu commerceu, kjer se celoten nakupni proces odvija znotraj AI-agenta brez obiska spletne trgovine.

Google Universal Commerce Protocol (UCP) in OpenAI Agentic Commerce Protocol (ACP) zahtevata, da AI-agenti delujejo na podlagi strukturiranih podatkov iz product/merchant feedov in sheme, ne na podlagi vsebine strani.

Avdit 141 dobro rangiranih produktnih strani 29 večjih trgovcev pokaže, da ima večina sicer osnovno shemo urejeno, a jim manjkajo ključna polja za agentični commerce.

Ključni problem ni platforma (Shopify, custom itd.), ampak konfiguracija: večina trgovcev ne prenaša obstoječih podatkov (dostava, vračila, GTIN, veljavnost cene) v feed in schema.org.

Avtor zagovarja, da mora SEO za agentični commerce prevzeti logiko “supply chaina” – fokus na kakovost, celovitost in pretočnost produktnih podatkov, ne na vsebinski marketing in kategorije.

DEJSTVA:

Avdit je zajel 207 URL-jev, od tega je bilo 141 produktnih strani (PDP), ki so bile dejansko analizirane; 52 URL-jev je bilo nedostopnih (403/404/0), 14 pa niso bile PDP.

99% analiziranih PDP ima ceno in zalogo, 99% ima MPN/SKU, 96% ima brand in praktično vsi uporabljajo Product-schema, kot jo Google priporoča od 2014.

Samo 18% PDP vključuje priceValidUntil, 13% shippingDetails.deliveryTime in 11% hasMerchantReturnPolicy.merchantReturnDays, kar pomeni, da 70% strani nima nobenega od treh ključnih signalov za UCP.

65% analiziranih PDP nima GTIN polja, kar omejuje možnost AI, da isti produkt primerja med trgovci in odgovarja na vprašanja o najboljših cenah.

15% vseh URL-jev (32 od 207) je dalo HTTP 403 in so tako za agentične AI-agente praktično nevidni; med njimi so velike blagovne znamke, kot so Adidas UK, UGG, Converse in Christian Louboutin.

CITATI:

“Ecommerce is entering a new phase – one where transactions can happen entirely off-site, making website visits optional, if not redundant.”

“Agentic commerce isn’t a content optimization problem so much as a data plumbing one.”

“If any of those fields are absent or incomplete, Gemini won’t simply rank the product lower or less prominently. Your product won’t be included. Period.”

“Left unaddressed, the problem of incomplete feeds and schema could see your online store left behind by agentic commerce.”

“The winners in agentic commerce won’t be the loudest brands, or the best-ranked pages. They’ll be whichever retailer made their products easiest for an AI agent to buy.”

TEST: "Risanje" Mona Lise z GPT-5.6, Claudeom, Geminijem in Grokom

AI modeli : GPT-5.6 Sol jasno vodi v kakovosti risb in učinkovitosti.

VIR: https://www.tryai.dev/blog/ai-drawing-arena-colored-pencils-claude-gpt-grok

image

BISTVO:

Članek opisuje eksperimentalni »drawing arena« sistem, kjer štirje vrhunski modeli z omejenim naborom orodij rišejo reprodukcije dveh slik (Mona Lisa, Zvezdna noč) ter pet risb po tekstovnih pozivih na prazno platno.

Vsi modeli uporabljajo enak nabor orodij (barvni svinčnik: nastavitev barve, čopiča, pritiska, poteze, brisanje, zabris/»smudge« in ogled platna), kar omogoča primerjavo strategij uporabe orodij pri daljših nalogah.

GPT-5.6 Sol se izkaže kot najbolj uravnotežen: najboljše ali skoraj najboljše vizualne rezultate doseže z razmeroma malo koraki, zmernim časom in nizkimi stroški v primerjavi z drugimi frontier modeli.

Claude Fable 5 porabi bistveno več časa, korakov in žetonov, pri čemer končna kakovost risb zaostaja za GPT-5.6 Sol, kar ga v tem eksperimentu postavi kot najmanj ugodno izbiro glede razmerja med kakovostjo in stroški.

V vseh ciljnih (target) ponovitvah modeli dosežejo najboljšo strukturno podobnost (SSIM) nekje sredi procesa, nato pa z nadaljnjim popravljanjem rezultat degradirajo, kar kaže na odsotnost robustne ustavitvene strategije pri lastnem izboljševanju vizualnega izhoda.

DEJSTVA:

Preizkušeni modeli so: GPT-5.6 Sol, Claude Fable 5, Grok 4.5 in Gemini 3.6 Flash; skupaj so ustvarili 28 risb (2 tarči + 5 pozivov × 4 modeli).

GPT-5.6 Sol povprečno porabi 29 korakov na risbo, 6,2 minute, 3,4 milijona žetonov in okoli 7,74 USD stroška, pri čemer ima povprečno 6 samopregledov platna.

Claude Fable 5 povprečno porabi 54 korakov, 12,5 minute, 14,6 milijona žetonov in približno 160,58 USD, z 15,6 samopregledi; strošek je približno 20-krat višji od ostalih.

Grok 4.5 ima povprečno 99 korakov na risbo, 4,8 minute, 34 milijonov žetonov in ocenjeni strošek 9,21 USD, pri čemer približno 65% vseh 1.349 klicev orodij predstavljajo nastavitve barve, čopiča in pritiska.

Gemini 3.6 Flash porabi povprečno 73 korakov, 6,9 minute, 27,7 milijona žetonov in 12,87 USD, hkrati pa je najintenzivnejši pri samopregledih (okoli 23 ogledov platna na risbo), kar mu omogoča najvišje SSIM vrhove, a ne nujno najboljši končni vizualni rezultat.

$100 AI glasbeni video: Claude Fable 5 proti GPT-5.6 Sol

Claude Fable 5 in GPT-5.6 Sol sta v avtonomnem preizkusu ustvarila  AI-glasbena videa, vendar so rezultati kljub uspešni tehnični izvedbi ostali slogovno in pripovedno nedosledni. Članek ugotavlja, da je Claude praviloma hitrejši in dražji, GPT pa bolj eksperimentalen pri montaži ter izbiri modelov.

VIR: https://www.tryai.dev/blog/ai-music-video-arena-claude-vs-gpt-5.6

BISTVO
TryAI je obema modeloma dal isto skladbo, »Uptown Funk«, besedilni opis, časovno usklajen prepis besedila, proračun in dostop do spletnega iskanja, generatorjev slik/videa ter FFmpeg.

Izvedeni so bili štirje samostojni zagoni: Claude Fable 5 in GPT-5.6 Sol, vsak s proračunoma 25 in 100 USD za generiranje vsebin.

Vsi štirje zagoni so sami dokončali veljaven video v polni dolžini z izvirno zvočno skladbo, brez prekoračitve časovne ali korakovne omejitve.

Claude je uporabljal izključno tekst-v-video pristop, medtem ko je GPT pri nižjem proračunu najprej ustvaril statične slike in jih nato animiral, pri višjem pa kombiniral več video modelov.

Ključne omejitve so bile nedoslednost likov med kadri, dobesedno vizualiziranje besedila, šibka sinhronizacija gibanja z ritmom in skoraj popolna odsotnost iterativnega preverjanja oziroma izboljševanja končne montaže.

DEJSTVA
Claude Fable 5 je pri proračunu 25 USD ustvaril 54 videoposnetkov, porabil 24,30 USD za generiranje in končni strošek skupaj z LLM-žetoni je znašal 41,29 USD.

GPT-5.6 Sol je pri 25 USD ustvaril 61 slik in 46 videoposnetkov; generiranje je stalo 23,18 USD, skupni strošek pa 27,45 USD.

Claude Fable 5 je pri 100 USD ustvaril 80 videoposnetkov, porabil 48,60 USD za generiranje ter dosegel izhodno ločljivost 1920 × 1080.

GPT-5.6 Sol je pri 100 USD ustvaril 70 videoposnetkov, uporabil Wan 2.5, Veo 3.1 Lite in Hailuo 2.3 Standard ter za generiranje porabil 36,57 USD.

Najdražji preizkus je bil Claude Fable 5 pri 100 USD: 73,65 USD skupnega stroška, od tega 25,05 USD za LLM-žetone; hkrati je bil tudi najhitrejši visokoproračunski zagon, s časom 38 minut in 56 sekund.

Decoy Font

Decoy Font je eksperimentalna pisava TTF, ki v istem znaku združi dve različni črki: navidezno besedilo za strojno branje in skrito besedilo, ki ga človek lažje prebere z razdalje. Namenjena je predvsem oteževanju površinskega branja besedila z modeli AI in OCR, ne pa zagotavljanju kriptografske zasebnosti.

VIR: https://www.mixfont.com/experiments/decoy-font

BISTVO:

Pisava uporablja načelo »hibridnih slik« oziroma različne prostorske frekvence: tanke, ostre konture tvorijo eno sporočilo, zamegljena masa ozadja pa drugo.

Od blizu je bolj vidno »vabljivo« oziroma lažno besedilo, z večje razdalje ali ob mežikanju pa se izriše skrito sporočilo.

Avtor navaja, da več multimodalnih jezikovnih modelov pri analizi slike prednostno prebere jasno obrisano, navidezno besedilo.

Na strani je interaktivni preizkus, v katerem uporabnik vnese skrito in vabljivo sporočilo, prilagodi povečavo ter izvozi nastalo sliko.

Na voljo je brezplačen prenos pisave TTF za osebne, komercialne in naročniške projekte; črkovne oblike izhajajo iz pisave DejaVu Sans Mono, pod pogoji povezane licence.

DEJSTVA:

Privzeti primer uporablja skrito besedilo »HAPPY HUMAN« in vabljivo besedilo »SORRY ROBOT«.

TTF je mogoče namestiti kot običajno pisavo in z njo zapisovati celotno besedilo, ne zgolj ustvarjati slik.

Projekt primerja svoj pristop s predhodnim eksperimentom Ghost Font, ki za zakrivanje sporočila uporablja gibanje oziroma animacijo.

Kot možne rabe stran omenja odvračanje spletnega strganja podatkov, preprosta zasebna sporočila in potencialne CAPTCHA-mehanizme.

Avtor izrecno opozarja, da pisava ni zanesljiva zaščita: naprednejši modeli ali agenti, ki prepoznajo tehniko, lahko poskusijo razvozlati obe plasti.

WordPress za e-trgovino

WordPress za e-trgovino: dobra, prilagodljiva izbira, a z jasnimi tehničnimi in varnostnimi kompromisi.

VIR:

https://www.searchenginejournal.com/is-wordpress-right-choice-for-ecommerce-websites/543221/

BISTVO:

WordPress (z WooCommerce) poganja več kot 4 milijone aktivnih spletnih trgovin, kar ga uvršča med najpogosteje uporabljene rešitve za e-trgovino.

Ključne prednosti za e-trgovino so odsotnost transakcijskih provizij platforme, brezplačna uporaba jedra, zelo široke možnosti prilagoditve in fleksibilnost pri izbiri gostovanja.

Platforma je SEO-prijazna in omogoča obsežne integracije z orodji za marketing, analitiko, e-pošto in družbena omrežja, kar podpira rast spletne trgovine.

Glavne slabosti so zahtevnost upravljanja, potreba po rednem posodabljanju jedra in vtičnikov ter večja površina napada zaradi široke uporabe vtičnikov.

V primerjavi z Shopify in BigCommerce WordPress ponuja več fleksibilnosti in prilagoditev, vendar zahteva več tehničnega znanja in časa za vzdrževanje ter varnost.

DEJSTVA:

Članek navaja, da WooCommerce na WordPressu poganja več kot 4 milijone živih spletnih trgovin.

33% prometa na spletnih trgovinah prihaja iz organskih iskanj, kar krepi pomen SEO pri e-trgovini.

Približno 70% WordPress namestitev uporablja zadnjo različico programske opreme, kar pomeni, da je okoli 30% namestitev potencialno ranljivih.

Po podatkih Patchstack naj bi vtičniki predstavljali 97% vseh novih varnostnih ranljivosti v WordPressu, medtem ko imajo teme relativno manjši delež.

Članek je objavljen 23. aprila 2025 na portalu Search Engine Journal, ocenjen kot devetminutno branje in uvrščen v kategoriji »Ecommerce« in »WordPress«.

Ključne omejitve WordPressa za e-trgovino

WordPress ni namenski e‑commerce sistem

WordPress je CMS, ki e‑trgovino podpira preko vtičnikov (npr. WooCommerce), ni pa zasnovan primarno za spletno prodajo, kot sta Shopify ali BigCommerce.

Posledično je več konfiguracij, optimizacij in integracij prepuščenih administratorju, namesto da bi bile del vnaprej rešenega »managed« ekosistema.

Zahtevnost in ne‑uporabniku prijazen vmesnik

Za uspešno upravljanje resne trgovine na WordPressu je potrebna tehnična oz. razvojna ekspertiza, ne le osnovno urejanje vsebin.

Učenje »od nule« preko vodičev in dokumentacije zahteva precej časa in sistematično delo, kar manj izkušenim uporabnikom oteži vzpostavitev stabilne trgovine.

Redna posodabljanja in operativno breme

Jedro WordPressa, teme in vtičniki se pogosto posodabljajo; večino posodobitev je treba namestiti ročno ali vsaj nadzorovati avtomatske procese.

Zanemarjanje posodobitev neposredno poveča napadno površino (ranljivosti) in tveganje za vdor ali izsiljevalske napade, kar je pri trgovini poslovno kritično.

Varnost: odgovornost je na lastniku

Okoli 30% namestitev ne uporablja zadnje različice WordPressa, kar pomeni znaten delež potencialno ranljivih sistemov.

Po podatkih Patchstack je 97% novih varnostnih ranljivosti povezanih z vtičniki, kar pomeni, da morajo administratorji striktno nadzorovati izbor in posodabljanje vtičnikov.

Vtičniki kot vir težav (performance + security)

Veliko število vtičnikov lahko napihne kodo, upočasni nalaganje strani in s tem neposredno negativno vpliva na konverzije in uporabniško izkušnjo.

Slabo vzdrževani ali »sumljivi« vtičniki lahko ustvarijo varnostne luknje ali »backdoor« poti v sistem, tudi če je jedro WordPressa ustrezno posodobljeno.

Večja operativna kompleksnost v primerjavi z managed platformami

V nasprotju z Shopify/BigCommerce moraš pri WordPressu sam reševati gostovanje, varnostne kopije, monitoring, hardening, WAF/CDN integracije ipd.

S tem pridobiš fleksibilnost, a tudi večjo operativno obremenitev in potrebo po DevOps pristopu za resno, rastočo trgovino.

Potreba po discipliniranem vzdrževanju

Za dolgoročno stabilnost trgovine na WordPressu je nujen proces: upravljanje posodobitev, testno okolje (staging), redni varnostni pregledi, revizija vtičnikov in backup strategija.

Brez tega WordPress sicer zmore e‑trgovino, a tveganje za varnostne incidente in izpade storitve je bistveno višje kot pri tipičnih »plug‑and‑play« SaaS platformah.

Sedaj Chat GPT v 30 kombinacijah … ChatGPT Work in Codex – 5.6 (Sol, Terra, Luna)

image

OpenAI lansira ChatGPT 5.6 z modeli Sol (najdražji), Terra (srednji kompromis) in Luna (najcenejši), poleg starega 5.5.

ChatGPT Work/Codex omogoča izbiro kombinacije modela, „effort“ in hitrosti, kar po avtoru tvori okoli 30 kombinacij.

Simulacija za 150 zaposlenih pri ChatGPT: 3.000 USD osnovne naročnine (150 × 20 USD) + približno 17.000 USD dodatnih stroškov porabe tokenov pri tipični uporabi.

Popolna uporaba Sol (High) v isti simulaciji bi dosegla okoli 37.000 USD mesečno, oziroma približno 250 USD na zaposlenega.