Claude 4

  • Podjetje Anthropic je pravkar predstavilo Claude Opus 4 in Claude Sonnet 4. Ta nova modela ne izboljšujeta le svojih predhodnikov, temveč nameravata na novo opredeliti, kaj je mogoče pri kodiranju, sklepanju in delovnih postopkih agentov.
  • Claude Opus 4 je zdaj najboljši model za kodiranje, ki je na voljo, in vodi v primerjalnih testih, kot sta SWE-bench (72,5 %) in Terminal-bench (43,2 %).
  • Več ur lahko izvaja osredotočena opravila in obvladuje zapletene delovne postopke, ki so bili prej nedosegljivi za umetno inteligenco.
  • Claude Sonnet 4 je velika nadgradnja različice 3.7, saj se v testu SWE-bench (72,7 %) kosa z Opusom in blesti v natančnosti, nadzoru in praktičnih namestitvah.
  • Oba modela zdaj podpirata razširjeno razmišljanje z uporabo orodij, kar jima omogoča, da izmenično uporabljata razmišljanje in zunanja orodja, kot je spletno iskanje.
  • Orodja lahko uporabljajo vzporedno in dostopajo do lokalnih datotek za ustvarjanje spomina, kar jim omogoča ohranjanje konteksta pri dolgih projektih.
  • Claude Code je uradno izšel iz beta različice z globoko integracijo IDE in nalogami v ozadju prek GitHub Actions.

Clot 4 je uradno na voljo, kar predstavlja prvo pomembno posodobitev od izida Claude 3 marca 2024, ki je med uporabniki in razvijalci vzbudil veliko navdušenja. Ta nova zbirka modelov vključuje visoko cenjeni Claude Opus 4, ki velja za najnaprednejši model kodiranja, ki je trenutno na voljo, in Claude Sonnet 4, ki ponuja znatne izboljšave v primerjavi s svojim predhodnikom, Claude 3.7. Družina Claude je razdeljena na stopnje, in sicer Haiku, Sonnet in Opus, pri čemer vsaka nova različica obljublja še večje zmogljivosti kot prejšnja, zlasti z novim spletnim iskanjem in razširjenimi funkcijami razmišljanja, ki modelom omogočajo dostop do najnovejših informacij in učinkovitejše razmišljanje o poizvedbah. V spodnjem videu  podrobno primerja zmogljivosti najnovejših modelov Claude in drugih vodilnih konkurentov, kot sta Gemini 2. 5 Pro in ChatGPT, pri čemer poudarja, da Claude Opus 4 izstopa v nalogah programskega inženirstva in razmišljanja, hkrati pa ponuja večstopenjski cenovni model, kjer je osnovni dostop do Claude Sonnet 4 brezplačen, medtem ko je Opus 4 na voljo za doplačilo, ki se začne pri 20 dolarjih na mesec; recenzent namerava predstaviti zmogljivosti modelov s pomočjo različnih testov, vključno z zanimivim izzivom kodiranja, osredotočenim na spreminjanje gibov šahovskih figur.

Google Gemini

Google je pravkar (23/05/2025)objavil obsežno posodobitev asistenta Gemini. Ne odgovarja več le na vprašanja, ampak jih tudi predvideva.

Gemini Live je zdaj brezplačen v operacijskih sistemih Android in iOS ter vam omogoča, da s kamero in souporabo zaslona dobite pomoč v realnem času.

Imagen 4 zagotavlja ostrejše slike in boljše upodabljanje besedila, kar je idealno za družabne grafike, krožnike ali vabila.

Veo 3 lahko ustvari celotne video prizore z zvokom, od preprostih pozivov od mestnega hrupa do dialoga likov.

Deep Research zdaj sprejema vaše lastne datoteke PDF in slike, zato vpogledi združujejo javne podatke z zasebnim kontekstom.

Canvas omogoča ustvarjanje kod, infografik in podcastov v 45 jezikih iz navadnih besedilnih opisov.

Gemini v Chromu se za uporabnike Pro in Ultra začne uvajati jutri, da razjasnijo ali povzamejo katero koli stran v trenutku.

Študentje v petih državah dobijo brezplačno celotno leto programa Google AI Pro z interaktivnimi kvizi, ki so zdaj v uporabi.

Pregledi AI v rezultatih iskanja jasno zmanjšujejo število klikov na organske rezultate.

Pregledi AI v rezultatih iskanja jasno zmanjšujejo število klikov na organske rezultate.

Študija podjetja Seer Interactive se ujema s številkami, ki jih vidimo v mnogih drugih poročilih.

Čeprav Google trdi, da uporabniki obožujejo preglede AI, je verjetnost, da bodo uporabniki, ki jih vidijo, kliknili na spletne strani, veliko manjša.

Similarweb je pokazal, da spletne strani prejmejo 20 % manj klikov, ko so prisotni pregledi AI.[1]

Podatki Ahrefs kažejo, da zmanjšujejo število klikov za 34,5 %.[2]

Podatki Amsive kažejo 19,98-odstotni upad stopnje klikov.[3]

Seer Interactive je ugotovil, da je stopnja klikov najnižja, kadar se pojavi AI.[4]

  1. Tweet Similarweb’s Darrell Mordecai
  2. Ryan Law’s Ahrefs
  3. Amsive Digital  AI Overview CTR
  4. Seer Interactive research  CTR

Enlarged Image

ChatGPT & Grok sta dobila dostop do praktično "neomejenega pomnilnika".

ChatGPT & Grok sta dobila dostop do praktično “neomejenega pomnilnika”.

☑ Zapomnita si vaše pretekle pogovore.

☑ Oba lahko naučite, kdo ste in kaj želite.

Kako dodate trajne podatke v “svoj” spomin:

1 – Pojdite na ChatGPT ali Grok. Ne deluje na Gemini & Claude (v času pisanja).

2 – Poziv začnite z “Update your memory with the following:”.

3 – Najbolje je, da razložite, za katero situacijo bi želeli, da se zgodi ta “slog”.

Update your memory with the following:

Whenever I write an email with you, I never use the – em dash, ever.

Be straightforward. Don’t be too polite. Always add an actionable next step
.

To je to. LLM bo v bodoče “vedel” vaše specifična želje in/ali okoliščine.

Amazon AI za trgovino: NOVA

Amazon New AI Models 'NOVA' Stun The Entire Industry!

Amazonov “hišni” AI model Nova je zdaj nadgrajen, da lahko konkurira sodobnim modelom, kot sta Claude 3 in Llama 4. Za trgovce na drobno in oglaševalce to pomeni, da lahko Amazonov AI izvaja tudi kompleksnejša in zahtevnejša opravila – od podrobnih opisov izdelkov do prilagojenih priporočil – ne da bi se pri tem zanašal na zunanje ponudnike umetne inteligence.

Nova zdaj tekmuje z modeli na ravni GPT-4 in Claude 3 po globini sklepanja (reasoning) in kontekstnem oknu (token), ne le po ceni.  Z njim Amazon lahko ohrani napredek v lastni hiši, hkrati pa še vedno omogoča izvajanje zahtevnejših naloge, kot so večjezični povzetki izdelkov, oblikovanje paketov in “agencijski” pogovori pri nakupovanju – vse to brez najemanja OpenAI ali Anthropic AI modelov.

NovaSonic Voice Shopping

Amazon enters real-time AI voice race with Nova Sonic, a unified voice  model that senses emotion

Novi model NovaSonic odpravlja ključne ovire, zaradi katerih se glasovno nakupovanje prej ni moglo uveljaviti:

  •     Nižja stopnja napak pri besedah (kupce razume že prvič)
  •     Bolj naravno zveneči odgovori
  •     Možnost shranjevanja/ohranjanja konteksta pogovora

Prejšnje glasovno nakupovanje je bilo neuspešno predvsem zaradi napak pri prepisovanju, robotsko zvenečih odzivov in pomanjkanja kontekstnega spomina. Sistem NovaSonic se teh težav loteva drugače: zahteve razume že prvič in se odziva s človeku podobnimi govornimi vzorci, hkrati pa ohranja kontekst med več sejami/pogovori. To je ključnega pomena, da potrošniki umetni inteligenci v končni fazi res zaupajo nakupne odločitve – zlasti v okoljih brez zaslonov, kot so kuhinje ali avtomobili.

Medtem ko številna podjetja razvijajo tekstualne klepetalne robote, Amazonova naložba v podjetje NovaSonic kaže na izrazit poudarek na glasovnem delu, pri čemer izkorišča svoj obstoječi sistem Alexe v milijonih domov, česar konkurenca ne more doseči.

    Glasovno iskanje bo verjetno postalo glavna vstopna točka za nakupovanje. Pričakujte iskanja izdelkov, kot so: “Alexa, pokaži mi maskaro brez xy, ki je cenejša od 25 dolarjev in jo lahko pošljemo do petka.” Agent poskrbi za filtriranje, preverjanje zalog in obdelavo plačil. Za oglaševalce bodo morale biti sponzorirane objave naravno umeščene v pogovorne odgovore, namesto da bi se pojavljale v tradicionalnih mrežah rezultatov iskanja.
     Govor bomo videli v Alexi+, morda pa tudi v drugih Amazonovih aplikacijah – da bi se vsi navadili na glasovne interakcije, bi lahko Amazon uvedel glasovne vmesnike v iskalno vrstico Amazonovih mobilnih aplikacij (tako kot smo se zdaj začeli pogovarjati s ChatGPT) in glasovni daljinec Fire TV.

Agenti in aplikacije

Amazon event 2023: Here's everything the company just announced

Alexa Plus: naročniški nakupovalni pomočnik

Amazonova pomočnica naslednje generacije ne le odgovarja na vprašanja, temveč lahko tudi ukrepa – tako je potencialni nakupovalni pomočnik, ki bi lahko:

  •     primerja izdelke in daje priporočila
  •     dodajati izdelke v košarico
  •     uporabiti kupone
  •     poskrbeti za vračilo

Trenutno se uvaja v ZDA, še letos pa je načrtovana globalna širitev.

Naročniški agenti bi lahko prekinili odkrivanje izdelkov za ponovne nakupe. Alexa Plus že upravlja naprave pametnega doma in omogoča rezervacije; naslednji logični korak je avtomatizacija rutinskih nakupov z navodili, kot je “poskrbite, da bo moje gospodinjstvo preskrbljeno z najcenejšimi žitaricami brez glutena, zamenjajte blagovno znamko, če se cena na enoto poveča za 10 %“. S tem se zruši odkrivanje v zgornjem tunelu in ustvari novo bojišče, kjer blagovne znamke tekmujejo, da bi postale privzeto priporočilo agenta – nova vrsta “nevidne police”.

NovaACT: agent brskalnika (predogled raziskav)

Ta agent za delovanje brskalnika, ki je še vedno v fazi raziskav, naj bi bistveno izboljšal natančnost večstopenjskih nalog z današnjih 30-60 % na več kot 90 %. Za e-trgovino bi to sčasoma lahko omogočilo agente, ki bi delovali avtonomno:

  •     krmarijo po blagajni
  •     uporabljajo točke zvestobe
  •     iskanje najboljših ponudb pri več trgovcih na drobno
  •     prikazovanje sponzoriranih ponudb med potovanjem

Ko bo program NovaACT dozorel, bo lahko Amazonov AI agent primerjal nakupovanje na spletnih straneh Nike.com, Walmart.com in Amazon, nato pa samodejno izvedel najboljšo ponudbo. Amazon lahko to možnost vgradi v gumbe “Buy button” s storitvijo Prime ali razširitve brskalnikov, s čimer bi lahko pridobil ekonomijo v stilu partnerskih podjetij tudi za nakupe zunaj spletnega mesta. To bi od oglaševalcev in trgovcev na drobno zahtevalo, da ponovno razmislijo o tem, kako hkrati predstaviti ponudbe človeškim kupcem in agentom umetne inteligence.

Zmanjšanje stroškov: 30-40 % cenejša umetna inteligenca

Amazon je poudaril znatno znižanje stroškov zaradi čipov Trainium 2. Za trgovce na drobno in oglaševalce so tako funkcije umetne inteligence bolj ekonomsko upravičene na več načinov:

  • Personalizacija v velikem obsegu: Nižji stroški omogočajo trgovcem na drobno, da brez prevelikih stroškov ustvarijo edinstvene opise izdelkov, priporočila in vizualne podobe za posamezne stranke.
  • Optimizacija kreativnosti v realnem času: Oglaševalci si lahko privoščijo ustvarjanje in preizkušanje več različic kreativ na prikaz, pri čemer lahko sporočila prilagodijo na podlagi zgodovine nakupovanja posameznika.
  • Vgrajena umetna inteligenca povsod: Ker se stroški znižujejo, je mogoče funkcije umetne inteligence vključiti v izdelke z nižjimi maržami in vsakodnevne nakupovalne izkušnje, za katere prej ni bilo mogoče upravičiti stroškov.

Za razliko od konkurentov Amazon gradi na celotnem nizu umetne inteligence, kar mu daje potencialno stroškovno in integracijsko prednost pred podjetji, ki se osredotočajo le na en nivo AI.

Amazon Rolls Out Generative AI Shopping Assistant - Voicebot.ai

Kako to spreminja trgovino

Amazonove objave o umetni inteligenci v prvem četrtletju 2025 razkrivajo celovito strategijo, ki zajema vse od silicija do nakupovalne izkušnje. Amazon z oblikovanjem AI modelov, glasovnih vmesnikov in v delovanje usmerjenih agentov ne izboljšuje le svojega trenutnega poslovanja, temveč spreminja način, kako bodo ljudje v prihodnosti odkrivali, ocenjevali in kupovali izdelke.

Za trgovce na drobno in oglaševalce je sporočilo jasno: pripravite se na svet, v katerem bodo pogovorni vmesniki nadomestili tradicionalna iskalna polja, v katerem bodo nakupovalni agenti samodejno opravljali rutinske nakupe in v katerem bo dinamična, personalizirana vsebina postala norma. Tisti, ki bodo svoje strategije prilagodili tej trgovinski pokrajini, ki jo poganja umetna inteligenca, bodo uspeli; tisti, ki tega ne bodo storili, bodo morda postali vse bolj nevidni za jutrišnje kupce.

Qwen3

Alibaba je pravkar predstavil družino modelov umetne inteligence Qwen3.

Po prvih primerjalnih testih so nekatere različice že presegle OpenAI in Google pri kritičnih testih.

  •     modeli Qwen3 imajo od 0,6B do 235B parametrov in podpirajo 119 jezikov.
  •     so “hibridni” modeli, ki lahko po potrebi poglobljeno razmišljajo ali se hitro odzovejo pri preprostejših nalogah
  •     Nekateri uporabljajo arhitekturo Mixture of Experts (MoE) za hitrejše in učinkovitejše reševanje problemov
  •     Vodilni model, Qwen-3-235B-A22B, je v primerjalnih testih kodiranja in matematike premagal o3-mini podjetja OpenAI in Googlov Gemini 2.5 Pro
  •     Čeprav največji model še ni javen, je Qwen3-32B odprt in že tekmuje z vodilnimi modeli, kot je DeepSeek R1
  •     Modeli Qwen3 so usposobljeni na 36 bilijonih žetonov, vključno z učbeniki, pari za preverjanje kakovosti, kodo in vsebinami, ki jih ustvarja umetna inteligenca
  •     Na voljo za prenos na straneh Hugging Face, GitHub in prek ponudnikov storitev v oblaku, kot sta Fireworks AI in Hyperbolic

image