OpenAI lansira GPT-5.2 in pospešuje boj za napredno umetno inteligenco

  • GPT-5.2 je bil predstavljen manj kot mesec dni po GPT-5.1 in je pozicioniran kot najzmogljivejši model OpenAI za profesionalno uporabo.
  • Serija vključuje tri različne različice – Instant, Thinking in Pro – z izboljšavami na področju sklepanja, kodiranja, preglednic in večstopenjskih projektov.
  • OpenAI trdi, da GPT-5.2 znatno zmanjša halucinacije in da v 70,9 % nalog, ocenjenih v GDPval, prekaša ali doseže enak rezultat kot človeški strokovnjaki.
  • Uvedba se začne v plačljivem ChatGPT in API-ju, sredi močnega konkurenčnega pritiska Googlovih Gemini 3 in Anthropic.

OpenAI izdaja GPT-5.2

OpenAI je s predstavitvijo GPT-5.2, svojega doslej najnaprednejšega modela za profesionalno in poslovno delo, dirko za umetno inteligenco popeljal še korak dlje. Posodobitev prihaja nenavadno hitro: pojavi se manj kot mesec dni po GPT-5.1 in sredi tehnološkega boja z Googlom, Anthropicem in drugimi konkurenti, ki prav tako pospešujejo svoje razvojne poti.

Podjetje vztraja, da ta različica ni popoln generacijski preskok, temveč razvoj znotraj serije GPT-5, osredotočen na sklepanje, zmanjševanje napak in koordinacijo orodij. Izdaja neposredno vpliva na uporabnike ChatGPT v Španiji in Evropi, kjer je uporaba asistenta postala dobro uveljavljena tako v izobraževalnih okoljih kot v podjetjih, ki ga vključujejo v svoje vsakodnevne delovne procese.

Izstrelitev s tempom "rdeče kode"

Napoved GPT-5.2 prihaja sredi zelo konkurenčnega okolja. Le nekaj dni prej je Sam Altman interno razglasil " rdečo kodo " , da bi osredotočil vire na izboljšanje ChatGPT in začasno odložil bolj eksperimentalne projekte, kot sta uvedba obvestil ali množična uporaba avtonomnih agentov. Prednostna naloga, kot je sporočil osebju, je bila vidno izboljšanje kakovosti odzivov in uspešnosti pri profesionalnih nalogah.

Aplikacijska ekipa OpenAI je pojasnila, da GPT-5.2 ni bil izdan prezgodaj zaradi te "rdeče kode ", temveč je bil v razvoju že več mesecev. Kljub temu podjetje samo priznava, da so bile dodatne ekipe, namenjene posebej ChatGPT, v pomoč pri izpopolnjevanju podrobnosti in veliko hitrejšem dokončanju različice kot GPT-5.1.

Pospešek je mogoče pojasniti tudi s pritiskom Geminija 3 , Googlovega modela , ki je v zadnjih tednih pridobil na veljavi pri uporabnikih in v različnih testih zmogljivosti, zlasti na splošnem sklepanju. Vzporedno se je Anthropic s svojimi modeli, osredotočenimi na kodo, prodrl na programsko področje. V tem scenariju je GPT-5.2 predstavljen kot odgovor OpenAI za ponovno pridobitev položaja v segmentu profesionalne umetne inteligence.

Na ravni trga podjetje priznava, da je preusmerilo svojo strategijo: manj se osredotoča na komercialne eksperimente, kot je oglaševanje, in več na krepitev tehnološke baze ChatGPT in njegovega API-ja, da bi ostalo relevantno za poslovne stranke in javne uprave, tudi v Evropi.

Razvoj znotraj serije GPT-5

OpenAI predstavlja GPT-5.2 kot naslednjo neposredno iteracijo GPT-5.1 , ne kot model naslednje generacije. Glavni cilj je izboljšati delo z znanjem: programiranje, analiza dokumentov, vizija, preglednice, predstavitve in projekti, sestavljeni iz številnih medsebojno povezanih korakov.

Med najpomembnejšimi spremembami je izboljšano obravnavanje dolgih kontekstov , kar je ključnega pomena za podjetja, ki upravljajo z dolgimi pogodbami, tehničnimi poročili ali kompleksno pravno dokumentacijo. Model lahko sledi toku pogovorov in obsežnejših dokumentov, kar zmanjšuje izgubo skladnosti v kasnejših razdelkih.

Podjetje tudi navaja, da GPT-5.2 bolje usklajuje uporabo zunanjih orodij (API-jev, baz podatkov, interpreterjev kode, notranjih sistemov), kar je ključna točka za razvijalce in IT oddelke, ki gradijo agente, sposobne izvajati dejanja v resničnem svetu, ki presegajo zgolj odzivanje z besedilom. Ta izboljšava krepi integracijo aplikacij tretjih oseb v avtomatizirane delovne procese.

Čeprav celotna arhitektura ostaja skladna z GPT-5, OpenAI trdi, da je prilagodil procese usposabljanja in poučevanja, da bi zmanjšal halucinacije in dejanske napake . V internih testih v primerjavi z GPT-5.1 različica razmišljanja in sklepanja zmanjša očitno napačne odgovore na objektivna vprašanja za približno tretjino.

Tri različice: Instant, Thinking in Pro

Kot pri nedavnih izdajah je tudi GPT-5.2 na voljo v treh različicah, zasnovanih za različne namene: Instant, Thinking in Pro . Namesto dodajanja ekskluzivnih funkcij posodobitev krepi profil vsake različice, da bi bolje razlikovala, za kaj je posamezen model priporočen.

GPT-5.2 Instant je najhitrejša in najbolj ekonomična možnost. Namenjena je vsakodnevnim poizvedbam, hitremu pisanju, iskanju informacij in podpori pri študiju . OpenAI navaja, da ponuja stabilnejše odgovore kot njegov predhodnik v tem razponu, z jasnejšimi razlagami in manj spremembami meril za podobna vprašanja.

GPT-5.2 Mišljenje je model globokega sklepanja in tisti, ki se je v tej generaciji najbolj razvil. Usposobljen je za obvladovanje kompleksnih, večstopenjskih nalog , kot so napredno programiranje, finančna analiza, interpretacija dolgih dokumentov in podrobno načrtovanje projektov. Večina izboljšav na področju matematike, znanosti in koordinacije orodij je skoncentriranih tukaj.

Končno, GPT-5.2 Pro je na vrhu ponudbe: je najzmogljivejši in najdražji model za uporabo , zasnovan za okolja, kjer je natančnost pomembnejša od zakasnitve, kot so tehnične raziskave, kompleksne pravne naloge ali zahtevni projekti analize podatkov. Ponuja najvišjo raven podrobnosti in nadzora v zameno za večjo porabo računalniške moči.

Namen te segmentacije je omogočiti tako posameznim plačljivim uporabnikom kot podjetjem in razvijalcem, da izberejo model, ki najbolj ustreza njihovemu primeru uporabe , namesto da bi se brez razlikovanja odločali za najdražjega. Za evropske organizacije s proračunskimi ali regulativnimi omejitvami lahko ta diferenciacija olajša načrtovanje stroškov in delovne obremenitve.

Rezultati testov: od namiznih računalnikov do primerjalnih testov

OpenAI zagon podpira z vrsto podatkov o učinkovitosti. V testnem paketu GDPval, ki ga je podjetje zasnovalo samo za simulacijo 44 poklicev iz resničnega sveta, GPT-5.2 Thinking uspe premagati ali izenačiti s človeškimi strokovnjaki v približno 70,9 % nalog, pri čemer jih opravi veliko hitreje in z bistveno nižjimi obratovalnimi stroški.

Na znanstvenem področju model izboljšuje svoje rezultate v testu GPQA Diamond , ki meri sklepanje na visoki ravni v znanosti, in v testu FrontierMath , ki se osredotoča na napredne matematične probleme. V nekaterih različicah testov, kot je AIME 2025, OpenAI poroča, da GPT-5.2 pri obravnavanih postavkah dosega rezultate blizu 100 %.

Poleg primerjalnih vrednosti podjetje izpostavlja interne ocene tipičnih nalog finančnih analitikov , kot so modeli s tremi stanji ali simulacije nakupov z vzvodom. V teh scenarijih se je GPT-5.2 Thinking po poročanjih izboljšal s povprečnih ocen okoli 59 % na več kot 68 %, s čimer se je približal ravni specializiranih ekip.

Izboljšave so opažene tudi pri ustvarjanju preglednic in predstavitev z jasnejšimi strukturami in manj napakami v skladnosti. Tehnološka podjetja, ki delajo z OpenAI – kot so platforme za produktivnost ali evropska zagonska podjetja za programsko opremo – so po poročanjih opazila napredek pri dolgoročnem sklepanju in dosledni uporabi avtomatiziranih orodij znotraj modela.

Vendar pa podjetje vztraja, da so merila uspešnosti le del zgodbe in da bo dejanska učinkovitost pri končnih uporabnikih v Španiji in Evropi odvisna od tega, kako bodo te zmogljivosti vključene v specifične primere uporabe: od samostojnih delavcev, ki pripravljajo proračune ali poročila, do velikih podjetij, ki za svoje osebje nameščajo notranje asistente.

Manj napak in večja stabilnost pri vsakodnevnem poslovanju

Eno od ključnih sporočil OpenAI je zmanjšanje halucinacij in dejanskih napak . Po njihovih podatkih GPT-5.2 Thinking v internih testih objektivnih vprašanj ustvari 38 % manj očitno napačnih odgovorov kot GPT-5.1. To je še posebej pomembno za tiste, ki model uporabljajo za podporo poročanju, raziskavam ali poslovnim odločitvam.

Poleg natančnosti podjetje trdi, da je izboljšalo tudi sposobnost modela za zaznavanje lastnih napak, preden posreduje končni odgovor. Z drugimi besedami, GPT-5.2 izvaja več notranjih preverjanj in zavrže rešitve, ki jih oceni kot nezanesljive, kar ima za posledico nekoliko bolj predvidljivo izkušnjo med dolgimi pogovori.

Ta posodobitev prihaja po kontroverznih incidentih, v katerih je bil OpenAI kritiziran zaradi vloge klepetalnega robota v občutljivih pogovorih , vključno s primerom najstnika, ki je storil samomor, potem ko ga je uporabil kot zaupnika. Brez spuščanja v pravne podrobnosti podjetje navaja, da GPT-5.2 prinaša izboljšave pri obravnavi občutljivih tem, s posebnim poudarkom na znakih čustvene stiske.

V praksi bi moral model bolje prilagoditi svoj ton in priporočila, ko zazna, da gre za ranljive uporabnike, čeprav OpenAI vztraja, da še vedno ne nadomešča strokovne medicinske ali psihološke podpore, kar je pomembno opozorilo glede na evropsko uredbo o umetni inteligenci.

Udobnejše okolje za razvijalce in podjetja

GPT-5.2 je neposredno namenjen tudi tistim, ki gradijo izdelke in storitve na OpenAI API-ju. Ta različica sklepanja dokazuje vrhunsko zmogljivost pri testih razvoja programske opreme , ki zahtevajo uporabo celovitih in doslednih sprememb v resničnih projektih, ne le reševanje posameznih vaj.

Platforme za sodelovalni razvoj in orodja za podprto programiranje, ki so že delovala z GPT-5.1, poročajo, da novi model bolje usklajuje zaporedja kompleksnih korakov , kar ima za posledico manj ročnih iteracij za dokončanje nalog, kot so refaktoriranje kode, uporaba revizij ali ustvarjanje modulov iz besedilnih specifikacij.

V evropskih poslovnih okoljih, kjer je integracija z notranjimi sistemi pogosto bolj konzervativna zaradi težav s skladnostjo s predpisi, lahko izboljšave doslednosti in nadzora sprememb olajšajo uporabo agentov, ki izvajajo avtomatizirana dejanja z manj neposrednim človeškim nadzorom.

Drug pomemben vidik je delovanje modela z obsežno korporativno dokumentacijo , saj GPT-5.2 izboljšuje branje, povzemanje in primerjavo pogodb, notranjih politik ali tehničnih poročil, kar je še posebej zanimivo za odvetniške pisarne, svetovalna podjetja in oddelke za skladnost v Španiji in EU.

Razpoložljivost, uvajanje in cene

OpenAI je začel globalno uvajanje GPT-5.2 v ChatGPT za svoje plačljive pakete , vključno s Plus, Pro, Go, Business in Enterprise. Uporabniki teh paketov bodo postopoma videli možnost izbire različic Instant, Thinking in Pro, medtem ko bo brezplačna različica še naprej uporabljala prejšnje modele.

V API- ju je GPT-5.2 Thinking predstavljen pod imenom gpt-5.2 , medtem ko je hitrejša, na klepet usmerjena različica prikazana kot gpt-5.2-chat-latest. OpenAI bo GPT-5.1 ohranil na voljo za prehodno obdobje več mesecev, vendar je njegov navedeni namen postopoma prenesti večino uporabe na novo serijo.

Kar zadeva ceno, GPT-5.2 zaračunava 1,75 USD na milijon vhodnih žetonov in 14 USD na milijon izhodnih žetonov za API, kar je več kot pri GPT-5.1. Kljub temu podjetje trdi, da lahko večja učinkovitost modela pri kompleksnih nalogah zmanjša skupne stroške na projekt, saj zahteva manj klicev in popravkov.

Za španska in evropska podjetja, ki cenijo predvsem zanesljivost pri analizah, ustvarjanju dokumentacije ali avtomatizaciji procesov, je logika OpenAI prodajati GPT-5.2 kot naložbo v natančnost in ne kot nizkocenovno orodje. To pozicioniranje je skladno z njihovo strategijo ciljanja na segment podjetij z visoko dodano vrednostjo.

Kar zadeva uporabo, ChatGPT ostaja eden najpogosteje uporabljenih klepetalnih robotov z umetno inteligenco na svetu, s stotinami milijonov aktivnih uporabnikov tedensko . Podjetje je prepričano, da bo izboljšanje dnevne uporabniške izkušnje, njena bolj strukturirana in predvidljiva, še dodatno spodbudilo profesionalno uporabo, zlasti na trgih, kjer je že močno prisoten, kot je Španija.

Konkurenca, infrastruktura in načrt

Izid GPT-5.2 prihaja v času, ko so se cikli posodabljanja za vodilne modele skrajšali z let na tedne . Ta hitrost jasno kaže, da tehnološka prednost postaja vse bolj minljiva in da podjetja v tem sektorju nosijo vse večje stroške, da bi sledila trendu.

Z Gemini 3 je Google izkoristil svoj privilegiran dostop do podatkov in svoj ekosistem produktivnosti (Docs, Sheets, Drive, Workspace) za integracijo umetne inteligence v orodja, ki so že vseprisotna v pisarnah po vsem svetu. Anthropic se je medtem osredotočil na varnost in zmogljivost programiranja ter okrepil svoj položaj v določenih segmentih.

Da bi ohranil ta zagon, OpenAI krepi svojo infrastrukturo s sporazumi s proizvajalci čipov in ponudniki storitev v oblaku ter z ogromnimi naložbami v podatkovne centre. Podjetje priznava, da so stroški delovanja naprednih modelov sklepanja strmo narasli in presegli podporo, ki so jo sprva zagotavljali krediti za oblak s strani partnerjev, in kot eno ključnih potez navaja sporazum z AWS za podporo svoji infrastrukturi.

Hkrati se je OpenAI zanašal na strateška zavezništva z velikimi korporacijami , kot sta Disney in Walmart , ki so v njegovih modelih videle način za ustvarjanje novih formatov vsebin in digitalnih izkušenj. Ti sporazumi, čeprav niso neposredno del funkcionalnosti GPT-5.2, ponazarjajo osredotočenost podjetja na uporabe, ki ustvarjajo ponavljajoče se prihodke in upravičujejo znatne naložbe v infrastrukturo.

V Evropi bo morala ta širitev sočasno obstajati s strožjim regulativnim okvirom, ki ga zaznamuje uredba EU o umetni inteligenci , kar bo zahtevalo večjo preglednost pri delovanju modelov, kot je GPT-5.2, in pri uporabi teh sistemov s strani podjetij in javnih uprav v svojih storitvah.

Z GPT-5.2 si OpenAI prizadeva utrditi svoj položaj vodilnega ponudnika generativne umetne inteligence za strokovnjake in organizacije, s čimer krepi sklepanje, zanesljivost in zmogljivosti integracije, ne da bi pri tem uvedel prelomno inovacijo . Ta poteza prihaja v času, ko trg začenja zahtevati manj spektakularnih demonstracij in bolj stabilna orodja, ki rešujejo resnične delovne probleme, zlasti v španskem in evropskem poslovnem sektorju, kjer sprejemanje umetne inteligence postaja ključno gonilo konkurenčnosti.

Google v Španiji aktivira »način umetne inteligence«
Povezani članek:
Google aktivira način umetne inteligence v Španiji: tako se spreminjajo iskanja

Dodaj kot prednostni vir v Googlu