Veebisaidi ikoon Xpert.Digital

Kus on Gemini 3.5 Pro? Google'i Gemini rünnak: kui kiirus muutub leidlikkusest olulisemaks

Kus on Gemini 3.5 Pro? Google'i Gemini rünnak: kui kiirus muutub leidlikkusest olulisemaks

Kus on Gemini 3.5 Pro? Google'i Gemini rünnak: kui kiirus muutub leidlikkusest olulisemaks – Pilt: Xpert.Digital

Tehisintellekti hinnalangus: kuidas Google Gemini 3.6 Flashiga turgu revolutsiooniliselt muudab

Odavam geniaalse asemel: Google'i üllatav strateegia muutus Gemini puhul

Google'i uus tehisintellekti plaan: kas ettevõte loobub targema tehisintellekti võidujooksust?

Google muudab globaalses tehisintellekti võidujooksus drastiliselt mängureegleid. Selle asemel, et pidada isoleeritud võitlust konkurentidega nagu OpenAI ja Anthropic kõige intelligentsema – ja seega ka kõige kallima – lipulaevamudeli pärast, keskendub tehnoloogiahiiglane radikaalsele tõhususele. Uue mudeliperekonnaga, mis keskendub Gemini 3.6 Flashile, äärmiselt energiasäästlikule Flash-Lite'ile ja kõrgelt spetsialiseeritud, kuid praegu saladuses hoitud Cyber-mudelile, on kesksel kohal uus mõõdik: kulude vähendamine maksimaalse praktilisusega. Kuigi kauaoodatud lipulaev Gemini 3.5 Pro on endiselt kättesaamatu, positsioneerib Google end kiiresti kasvava agentmajanduse asendamatu alusteenuse pakkujana. Aga mida see strateegiline nihe tähendab generatiivse tehisintellekti tuleviku jaoks? Ja miks peab Google oma viimast turvamudelit üldsuse jaoks liiga riskantseks? Järgnev artikkel analüüsib Google'i pragmaatilist teed järgmise tehisintellekti põlvkonna poole ja uurib selle tohutut mõju ettevõtetele ja arendajatele.

Miks Google eelistab pakkuda kolme väikest mudelit ühe suure lubaduse täitmise asemel

Google'i viimane samm suurte tehisintellekti pakkujate vahelises võidujooksus järgib mustrit, mis on tööstuses üha enam normiks muutumas: ühe monoliitse edasimineku asemel pakub ettevõte tervet mudeliperekonda, mis on kohandatud erinevatele kasutusjuhtudele. Gemini 3.6 Flashi, Gemini 3.5 Flash-Lite'i ja Gemini 3.5 Flash Cyberiga käivitab Google järgmise evolutsioonilise etapi vaid mõne kuu jooksul pärast Gemini 3.5 Flashi tutvustamist mais. Tähelepanuväärne on siinkohal vähem üksikute uuenduste tehniline sisu kui nende aluseks olev strateegiline sõnum: Google ei positsioneeri end enam eelkõige kõige intelligentsema mudeli pakkujana, vaid pigem majanduslikult kõige tõhusama tehisintellekti ökosüsteemi pakkujana.

Kokkuhoidlikkus kui uus staatusesümbol tehisintellekti võidujooksus

Gemini 3.6 Flashi peamine müügiargument ei ole suurem intelligentsus, vaid kulude vähendamine. Google reklaamib Artificial Analysis Indexi mõõtmiste põhjal umbes 17-protsendilist žetoonide tarbimise vähenemist võrreldes eelkäija 3.5 Flashiga. Mõnes võrdlusaluses, näiteks DeepSWE-s, öeldakse, et genereeritud väljundžetooni hind väheneb koguni 65 protsenti. Samal ajal on langenud ka nominaalhind: kui Gemini 3.5 Flashi arveldati 1,50 dollarit miljoni sisendžetooni ja 9 dollarit miljoni väljundžetooni kohta, siis Gemini 3.6 Flash maksab muutumatute sisendkuludega vaid 7,50 dollarit miljoni väljundžetooni kohta. See väiksema tarbimise ja madalama ühikuhinna kombinatsioon avaldab selgelt märgatavat mõju ettevõtete tegevuskuludele, kes juurutavad generatiivset tehisintellekti mastaapselt.

See keskendumine tõhususele ei ole kokkusattumus, vaid pigem väljendus majanduslikust reaalsusest, mis praegu kogu tööstusharu kujundab. Suured keelemudelid tekitavad iga üksiku päringuga arvutuskulusid, mis moodustavad märkimisväärse summa miljonite või miljardite igapäevaste päringute käsitlemisel. Pilveteenuse pakkujad ja platvormioperaatorid, kes soovivad skaleerida agentsüsteeme, mis iseseisvalt mitmeastmelisi ülesandeid täidavad, peavad drastiliselt vähendama märgi tarbimist sammu kohta; vastasel juhul neelavad selliste süsteemide majandusliku kasu taristukulud. Google lahendab just selle probleemi, pakkudes uut mudelit, mis ettevõtte enda väidete kohaselt nõuab mitmeastmeliste töövoogude lõpuleviimiseks vähem mõtteprotsesse ja tööriistakõnesid.

Tehnoloogilised edusammud ulatuvad pelgalt kuluküsimusest kaugemale

Lisaks suurenenud tõhususele näitab Gemini 3.6 Flash edusamme ka klassikalistes jõudlusnäitajates. Programmeerimisülesannetes, mida mõõdetakse DeepSWE testiga, tõuseb edukuse määr 37 protsendilt 49 protsendile. ML Research Benchmark MLE Bench'is paraneb mudel 49,7 protsendilt 63,9 protsendile. Edusamme on näha ka teadmistepõhistes ülesannetes: GDPval-AA skoor tõuseb 1349 punktilt 1421 punktile. Eriti tähelepanuväärne on arvutioskuse paranemine, täpsemalt tehisintellekti võime osas iseseisvalt graafilistes kasutajaliidestes navigeerida: OSWorld-Verified skoor tõuseb 78,4 protsendilt 83 protsendile. Lisaks on mudeli teadmistebaasi uuendatud jaanuarist 2025 kuni märtsini 2026, mis on tänapäeva kiiresti arenevas tehnoloogilises maastikus märkimisväärne praktiline eelis.

Vaatamata neile edusammudele jääb Gemini 3.6 Flash selgelt keskklassi mudeliks. Otsestes võrdlustestides platvormidel nagu Arena.ai jääb see alla tippmudelitele nagu Claude Opus või uus GPT 5.6-Sol. See ei ole nõrkus, vaid teadlik disainivalik: Google loobub väitest pakkuda kõige võimsamat mudelit üldiselt ja keskendub selle asemel segmendile, kus kiirus, hind ja piisav kvaliteet on olulisemad kui intelligentsuse osas teoreetiline maksimum. See strateegia meenutab klassikalist turusegmenteerimist teistes tehnoloogiasektorites, näiteks protsessorite puhul, kus tootjad pakuvad järjepidevalt tõhusaid keskklassi tooteid massturu rakenduste jaoks koos suure jõudlusega kiipidega.

Agentide ökonoomika uus aluskiht

Gemini 3.5 Flash-Lite'iga taotleb Google veelgi radikaalsemat efektiivsuseesmärki. See mudel on loodud spetsiaalselt tehisintellekti agentide – süsteemide, mis suudavad iseseisvalt töödelda keerulisi ülesandeid mitmes etapis ilma inimese sekkumist igas etapis vajamata – loomise ja skaleerimise aluseks. See edestab oluliselt oma eelkäijat 3.1 Flash-Lite'i nii teadmuspõhiste kui ka programmeerimisülesannete võrdlusalustes, samas kui tegevuskulud jäävad erakordselt madalaks – 0,30 dollarit miljoni sisendtokeni ja 2,50 dollarit miljoni väljundtokeni kohta. Mudeli paindlikkus on tähelepanuväärne: olenevalt kasutusjuhtumist saab seda konfigureerida nii, et see toimiks eriti kiiresti ja kulutõhusalt või toetuks rohkem oma arutlusvõimele. Viimane on vajalik siis, kui ülesandeid tuleb töödelda koostöös mitme spetsialiseeritud alamprogrammi ehk subagentide abil.

See arhitektuuriline otsus näitab suunda, kuhu kogu tööstusharu liigub. Paljud turuvaatlejad usuvad, et tehisintellekti tulevik ei peitu mitte üha suuremates individuaalsetes mudelites, vaid väiksemate, spetsialiseeritud mudelite võrgusüsteemides, mis koos töötades kaardistavad keerulisi protsesse. Võimsa mudeli üks suur arvutus asendatakse paljude väikeste ja odavate päringutega, et luua paralleelselt või järjestikku koostööd tegevaid lihtsustatud mudeleid. Flash-Lite'i-sugune mudel sobib ideaalselt selle arhitektuuriga, kuna see vähendab päringu maksumust sedavõrd, et suur hulk päringuid jääb majanduslikult tasuvaks. Teadaanne, et Flash-Lite hakkab esitama tehisintellekti tulemusi ka Google'i veebiotsingus, rõhutab veelgi Google'i keskset rolli sellele lihtsustatud mudelile massiturul.

Kahe näoga tööriist: küberturvalisus ärivaldkonnana

Kolmas uus väljalase, Gemini 3.5 Flash Cyber, tähistab Flashi seeria olulist laiendamist väga tundlikule valdkonnale. See mudel on spetsiaalselt treenitud tarkvarakoodi turvanõrkuste leidmiseks ja analüüsimiseks ning parandusmeetmete soovitamiseks. See spetsialiseerumine põhineb juba niigi tõhusal Gemini 3.5 Flashil, mida on veelgi täiustatud sihipärase treenimise abil suurte koodibaaside analüüsimiseks. Ühe kalli päringu saatmise asemel väga suurele mudelile kutsub üldine turvaagent Codemender sujuvamaks muudetud Cyberi mudelit mitu korda, et paralleelselt uurida programmi erinevaid teostusradasid. Seejärel koondatakse individuaalsed osatulemused terviklikuks aruandeks.

Selle lähenemisviisi toimivust saab näha konkreetsetes numbrites. Keerulise JavaScripti mootori V8 testis tuvastas kübermudel 55 erinevat ja kinnitatud haavatavust, samas kui üldine Flashi mudel leidis vaid 47 ja Anthropicu Claude Opus 4.6 kõigest 36. Kümme avastatud probleemi leiti ainult spetsialiseeritud kübermudeli abil. CyberGymi võrdlusaluses, mis hindab tehisintellekti agente sadade reaalsete tarkvaranõrkuste suhtes, saavutab mudel koos mitme testimisega jõudlustaseme, mis on võrreldav oluliselt suuremate ja kallimate turvamudelitega sellistelt müüjatelt nagu Anthropic ja OpenAI. Google'i pilveturbemeeskonna sisetestis avastas mudel vaid kahe tunni jooksul mitu kriitilist haavatavust tootmissüsteemides, sealhulgas mälu rikkumise haavatavuse, mille jaoks genereeriti ka toimiv ärakasutamise mehhanism, mis möödus tavalistest kaitsemehhanismidest, näiteks aadressiruumi paigutuse randomiseerimisest.

See tohutu võime tuvastada koodis haavatavusi on ka mudeli suurim risk. Google ise tunnistab avalikult tehnoloogia kaheotstarbelist olemust: sama võimekust, mis võimaldab kaitsjatel haavatavusi sulgeda, võivad ründajad kasutada samade lünkade ärakasutamiseks enne nende parandamist. Sel põhjusel on Google otsustanud mudelit esialgu mitte avalikult kättesaadavaks teha, vaid jagada seda eksklusiivselt oma turvatööriista Codemender kaudu osana rangelt kontrollitud pilootprogrammist valitsuste ja valitud usaldusväärsete partneritega. Juurdepääsu laiendamise konkreetset ajakava pole antud. See vastumeelsus peegeldab kogu tööstuses kasvavat teadlikkust sellest, et turvavaldkonnas spetsialiseeritud tehisintellekti süsteeme ei saa avaldada samade reeglite alusel kui üldiseid vestlusrobotite rakendusi.

 

Digitaalse transformatsiooni uus dimensioon hallatud tehisintellekti (AI) abil - platvormi- ja B2B-lahendus | Xpert Consulting

Digitaalse transformatsiooni uus dimensioon hallatud tehisintellekti (AI) abil – platvormi ja B2B lahendus | Xpert Consulting - pilt: Xpert.Digital

Siit saate teada, kuidas teie ettevõte saab kiiresti, turvaliselt ja ilma kõrgete sisenemisbarjäärideta rakendada kohandatud tehisintellekti lahendusi.

Hallatud tehisintellekti platvorm on teie kõikehõlmav ja muretu tehisintellekti lahendus. Keerulise tehnoloogia, kalli infrastruktuuri ja pikkade arendusprotsessidega tegelemise asemel saate spetsialiseerunud partnerilt teie vajadustele vastava valmislahenduse – sageli vaid mõne päeva jooksul.

Peamised eelised lühidalt:

⚡ Kiire teostus: Ideest kasutusvalmis rakenduseni päevade, mitte kuude jooksul. Pakume praktilisi lahendusi, mis loovad kohest lisaväärtust.

🔒 Maksimaalne andmeturve: Teie tundlikud andmed jäävad teie kätte. Garanteerime turvalise ja nõuetele vastava töötlemise ilma andmeid kolmandate osapooltega jagamata.

💸 Finantsriski pole: maksate ainult tulemuste eest. Suured esialgsed investeeringud riist- ja tarkvarasse või personali jäävad täielikult ära.

🎯 Keskendu oma põhitegevusele: Keskendu sellele, mida sa kõige paremini oskad. Meie hoolitseme sinu tehisintellekti lahenduse kogu tehnilise juurutamise, käitamise ja hoolduse eest.

📈 Tulevikukindel ja skaleeritav: teie tehisintellekt kasvab koos teiega. Tagame pideva optimeerimise ja skaleeritavuse ning kohandame mudeleid paindlikult uutele nõuetele.

Lisateavet leiate siit:

 

Google lükkab Gemini 3.5 Pro väljalaske edasi ja keskendub suurele Flashi pealetungile

Kadunud lipulaevamudeli ümbritsev müsteerium

Kogu teadaande juures on rabav see, mis puudub: praeguse põlvkonna võimsaim mudel Gemini 3.5 Pro ilmumist oodati juba mais Google I/O-l ning pole sellest ajast peale teoks saanud. Google selgitab vaid, et uut versiooni testitakse praegu valitud partneritega ja see tehakse kättesaadavaks pärast nende testide edukat läbimist. Ettevõte ei ole veel konkreetset väljalaskekuupäeva avaldanud, kuid rõhutab, et ootamine ei tohiks olla palju pikem. Mitmete valdkonna vaatlejate vaatenurgast viitab see korduv viivitus sellele, et Pro versioon ei ole veel saavutanud soovitud tulemusi keerulistes programmeerimis- ja arutlusülesannetes, mistõttu Google eelistab ilmselt oodata, selle asemel et välja anda toodet, mis ei vasta ettevõtte enda kvaliteedistandarditele ega konkurentide ootustele.

See tagasihoidlikkus heidab huvitavat valgust juhtivate tehisintellekti pakkujate konkurentsidünaamikale. Samal ajal kui OpenAI ja Anthropic toovad kiiresti järjest välja uusi tippmudeleid, keskendub Google praegu nähtavalt keskmise ja algtaseme jõudlussegmentidele. Seda võib tõlgendada ettevaatlikkuse märgina, aga ka nutika turupositsioneerimisena: potentsiaalselt alles areneva lipulaevamudeli esitlemise asemel kindlustab Google turuosa taskukohaste, kiirete ja praktiliste mudelitega, mis juba katavad usaldusväärselt enamiku igapäevastest ärirakendustest. Paljude ärikasutusjuhtude puhul, näiteks dokumentide töötlemise, aruandluse või lihtsate programmeerimisülesannete puhul, on mudeli absoluutne tippjõudlus niikuinii teisejärguline, kui kiirus ja hind on sobivad.

Saadavus ja integreerimine olemasolevasse ökosüsteemi

Uute mudelite praktiline kasutuselevõtt on märkimisväärselt kiire ja laialt levinud. Gemini 3.6 Flash ja Gemini 3.5 Flash-Lite on juba saadaval Google'i tehisintellekti stuudios, Android Studios ja Gemini Enterprise Agent platvormil. Lisaks on 3.6 Flash integreeritud Antigravity arenduskeskkonda ja Gemini Enterprise rakendusse, samas kui mõlemad mudelid on saadaval ka tavalises Gemini lõppkasutaja rakenduses. Eriti tähelepanuväärne on teadaanne, et Flash-Lite hakkab peagi edastama ka Google'i veebiotsingute tehisintellekti loodud tulemusi, mis arvestades selle otsingumootori tohutut päringute mahtu, rõhutab kulutõhusa mudeli olulisust Google'i jaoks täiesti uues dimensioonis. Kiire kasutuselevõtt on ilmne ka väljaspool Google'i enda ökosüsteemi: Gemini 3.6 Flash integreeriti GitHub Copiloti selle väljakuulutamise päeval, mis rõhutab suurte tehisintellekti pakkujate üha suurenevat integratsiooni väljakujunenud arendustööriistadega.

See lai ja samaaegne integratsioon erinevate tootesarjade vahel näitab Google'i süstemaatilist lähenemist uute mudelipõlvkondade sujuvale juurutamisele kogu oma tooteportfellis. Erinevalt varasematest mudelimuudatustest, mille puhul teatamise ja tegeliku kättesaadavuse vahel erinevates rakendustes sageli esines märgatavaid lünki, näib see juurutamine olevat hoolikalt korraldatud protsess. See viitab küpsele sisemisele infrastruktuurile, mis võimaldab uue mudeli peaaegu samaaegset juurutamist kõigis arendajate ja lõppkasutajatega suhtlemise punktides.

Tulevikku vaadates: Gemini 4 väljakuulutamine

Lisaks kolmele konkreetsele mudelile annab Google teadaandes ülevaate ka järgmisest suuremast põlvkonnast. Ettevõte kinnitab, et nn eelkoolitus ehk Gemini 4 põhiline algkoolituse etapp on juba alanud. Google ei avalda tulevase suuremahulise mudeli arhitektuuri, suuruse ega kavandatud võimaluste kohta täpseid tehnilisi üksikasju, kuid rõhutab oma elevust seni tehtud edusammude üle. See tahtlikult ebamäärane sõnastus on tüüpiline suurte tehisintellekti laborite kommunikatsioonistrateegiale, mis ühelt poolt tekitavad ootusi, kuid teiselt poolt ei taha anda kontrollitavaid lubadusi, mis võivad hiljem ennatlikuks osutuda.

Arvestades viimaste aastate väljalasketsüklit, kus Google tutvustas uusi baasmudeleid tavaliselt kevadel oma I/O arendajate konverentsil ning sügisel või talvel tegi suuri põlvkonnavahetusi, tundub Gemini 4 väljalase selle aasta lõpupoole usutav. Ettevõtete jaoks, kes planeerivad oma tehisintellekti strateegiat pikaajaliselt, tähendab see seda, et igaüks, kes investeerib täna Flashi perekonda, teeb seda teadmisega, et uus tehnoloogiline alus võib järgneda vaid mõne kuu pärast, mis omakorda nõuaks uusi migratsiooniotsuseid. See tehisintellekti mudelipõlvkondade lühike poolestusaeg esitab IT-osakondadele ja tarkvaraarhitektidele pideva väljakutse kujundada oma süsteemid nii, et alusmudelite muudatusi saaks rakendada võimalikult sujuvalt.

Kontekst: Mida see mudelistrateegia Google'i turupositsiooni kohta paljastab

Üldiselt näitab hiljutine teadaanne, et juhtivate tehisintellekti ettevõtete vaheline konkurents jaguneb üha enam kaheks paralleelseks dimensiooniks. Ühelt poolt käib võidujooks kõige intelligentsem ja võimsam mudel – valdkond, kus Anthropic ja OpenAI domineerivad praegu oma lipulaevatoodetega pealkirjades ning kus Google jääb oma edasilükatud Pro-versiooniga nähtavalt maha. Teisest küljest on tekkimas teine, potentsiaalselt majanduslikult olulisem lahinguväli: võistlus kõige tõhusama, kulutõhusama ja skaleeritavama infrastruktuuri pärast tehisintellekti igapäevaseks ja massiliseks juurutamiseks ettevõtetes, otsingumootorites ja agentsüsteemides. Selles teises valdkonnas positsioneerib Google end oma Flashi tooteperekonnaga väga teadlikult ja järjekindlalt esirinnas.

See kahetine strateegia on majanduslikult mõistlik. Valdava enamiku ettevõtete praktiliste rakenduste puhul, alates automatiseeritud dokumenditöötlusest ja klienditeeninduse vestlusrobotitest kuni lihtsate programmeerimisülesanneteni, ei ole mudeli absoluutne tipptasemel intelligentsus määrav tegur, vaid pigem tasakaal kulude, kiiruse ja piisava kvaliteedi vahel. Pilveteenuse pakkujad, kes peavad päevas töötlema miljoneid päringuid, saavad rohkem kasu kahekohalisest protsendilisest žetoonide kulude vähenemisest kui kalli tippmudeli arutlusvõime marginaalsest paranemisest. Google näib seda arusaama järjepidevalt oma tootestrateegiasse üle kandvat, saates samal ajal signaali arendajatele ja äriklientidele: igaüks, kes soovib täna luua skaleeritavaid tehisintellekti agente või kulutõhusaid otsinguintegratsioone, leiab Flashi perekonnast kindla ja majanduslikult elujõulise aluse, olenemata sellest, millal suur Pro-mudel lõpuks välja antakse.

Samal ajal paljastab spetsialiseeritud kübermudeli kasutuselevõtt tehisintellekti konkurentsimaastikul uue tahu, mis ulatub pelgadest efektiivsuskaalutlustest kaugemale: tehisintellekti üha suurem kasutamine aktiivse tööriistana küberturvalisuses koos kõigi sellega kaasnevate võimaluste ja riskidega kaitsjatele väärkasutuse korral. Selle mudeli kontrollitud ja etapiviisiline avaldamine näitab, et Google on teadlik oma sotsiaalsest vastutusest eriti võimsate turvatööriistade avaldamisel ning on valmis piirama kommertslikku ulatust, vähemalt ajutiselt, turvakaalutluste kasuks. See, kuidas see tasakaal laia kättesaadavuse ja kontrollitud juurdepääsu vahel tulevikus areneb, saab tõenäoliselt üheks huvitavamaks valdkonnaks, mida jälgida, kuna tehisintellekti mudelid muutuvad üha võimekamaks iseseisvalt analüüsima ja manipuleerima keerulisi tehnilisi süsteeme.

 

Teie globaalne turundus- ja äriarenduspartner

☑️ Meie ärikeel on inglise või saksa keel

☑️ UUS: Kirjavahetus teie emakeeles!

 

Konrad Wolfenstein

Mina ja minu meeskond oleme hea meelega teie käsutuses teie isikliku nõustajana.

Võite minuga ühendust võtta, täites siinse kontaktvormi wolfenstein@xpert.digital:või helistades mulle numbril +49 7348 4088 965. Minu e-posti aadress on

Ootan põnevusega meie ühist projekti.

 

 

☑️ VKEde tugi strateegia, konsultatsioonide, planeerimise ja rakendamise alal

☑️ Digitaalse strateegia loomine või ümberkorraldamine ja digitaliseerimine

☑️ Rahvusvaheliste müügiprotsesside laiendamine ja optimeerimine

☑️ Globaalsed ja digitaalsed B2B kauplemisplatvormid

☑️ Pioneer Äriarendus / Turundus / PR / Messid

 

🎯🎯🎯 Andmepõhine B2B tööstuskeskus peaaegu ettevõttesisese lahendusena

Peaaegu ettevõttesisene lahendus: kuidas Xpert.Digital täidab B2B turunduse ja müügi operatiivseid lünki – nutikas sisupõhine äri - pilt: Xpert.Digital

Xpert.Digital on Konrad Wolfenstein juhitav andmepõhine B2B tööstuskeskus. Ettevõte tegutseb tööstuspartneritele välise, peaaegu sisemise lahendusena, täites turunduse, sisu ja müügi operatiivseid lünki – ilma kliendipoolsete lisaressurssideta.

Lisateavet leiate siit:

Jäta mobiiliversioon vahele