Ipinakilala ng Google ang tatlong bagong Gemini models upang mapabuti ang efficiency at bilis ng AI agent

iconTechFlow
I-share
AI summary iconSummary
Lumunsad ang Google ng tatlong bagong Gemini models—3.6 Flash, 3.5 Flash-Lite, at 3.5 Flash Cyber—upang palakasin ang performance ng AI Agent. Ang model na 3.6 Flash ay nagbabawas ng paggamit ng tokens ng 17% at nagpapabuti sa coding at knowledge tasks. Ang 3.5 Flash-Lite ay nakakamit ng 350 tokens bawat segundo, pinakamabilis sa serye nito. Ang 3.5 Flash Cyber ay nakatuon sa pagkilala at paglutas ng mga isyu sa cybersecurity sa code. Ang mga update na ito ay nagsasama sa balita tungkol sa AI + crypto at maaaring makaapekto sa mga bagong listahan ng token sa larangan.

May-akda: Google DeepMind

Isinalin: Deep潮 TechFlow

DeepChaoyu Summary: Ang tatlong modelo na ipinakilala ni Google ay nakatuon sa paglutas ng totoong hamon sa komersyalisasyon ng AI Agent—gastos at bilis. Ang 3.6 Flash ay nag-iipon ng 17% mas maraming token kaysa sa nakaraang bersyon, mas mura, ngunit mas maganda ang kalidad; ang 3.5 Flash-Lite ay nakakamit ng 350 token/s, ang pinakamabilis na modelo sa 3.5 series; samantala, ang espesyalisadong modelo para sa网络安全 na Flash Cyber ay tumutok sa pangangailangan sa pagpapabuti ng mga butas sa code. Hindi ito isang paligsahan sa performance score, kundi isang paghahanda para sa malawakang pag-deploy ng AI Agent.

Ipinakilala ng Google DeepMind ngayon ang tatlong bagong Gemini model: 3.6 Flash, 3.5 Flash-Lite, at 3.5 Flash Cyber. Ang mga model na ito ay disenyo para sa efficiency, latency, at reliability na kailangan sa malawakang pagbuo ng AI Agent.

Gemini 3.6 Flash: Mas epektibo, mas mataas ang kalidad

3.6 Flash ay isang pagpapabuti batay sa feedback ng mga developer tungkol sa 3.5 Flash. Hindi lamang ito lumalawak sa coding at knowledge work, kundi nagpapababa nang malaki ng pagkakagamit ng token. Ayon sa Artificial Analysis Index, ang 3.6 Flash ay nagbawas ng 17% sa pagkakagamit ng output token kumpara sa 3.5 Flash. Sa ilang benchmark tulad ng Datacurve’s DeepSWE, ang pagbawas ay umabot hanggang sa 65%. Mas kaunti rin ang mga hakbang sa pag-iisip at pagtawag sa mga tool na kailangan para matapos ang mga multi-step workflow.

Kasama ng pagtaas ng efficiency ay mas mababang presyo. Pinapresyohan sa $1.5 bawat milyong input token at $7.5 bawat milyong output token, bumaba ng 3.6% ang kabuuang gastos bawat Agent task, gawing mas ekonomiko ang pagbuo at pagpapatakbo ng Agent.

Kahit mas epektibo, mas mabuting performance ng 3.6 Flash kaysa sa 3.5 Flash sa iba't ibang use case:

Mas tumpak ang pag-edit ng code, na nagbawas ng hindi kailangang pagbabago at pag-uulit ng loop, na nagtataglay ng 49% sa DeepSWE (3.5 Flash ay 37%), at nagpataas nang malaki sa 63.9% sa MLE Bench, ang machine learning research benchmark (3.5 Flash ay 49.7%)

Nag-improve ang kakayahan sa paggamit ng computer, ang OSWorld-Verified score ay 83.0% (3.5 Flash ay 78.4%). Ang paggamit ng computer ay ngayon available bilang built-in client tool sa Gemini API at Gemini Enterprise

Mas mabuting pagganap sa mga gawain na kaugnay sa kaalaman, tulad ng GDPval-AA v2 benchmark score na 1421 (ang 3.5 Flash ay 1349). Nakakita ang mga kliyente tulad ng Hebbia at Harvey na ito ay lalong epektibo sa mga maraming modalidad na gawain tulad ng pag-decode ng dokumento, pag-analyze ng mga graph at data, at pagsulat ng mga ulat.

Ang feedback ng customer ay 3.6 Flash ay isang pag-unlad sa halaga at kalidad, na nagtataglay ng balanseng token efficiency, accuracy, at speed sa mga kumplikadong workflow at knowledge-based tasks.

Security design

3.6 ang Flash ay may nakapagpapalakas na mga pagsisiguro sa kaligtasan na nakasaklaw sa kimikal, biyolohikal, radyoaktibo, at nukleyar (CBRN) pati na rin ang pang-aabuso sa cyber attack. Ang mga pagsisigurong ito ay nagpapalakas ng kakayahan ng modelo na labanan ang mga pag-atake sa paglilipas sa mga limitasyon. Samantala, tinuruan ang modelo upang mabawasan ang pagtanggi sa mga kapaki-pakinabang na paggamit.

Gemini 3.5 Flash-Lite: Ginawa para sa pag-scall ng Agent workflow

3.5 Flash-Lite ay disenyo para sa mga task na nangangailangan ng mababang latency at mataas na throughput, tulad ng paghahanap ng Agent at pagproseso ng dokumento.

Ang 3.5 Flash-Lite ay ang pinakamabilis na modelo sa serie ng 3.5. Ayon sa Artificial Analysis, ito ay nakakapagpapatakbo ng 350 output token bawat segundo. Ang presyo ay $0.30 bawat milyong input token at $2.50 bawat milyong output token, at mas mataas ang kalidad kumpara sa 3.1 Flash-Lite, nagbibigay ng mahusay na halaga para sa mga developer at customer na nagpapatakbo ng malalaking produksyon na gawain.

3.5 Flash-Lite ay sumusuporta sa epektibong paglalawak ng Agent system. Sa lahat ng antas ng pag-iisip, mas mahusay ang modelo kumpara sa 3.1 Flash-Lite. Maaaring i-configure ng mga developer ang modelo batay sa workload: gamitin ang pinakamaliit at mababang antas ng pag-iisip para sa malalaking hanay ng mga gawain, na nagbibigay-prioridad sa mababang latency at mababang gastos; o paganahin ang mas mataas na antas ng pag-iisip upang tratuhin ang mga multi-step na sub-Agent workload. Ang modelo ay mayroon na rin ng computer operation bilang built-in tool, na nagbibigay ng maaasahang suporta sa mga gawain ng Agent sa iba’t ibang interface.

May malaking pagpapabuti sa coding at mga gawain ng Agent, tulad ng skor na 54% sa Terminal-Bench 2.1 (3.1 Flash-Lite ay 31%), mahabang konteksto tulad ng skor na 72.2% sa GDM-MRCR v2 (3.1 Flash-Lite ay 60.1%), at pagpapatupad ng mga aktuwal na gawain tulad ng skor na 1140 sa GDPval-AA v2 (3.1 Flash-Lite ay 642).

Sa katotohanan, sa maraming pagtataya ng Agent at coding, lalong lumampas ang 3.5 Flash-Lite sa 3 Flash, kabilang ang SWE-Bench Pro (54.2% kumpara sa 49.6%) at OSWorld-Verified (74.0% kumpara sa 65.1%), gawing mas mabilis at mas makapangyarihan na pagpipilian para sa mga workload ng 2.5 at 3 Flash.

Ang mga kliyente sa panahon ng pagbuo ay nagteklar na ang 3.5 Flash-Lite ay may natatanging kombinasyon ng bilis,智能化, at cost efficiency sa pagpapalawak ng mga workflow ng Agent at mga gawain sa pagproseso ng data.

Gemini 3.5 Flash Cyber sa CodeMender: Mabilis na paghahanap at pagpapabuti ng mga vulnerability

Mas mabilis na natutuklasan ng AI models ang mga security vulnerability kaysa sa kasalukuyang sistema na nagpapabuti sa kanila. Kailangan ng isang epektibo at makapangyarihang paraan sa software security upang harapin ang lalong lumalalang banta na ito.

Ang pagiging mabilis at epektibo ni Flash ay ginagawa itong ideal na batayan para sa malawakang pagdetekta, pag-verify, at pagpapabuti ng mga problema sa kaligtasan ng code. Ang Gemini 3.5 Flash Cyber ay binuo batay sa 3.5 Flash, na binawian ng mga pagpapabuti upang espesyalisahin ang paghahanap at pagpapabuti ng mga vulnarabilidad sa cybersecurity, at mas mababa ang presyo bawat token kaysa sa mga malalaking modelo.

Sa CodeMender, ang maraming 3.5 Flash Cyber Agent ay nagtatrabaho nang sabay-sabay upang lumikha ng isang komprehensibong ulat, na nakakamit ng pinakamataas na antas ng kompetisyon sa popular na benchmark na CyberGym.

Dahil sa dual-use na kalikasan ng teknolohiyang ito, aming ginamit ang isang mapagbantay na pagpapalabas. Ang modelo ay maaaring maibigay sa pormal na anyo ng isang limitadong pagsubok sa pamamagitan ng CodeMender para sa mga gobyerno at matitibay na kapartner. Ito ay magpapahintulot sa mga unang linya ng depensa na makahanap at mag-ayos ng mga mahalagang vulnerabilities bago ito maabuso, habang binabawasan ang mas malawak na panganib ng pang-aabuso.

Magsimula na agad

3.6 Flash at 3.5 Flash-Lite ay magagamit na mula sa araw na ito:

Maaaring gamitin ng mga developer ang Gemini API sa pamamagitan ng Google AI Studio at Android Studio. Ang 3.6 Flash ay maaari rin gamitin sa Google Antigravity.

Ang Enterprise Agent platform ng Gemini ay maaaring gamitin ng mga negosyo. Ang 3.6 Flash ay maaari ring gamitin sa Gemini Enterprise app.

Magagamit ng lahat sa Gemini app. Ang 3.5 Flash-Lite ay pati na rin ay ipinapakilala sa Google Search.

Magbigay ng feedback upang mapabuti ang mga hinaharap na Gemini model, at umaasahang ilalabas namin ang 3.5 Pro sa malapit na pagkakataon.

Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito. Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.