Google DeepMind Mengumumkan Tiga Peningkatan Model Gemini dan Melancarkan Pra-pelatihan untuk Gemini 4

iconMetaEra
Kongsi
AI summary iconRingkasan
Google DeepMind mengumumkan tiga peningkatan model Gemini—Gemini 3.6 Flash, Gemini 3.5 Flash-Lite, dan Gemini 3.5 Flash Cyber—masing-masing dioptimalkan untuk kos, kelajuan, dan prestasi. Gemini 3.6 Flash mengurangkan penggunaan token sebanyak 65% dalam tugas pengaturcaraan dan menurunkan harga. Flash-Lite menghantar 350 token per saat dengan kos yang lebih rendah. Flash Cyber menargetkan berita kerentanan dengan fokus pada keselamatan siber, mengesan dan membaiki kelemahan sistem. Google juga melancarkan usaha pra-pelatihan terbesarnya hingga kini untuk model Gemini 4 yang akan datang, yang boleh memberi kesan kepada berita di rantai dengan alat-alat bersepadu AI baharu.
Google DeepMind melancarkan tiga kemas kini model Gemini: model utama 3.6 Flash mampu menghemat hingga 65% Token dalam tugas pengkodean, dengan harga $1.50 masukan dan $7.50 keluaran per juta Token, lebih murah, serta meningkatkan prestasi secara ketara dalam ujian seperti DeepSWE; versi ringan 3.5 Flash-Lite mencapai kelajuan keluaran 350 Token per saat, dengan harga serendah $0.30 masukan dan $2.50 keluaran, serta mengungguli Gemini 3 Flash yang lebih besar dalam beberapa ujian; model keselamatan 3.5 Flash Cyber khusus untuk memperbaiki lubang keamanan. Google juga mengumumkan permulaan "latihan pra-pelatihan paling agresif sepanjang sejarah" dengan sasaran langsung ke Gemini 4. Bagi pengguna, keuntungan utama ialah penurunan menyeluruh dalam harga, penggunaan Token, dan kos operasi Agent.

Penulis artikel, sumber: XinZhiYuan

Bagi kita yang benar-benar mengeluarkan wang sungguhan untuk membeli Token dan membina Agent, pelancaran hari ini sebenarnya hanya satu kata yang paling nyata—penurunan.

Tiga berturut-turut, Google kali ini benar-benar tidak berpura-pura lagi.

Hari ini, Google DeepMind melepaskan tiga senjata utama sekaligus:

  • Gemini 3.6 Flash
  • Gemini 3.5 Flash-Lite
  • Gemini 3.5 Flash Cyber

Sebuah kuasa utama yang lebih kuat, sebuah versi ringan yang lebih pantas, dan seorang askar keselamatan khas yang pakar dalam menutup lubang kelemahan.

Tiga Gemini merujuk kepada perkara yang sama: membuat AI Agent yang berjalan di persekitaran pengeluaran lebih pantas, lebih pintar, dan lebih murah.

Pada hari yang sama dengan pengumuman itu, Google juga meletakkan bom yang lebih besar—

Google DeepMind "latihan pra-pertama paling agresif sepanjang sejarah telah bermula", dengan sasaran model generasi seterusnya, Gemini 4.

Di satu sisi, Gemini melancarkan tiga kempen berturut-turut, di sisi lain, Gemini 4 bermula.

Sinyal yang diberikan oleh Google sangat jelas, permainan akhir AI baru sahaja bermula.

Google membongkar senjata larut malam, melancarkan tiga Gemini sekaligus

Tiga buah Gemini, akan diuraikan satu per satu.

Gemini 3.6 Flash, menjimatkan 65% token

Mari kita lihat "pusat perhatian" sebenar kali ini—Gemini 3.6 Flash.

Fitur utama kali ini ialah Token yang sangat menjimatkan.

Berdasarkan pengiraan Artificial Analysis Index, ia menggunakan 17% lebih sedikit Token output berbanding generasi sebelumnya 3.5 Flash.

Pada benchmark pengkodean seperti DeepSWE, penghematan tertinggi boleh mencapai 65%.

Tidak hanya menghasilkan lebih sedikit kata, ia juga memerlukan lebih sedikit langkah penalaran dan pemanggilan alat untuk menyelesaikan tugas berbilang langkah, dengan jalan yang lebih pendek, sehingga lebih cepat dan lebih hemat.

Selain itu, Gemini 3.6 Flash juga lebih murah sambil mengurangkan penggunaan Token:

Masukkan 1.5 dolar, keluaran 7.5 dolar setiap juta Token, lebih murah berbanding 3.5 Flash.

Lebih jimat, lebih murah, dan lebih berkesan—inilah yang disebut kesungguhan. 3.6 Flash mengungguli generasi sebelumnya dalam beberapa ujian utama—

  • DeepSWE: Ujian pemrograman 37% ➔ 49%
  • MLE Bench: Ujian penyelidikan pembelajaran mesin 49.7% ➔ 63.9%
  • OSWorld-Disahkan: Menguji model untuk mengendalikan komputer secara langsung, meningkatkan dari 78.4% ➔ 83%
  • GDPVal-AA v2: Tugasan kerja berasaskan pengetahuan telah meraih 1,421, meningkat lebih daripada 70 daripada generasi sebelumnya

Dalam demo berikut, 3.6 Flash memperlihatkan keahlian pengaturan agen pintar ganda, tidak hanya berjaya menyelesaikan tugas pemindahan kod yang kompleks, tetapi juga mengungguli 3.5 Flash dari segi kelajuan respons dan kualiti kod.

Dengan Gemini Canvas, 3.6 Flash menghubungkan alur kerja 3D, serta menghasilkan alat ekstraksi tekstur profesional setara fotografi dalam sekejap.

Ia juga boleh berubah menjadi 'Pereka Interaksi AI' untuk menghasilkan studio bertema dengan pengalaman mendalam yang luar biasa.

3.5 Flash-Lite, mengalahkan saudara tertua

Gemini 3.5 Flash-Lite versi kedua mengambil jalan lain: menekankan kecepatan dan harga yang murah.

3.5 Flash-Lite menghasilkan kelajuan 350 token per saat, yang paling pantas dalam keseluruhan siri 3.5.

Harga juga sangat rendah, dengan input $0.3 dan output $2.5 setiap juta token.

Cepat dan murah, direka khas untuk skenario frekuensi tinggi dan volum tinggi seperti pemprosesan dokumen besar dan carian Agent.

Yang paling hebat ialah, ia justru menginjakkan kaki ke atas «kakak tertua» sendiri.

Dalam pelbagai ujian pemrograman dan Agent, model ringkas ini berjaya mengalahkan Gemini 3 Flash yang lebih besar—

  • SWE-Bench Pro: 54.2% vs 49.6%
  • OSWorld-Dikemaskan: 74.0% vs 65.1%

3.6 Flash bertindak sebagai "otak utama" untuk membongkar tugas, Flash-Lite bertindak sebagai "duplikat" untuk menjalankan tugas secara beramai-ramai.

Satu bertanggungjawab untuk berfikir, banyak yang bertanggungjawab untuk menjalankan, dengan mudah menghilangkan tekanan arus tinggi.

Dalam demo rasmi, dua elemen digabungkan, Flash-Lite menghasilkan 25 reka bentuk laman web berkelanjutan tinggi sekaligus, secepat hampir "fikir sekali, keluarkan sekumpulan".

Flash-Lite kini telah dilancarkan di Aplikasi Gemini dan akan menyusul dimasukkan ke dalam carian Google.

Flash Cyber: Boleh memperbaiki lubang keamanan, tetapi tidak semua orang boleh menggunakannya

Gemini 3.5 Flash Cyber, model keras yang khusus untuk keselamatan siber.

Tugasnya hanya satu, mencari lubang dan memperbaikinya.

Sekarang, realiti yang memalukan ialah kecepatan AI dalam mencari lubang keamanan sudah lebih cepat daripada kecepatan sistem semasa memperbaiki lubang tersebut.

Google memasukkan model ini ke dalam agen keselamatan kod CodeMender, yang bekerja secara kolaboratif melalui beberapa agen Cyber, dan memecahkan rekod SOTA di benchmark keselamatan CyberGym, dengan kos yang lebih rendah berbanding model yang lebih besar—

Gunakan model yang lebih ringan untuk melakukan tugas yang paling memerlukan ketepatan.

Namun, model ini tidak boleh diakses oleh orang biasa pada masa ini.

Gemini 4 bermula - pra-pelatihan paling agresif sepanjang sejarah

Walaupun Gemini 3.5 Pro belum diperoleh, pelatihan Gemini 4 sudah bermula.

Tiga tembakan berturut-turut ini hanyalah pembuka, tetapi pengumuman terakhir itulah yang menjadi sorotan utama.

Google telah mengesahkan bahawa satu latihan pra-pelatihan paling agresif dalam sejarah telah dimulakan, dengan sasaran langsung kepada Gemini 4.

Pengguna berpengalaman menyatakan, mengikut jadual latihan biasa Google selama 6 bulan, mungkin pada akhir tahun ini kita akan melihat Gemini 4.

Bagi kita yang benar-benar mengeluarkan wang sungguhan untuk membeli Token dan membina Agent, pelancaran hari ini sebenarnya hanya satu kata yang paling nyata—penurunan.

Harga turun, penggunaan token turun, kos menjalankan satu Agent turun.

Mengenai flagship yang masih belum datang dan Gemini 4 yang baru sahaja dilancarkan, keduanya masih merupakan "futures".

Yang boleh digunakan dan murah, itulah yang boleh dimasukkan ke dalam dompet anda hari ini. Sehebat apa pun flagship, ia mesti terlebih dahulu berjaya dilancarkan.

Penafian: Maklumat yang terdapat pada halaman ini mungkin telah diperoleh daripada pihak ketiga dan tidak semestinya menggambarkan pandangan atau pendapat KuCoin. Kandungan ini adalah disediakan bagi tujuan maklumat umum sahaja, tanpa sebarang perwakilan atau waranti dalam apa jua bentuk, dan juga tidak boleh ditafsirkan sebagai nasihat kewangan atau pelaburan. KuCoin tidak akan bertanggungjawab untuk sebarang kesilapan atau pengabaian, atau untuk sebarang akibat yang terhasil daripada penggunaan maklumat ini. Pelaburan dalam aset digital boleh membawa risiko. Sila menilai risiko produk dan toleransi risiko anda dengan teliti berdasarkan keadaan kewangan anda sendiri. Untuk maklumat lanjut, sila rujuk kepada Terma Penggunaan dan Pendedahan Risiko kami.