Boom AI Generatif Mendorong Biaya Memori Melambung, Google Luncurkan Model AI Lokal yang Lebih Hemat RAM
Google telah meluncurkan model AI lokal terbaru, Gemma 4, yang lebih hemat RAM. Model ini hadir untuk memenuhi kekosongan di antara model yang diluncurkan sebelumnya. Dengan keefisienan yang lebih baik, Anda mungkin dapat menjalankannya pada laptop konsumen yang cukup standar.
Rilis Model Gemma 4 Baru
Pada April, Google merilis empat model dalam keluarga Gemma 4, yang juga menandai peralihan ke lisensi Apache 2.0 yang lebih terbuka. Model awal tersebut termasuk dua opsi yang dioptimalkan untuk mobile (E2B dan E4B) serta dua model untuk pekerjaan yang lebih serius (26B Mixture of Experts dan 31B Dense). Namun, hal ini meninggalkan celah yang cukup besar di tengah, yang kini diisi oleh model baru ini.
Model Gemma 4 12B jauh lebih mampu daripada versi mobile, tetapi tidak memerlukan akselerator AI seharga $20.000 untuk menjalankannya secara lokal. Google mengklaim bahwa Gemma 4 12B unik karena dapat berjalan pada banyak laptop konsumen tanpa mengorbankan kualitas. Asalkan Anda memiliki komputer dengan 16GB RAM sistem atau VRAM, model 12-miliar-parameter ini akan berfungsi. Ini setengah dari jejak memori total Gemma 4 26B MoE, dan Google mengklaim bahwa model baru ini hampir sama mampu, setidaknya menurut benchmark.