Google akan segera meluncurkan berbagai alat dan sistem bertenaga kecerdasan buatan (AI) baru, termasuk asisten AI yang secara proaktif membantu pengguna dengan melakukan tugas-tugas atas nama mereka.
Konsep AI "agentic" menjadi fokus utama dalam konferensi tahunan pengembang Google, Google I/O.
Agen AI terbaru bernama Gemini Spark adalah salah satu dari banyak pengumuman perusahaan pada konferensi yang digelar Selasa waktu setempat.
"Kami kini berada di era Gemini yang agentic," ujar CEO Google Sundar Pichai di hadapan hadirin di amfiteater dekat kantor pusat perusahaan di Mountain View, California.
"Saya telah mencoba berbagai agen dan Anda benar-benar bisa melihat potensinya, tetapi masih awal untuk membuat agen mudah digunakan, sangat aman, dan benar-benar membantu."
Investasi Besar dan Pertumbuhan Pengguna
Google dan perusahaan induknya, Alphabet Inc., telah menginvestasikan miliaran dolar dalam pengembangan AI.
Eksekutif keuangan puncak perusahaan mengatakan dalam panggilan dengan investor pada akhir April bahwa belanja modal tahun ini mungkin mencapai $190 miliar.
Investasi tersebut tampaknya membuahkan hasil, dengan laba kuartalan menunjukkan pertumbuhan yang kuat. Saham perusahaan telah naik 11% sejak laporan bulan lalu.
Pichai mengatakan dalam pidato utama bahwa aplikasi Gemini memiliki 400 juta pengguna aktif bulanan tahun lalu, tetapi jumlah pengguna kini telah melampaui 900 juta, lebih dari dua kali lipat dalam setahun.
Model Gemini Terbaru Hadir
Keluarga model terbaru Google, Gemini 3.5, mulai diluncurkan pada Selasa kepada miliaran pengguna global, dimulai dengan Gemini 3.5 Flash.
Model Flash ini berfokus pada kecepatan, dan Google mengatakan 3.5 Flash adalah model agentic dan coding terkuat mereka, tetapi juga sekitar empat kali lebih cepat dari beberapa pesaing.
Model ini kini menjadi default untuk aplikasi Gemini dan "AI mode" di pencarian Google.
Perusahaan juga sedang mengerjakan versi 3.5 dari Gemini Pro, yang digunakan secara internal dan diharapkan diluncurkan bulan depan.
Gemini 3.5 dikembangkan dengan pelatihan dan mitigasi keselamatan baru yang lebih canggih, sehingga modelnya cenderung tidak menghasilkan konten berbahaya atau secara keliru menolak menjawab pertanyaan yang aman, kata perusahaan.
Google juga mengumumkan model baru, Gemini Omni, yang memungkinkan pengguna membuat video berkualitas tinggi dengan memasukkan berbagai input, baik teks, gambar, video, maupun audio.
Video yang dibuat Omni kemudian dapat diedit dengan mudah melalui percakapan dengan model.
Pengguna nantinya juga bisa membuat gambar dan audio dengan Omni, tetapi belum ada detail kapan fitur tersebut akan diluncurkan.
Perusahaan mengatakan video Omni akan tampak lebih realistis daripada video yang dibuat oleh model lain karena pemahamannya tentang gaya gravitasi, energi kinetik, dan dinamika fluida.
Gemini Omni Flash, yang pertama dari keluarga Omni, diluncurkan pada Selasa untuk pelanggan Google AI Plus, Pro, dan Ultra melalui aplikasi Gemini dan Google Flow.
Mulai pekan ini, akan tersedia gratis di YouTube Shorts dan YouTube Create App.
Semua video yang dibuat dengan Omni akan menyertakan tanda air digital tak terlihat milik Google, SynthID, tetapi Google juga menambahkan verifikasi kredensial konten ke aplikasi Gemini.
Alat ini menentukan apakah konten seperti foto atau video dibuat oleh AI atau ditangkap dengan kamera ponsel dan diedit dengan alat AI.
Alat ini akan tersedia di pencarian di Chrome dalam beberapa bulan mendatang.
Google juga mengumumkan perusahaan AI OpenAI, Kakao, dan Eleven Labs mengadopsi teknologi SynthID untuk lebih banyak konten buatan AI mereka.
Agen 24/7 dan AI yang Dapat Dipakai
Didukung oleh Gemini 3.5, Gemini Spark akan mampu menyelesaikan tugas-tugas rutin seperti menyortir catatan rapat, email, dan obrolan, lalu membuat dokumen dengan kesimpulan dan daftar tugas terbesar.
Tidak seperti agen lain yang tersedia, Spark berbasis di cloud, sehingga terus bekerja di latar belakang bahkan saat pengguna menutup laptop atau mengunci ponsel.
Sifat proaktif dari agen AI inilah yang membedakannya dari chatbot, dan hal ini juga menimbulkan beberapa kekhawatiran tentang kekuatan teknologi tersebut.
Gemini Spark dirancang untuk meminta izin sebelum melakukan tugas "berisiko tinggi" seperti mengirim email atau melakukan pembelian, kata perusahaan.
Penguji terpilih akan memiliki akses ke agen tersebut mulai Selasa, dan perusahaan berencana meluncurkan mode beta ke pelanggan di AS yang berlangganan Google AI Ultra.
Akhir musim panas nanti, Gemini Spark akan beroperasi langsung di dalam Chrome, kata perusahaan.
Di antara banyak pengumuman berpusat AI di konferensi tersebut adalah pembaruan tentang kacamata pintar yang telah lama ditunggu dari Google, yang akan hadir dalam dua jenis: kacamata audio yang menawarkan bantuan lisan di telinga, dan kacamata tampilan yang memberikan informasi secara visual.
Kacamata audio akan hadir lebih dulu, dengan perusahaan memperkirakannya tiba pada musim gugur tahun ini.
Pengguna dapat mengatakan "Hey Google" atau mengetuk sisi bingkai untuk mengakses Gemini, yang kemudian akan membantu navigasi, mengelola komunikasi di ponsel, terjemahan waktu nyata, dan tugas lainnya.
Google bermitra dengan Samsung dan merek kacamata Gentle Monster serta Warby Parker untuk membuat kacamata tersebut dan memberikan tampilan pertama pada dua desain pada Selasa, dengan kacamata hitam dari Gentle Monster dan kacamata dari Warby Parker.
Desain tersebut akan diluncurkan sebagai bagian dari koleksi lengkap merek kacamata tersebut akhir tahun ini, kata Google.
Lebih Banyak AI dalam Pencarian dan Belanja
Pada konferensi tahun lalu, perkembangan yang paling banyak dibicarakan adalah pengenalan dan peluncuran "AI mode" di mesin pencari Google.
Fitur ini memberikan jawaban yang lebih percakapan kepada pengguna sebelum memberikan tautan yang relevan, membangun perubahan yang sebelumnya diterapkan pada cara pengguna mengalami dan berinteraksi dengan platform.
Permintaan AI mode telah meningkat lebih dari dua kali lipat setiap kuartal sejak diluncurkan tahun lalu, dan alat tersebut baru-baru ini melampaui 1 miliar pengguna bulanan, menurut Liz Reid, kepala pencarian Google.
Model default baru di pencarian sekarang akan menjadi Gemini 3.5 Flash dan perusahaan memperkenalkan apa yang disebutnya kotak pencarian cerdas.
Perubahan ini, yang menurut Reid merupakan peningkatan terbesar pada kotak pencarian dalam 25 tahun, berarti kotak tersebut akan beradaptasi untuk menampung pertanyaan yang lebih panjang dan dapat membantu pengguna menulis pertanyaan mereka dengan saran bertenaga AI, bukan pelengkapan otomatis tradisional.
Pengguna juga dapat mencari menggunakan berbagai modalitas, menggunakan teks, gambar, video, file, dan bahkan tab Chrome sebagai input pencarian.
Kotak pencarian baru mulai diluncurkan pada Selasa di semua negara dan bahasa tempat AI mode saat ini tersedia.
Perusahaan juga mengumumkan alat baru, Universal Cart, yang disebutnya "keranjang belanja yang benar-benar cerdas."
Alat ini berfungsi di berbagai pedagang dan layanan sehingga pengguna dapat menambahkan barang ke keranjang mereka saat menjelajahi pencarian Google, mengobrol dengan Gemini, menonton YouTube, atau membaca email di Gmail.
Keranjang tersebut kemudian berjalan pada model Gemini untuk bekerja segera setelah barang ditempatkan di keranjang, mencari penawaran dan penurunan harga, memberikan informasi riwayat harga, dan memberi tahu pengguna saat sesuatu tersedia kembali.
Alat Universal Cart akan tersedia untuk pengguna di pencarian dan aplikasi Gemini pada musim panas ini, dengan YouTube dan Gmail menyusul.
Google juga mengumumkan bahwa perusahaan AI OpenAI, Kakao, dan Eleven Labs mengadopsi teknologi SynthID untuk lebih banyak konten buatan AI mereka.
Alat ini akan tersedia di pencarian di Chrome dalam beberapa bulan mendatang.