top of page
Generatif (Beta) |. Memberikan berita dan tren terkini dalam AI generatif
logo.png

Gemini Mengumumkan Flash-Lite 2.5 untuk AI yang Lebih Cepat dan Hemat Biaya

Generatived

24/7/25, 09.00

Gemini 2.5 Flash-Lite adalah tambahan terbaru dalam keluarga model Gemini 2.5, yang memberikan kecepatan dan efisiensi biaya yang tak tertandingi bagi pengguna. Model ini dirancang untuk mengoptimalkan kinerja biaya dan juga dilengkapi opsi untuk mengaktifkan kemampuan inferensi tingkat lanjut untuk tugas-tugas kompleks. Model ini melengkapi model 2.5 Pro dan 2.5 Flash yang sudah ada, keduanya dirancang untuk penggunaan produksi skala besar.

Model baru ini menawarkan kecepatan superior dan mengungguli pendahulunya dalam hal latency pada berbagai perintah, menjadikannya ideal untuk aplikasi yang sensitif terhadap waktu seperti penerjemahan dan klasifikasi. Gemini 2.5 Flash-Lite adalah yang paling terjangkau di kelasnya, dengan harga token input dan output masing-masing $0,10 dan $0,40 per juta token. Selain itu, biaya input suara telah berkurang 40% sejak rilis pratinjau. Meskipun ukurannya kecil, model ini memberikan kinerja berkualitas tinggi di semua tolok ukur, termasuk pengodean, matematika, sains, dan pemahaman multimoda. Pengembang memiliki akses ke serangkaian fitur, termasuk jendela konteks jutaan token dan berbagai alat asli.

Gemini 2.5 Flash-Lite telah menjadi bagian integral dari sejumlah proyek inovatif sejak dirilis. Platform komputasi ruang terdistribusi Satlyt telah mengalami peningkatan signifikan dalam latency dan konsumsi daya, sementara avatar berbasis AI HeyGen untuk konten video mendapatkan manfaat dari kemampuan analisis video dan penerjemahan yang cepat dari model ini. DocsHound memanfaatkan model ini untuk mengubah demo produk menjadi dokumen lebih cepat dari sebelumnya, dan Evertune memanfaatkan model ini untuk mendukung analisis ekspresi merek bagi kliennya. Para pengembang dapat mengintegrasikan Gemini 2.5 Flash-Lite ke dalam proyek mereka dengan menentukan model tersebut dalam kode mereka. Namun, alias pratinjau akan dihentikan penggunaannya akhir tahun ini.

Bagikan artikel ini:

Tin tức mới nhất
WPP Meluncurkan Kerangka Data Pemasaran Terintegrasi

WPP Meluncurkan Kerangka Data Pemasaran Terintegrasi

25/8/26, 07.00

WPP membangun arsitektur data terintegrasi di Google Cloud untuk mendukung ekosistem pemasaran berbasis agennya.

NVIDIA Meluncurkan Platform Inferensi Groq yang Dipercepat

NVIDIA Meluncurkan Platform Inferensi Groq yang Dipercepat

25/8/26, 07.00

NVIDIA mengungkapkan evaluasi benchmark independen yang mencakup akselerator inferensi interaktif Groq 3 LPX yang dirancang untuk beban kerja kecerdasan buatan berbasis agen.

NVIDIA Mengevaluasi Kinerja Perangkat Keras Inferensi Agen

NVIDIA Mengevaluasi Kinerja Perangkat Keras Inferensi Agen

25/8/26, 07.00

NVIDIA mengevaluasi kinerja sistem di seluruh beban kerja kecerdasan buatan berbasis agen menggunakan rangkaian benchmark SemiAnalysis AgentX.

NVIDIA Merilis Platform Arsitektur CPU Vera

NVIDIA Merilis Platform Arsitektur CPU Vera

25/8/26, 07.00

NVIDIA mengungkapkan detail teknis mengenai platform CPU Vera yang dirancang khusus untuk mengoptimalkan beban kerja agen kecerdasan buatan di pusat data modern.

Copyright © 2024 Generatived - All right Reserved.

Bagikan artikel ini:

Bagikan artikel ini:

Generatived

Hãy theo dõi chúng tôi

  • Facebook
  • X

Bahasa

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

Generatived AI Logo

Generatived adalah layanan yang memberikan informasi dan tren khusus dalam AI Generatif. Kami akan melakukan yang terbaik untuk menyampaikan informasi tentang dunia yang berubah dengan cepat.

  • Facebook
  • X

Ikuti kami

Bahasa

Berita terkini
WPP Meluncurkan Kerangka Data Pemasaran Terintegrasi

WPP Meluncurkan Kerangka Data Pemasaran Terintegrasi

25/8/26, 07.00

WPP membangun arsitektur data terintegrasi di Google Cloud untuk mendukung ekosistem pemasaran berbasis agennya.

NVIDIA Meluncurkan Platform Inferensi Groq yang Dipercepat

NVIDIA Meluncurkan Platform Inferensi Groq yang Dipercepat

25/8/26, 07.00

NVIDIA mengungkapkan evaluasi benchmark independen yang mencakup akselerator inferensi interaktif Groq 3 LPX yang dirancang untuk beban kerja kecerdasan buatan berbasis agen.

NVIDIA Mengevaluasi Kinerja Perangkat Keras Inferensi Agen

NVIDIA Mengevaluasi Kinerja Perangkat Keras Inferensi Agen

25/8/26, 07.00

NVIDIA mengevaluasi kinerja sistem di seluruh beban kerja kecerdasan buatan berbasis agen menggunakan rangkaian benchmark SemiAnalysis AgentX.

NVIDIA Merilis Platform Arsitektur CPU Vera

NVIDIA Merilis Platform Arsitektur CPU Vera

25/8/26, 07.00

NVIDIA mengungkapkan detail teknis mengenai platform CPU Vera yang dirancang khusus untuk mengoptimalkan beban kerja agen kecerdasan buatan di pusat data modern.

bottom of page