top of page

Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo

logo.png

Gemini công bố Flash-Lite 2.5 cho AI nhanh hơn, tiết kiệm chi phí hơn

Generatived

9:00 24/7/25

Gemini 2.5 Flash-Lite là phiên bản mới nhất của dòng sản phẩm Gemini 2.5, mang đến cho người dùng tốc độ và hiệu quả chi phí vượt trội. Model này được thiết kế để tối ưu hóa hiệu suất chi phí và cũng có tùy chọn cho phép các chức năng suy luận nâng cao cho các tác vụ phức tạp. Sản phẩm này bổ sung cho các model 2.5 Pro và 2.5 Flash hiện có, cả hai đều được thiết kế để sử dụng trong sản xuất quy mô lớn.

Phiên bản mới này tự hào có tốc độ vượt trội và vượt trội hơn phiên bản tiền nhiệm về latency ở nhiều yêu cầu khác nhau, khiến nó trở nên lý tưởng cho các ứng dụng nhạy cảm về thời gian như dịch thuật và phân loại. Gemini 2.5 Flash-Lite là phiên bản có giá cả phải chăng nhất trong phân khúc, với giá token đầu vào và đầu ra lần lượt là 0,10 đô la và 0,40 đô la cho mỗi triệu token. Ngoài ra, chi phí nhập liệu bằng giọng nói đã giảm 40% kể từ khi phát hành bản xem trước. Mặc dù có kích thước nhỏ, phiên bản này mang lại hiệu suất chất lượng cao trên tất cả các tiêu chuẩn, bao gồm mã hóa, toán học, khoa học và hiểu biết đa phương thức. Các nhà phát triển có quyền truy cập vào một bộ tính năng, bao gồm cửa sổ ngữ cảnh triệu token và một loạt các công cụ gốc.

Gemini 2.5 Flash-Lite đã là một phần không thể thiếu của nhiều dự án sáng tạo kể từ khi ra mắt. Nền tảng điện toán không gian phân tán của Satlyt đã chứng kiến những cải tiến đáng kể về latency và mức tiêu thụ điện năng, và các avatar AI của HeyGen cho nội dung video được hưởng lợi từ khả năng phân tích và dịch video nhanh chóng của mô hình. DocsHound tận dụng mô hình để chuyển đổi bản demo sản phẩm thành tài liệu nhanh hơn bao giờ hết, và Evertune tận dụng mô hình để hỗ trợ phân tích biểu đạt thương hiệu cho khách hàng. Các nhà phát triển có thể tích hợp Gemini 2.5 Flash-Lite vào dự án của họ bằng cách chỉ định mô hình trong mã của họ. Tuy nhiên, bí danh xem trước sẽ bị loại bỏ vào cuối năm nay.

Chia sẻ bài viết này:

Tin tức mới nhất
NVIDIAが機密計算技術検証

NVIDIAが機密計算技術検証

7:00 24/9/26

NVIDIA(米国カリフォルニア州)は、機密計算機能「Confidential Computing」を有効化した環境におけるAI推論処理の性能検証結果を公表した。

MicrosoftがGPT6提供

MicrosoftがGPT6提供

7:00 24/9/26

Microsoft(米国ワシントン州)は、開発プラットフォーム『Microsoft Foundry』において『GPT-6 Sol』および『GPT-6 Luna』の提供を開始した。

NVIDIAがウイルス構造公開

NVIDIAがウイルス構造公開

7:00 24/9/26

NVIDIA(米国カリフォルニア州)は、国際研究組織の連合体と共同で2,800種以上のウイルスにおけるタンパク質複合体の3D予測構造を一般公開したと発表した。

NVIDIAが新評価指標発表

NVIDIAが新評価指標発表

7:00 24/9/26

NVIDIA(米国カリフォルニア州)は、推論サーバー向けソフトウェアにおけるAIコーディングエージェントの性能を測定する新評価指標『SWE-Serve』を発表した。

Copyright © 2024 Generatived - All right Reserved.

Chia sẻ bài viết này:

Chia sẻ bài viết này:

Generatived AI Logo

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

  • Facebook
  • X

Hãy theo dõi chúng tôi

Ngôn ngữ

Tin tức mới nhất
NVIDIAが機密計算技術検証

NVIDIAが機密計算技術検証

7:00 24/9/26

NVIDIA(米国カリフォルニア州)は、機密計算機能「Confidential Computing」を有効化した環境におけるAI推論処理の性能検証結果を公表した。

MicrosoftがGPT6提供

MicrosoftがGPT6提供

7:00 24/9/26

Microsoft(米国ワシントン州)は、開発プラットフォーム『Microsoft Foundry』において『GPT-6 Sol』および『GPT-6 Luna』の提供を開始した。

NVIDIAがウイルス構造公開

NVIDIAがウイルス構造公開

7:00 24/9/26

NVIDIA(米国カリフォルニア州)は、国際研究組織の連合体と共同で2,800種以上のウイルスにおけるタンパク質複合体の3D予測構造を一般公開したと発表した。

NVIDIAが新評価指標発表

NVIDIAが新評価指標発表

7:00 24/9/26

NVIDIA(米国カリフォルニア州)は、推論サーバー向けソフトウェアにおけるAIコーディングエージェントの性能を測定する新評価指標『SWE-Serve』を発表した。

bottom of page