top of page

Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo

logo.png

Gemini công bố Flash-Lite 2.5 cho AI nhanh hơn, tiết kiệm chi phí hơn

Generatived

9:00 24/7/25

Gemini 2.5 Flash-Lite là phiên bản mới nhất của dòng sản phẩm Gemini 2.5, mang đến cho người dùng tốc độ và hiệu quả chi phí vượt trội. Model này được thiết kế để tối ưu hóa hiệu suất chi phí và cũng có tùy chọn cho phép các chức năng suy luận nâng cao cho các tác vụ phức tạp. Sản phẩm này bổ sung cho các model 2.5 Pro và 2.5 Flash hiện có, cả hai đều được thiết kế để sử dụng trong sản xuất quy mô lớn.

Phiên bản mới này tự hào có tốc độ vượt trội và vượt trội hơn phiên bản tiền nhiệm về latency ở nhiều yêu cầu khác nhau, khiến nó trở nên lý tưởng cho các ứng dụng nhạy cảm về thời gian như dịch thuật và phân loại. Gemini 2.5 Flash-Lite là phiên bản có giá cả phải chăng nhất trong phân khúc, với giá token đầu vào và đầu ra lần lượt là 0,10 đô la và 0,40 đô la cho mỗi triệu token. Ngoài ra, chi phí nhập liệu bằng giọng nói đã giảm 40% kể từ khi phát hành bản xem trước. Mặc dù có kích thước nhỏ, phiên bản này mang lại hiệu suất chất lượng cao trên tất cả các tiêu chuẩn, bao gồm mã hóa, toán học, khoa học và hiểu biết đa phương thức. Các nhà phát triển có quyền truy cập vào một bộ tính năng, bao gồm cửa sổ ngữ cảnh triệu token và một loạt các công cụ gốc.

Gemini 2.5 Flash-Lite đã là một phần không thể thiếu của nhiều dự án sáng tạo kể từ khi ra mắt. Nền tảng điện toán không gian phân tán của Satlyt đã chứng kiến những cải tiến đáng kể về latency và mức tiêu thụ điện năng, và các avatar AI của HeyGen cho nội dung video được hưởng lợi từ khả năng phân tích và dịch video nhanh chóng của mô hình. DocsHound tận dụng mô hình để chuyển đổi bản demo sản phẩm thành tài liệu nhanh hơn bao giờ hết, và Evertune tận dụng mô hình để hỗ trợ phân tích biểu đạt thương hiệu cho khách hàng. Các nhà phát triển có thể tích hợp Gemini 2.5 Flash-Lite vào dự án của họ bằng cách chỉ định mô hình trong mã của họ. Tuy nhiên, bí danh xem trước sẽ bị loại bỏ vào cuối năm nay.

Chia sẻ bài viết này:

Tin tức mới nhất
マイクロソフト、Claude Opus 5.5の提供を開始

マイクロソフト、Claude Opus 5.5の提供を開始

7:00 24/9/26

Microsoft(ワシントン州)は、Anthropicが開発した最新AIモデル「Claude Opus 5.5」を開発者向けプラットフォーム「Microsoft Foundry」上で一般提供開始した。

マイクロソフト、AIエージェント実行基盤�を提供

マイクロソフト、AIエージェント実行基盤を提供

7:00 24/9/26

Microsoft(ワシントン州)は、自律型AIエージェントの安全な実行と統制を両立する新機能「Azure Container Apps Sandboxes」の一般提供を開始した。

マイクロソフト、AI犯罪基盤を妨害

マイクロソフト、AI犯罪基盤を妨害

7:00 24/9/26

Microsoft(ワシントン州)は、サイバー犯罪プラットフォーム「EvilTokens」のインフラを妨害・無効化したと発表した。

NVIDIAがMoE高速化手法発表

NVIDIAがMoE高速化手法発表

7:00 24/9/26

NVIDIA(米国カリフォルニア州)は、大規模言語モデルやバイオ基盤モデルに向けたMoE(Mixture-of-Experts)アーキテクチャの学習効率化手法を公開した。

Copyright © 2024 Generatived - All right Reserved.

Chia sẻ bài viết này:

Chia sẻ bài viết này:

Generatived AI Logo

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

  • Facebook
  • X

Hãy theo dõi chúng tôi

Ngôn ngữ

Tin tức mới nhất
マイクロソフト、Claude Opus 5.5の提供を開始

マイクロソフト、Claude Opus 5.5の提供を開始

7:00 24/9/26

Microsoft(ワシントン州)は、Anthropicが開発した最新AIモデル「Claude Opus 5.5」を開発者向けプラットフォーム「Microsoft Foundry」上で一般提供開始した。

マイクロソフト、AIエージェント実行基盤を提供

マイクロソフト、AIエージェント実行基盤を提供

7:00 24/9/26

Microsoft(ワシントン州)は、自律型AIエージェントの安全な実行と統制を両立する新機能「Azure Container Apps Sandboxes」の一般提供を開始した。

マイクロソフト、AI犯罪基盤を妨害

マイクロソフト、AI犯罪基盤を妨害

7:00 24/9/26

Microsoft(ワシントン州)は、サイバー犯罪プラットフォーム「EvilTokens」のインフラを妨害・無効化したと発表した。

NVIDIAがMoE高速化手法発表

NVIDIAがMoE高速化手法発表

7:00 24/9/26

NVIDIA(米国カリフォルニア州)は、大規模言語モデルやバイオ基盤モデルに向けたMoE(Mixture-of-Experts)アーキテクチャの学習効率化手法を公開した。

bottom of page