top of page

Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo

logo.png

Gemini công bố Flash-Lite 2.5 cho AI nhanh hơn, tiết kiệm chi phí hơn

Generatived

9:00 24/7/25

Gemini 2.5 Flash-Lite là phiên bản mới nhất của dòng sản phẩm Gemini 2.5, mang đến cho người dùng tốc độ và hiệu quả chi phí vượt trội. Model này được thiết kế để tối ưu hóa hiệu suất chi phí và cũng có tùy chọn cho phép các chức năng suy luận nâng cao cho các tác vụ phức tạp. Sản phẩm này bổ sung cho các model 2.5 Pro và 2.5 Flash hiện có, cả hai đều được thiết kế để sử dụng trong sản xuất quy mô lớn.

Phiên bản mới này tự hào có tốc độ vượt trội và vượt trội hơn phiên bản tiền nhiệm về latency ở nhiều yêu cầu khác nhau, khiến nó trở nên lý tưởng cho các ứng dụng nhạy cảm về thời gian như dịch thuật và phân loại. Gemini 2.5 Flash-Lite là phiên bản có giá cả phải chăng nhất trong phân khúc, với giá token đầu vào và đầu ra lần lượt là 0,10 đô la và 0,40 đô la cho mỗi triệu token. Ngoài ra, chi phí nhập liệu bằng giọng nói đã giảm 40% kể từ khi phát hành bản xem trước. Mặc dù có kích thước nhỏ, phiên bản này mang lại hiệu suất chất lượng cao trên tất cả các tiêu chuẩn, bao gồm mã hóa, toán học, khoa học và hiểu biết đa phương thức. Các nhà phát triển có quyền truy cập vào một bộ tính năng, bao gồm cửa sổ ngữ cảnh triệu token và một loạt các công cụ gốc.

Gemini 2.5 Flash-Lite đã là một phần không thể thiếu của nhiều dự án sáng tạo kể từ khi ra mắt. Nền tảng điện toán không gian phân tán của Satlyt đã chứng kiến những cải tiến đáng kể về latency và mức tiêu thụ điện năng, và các avatar AI của HeyGen cho nội dung video được hưởng lợi từ khả năng phân tích và dịch video nhanh chóng của mô hình. DocsHound tận dụng mô hình để chuyển đổi bản demo sản phẩm thành tài liệu nhanh hơn bao giờ hết, và Evertune tận dụng mô hình để hỗ trợ phân tích biểu đạt thương hiệu cho khách hàng. Các nhà phát triển có thể tích hợp Gemini 2.5 Flash-Lite vào dự án của họ bằng cách chỉ định mô hình trong mã của họ. Tuy nhiên, bí danh xem trước sẽ bị loại bỏ vào cuối năm nay.

Chia sẻ bài viết này:

Tin tức mới nhất
WPP ra mắt hệ thống dữ liệu tiếp thị tích hợp.

WPP ra mắt hệ thống dữ liệu tiếp thị tích hợp.

7:00 25/8/26

WPP đã xây dựng một kiến ​​trúc dữ liệu tích hợp trên Google Cloud để hỗ trợ hệ sinh thái tiếp thị dựa trên tác nhân của mình.

NVIDIA ra mắt nền tảng suy luận Groq được tăng tốc.

NVIDIA ra mắt nền tảng suy luận Groq được tăng tốc.

7:00 25/8/26

NVIDIA đã công bố các đánh giá hiệu năng độc lập về bộ tăng tốc suy luận tương tác Groq 3 LPX được thiết kế cho các tác vụ trí tuệ nhân tạo dựa trên tác nhân.

NVIDIA đánh giá hiệu năng phần cứng suy luận tác nhân.

NVIDIA đánh giá hiệu năng phần cứng suy luận tác nhân.

7:00 25/8/26

NVIDIA đã đánh giá hiệu năng hệ thống trên các tác vụ trí tuệ nhân tạo dựa trên tác nhân bằng bộ công cụ đo hiệu năng SemiAnalysis AgentX.

NVIDIA ra mắt nền tảng kiến ​​trúc CPU Vera.

NVIDIA ra mắt nền tảng kiến ​​trúc CPU Vera.

7:00 25/8/26

NVIDIA đã tiết lộ các chi tiết kỹ thuật về nền tảng CPU Vera của mình, được thiết kế đặc biệt để tối ưu hóa khối lượng công việc của các tác nhân trí tuệ nhân tạo trong các trung tâm dữ liệu hiện đại.

Copyright © 2024 Generatived - All right Reserved.

Chia sẻ bài viết này:

Chia sẻ bài viết này:

Generatived AI Logo

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

  • Facebook
  • X

Hãy theo dõi chúng tôi

Ngôn ngữ

Tin tức mới nhất
WPP ra mắt hệ thống dữ liệu tiếp thị tích hợp.

WPP ra mắt hệ thống dữ liệu tiếp thị tích hợp.

7:00 25/8/26

WPP đã xây dựng một kiến ​​trúc dữ liệu tích hợp trên Google Cloud để hỗ trợ hệ sinh thái tiếp thị dựa trên tác nhân của mình.

NVIDIA ra mắt nền tảng suy luận Groq được tăng tốc.

NVIDIA ra mắt nền tảng suy luận Groq được tăng tốc.

7:00 25/8/26

NVIDIA đã công bố các đánh giá hiệu năng độc lập về bộ tăng tốc suy luận tương tác Groq 3 LPX được thiết kế cho các tác vụ trí tuệ nhân tạo dựa trên tác nhân.

NVIDIA đánh giá hiệu năng phần cứng suy luận tác nhân.

NVIDIA đánh giá hiệu năng phần cứng suy luận tác nhân.

7:00 25/8/26

NVIDIA đã đánh giá hiệu năng hệ thống trên các tác vụ trí tuệ nhân tạo dựa trên tác nhân bằng bộ công cụ đo hiệu năng SemiAnalysis AgentX.

NVIDIA ra mắt nền tảng kiến ​​trúc CPU Vera.

NVIDIA ra mắt nền tảng kiến ​​trúc CPU Vera.

7:00 25/8/26

NVIDIA đã tiết lộ các chi tiết kỹ thuật về nền tảng CPU Vera của mình, được thiết kế đặc biệt để tối ưu hóa khối lượng công việc của các tác nhân trí tuệ nhân tạo trong các trung tâm dữ liệu hiện đại.

bottom of page