Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo
%20(1).webp)
Gemini công bố Flash-Lite 2.5 cho AI nhanh hơn, tiết kiệm chi phí hơn
Generatived
9:00 24/7/25
Gemini 2.5 Flash-Lite là phiên bản mới nhất của dòng sản phẩm Gemini 2.5, mang đến cho người dùng tốc độ và hiệu quả chi phí vượt trội. Model này được thiết kế để tối ưu hóa hiệu suất chi phí và cũng có tùy chọn cho phép các chức năng suy luận nâng cao cho các tác vụ phức tạp. Sản phẩm này bổ sung cho các model 2.5 Pro và 2.5 Flash hiện có, cả hai đều được thiết kế để sử dụng trong sản xuất quy mô lớn.
Phiên bản mới này tự hào có tốc độ vượt trội và vượt trội hơn phiên bản tiền nhiệm về latency ở nhiều yêu cầu khác nhau, khiến nó trở nên lý tưởng cho các ứng dụng nhạy cảm về thời gian như dịch thuật và phân loại. Gemini 2.5 Flash-Lite là phiên bản có giá cả phải chăng nhất trong phân khúc, với giá token đầu vào và đầu ra lần lượt là 0,10 đô la và 0,40 đô la cho mỗi triệu token. Ngoài ra, chi phí nhập liệu bằng giọng nói đã giảm 40% kể từ khi phát hành bản xem trước. Mặc dù có kích thước nhỏ, phiên bản này mang lại hiệu suất chất lượng cao trên tất cả các tiêu chuẩn, bao gồm mã hóa, toán học, khoa học và hiểu biết đa phương thức. Các nhà phát triển có quyền truy cập vào một bộ tính năng, bao gồm cửa sổ ngữ cảnh triệu token và một loạt các công cụ gốc.
Gemini 2.5 Flash-Lite đã là một phần không thể thiếu của nhiều dự án sáng tạo kể từ khi ra mắt. Nền tảng điện toán không gian phân tán của Satlyt đã chứng kiến những cải tiến đáng kể về latency và mức tiêu thụ điện năng, và các avatar AI của HeyGen cho nội dung video được hưởng lợi từ khả năng phân tích và dịch video nhanh chóng của mô hình. DocsHound tận dụng mô hình để chuyển đổi bản demo sản phẩm thành tài liệu nhanh hơn bao giờ hết, và Evertune tận dụng mô hình để hỗ trợ phân tích biểu đạt thương hiệu cho khách hàng. Các nhà phát triển có thể tích hợp Gemini 2.5 Flash-Lite vào dự án của họ bằng cách chỉ định mô hình trong mã của họ. Tuy nhiên, bí danh xem trước sẽ bị loại bỏ vào cuối năm nay.
Chia sẻ bài viết này:
Tin tức mới nhất
NVIDIA giới thiệu nền tảng kiến trúc Vera Rubin.
7:00 25/8/26
NVIDIA đã công bố dữ liệu chuẩn hiệu năng đo được cho nền tảng Vera Rubin NVL72 được thiết kế để chạy các tác vụ trí tuệ nhân tạo dựa trên tác nhân.
OpenAI tích hợp chuỗi mô hình GPT vào Kiro
7:00 25/8/26
OpenAI đã tích hợp dòng mô hình GPT-5.6 mới nhất của mình vào nền tảng phát triển phần mềm Kiro để tăng cường quy trình lập trình trí tuệ nhân tạo.
OpenAI nghiên cứu về Tự do và Quyền lực trong Kỷ nguyên Trí tuệ Nhân tạo
7:00 25/8/26
OpenAI (Mỹ) đã ra mắt “Kỷ nguyên Trí tuệ”, một blog từ nhóm Chiến lược Tương lai của họ, phân tích cách các xã hội tự do có thể bảo vệ quyền và khả năng tự quyết của cá nhân khi trí tuệ nhân tạo phát triển.
Copyright © 2024 Generatived - All right Reserved.
Chia sẻ bài viết này:
Chia sẻ bài viết này:
Danh mục
Tin tức
AI và luật/hệ thống/kinh tế/xã hội
Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.
Tin tức mới nhất
NVIDIA giới thiệu nền tảng kiến trúc Vera Rubin.
7:00 25/8/26
NVIDIA đã công bố dữ liệu chuẩn hiệu năng đo được cho nền tảng Vera Rubin NVL72 được thiết kế để chạy các tác vụ trí tuệ nhân tạo dựa trên tác nhân.
OpenAI tích hợp chuỗi mô hình GPT vào Kiro
7:00 25/8/26
OpenAI đã tích hợp dòng mô hình GPT-5.6 mới nhất của mình vào nền tảng phát triển phần mềm Kiro để tăng cường quy trình lập trình trí tuệ nhân tạo.
OpenAI nghiên cứu về Tự do và Quyền lực trong Kỷ nguyên Trí tuệ Nhân tạo
7:00 25/8/26
OpenAI (Mỹ) đã ra mắt “Kỷ nguyên Trí tuệ”, một blog từ nhóm Chiến lược Tương lai của họ, phân tích cách các xã hội tự do có thể bảo vệ quyền và khả năng tự quyết của cá nhân khi trí tuệ nhân tạo phát triển.

%20(1).webp)




