top of page

Generatived (Beta) | Cung cấp tin tức và xu hướng mới nhất về AI sáng tạo

logo.png

Galileo phát hành Hallucination Index, một mô hình học ngôn ngữ

Generatived

13:21 17/11/23

Galileo, một công ty máy học nổi tiếng, đã công bố Chỉ số ảo giác để giúp người dùng các mô hình học ngôn ngữ (LLM) hàng đầu của họ xác định mô hình nào ít có khả năng gây ảo giác nhất trong một ứng dụng nhất định. Được phát triển bởi Phòng thí nghiệm Galileo, Chỉ số này là một phản ứng trước thách thức do ảo ảnh AI đặt ra, trong đó AI tạo ra thông tin trông có vẻ thực tế nhưng cuối cùng lại không chính xác hoặc nằm ngoài ngữ cảnh. Đây là trở ngại lớn đối với các công ty thuộc mọi quy mô đang phát triển các ứng dụng dựa trên LLM.

Chỉ số ảo giác đánh giá 11 LLM từ các nhà phát triển khác nhau và đánh giá xu hướng gây ảo giác của từng mô hình trong các nhiệm vụ AI tổng quát thông thường. Những hiểu biết sâu sắc chính từ Chỉ số bao gồm GPT-4 của OpenAI, một công cụ thực hiện hàng đầu trong các nhiệm vụ hỏi và trả lời không cần tìm kiếm, thể hiện độ chính xác ấn tượng và khả năng xảy ra ảo giác thấp nhất. Trong số các mô hình nguồn mở, Llama-2-70b của Meta dẫn đầu, nhưng các mô hình khác đã được chứng minh là dễ gây ảo giác hơn.

Trong nhiệm vụ hỏi đáp bằng tìm kiếm, GPT-4-0613 của OpenAI hoạt động tốt hơn và hiệu suất của nó gần như ngang bằng với mẫu GPT-3.5 Turbo nhanh hơn và tiết kiệm chi phí hơn. Điều thú vị là, mô hình nguồn mở của Hugging Face, Zephyr-7b, hoạt động tốt hơn Llama-2-70b lớn hơn của Meta, bác bỏ quan điểm cho rằng các mô hình lớn hơn vốn đã tốt hơn. Trong quá trình tạo văn bản dài, GPT-4-0613 của OpenAI một lần nữa có hiệu suất cao nhất và được chứng minh là ít bị ảo giác nhất.

Chỉ số này cũng nêu bật các cơ hội tiết kiệm chi phí thông qua các mô hình nguồn mở. Ví dụ: đối với các tác vụ tạo văn bản dài, mô hình trò chuyện Llama-2-13b-chat mã nguồn mở của Meta là một giải pháp thay thế khả thi cho các mô hình của Open AI. Đối với các câu hỏi và câu trả lời liên quan đến nhiệm vụ tìm kiếm, người dùng có thể tự tin thử nghiệm mô hình Zephyr của Hugging Face thay vì OpenAI. Chỉ số này được hỗ trợ bởi các số liệu độc đáo của Galileo về độ chính xác và tuân thủ ngữ cảnh, được hỗ trợ bởi ChainPoll, một phương pháp phát hiện ảo giác do Galileo Labs phát triển.

Chia sẻ bài viết này:

Tin tức mới nhất
NVIDIA giới thiệu nền tảng kiến ​​trúc Vera Rubin.

NVIDIA giới thiệu nền tảng kiến ​​trúc Vera Rubin.

7:00 25/8/26

NVIDIA đã công bố dữ liệu chuẩn hiệu năng đo được cho nền tảng Vera Rubin NVL72 được thiết kế để chạy các tác vụ trí tuệ nhân tạo dựa trên tác nhân.

OpenAI tích hợp chuỗi mô hình GPT vào Kiro

OpenAI tích hợp chuỗi mô hình GPT vào Kiro

7:00 25/8/26

OpenAI đã tích hợp dòng mô hình GPT-5.6 mới nhất của mình vào nền tảng phát triển phần mềm Kiro để tăng cường quy trình lập trình trí tuệ nhân tạo.

OpenAI nghiên cứu về Tự do và Quyền lực trong Kỷ nguyên Trí tuệ Nhân tạo

OpenAI nghiên cứu về Tự do và Quyền lực trong Kỷ nguyên Trí tuệ Nhân tạo

7:00 25/8/26

OpenAI (Mỹ) đã ra mắt “Kỷ nguyên Trí tuệ”, một blog từ nhóm Chiến lược Tương lai của họ, phân tích cách các xã hội tự do có thể bảo vệ quyền và khả năng tự quyết của cá nhân khi trí tuệ nhân tạo phát triển.

NVIDIA ra mắt nền tảng kiến ​​trúc tác nhân AVO.

NVIDIA ra mắt nền tảng kiến ​​trúc tác nhân AVO.

14:00 24/8/26

NVIDIA đã phát triển một kiến ​​trúc tác nhân tự động có tên AVO để duy trì liên tục các tác vụ kỹ thuật và tối ưu hóa dài hạn.

Copyright © 2024 Generatived - All right Reserved.

Chia sẻ bài viết này:

Chia sẻ bài viết này:

Generatived AI Logo

Generatived là dịch vụ cung cấp thông tin và xu hướng chuyên về Generative AI. Chúng tôi sẽ cố gắng hết sức để cung cấp thông tin về thế giới đang thay đổi nhanh chóng.

  • Facebook
  • X

Hãy theo dõi chúng tôi

Ngôn ngữ

Tin tức mới nhất
NVIDIA giới thiệu nền tảng kiến ​​trúc Vera Rubin.

NVIDIA giới thiệu nền tảng kiến ​​trúc Vera Rubin.

7:00 25/8/26

NVIDIA đã công bố dữ liệu chuẩn hiệu năng đo được cho nền tảng Vera Rubin NVL72 được thiết kế để chạy các tác vụ trí tuệ nhân tạo dựa trên tác nhân.

OpenAI tích hợp chuỗi mô hình GPT vào Kiro

OpenAI tích hợp chuỗi mô hình GPT vào Kiro

7:00 25/8/26

OpenAI đã tích hợp dòng mô hình GPT-5.6 mới nhất của mình vào nền tảng phát triển phần mềm Kiro để tăng cường quy trình lập trình trí tuệ nhân tạo.

OpenAI nghiên cứu về Tự do và Quyền lực trong Kỷ nguyên Trí tuệ Nhân tạo

OpenAI nghiên cứu về Tự do và Quyền lực trong Kỷ nguyên Trí tuệ Nhân tạo

7:00 25/8/26

OpenAI (Mỹ) đã ra mắt “Kỷ nguyên Trí tuệ”, một blog từ nhóm Chiến lược Tương lai của họ, phân tích cách các xã hội tự do có thể bảo vệ quyền và khả năng tự quyết của cá nhân khi trí tuệ nhân tạo phát triển.

NVIDIA ra mắt nền tảng kiến ​​trúc tác nhân AVO.

NVIDIA ra mắt nền tảng kiến ​​trúc tác nhân AVO.

14:00 24/8/26

NVIDIA đã phát triển một kiến ​​trúc tác nhân tự động có tên AVO để duy trì liên tục các tác vụ kỹ thuật và tối ưu hóa dài hạn.

bottom of page