image Thứ Bảy, 01/08/2026

Facebook ra mắt công nghệ “dùng AI để huấn luyện AI”

Thanh Minh, Huyền Thương, Hoàng

21/10/2024

Chia sẻ

Nhà nghiên cứu của Meta hy vọng khi AI ngày càng tiến bộ, nó sẽ tự kiểm tra và cải thiện công việc của mình, thậm chí có thể vượt qua trình độ của con người...

Meta cho rằng khả năng tự học và tự đánh giá là yếu tố then chốt để AI đạt đến trình độ vượt trội
Meta cho rằng khả năng tự học và tự đánh giá là yếu tố then chốt để AI đạt đến trình độ vượt trội

Cuối tuần qua, Meta, công ty sở hữu Facebook, đã công bố một loạt các mô hình AI mới từ bộ phận nghiên cứu của mình, bao gồm một công cụ được gọi là "Trình đánh giá tự học". Công cụ này có thể mở ra hướng đi mới giúp giảm bớt sự tham gia của con người trong quá trình phát triển AI.

Trước đó, vào tháng 8, Meta đã giới thiệu công cụ này trong một bài viết, trong đó giải thích rằng công nghệ này dựa trên kỹ thuật "chuỗi suy nghĩ" tương tự như các mô hình GPT-4 mới nhất của OpenAI. Kỹ thuật này giúp AI chia nhỏ các vấn đề phức tạp thành các bước nhỏ hơn, giúp cải thiện độ chính xác của phản hồi, đặc biệt là trong các lĩnh vực như khoa học, mã hóa và toán học.

SỬ DỤNG DỮ LIỆU DO AI TẠO RA ĐỂ HUẤN LUYỆN CÁC MÔ HÌNH AI

Điểm đặc biệt của nghiên cứu này là các nhà khoa học tại Meta đã sử dụng hoàn toàn dữ liệu do AI tạo ra để huấn luyện mô hình, không cần đến sự can thiệp của con người trong giai đoạn này. Việc AI có khả năng đánh giá AI một cách đáng tin cậy là bước tiến quan trọng, mở ra con đường để phát triển các tác nhân AI tự chủ, có thể tự học hỏi từ những sai lầm của chính mình.

Nhiều chuyên gia AI hình dung rằng các tác nhân AI trong tương lai sẽ là trợ lý kỹ thuật số thông minh, có khả năng thực hiện nhiều nhiệm vụ mà không cần sự can thiệp của con người. Những mô hình tự cải thiện như vậy có thể thay thế phương pháp "Học tăng cường từ phản hồi của con người" (RLHF) hiện tại, một quy trình tốn kém và kém hiệu quả vì phải dựa vào các chuyên gia để dán nhãn dữ liệu và xác minh tính chính xác của các phản hồi.

Học tăng cường từ phản hồi của con người (RLHF) là một kỹ thuật trong học máy, trong đó tác nhân AI học từ phản hồi do con người cung cấp, thay vì chỉ dựa vào các hàm được thiết kế. RLHF được sử dụng trong nhiều ứng dụng khác nhau, bao gồm cải thiện hiệu suất và khả năng thích ứng của các hệ thống thông minh. Tuy nhiên, quy trình này khá tốn kém và tính hiệu quả không cao.

Jason Weston, một trong những nhà nghiên cứu của Meta, cho biết: "Chúng tôi hy vọng rằng, khi AI ngày càng tiến bộ, nó sẽ tự kiểm tra và cải thiện công việc của mình, thậm chí có thể vượt qua trình độ của con người". Ông cũng nhấn mạnh rằng khả năng tự học và tự đánh giá là yếu tố then chốt để AI đạt đến trình độ vượt trội.

Ngoài Meta, các công ty khác như Google và Anthropic cũng đang nghiên cứu về Học tăng cường từ phản hồi của AI (RLAIF). Tuy nhiên, khác với Meta, các công ty này thường không công khai các mô hình của họ để cộng đồng sử dụng.

TRANH CÃI VẤN ĐỀ ĐẠO ĐỨC TRONG CÁCH ĐÀO TẠO AI

Cùng với "Trình đánh giá tự học", Meta còn phát hành một số công cụ AI khác như bản cập nhật cho mô hình nhận dạng hình ảnh Segment Anything, một công cụ giúp tăng tốc thời gian phản hồi của các mô hình ngôn ngữ lớn (LLM), và các tập dữ liệu hỗ trợ nghiên cứu về vật liệu vô cơ mới.

Đối với các mô hình AI của Meta, bao gồm cả Self-Taught Evaluator, đã gây ra câu hỏi về đạo đức liên quan đến việc giảm thiểu sự tham gia của con người trong quá trình phát triển AI. Các nhà phê bình cho rằng điều này có thể dẫn đến thiếu trách nhiệm và minh bạch trong quá trình ra quyết định của AI.

Meta thừa nhận đang dùng cả nội dung bài viết và ảnh chia sẻ công khai trên Facebook và Instagram để đào tạo mô hình AI mới.
Meta thừa nhận đang dùng cả nội dung bài viết và ảnh chia sẻ công khai trên Facebook và Instagram để đào tạo mô hình AI mới.

Việc sử dụng các tập dữ liệu lớn để đào tạo các mô hình AI đặt ra nhiều mối quan ngại về quyền riêng tư và bảo mật dữ liệu. Đảm bảo rằng dữ liệu người dùng được xử lý một cách trách nhiệm và đạo đức là một thách thức lớn. Trước đó, Meta có thừa nhận đang dùng cả nội dung bài viết và ảnh chia sẻ công khai trên Facebook và Instagram để đào tạo mô hình AI mới.

Theo Reuters, khi công nghệ AI phát triển, các khung pháp lý cố gắng theo kịp tiến bộ này. Meta phải điều hướng các cảnh quan pháp lý phức tạp để đảm bảo tuân thủ các quy định về bảo vệ dữ liệu và đạo đức AI. Xây dựng lòng tin với người dùng và các bên liên quan rất quan trọng cho việc triển khai thành công các công nghệ AI.


Mô hình AI mở của Trung Quốc phơi bày những "điểm mù" trong chiến lược trí tuệ nhân tạo của Mỹ

Những tập đoàn công nghệ hàng đầu nước Mỹ đang đồng loạt kêu gọi Chính phủ coi phát triển AI mở là một ưu tiên chiến lược quốc gia. Theo họ, nếu Mỹ đã có chiến lược về chip AI thì giờ đây cũng cần một chiến lược tương tự dành cho các mô hình AI mở...

16:28 31/07/2026
Mỹ cấm robot hình người mới từ Trung Quốc, siết chuỗi cung ứng AI

Chính quyền Tổng thống Donald Trump vừa ban hành các biện pháp hạn chế nhập khẩu robot hình người, robot bốn chân và bộ biến tần điện mới từ Trung Quốc…

09:29 31/07/2026
Những nghề nghiệp bất ngờ “hưởng lợi” từ AI

Đằng sau cuộc đua AI là một cuộc săn nhân lực mới. Không chỉ kỹ sư phần mềm, các thợ điện, thợ xây, kỹ thuật viên cũng đang trở thành nhân sự “nóng” để xây dựng hạ tầng công nghệ tương lai.

09:45 30/07/2026
Intel bắt tay Fortinet, phát triển chip bảo mật thế hệ mới

Sự gia tăng của các mối đe dọa mạng và yêu cầu xử lý dữ liệu trong kỷ nguyên AI đang thúc đẩy nhu cầu phát triển các công nghệ bảo mật mới…

10:46 29/07/2026
AI khiến tấn công mạng diễn ra nhanh đến mức con người "không kịp phản ứng"

Theo CrowdStrike, thời gian trung bình từ lúc tin tặc xâm nhập thành công đến khi bắt đầu di chuyển sang các hệ thống khác đã giảm từ 98 phút vào năm 2021 xuống chỉ còn 29 phút trong năm 2025. Đáng báo động hơn, có trường hợp kẻ xâm nhập chỉ cần 27 giây...

22:30 28/07/2026
Trung Quốc đẩy mạnh "ngoại giao AI"

Thông qua việc thúc đẩy các mô hình AI nguồn mở, đào tạo nhân lực và xây dựng mạng lưới hợp tác quốc tế, Trung Quốc đang đưa ra một lời đề nghị mà nhiều quốc gia đang phát triển khó có thể từ chối...

11:24 27/07/2026
Các hãng AI bắt đầu thâm nhập thị trường edtech trị giá 6.000 tỷ USD

Đối với các công ty AI, đây không chỉ là cơ hội hỗ trợ xã hội thích ứng với kỷ nguyên AI mà còn là một thị trường có quy mô hàng nghìn tỷ USD và là nơi có thể tiếp cận thế hệ người dùng tương lai ngay từ trên ghế nhà trường...

11:24 27/07/2026
AI thúc đẩy doanh nghiệp công nghệ Trung Quốc toàn cầu hóa

Nhiều công ty Trung Quốc đang từng bước giành vị trí trong cả hai mắt xích quan trọng của chuỗi giá trị AI toàn cầu: phần mềm và hạ tầng...

18:46 24/07/2026
Trung Quốc cân nhắc "siết" xuất khẩu mô hình AI và công nghệ chip tiên tiến

Trung Quốc đang xem xét khả năng tăng cường kiểm soát xuất khẩu đối với các công nghệ trí tuệ nhân tạo (AI) và bán dẫn tiên tiến...

13:45 23/07/2026
Pháp trở thành quốc gia châu Âu đầu tiên cấm trẻ dưới 15 tuổi dùng mạng xã hội

Việc Pháp thông qua đạo luật cấm trẻ em dưới 15 tuổi sử dụng mạng xã hội đánh dấu bước đi mạnh mẽ nhất của một quốc gia châu Âu trong nỗ lực bảo vệ trẻ vị thành niên trên không gian số…

13:44 23/07/2026