DeepSeek V3: Chatbot AI của Trung Quốc tự nhận mình là Chat GPT

DeepSeek V3 nhận mình là Chat GPT
Thư mục bài viết

DeepSeek, một phòng thí nghiệm AI của Trung Quốc đã phát hành một mô hình AI “mở” đánh bại nhiều đối thủ trên các tiêu chuẩn phổ biến. Mô hình, DeepSeek V3 , lớn nhưng hiệu quả, xử lý các tác vụ dựa trên văn bản như mã hóa và viết bài luận một cách dễ dàng. 

Tuy nhiên, đã có những phản hồi trên các nền tảng mạng xã hội cho thấy DeepSeek AI tự nhận mình là Chat GPT. Vậy sự việc này là như thế nào? Tại sao DeepSeek V3 tự nhận mình là Chat GPT cùng RG66 News tìm hiểu qua bài viết sau đây nhé!

DeepSeek V3 tự nhận mình là Chat GPT 

DeepSeek V3 tự nhận
DeepSeek V3 tự nhận mình là Chat GPT

Các bài đăng trên nền tảng X và một số bài kiểm tra của TechCrunch (trang tin tức về AI) cho thấy, DeepSeek V3 tự nhận mình là Chat GPT, nền tảng chatbot hỗ trợ AI của OpenAI. Ngoài ra, khi được người dùng yêu cầu giải thích thêm thì DeepSeek V3 cũng khẳng định rằng, đây là phiên bản mới của GPT – 4 của OpenAI được phát hành vào năm 2023.

Bên cạnh đó, Nếu bạn hỏi DeepSeek V3 một câu hỏi về API của DeepSeek, nó sẽ hướng dẫn bạn cách sử dụng API của OpenAI . DeepSeek V3 thậm chí còn kể một số câu chuyện cười giống như GPT – 4  cho đến những câu đùa dí dỏm.

Tại sao DeepSeek V3 lại tự nhận mình là Chat GPT?

Được biết, các mô hình AI như Chat GPT và DeepSeek V3 hoạt động dựa trên phân tích dữ liệu thống kê. Chúng được huấn luyện bằng hàng tỷ ví dụ để nhận diện và tạo ra các mẫu ngôn ngữ ví dụ như cụm từ “gửi đến ai” thường xuất hiện trước “có thể liên quan” trong email.

Thêm vào đó, DeepSeek vẫn chưa công bố chi tiết về dữ liệu đào tạo của DeepSeek V3. Tuy nhiên, nhiều tập dữ liệu công khai hiện nay chứa văn bản được tạo ra bởi GPT-4 thông qua Chat GPT. Điều này dẫn đến khả năng DeepSeek V3 đã học hỏi hoặc thậm chí sao chép nguyên văn một số nội dung từ GPT- 4.

Lý giải từ các chuyên gia 

Theo Mike Cook, chuyên gia nghiên cứu AI tại King’s College London, việc mô hình DeepSeek V3 cung cấp thông tin tương tự Chat GPT có thể do đã tiếp nhận dữ liệu từ Chat GPT ở một giai đoạn nào đó. Cook cảnh báo rằng một số nhà phát triển đã sử dụng đầu ra của mô hình khác để huấn luyện mô hình của họ nhằm tận dụng kiến thức có sẵn.

Tuy nhiên, cách làm này của DeepSeek AI có thể dẫn đến kết quả kém chất lượng, như việc tạo ra những phản hồi sai lệch hoặc gây nhầm lẫn. Cook ví điều này như “chụp ảnh bản sao của bản sao“, khiến thông tin ngày càng thiếu chính xác và mất kết nối với thực tế của DeepSeek V3.

Hơn nữa, hành động này có thể vi phạm điều khoản sử dụng của OpenAI. Cụ thể, OpenAI cấm người dùng Chat GPT sử dụng dữ liệu đầu ra để phát triển các sản phẩm cạnh tranh trực tiếp.

Phản hồi về tình huống này, CEO OpenAI, Sam Altman, đã đăng một bài viết trên mạng xã hội X, có ý ám chỉ đến DeepSeek và các đối thủ khác:

Sao chép những gì đã hiệu quả thì dễ! Nhưng sáng tạo ra điều mới mẻ, táo bạo lại là một thách thức thực sự.”

DeepSeek V3 không phải là trường hợp nhầm lẫn duy nhất

DeepSeek V3 không phải là trường hợp duy nhất nhầm lẫn danh tính. Ví dụ, mô hình Gemini của Google đôi khi cũng tự nhận là chatbot của Baidu khi được nhắc bằng tiếng Quan Thoại.

Nguyên nhân của những nhầm lẫn này có thể xuất phát từ sự hỗn tạp của dữ liệu trên Internet. Các nội dung do AI tạo ra, từ bài viết quảng cáo cho đến các bình luận trên mạng xã hội, đang tràn lan khắp nơi. Một ước tính cho rằng vào năm 2026, khoảng 90% nội dung trên web có thể được tạo bởi AI.

Điều này khiến việc sàng lọc dữ liệu DeepSeek V3 trong quá trình đào tạo trở nên vô cùng khó khăn. Heidy Khlaaf, nhà khoa học tại Viện AI Now, cho rằng nhiều công ty có thể đã chọn cách “chắt lọc” kiến thức từ các mô hình hiện có để giảm chi phí phát triển, dù biết rằng điều này tiềm ẩn rủi ro.

Heidy Khlaaf nhấn mạnh:

Ngay cả khi internet tràn ngập dữ liệu do AI tạo ra, việc các mô hình vô tình học lại từ GPT-4 không phải là điều bất ngờ.

Với tình trạng này, khả năng DeepSeek V3 đã vô tình hoặc cố ý hấp thụ dữ liệu từ GPT-4 là hoàn toàn có thể. Tuy nhiên, điều đáng lo ngại hơn là việc sao chép này có thể làm trầm trọng thêm các sai sót hoặc thiên lệch trong phản hồi của mô hình.

Xem thêm: Google và cuộc chạy đua cải thiện AI Gemini

Kết luận

DeepSeek đang nổi lên như một đối thủ mạnh mẽ trong lĩnh vực AI với mô hình DeepSeek V3. Tuy nhiên, các vấn đề liên quan đến dữ liệu đào tạo và khả năng sao chép từ GPT – 4 đặt ra nhiều thách thức về tính minh bạch và chất lượng. Điều này cũng mở ra cuộc thảo luận quan trọng về việc xây dựng AI trong môi trường dữ liệu ngày càng phức tạp. DeepSeek cần tiếp tục cải tiến để đáp ứng kỳ vọng của thị trường và duy trì vị thế cạnh tranh.

Bạn cũng có thể thích

Thư mục bài viết
Danh mục phổ biến
[list_all_cats]
Thẻ phổ biến
[list_tags number=20]
Thư mục bài viết