đây là 1 link cơ bản : https://clickup.com/vi/blog/433153/how- ... r-own-dataLadyR đã viết: 22:20, 30/06/26 Em nhấn mạnh 1 lần nữa – mấy thao tác muh bác và thầy X làm với AI hok phải “training” theo đúng nghĩa của nó. “Training” cho các LLM là gì thì đề nghị các bác thầy tra Google hoặc hỏi luôn anh GPT cho nhanh!!!
Còn đương nhiên, các công ty mua phiên bản nào đó của GPT từ OpenAI rồi sau đó tweak lại, bổ sung thêm database hay ra lệnh (parameters) gì đó thêm (khả năng là với sự trợ giúp từ nhân sự OpenAI) có gọi là “training” hok thì em hok rõ.
Em ngạc nhiên là 1 người tự xưng mình học IT và làm lập trình viên lại có kiến thức về AI nông như vậy. Nhưng em lên đây hok phải để tranh luận vô bổ, tự tâng bốc năng lực hay đánh bóng tên tuổi. Chỉ vì em tôn trọng sự thật, nhìn thấy những thông tin sai lệch cảm thấy rất khó chịu, bứt rứt trong người… Nhưng em cũng hok muốn sa đà vào những cuộc đối thoại kiểu này.. nên nếu sau này em hok lên tiếng hoặc hok engage trực tiếp với các bác thì các bác cũng đừng nghĩ em đồng tình hay “tâm phục khẩu phục”…
Btw, việc OpenAI sử dụng thông tin trao đổi giữa users và GPT để train future models là công khai chứ có gì bí mật lén lút đâu. Em dùng acc free vẫn có thể tự chọn, cho phép OpenAI sử dụng hay hok. Dĩ nhiên em bật cho. It’s the least I could do for GPT, my favourite AI
![]()
tất nhiên AI nó là cụm bộ nhớ lớn với các tham số dữ liệu lớn, nó là 1 bãi rác dữ liệu, và vì rất nhiều dữ liệu nên thông tin nó ko thể chính xác 100%, việc training cho nó, như mình đã nói với anh X ở đoạn chat trước đó, muốn tối ưu và chính xác thì phải up dữ liệu cho nó (bằng file text, pdf, tài liệu ...) của riêng anh ấy để nó bám sát sườn khi suy luận hoặc yêu cầu nósuy luận dựa vào tài liệu, ngữ cảnh nào, thì mới đúng dc, còn việc chat chung chung của bạn ladyR thì giữa bãi rác dữ liệu của nó, nó lựa kết quả nào mà nhiều người (cho là) đúng nhất và trả kết quả cho bạn. Tất nhiên, khi nhiều người cho là đúng thì khả năng đúng cao hơn nhưng ko đảm bảo chính xác.
Còn training ở các LLM thì phức tạp hơn là phải nhặt lại các câu giả lời (đó là lý do mình nói với anh X về coccoc, 1 nền tảng search nổi tiếng ở vn 1 thời, từng trả tiền cho mem ttv để giúp họ loại bỏ các câu trả lời lỗi).
Và cái ảnh của bạn, bạn tắt cái option đầu đi, là openAI nó ko dùng dữ liệu của bạn để huấn luyện AI nữa, và ở đây, openAI nó cũng nói về việc này :
https://openai.com/vi-VN/consumer-privacy/
Và vì lẽ đó, nên mình có nói là, thông tin bạn xem về tử bình hay tử vi cho bạn hay 1 vài người trên này, sai bét, nếu bạn ko tin, bạn cứ up lá số và 1 đoạn nào đó nói về cuộc đời bạn, với điều kiện trước đó bạn bảo nó xoá hết bộ nhớ về bạn đi, xoá trắng, xong bạn up luận giải của nó lên đây, mời anh X vào luận tử vi hay mình luận tử bình cho, đảm bảo 60% sai. Chắc luôn, do đó mới có từ train này ở đây.


