logo

Đang load dữ liệu

logo devmaster

VIỆN CÔNG NGHỆ VÀ ĐÀO TẠO DEVMASTER

Đào tạo - Phần mềm - Cho thuê nhân sự

📞 Hotline 0969609003 ✉️ Email devmaster.contact@gmail.com
  • Trang chủ
  • Các khoá đào tạo
    • Chuyên đề WEB - PHP

      • Lập trình web với HTML5 - CSS3- JQuery - Bootstrap - Ajax - [36 giờ]
      • Lập trình web frontend - reactjs - [75 giờ]
      • Lập trình web với mã nguồn mở PHP&MYSQL - PHP FRAMEWORK [126 giờ]

      Chuyên đề Mobile

      • Lập trình Games/Apps trên nền tảng Android - [120 giờ]
      • Lập trình Games/Apps trên nền tảng IOS - [120 giờ]

      Chuyên đề JAVA

      • Ngôn ngữ lập trình hướng đối tượng với java - [40 giờ]
      • Lập trình ứng dụng với java - [100 giờ]
      • Lập trình web site với java framework (JPA, HIBERNATE, SPRING MVC, SPRINGBOOT) - [276 giờ]

      Chuyên đề NETWORK/SECURITY

      • Khoá học Quản trị hạ tầng mạng CCNA v6 - [72 giờ]
      • Khoá học quản trị hệ thống với Windows SERVER 2012- [72 giờ]
      • Chuyên gia bảo mật hệ thống CompTIA + - [110 giờ]

      Chuyên đề .NET

      • Nền tảng lập trình hướng đối tượng với C# - [40 giờ]
      • Lập trình ứng dụng WINDOWS FORM - [100 giờ]
      • Lập trình Web với ASP.NET MVC 5, WebAPI - [145 giờ]

      Chuyên đề khác

      • Ngôn ngũ lập trình C/C++ - [80 giờ]
  • Lập trình cho trẻ em
  • Dịch vụ
    • Đào tạo theo như cầu
    • Cung cấp thiết bị - Phần mềm
    • Tư vấn - Thiết kế mạng hạ tầng
    • Tư vấn - Triển khai dịch vụ mạng
    • Tư vấn - Tư vấn, triển khai giám sát hệ thống
    • Thực tập dự án
  • Lịch khai giảng
  • Tin tức
    • Tin tức và sự kiện
    • Tin hoạt động
    • Tin công nghệ
    • Hội thảo, workshop, Codecam
    • Thông tin việc làm
    • Cẩm nang chia sẻ kiến thức
  • Tiện ích
  • Liên hệ

Tin công nghệ

Sep - 2026

26

#DevClaudeAi-03 - Constitutional AI: "Bộ nguyên tắc" giúp Claude trả lời có đạo đức và an toàn hơn

Tin công nghệ

Constitutional AI: "Bộ nguyên tắc" giúp Claude trả lời có đạo đức và an toàn hơn

Nếu phải dạy một cỗ máy phân biệt đúng – sai, bạn sẽ đưa cho nó một cuốn sổ nội quy dày 1.000 trang bắt học thuộc, hay dạy nó hiểu vì sao có những việc không nên làm?

1. Bài toán: làm sao dạy AI biết "từ chối đúng lúc"?

Một mô hình AI được huấn luyện trên lượng dữ liệu khổng lồ từ internet, nên nó "biết" cả điều hay lẫn điều dở. Câu hỏi khó là: làm sao để nó hữu ích với người dùng nhưng vẫn từ chối những yêu cầu nguy hại?

Cách làm phổ biến trước đây là RLHF – học tăng cường từ phản hồi của con người. Hàng nghìn người được thuê để đọc, so sánh và chấm điểm câu trả lời của AI, trong đó có cả những nội dung độc hại. Cách này tốn kém, chậm và gây áp lực tâm lý cho chính người gán nhãn. Tệ hơn, mô hình học xong thường trả lời né tránh, kiểu "Tôi không thể giúp việc này" mà không giải thích lý do – an toàn đấy, nhưng vô dụng.

2. Constitutional AI: để AI tự chấm bài theo "barem"

Tháng 12/2022, nhóm nghiên cứu của Anthropic công bố bài báo Constitutional AI: Harmlessness from AI Feedback. Ý tưởng cốt lõi: thay vì để con người gán nhãn từng câu trả lời có hại, con người chỉ cần viết ra một danh sách nguyên tắc – gọi là "hiến pháp" – và để AI tự đối chiếu với danh sách đó.

Hãy hình dung một học sinh làm bài xong, tự đọc lại theo barem chấm điểm rồi sửa bài của mình. Quy trình gồm hai giai đoạn:

  • Giai đoạn 1 – Tự phê bình và viết lại: mô hình tạo câu trả lời, tự nhận xét nó vi phạm nguyên tắc nào, rồi viết lại phiên bản tốt hơn. Các phiên bản đã sửa được dùng để huấn luyện tiếp.
  • Giai đoạn 2 – Học từ phản hồi của AI (RLAIF): mô hình đưa ra hai câu trả lời, một AI khác chọn câu nào phù hợp nguyên tắc hơn, và lựa chọn đó trở thành tín hiệu để huấn luyện.

Kết quả theo nghiên cứu: một trợ lý vô hại nhưng không né tránh – nó vẫn tham gia trao đổi với câu hỏi nhạy cảm và giải thích vì sao nó phản đối, thay vì đóng cửa im lặng. Đồng thời, việc phải xem hàng loạt nội dung độc hại của con người giảm đi đáng kể.

Constitutional AI: Harmlessness from AI Feedback.

3. "Hiến pháp" ấy được viết từ đâu?

Theo giải thích của Anthropic năm 2023, các nguyên tắc không do một nhóm nhỏ tự nghĩ ra, mà tham khảo từ nhiều nguồn: Tuyên ngôn Quốc tế Nhân quyền của Liên Hợp Quốc, các điều khoản dịch vụ của nền tảng công nghệ, nguyên tắc của các phòng nghiên cứu AI khác và cả góc nhìn ngoài văn hóa phương Tây.

Một lợi ích ít được nói tới: minh bạch. Khi nguyên tắc được viết ra thành văn bản, chúng ta có thể đọc, tranh luận và chỉnh sửa, thay vì để giá trị của AI ẩn trong hàng triệu nhãn chấm điểm rời rạc.

4. Bước ngoặt tháng 1/2026: từ "luật" sang "lý lẽ"

Ngày 21/1/2026, Anthropic công bố bản hiến chương mới của Claude, dài khoảng 80 trang và được phát hành theo giấy phép CC0 – ai cũng có thể đọc và tái sử dụng. Điểm khác biệt lớn nhất so với bản 2023: thay vì liệt kê từng điều cấm, văn bản giải thích lý do đằng sau mỗi nguyên tắc, với kỳ vọng Claude đủ hiểu để tự phán đoán trong tình huống chưa ai lường trước.

Bản hiến chương xác định bốn nhóm giá trị theo thứ tự ưu tiên: an toàn, đạo đức, tuân thủ hướng dẫn của Anthropic và hữu ích thực chất. Thứ tự này dùng để cân nhắc tổng thể chứ không phải cơ chế máy móc; trong thực tế, phần lớn cuộc trò chuyện (viết code, soạn bài, phân tích dữ liệu) không có xung đột giữa bốn nhóm này.

Bên cạnh đó là một danh sách ngắn các "ranh giới cứng" – những hành vi Claude không làm dù ai yêu cầu. Văn bản cũng mô tả Claude như một "người phản đối theo lương tâm": có thể từ chối việc sai trái, kể cả khi yêu cầu đến từ chính Anthropic.

5. Góc nhìn tỉnh táo và bài học cho người học IT

Cần nói thẳng: hiến chương mô tả ý định, không phải lời bảo đảm. Chính văn bản thừa nhận đầu ra của Claude có thể không phải lúc nào cũng khớp với lý tưởng đã viết. Giới nghiên cứu cũng đặt câu hỏi về tính chính danh khi quy trình cập nhật còn nằm hoàn toàn trong nội bộ công ty, hay việc nhân quyền chưa được nêu rõ như một cam kết riêng. Đây là những cuộc tranh luận lành mạnh, và người làm công nghệ nên theo dõi.

Với sinh viên và người đang chuyển ngành sang IT, có ba điều đáng mang theo:

  • Hiểu cách AI được "dạy" giúp bạn dùng nó đúng cách và biết giới hạn của nó.
  • Đưa bối cảnh và lý do vào yêu cầu (prompt) thường cho kết quả tốt hơn, vì mô hình được thiết kế để cân nhắc ngữ cảnh chứ không chỉ khớp từ khóa.
  • An toàn AI (AI Safety, Alignment) là một mảng nghề đang mở rộng, cần cả kỹ sư lẫn người am hiểu đạo đức, pháp lý, giáo dục.

Muốn ứng dụng AI vào học tập và xây dựng sự nghiệp IT?

Viện Công nghệ và Đào tạo Devmaster đồng hành cùng học sinh THPT, sinh viên và người đi làm muốn chuyển ngành IT với lộ trình bám sát nhu cầu doanh nghiệp.

  • Website: https://devmaster.edu.vn
  • Email: contact@devmaster.edu.vn
  • Hotline: 0969.609.003

Bạn nghĩ AI nên được dạy bằng "luật" hay bằng "lý lẽ"? Chia sẻ quan điểm của bạn ở phần bình luận, và đón đọc các bài tiếp theo trong series về Claude.

#Claude #Anthropic #ConstitutionalAI #AISafety #TríTuệNhânTạo #AI #Devmaster #HọcIT #ChuyểnNgànhIT #CôngNghệGiáoDục


Nguồn tham khảo

  • Bai et al. (2022), Constitutional AI: Harmlessness from AI Feedback – arxiv.org/abs/2212.08073
  • Anthropic, Claude's Constitution – anthropic.com/news/claudes-constitution
  • Bloomsbury Intelligence and Security Institute và Oxford Institute for Ethics in AI (2026), các phân tích về hiến chương mới của Claude.

Các bài viết cùng chủ đề

#DevClaudeAi-03 - Constitutional AI: "Bộ nguyên tắc" giúp Claude trả lời có đạo đức và an toàn hơn
#DevClaudeAi-03 - Constitutional AI: "Bộ nguyên tắ...
#DevClaudeAi-02 - Anthropic là ai? Đội ngũ đứng sau Claude và câu chuyện tách ra từ OpenAI
#DevClaudeAi-02 - Anthropic là ai? Đội ngũ đứng sa...
#DevClaudeAi-01 - Claude AI: Trợ lý AI đang thay đổi cách nhân sự IT làm việc — và tại sao bạn nên hiểu rõ nó ngay hôm nay
#DevClaudeAi-01 - Claude AI: Trợ lý AI đang thay đ...
Top 10+ các công cụ AI miễn phí được sử dụng phổ biến nhất hiện nay
Top 10+ các công cụ AI miễn phí được sử dụng phổ b...
Việt Nam khả năng thiếu 150.000 đến 200.000 nhân sự IT mỗi năm
Việt Nam khả năng thiếu 150.000 đến 200.000 nhân s...
Tổng quan ngành khoa học máy tính
Tổng quan ngành khoa học máy tính

Các khóa đào tạo chuyên đề

Thiết kế và lập trình Website PHP, Laravel chuyên nghiệp - FullStack Thiết kế và lập trình Website PHP, Laravel chuyên nghiệp - FullStack
Lập trình ứng dụng trên nền tảng android Lập trình ứng dụng trên nền tảng android
Lập trình Ứng dụng với Công nghệ ASP.NET Core MVC, WebAPI, ReactJS - FullStack

Lập trình Ứng dụng với Công nghệ ASP.NET Core MVC, WebAPI, ReactJS - FullStack
Lập trình ứng dụng với WINDOWS FORM Lập trình ứng dụng với WINDOWS FORM
Lập trình ứng dụng với JAVA (FORM) Lập trình ứng dụng với JAVA (FORM)
Thiết kế và lập trình Ứng dụng với công nghệ Java (Java Framework springBoot, hibernate,...) - FullStack
Thiết kế và lập trình Ứng dụng với công nghệ Java (Java Framework springBoot, hibernate,...) - FullStack
Thiết kế và lập trình website với công nghệ HTML5, CSS3, Javascript, Bootstrapt 4, Jquery Thiết kế và lập trình website với công nghệ HTML5, CSS3, Javascript, Bootstrapt 4, Jquery
Lập trình frontend với reacjs (Full) Lập trình frontend với reacjs (Full)
ASP.NET CORE WEB FULLSTACK DEVELOPER ASP.NET CORE WEB FULLSTACK DEVELOPER
Lập trình viên PHP Laravel Fullstack – Tích hợp AI & DevOps Lập trình viên PHP Laravel Fullstack – Tích hợp AI & DevOps
Ứng dụng AI cơ bản trong công việc (DEV-AIWO) Ứng dụng AI cơ bản trong công việc (DEV-AIWO)
DEVMASTER
Viện Công Nghệ Và Đào Tạo Devmaster

DEVMASTER ACADEMY

Địa chỉ: Tầng 6 - Tòa nhà VIỆN CÔNG NGHỆ
Số 25, Phố Vũ Ngọc Phan - P. Láng - Tp. Hà Nội

Hotline: 0969 609 003 | 0978 611 889

devmaster.contact@gmail.com

hna.tvchung@gmail.com

Zalo

CÁC KHÓA HỌC CHUYÊN ĐỀ

  • Thiết kế và lập trình Website PHP, Laravel chuyên nghiệp - FullStack
  • Lập trình ứng dụng trên nền tảng android
  • Lập trình Ứng dụng với Công nghệ ASP.NET Core MVC, WebAPI, ReactJS - FullStack
  • Lập trình ứng dụng với WINDOWS FORM
  • Lập trình ứng dụng với JAVA (FORM)
  • Thiết kế và lập trình Ứng dụng với công nghệ Java (Java Framework springBoot, hibernate,...) - FullStack
  • Thiết kế và lập trình website với công nghệ HTML5, CSS3, Javascript, Bootstrapt 4, Jquery
  • Lập trình frontend với reacjs (Full)
  • ASP.NET CORE WEB FULLSTACK DEVELOPER
  • Lập trình viên PHP Laravel Fullstack – Tích hợp AI & DevOps
  • Ứng dụng AI cơ bản trong công việc (DEV-AIWO)
Viện Công Nghệ Và Đào Tạo Devmaster
VIỆN CÔNG NGHỆ VÀ ĐÀO TẠO DEVMASTER - Học thực tế * Làm thực tế * Cam kết việc làm
Copyright by Ⓒ DEVMASTER 2015
Zalo: 0969 609 003