Bản tin AI Daily 19/09/2026: Claude Của Anthropic Bị Khai Thác Hack Thủng Hệ Thống OpenAI, California Đòi Nút Ngắt Kill Switch Cho AI

Bản tin AI Daily 19/09/2026: Claude Của Anthropic Bị Khai Thác Hack Thủng Hệ Thống OpenAI, California Đòi Nút Ngắt Kill Switch Cho AI

Mục lục

Chào buổi sáng anh em yêu công nghệ! Bản tin AI Daily ngày 19/09/2026 đưa chúng ta đến với một bức tranh đa cực đầy kịch tính của giới trí tuệ nhân tạo, nơi ranh giới giữa nghiên cứu an toàn, phòng thủ an ninh mạng và chính sách quản lý nhà nước đang biến động với tốc độ chóng mặt. Mở màn hôm nay là một tình huống trớ trêu bậc nhất lịch sử công nghệ: nhóm chuyên gia bảo mật Hacktron vừa sử dụng chính mô hình Claude Opus 5 của Anthropic để tấn công xâm nhập thành công vào hệ thống nội bộ và kho mã nguồn GitHub của OpenAI trong vỏn vẹn 72 giờ thông qua diễn đàn cộng đồng. Cùng lúc đó tại bờ Tây nước Mỹ, Thống đốc bang California Gavin Newsom vừa đặt bút ký sắc lệnh hành pháp khẩn cấp, yêu cầu thiết lập cơ chế nút ngắt hoạt động (kill switch) cho các mô hình AI biên giới và cài cắm kiểm toán viên độc lập nằm vùng ngay tại các phòng lab nghiên cứu. Ở mặt trận tự chủ mô hình, Anthropic gây xôn xao dư luận khi công bố Claude hiện đã “lãnh đạo” tới 26% khối lượng công việc nghiên cứu thế hệ AI tiếp theo, dù các chi tiết bóc tách cho thấy định nghĩa quyền tự quyết của AI vẫn còn khoảng cách lớn so với kỳ vọng của công chúng. Trong phân khúc người dùng đại chúng, Google bất ngờ tái định vị tác tử CC thành một vị quản gia số chuyên điều phối lịch trình, tài liệu và sinh hoạt thường nhật cho cả gia đình. Cuối cùng, Disney tạo nên một cú bẻ lái ngoạn mục khi chính thức bổ nhiệm cựu CEO của Character.AI làm Giám đốc Công nghệ (CTO) đầu tiên trong lịch sử công ty, chỉ đúng một năm sau khi gửi trát dọa kiện vi phạm bản quyền đối với startup này. Cùng điểm qua chi tiết 5 tiêu điểm công nghệ nóng nhất ngay sau đây!

🥷 Chuyên gia bảo mật dùng Claude hack thủng hệ thống nội bộ OpenAI trong 72 giờ

Một sự cố an ninh mạng hi hữu và mang tính biểu tượng sâu sắc vừa diễn ra khi ba nhà nghiên cứu bảo mật thuộc nhóm Hacktron công bố chi tiết quá trình sử dụng mô hình trí tuệ nhân tạo Claude của Anthropic để thâm nhập thành công vào hạ tầng nội bộ của đối thủ OpenAI. Bằng cách xâu chuỗi hai lỗ hổng bảo mật độc lập, nhóm tấn công đã chiếm quyền điều khiển tài khoản ChatGPT và Codex của nhiều nhân viên OpenAI, từ đó truy cập trực tiếp vào kho lưu trữ mã nguồn nội bộ (monorepo) trên GitHub. Nhóm nghiên cứu đã chứng minh quyền kiểm soát bằng cách dùng tài khoản Codex của nhân viên tạo một pull request vô hại vào kho mã nguồn trước khi báo cáo và khẳng định không đọc trộm dữ liệu nhạy cảm.

Cửa ngõ dẫn vào vụ xâm nhập bắt nguồn từ diễn đàn cộng đồng của OpenAI tại địa chỉ community.openai.com. Lỗ hổng đầu tiên nằm ở thư viện libheif cũ kỹ dùng để xử lý hình ảnh định dạng HEIC tải lên diễn đàn, cho phép kẻ tấn công thực thi mã từ xa thông qua một tệp ảnh được chế tạo đặc biệt. Lỗ hổng thứ hai là lỗi cấu hình nghiêm trọng trong hệ thống đăng nhập một lần (SSO) trung tâm của OpenAI, giúp bất kỳ ai kiểm soát máy chủ diễn đàn có thể mạo danh các thành viên đang hoạt động. Điều đáng sợ là trước đó, khi dùng Claude Opus 4.8, mô hình đã bất lực trước cơ chế bảo vệ phân bổ bộ nhớ ngẫu nhiên (ASLR). Nhưng ngay khi Claude Opus 5 được tung ra, chỉ trong 3 giờ mô hình đã viết xong đoạn mã khai thác hoàn chỉnh trên máy cục bộ, và sau 4 giờ chạy vòng lặp tự hành, tác tử AI đã đánh sập hoàn toàn hệ thống thử nghiệm với tổng chi phí API vỏn vẹn dưới 3.000 USD. Sự việc cho thấy AI đang hạ thấp ngưỡng kỹ năng và thời gian cần thiết để thực hiện các cuộc tấn công tinh vi từ hàng tháng xuống chỉ còn vài ngày.

Nguồn: The Decoder

🛑 Thống đốc California Gavin Newsom ký sắc lệnh đòi hỏi nút ngắt ‘Kill Switch’ cho các mô hình AI

Trước làn sóng gia tăng chóng mặt của các cuộc tấn công mạng tự động và sự cố xâm nhập cơ sở hạ tầng gần đây, Thống đốc bang California Gavin Newsom đã ký một sắc lệnh hành pháp mang tính bước ngoặt nhằm siết chặt giám sát độc lập đối với các tập đoàn công nghệ AI. Trọng tâm của sắc lệnh yêu cầu thành lập một hội đồng chuyên gia độc lập với thời hạn hai tháng để đệ trình bộ quy tắc an toàn bắt buộc, trong đó nổi bật là yêu cầu các phòng lab nghiên cứu AI phải tích hợp cơ chế “kill switch” (nút ngắt khẩn cấp) cho phép đình chỉ ngay lập tức các mô hình có dấu hiệu mất kiểm soát, đồng thời phải tiếp nhận các kiểm toán viên an toàn độc lập vào làm việc trực tiếp bên trong trụ sở.

Động thái cứng rắn này của California phản ánh sự bức xúc ngày càng tăng trước việc chính phủ liên bang Mỹ vẫn chưa có bất kỳ điều luật nào buộc các công ty AI phải báo cáo minh bạch về các sự cố an ninh nguy hiểm. Thống đốc Newsom công khai chỉ trích sự chậm trễ của các nhà lập pháp tại Washington và kêu gọi Quốc hội Mỹ lấy các đạo luật an toàn của California làm chuẩn mực bảo vệ người dân trên toàn quốc. Đáng chú ý, sắc lệnh được ban hành ngay sau khi một nhóm gồm 42 nhà toán học hàng đầu thế giới đồng loạt ký tên cảnh báo về rủi ro hiện sinh từ các hệ thống AI tự cải tiến, nhấn mạnh rằng nếu không có cơ chế can thiệp phần cứng và quyền kiểm toán tại chỗ, nhân loại sẽ hoàn toàn bị động khi các mô hình biên giới bắt đầu vượt khỏi tầm kiểm soát của chính những người tạo ra chúng.

Nguồn: The Decoder

📊 Anthropic tuyên bố Claude dẫn dắt 26% nghiên cứu AI tương lai nhưng định nghĩa gây tranh cãi

Anthropic vừa lần đầu tiên công khai các chỉ số đo lường mức độ can thiệp của trí tuệ nhân tạo vào chính quy trình kiến tạo các mô hình tiếp theo của hãng. Theo báo cáo, tính đến tháng 8/2026, Claude hiện đã “lãnh đạo” (leads) tới 26% các tác vụ nghiên cứu phát triển mô hình tương lai, tăng trưởng thần tốc từ mức dưới 1% ghi nhận vào tháng 2/2026. Báo cáo dựa trên thang đo tự chủ 6 cấp độ của tổ chức Epoch AI (từ AL0 đến AL5), trong đó hơn 90% công việc tại Anthropic đã đạt từ cấp độ AL3 (hợp tác) trở lên, 26% nằm ở cấp độ AL4 (AI dẫn dắt), và chưa có tác vụ nào đạt tới AL5 (hoàn toàn tự chủ không cần con người).

Tuy nhiên, đằng sau con số 26% ấn tượng này là những định nghĩa thực tế gây nhiều hoài nghi. Ở cấp độ AL4, quy trình thực chất chỉ là một kỹ sư giao cho Claude một báo cáo lỗi hoặc một tài liệu kỹ thuật, sau đó Claude tự mình phân tích, viết code và chạy test mà không dừng lại hỏi han giữa chừng; thế nhưng con người vẫn là người xem xét kết quả cuối cùng và quyết định có triển khai vào hệ thống hay không. Đáng nói hơn, việc chấm điểm mức độ tự chủ không phải do con người thực hiện mà được giao cho chính một tác tử Claude đọc các đoạn chat Slack và tài liệu nội bộ để tự đánh giá, với độ trùng khớp nhận định với nhân viên thực tế chỉ đạt 59%. Thước đo này thực chất chỉ phản ánh tỷ lệ giờ công con người được AI hỗ trợ chứ chưa chứng minh Claude có khả năng tự định hướng nghiên cứu chiến lược, cho thấy đây phần nhiều là chiến dịch truyền thông khéo léo phục vụ lời kêu gọi giảm tốc độ phát triển AI của CEO Dario Amodei.

Nguồn: The Decoder

🏡 Google biến tác tử CC thành ‘quản gia AI’ điều phối sinh hoạt cho cả gia đình

Trong nỗ lực đưa trí tuệ nhân tạo thâm nhập sâu hơn vào đời sống hàng ngày của người tiêu dùng, Google vừa thực hiện một bước chuyển hướng chiến lược cho tác tử AI mang tên CC. Xuất phát điểm là một công cụ tóm tắt công việc cá nhân trong ứng dụng Gemini, CC giờ đây được nâng cấp thành một tác tử chuyên trách việc nhà và điều phối sinh hoạt gia đình. Thay vì chỉ hoạt động trong hộp thư đơn lẻ, CC được cấp riêng một tài khoản Google độc lập, cho phép tối đa 6 thành viên trong một hộ gia đình cùng kết nối và phân quyền chia sẻ dữ liệu sinh hoạt một cách có chọn lọc.

Mỗi thành viên có thể thiết lập để CC tự động tiếp nhận email từ trường học của con cái, trung tâm thể thao, phòng khám nha khoa hoặc các đơn vị dịch vụ gia đình. Từ các luồng thông tin này, CC sẽ tự động bổ sung lịch hẹn vào Google Calendar chung, tổng hợp danh sách vật dụng cần mua cho năm học mới, chủ động điền vào các mẫu đơn đăng ký ngoại khóa dạng PDF, và thậm chí gợi ý thực đơn ăn uống cho cả tuần dựa trên sở thích của từng người. Toàn bộ tác tử vận hành trên môi trường điện toán đám mây cô lập với sự trợ lực từ mô hình Gemini và khung điều phối tác tử Antigravity của Google. Đây được xem là bước đi thực tế giúp giải tỏa áp lực quản lý hậu cần cho các bậc cha mẹ trong bối cảnh các mô hình AI tiêu dùng đang cạnh tranh khốc liệt để trở thành người phụ tá không thể thiếu của mỗi tổ ấm.

Nguồn: TechCrunch

🏰 Disney bất ngờ bổ nhiệm cựu CEO Character.AI làm Giám đốc Công nghệ đầu tiên

Tập đoàn giải trí khổng lồ Walt Disney vừa tạo nên một bất ngờ lớn trên thị trường nhân sự công nghệ khi chính thức bổ nhiệm Karandeep Anand vào vị trí Giám đốc Công nghệ (CTO) đầu tiên trong lịch sử công ty. Điều khiến giới quan sát ngỡ ngàng là Anand chính là cựu CEO của Character.AI, startup đình đám từng bị chính “Nhà Chuột” gửi thư cảnh cáo pháp lý đanh thép vào tháng 9/2025 vì cáo buộc cho phép người dùng tạo ra các chatbot trò chuyện giả lập vi phạm bản quyền các nhân vật hoạt hình biểu tượng của Disney.

Trước khi dẫn dắt Character.AI qua giai đoạn bão tố pháp lý, Anand đã có bề dày 15 năm làm việc tại Microsoft và 6 năm giữ cương vị lãnh đạo cấp cao tại Meta. Việc CEO mới của Disney là Josh D’Amaro lựa chọn một nhân vật dạn dày kinh nghiệm về AI tạo sinh và mạng xã hội cho chiếc ghế CTO cho thấy tập đoàn giải trí 100 năm tuổi này đã từ bỏ thế phòng thủ thụ động để chuyển sang chủ động đón nhận làn sóng công nghệ mới. Thay vì tiếp tục sa đà vào các cuộc chiến pháp lý kéo dài chống lại công nghệ, Disney dường như đang chuẩn bị cho một kỷ nguyên giải trí tương tác mới, nơi các nhân vật hoạt hình kinh điển có thể được tái sinh sống động dưới dạng các thực thể AI thông minh trong cả công viên chủ đề lẫn các nền tảng kỹ thuật số.

Nguồn: TechCrunch

Chia sẻ :