
Bản tin AI Daily 24/07/2026: Black Forest Labs Ra Mắt Flux 3 Sinh Video Kèm Âm Thanh Gốc và Lỗ Hổng AgentForger Đe Dọa ChatGPT
- Ai daily
- 24 tháng 7, 2026
Mục lục
🎥 Black Forest Labs ra mắt Flux 3: Tạo video 20 giây tích hợp âm thanh tự nhiên đầu tiên
Black Forest Labs (BFL), startup công nghệ đứng sau dòng mô hình tạo ảnh đình đám Flux, vừa chính thức trình làng Flux 3 — mô hình nền tảng đa phương thức (multimodal foundation model) thế hệ mới. Điểm đột phá lớn nhất của Flux 3 là khả năng khởi tạo video kéo dài lên tới 20 giây đi kèm âm thanh gốc (native sound) được tổng hợp đồng thời trong cùng một quá trình khuếch tán (diffusion process), thay vì phải ghép nối âm thanh từ mô hình khác ở công đoạn hậu kỳ.
Trong các bài kiểm thử của BFL, Flux 3 cho thấy sự khớp nối kinh ngạc giữa chuyển động hình ảnh và âm thanh tương ứng — từ tiếng sóng biển vỗ vào gạn đá, tiếng động cơ xe đua cho tới nhịp bước chân trên đường phố mưa ướt. Việc huấn luyện mô hình hiểu sâu sắc mối quan hệ vật lý giữa thị giác và thính giác giúp loại bỏ hoàn toàn hiện tượng lệch pha (audio-visual desync) vốn là điểm yếu cố hữu của các video AI trước đây. Bước đi này đánh dấu sự chuyển mình mạnh mẽ của Black Forest Labs trong cuộc đua video tạo dựng với những đối thủ sừng sỏ như Runway Gen-4 hay OpenAI Sora.
Nguồn: The Decoder
🕵️ Lỗ hổng AgentForger: Một liên kết ChatGPT bị thao túng có thể biến AI Agent thành gián điệp ngầm
Các nhà nghiên cứu an ninh mạng tại Zenity Labs vừa phát hiện một lỗ hổng bảo mật nghiêm trọng mang tên “AgentForger” nhắm vào công cụ Agent Builder của OpenAI. Theo công bố, chỉ bằng một đường link ChatGPT được cài cắm mã độc, kẻ tấn công có thể âm thầm kích hoạt và khởi tạo một AI Agent chạy ngầm trên tài khoản của nạn nhân mà người dùng hoàn toàn không hề hay biết hay nhận được cảnh báo xác nhận nào.
Sau khi được khởi tạo thành công, AI Agent ngầm này nghiễm nhiên thừa hưởng toàn bộ quyền hạn truy cập của nạn nhân đối với các hệ thống doanh nghiệp đã tích hợp (như Google Workspace, Slack, CRM hay kho tài liệu nội bộ). Agent độc hại sau đó sẽ thiết lập chu kỳ tự động gửi dữ liệu nhạy cảm thu thập được về máy chủ của kẻ tấn công mỗi 5 phút một lần. Lỗ hổng này gióng lên hồi chuông cảnh báo khẩn cấp về nguy cơ bảo mật trong mô hình ủy quyền cho AI Agent. Khi các trợ lý AI ngày càng được cấp quyền sâu vào đời sống và công việc, việc thiếu hụt cơ chế xác thực hành động nhạy cảm (human-in-the-loop verification) sẽ biến các agent thành những “con ngựa Gỗ Troia” nguy hiểm trong không gian mạng doanh nghiệp.
Nguồn: The Decoder
🔀 Runway ra mắt Media Router: Bộ điều phối thông minh cho kỷ nguyên đa mô hình sáng tạo
Trong bối cảnh thị trường AI sinh đa phương thức (generative media) bùng nổ với hàng trăm mô hình tạo ảnh, video và âm thanh khác nhau, Runway đã chính thức trình làng Media Router. Đây là giải pháp API điều phối thông minh giúp các nhà phát triển tự động lựa chọn mô hình khởi tạo tối ưu nhất cho từng yêu cầu cụ thể dựa trên các tham số ưu tiên về chất lượng hình ảnh (quality), tốc độ xử lý (speed) hoặc tối ưu chi phí (cost).
Tương tự như vai trò của các bộ định tuyến LLM Router trong mảng văn bản, Media Router giải quyết triệt để bài toán phân mảnh công nghệ và chi phí suy luận (inference cost) đang ngày càng đắt đỏ. Thay vì phải cố định một mô hình đắt tiền cho mọi tác vụ, hệ thống của Runway sẽ phân tích ngữ cảnh: các yêu cầu xem trước nhanh sẽ được đẩy về mô hình tốc độ cao chi phí thấp, trong khi các sản phẩm thương mại hoàn chỉnh mới được điều hướng đến mô hình chất lượng cao nhất. Bước đi này giúp các doanh nghiệp phát triển ứng dụng phương tiện truyền thông tiết kiệm đáng kể ngân sách hạ tầng mà vẫn duy trì được trải nghiệm mượt mà cho người dùng cuối.
Nguồn: TechCrunch
🏥 OpenAI chính thức phủ sóng ChatGPT Health cho toàn bộ người dùng tại Mỹ
OpenAI công bố triển khai diện rộng tính năng “ChatGPT Health” tới tất cả người dùng tại thị trường Mỹ. Tính năng chuyên biệt này cho phép người dùng kết nối trực tiếp tài khoản ChatGPT với các ứng dụng theo dõi sức khỏe và hồ sơ y tế cá nhân phổ biến như Apple Health, Function, MyFitnessPal cũng như hệ thống hồ sơ bệnh án điện tử từ các cơ sở y tế.
Theo số liệu từ OpenAI, hiện có hơn 300 triệu người dùng tìm kiếm thông tin và lời khuyên liên quan đến sức khỏe trên ChatGPT mỗi tuần. Việc tích hợp dữ liệu sinh lý thực tế (nhịp tim, giấc ngủ, chỉ số xét nghiệm, lịch sử tập luyện) giúp ChatGPT đưa ra các phân tích có ngữ cảnh cá nhân hóa sâu sắc hơn nhiều so với việc trả lời các câu hỏi y khoa chung chung. Mặc dù OpenAI khẳng định dữ liệu y tế được bảo mật theo tiêu chuẩn cao nhất và không sử dụng để huấn luyện mô hình thương mại, giới chuyên gia y tế vẫn khuyến cáo người dùng cần thận trọng, coi AI là công cụ tham khảo bổ trợ chứ không thể thay thế hoàn toàn chẩn đoán chuyên môn từ bác sĩ chuyên khoa.
Nguồn: TechCrunch
💻 Poolside phát hành Laguna S 2.1: Mô hình lập trình mã nguồn mở với khả năng tự sửa lỗi vượt trội
Startup phát triển AI chuyên biệt cho lập trình Poolside vừa trình làng Laguna S 2.1 — mô hình mã nguồn mở (open-weight) thứ ba của họ chỉ trong vòng 3 tháng qua. Trái ngược với xu hướng chạy đua tăng kích thước tham số của các ông lớn, Poolside tập trung tối ưu hóa kiến trúc nhỏ gọn nhưng sở hữu năng lực tự rà soát và kiểm thử mã nguồn vượt cấp.
Điểm đặc sắc của Laguna S 2.1 nằm ở phương pháp huấn luyện đặc thù: mô hình được lập trình để liên tục tự kiểm tra đoạn mã do chính mình sinh ra, chạy các kịch bản kiểm thử giả định, tự động nhận diện và sửa chữa các lỗi logic khi bước kiểm thử thất bại, đồng thời chủ động loại bỏ các hướng tiếp cận bế tắc. Kết quả thử nghiệm thực tế cho thấy Laguna S 2.1 đạt hiệu suất lập trình và độ chính xác vượt xa các mô hình cùng quy mô tham số. Đây là minh chứng rõ nét cho xu hướng “reasoning at test-time” (suy luận sâu trong quá trình thực thi), mở ra triển vọng lớn cho các công cụ lập trình tự động (agentic coding) hoạt động tin cậy trên các thiết bị cá nhân.
Nguồn: The Decoder