Bản tin AI Daily 18/08/2026: Amazon Bị Phanh Phui Huỷ Sách Hiếm Để Luyện AI, OpenAI Ký Hợp Đồng Siêu Data Center 8GW

Bản tin AI Daily 18/08/2026: Amazon Bị Phanh Phui Huỷ Sách Hiếm Để Luyện AI, OpenAI Ký Hợp Đồng Siêu Data Center 8GW

Mục lục

Chào buổi sáng anh em! Bản tin AI Daily ngày 18/08/2026 mang đến bức tranh toàn cảnh về những cuộc chạy đua nghẹt thở từ nguồn dữ liệu gốc cho đến hạ tầng điện toán khổng lồ. Mở đầu hôm nay là vụ việc gây chấn động giới học thuật khi Amazon bị lần ra hành vi mua và tiêu huỷ các bản sách in quý hiếm để trích xuất dữ liệu huấn luyện mô hình. Tiếp đến là thương vụ thế kỷ giữa OpenAI và Nvidia với trung tâm dữ liệu công suất kỷ lục 8 gigawatt, sự chuyển dịch của đội ngũ startup Relay về Google Chrome để tăng tốc tính năng AI Agent trên trình duyệt, bước nhảy vọt tài chính của Groq sang mảng đám mây, và chiến dịch thao túng nhận thức tinh vi nhắm thẳng vào các chatbot AI. Cùng điểm qua chi tiết 5 tin tức nóng nhất ngay dưới đây nhé!

📚 AirTag phanh phui vụ việc Amazon thu mua và tiêu huỷ sách hiếm để huấn luyện AI

Gã khổng lồ công nghệ từng khởi nghiệp từ một hiệu sách trực tuyến vừa bị đưa ra ánh sáng trong một cuộc điều tra chấn động: Amazon âm thầm thu mua số lượng lớn các ấn bản sách in quý hiếm, mang về các cơ sở bí mật để quét số hoá phục vụ huấn luyện mô hình ngôn ngữ lớn, sau đó trực tiếp tiêu huỷ chúng trong quá trình xử lý nhằm tránh các vướng mắc bản quyền và rò rỉ vật lý.

Cuộc điều tra độc lập đã sử dụng thiết bị định vị AirTag giấu kín trong các tập sách lịch sử và tài liệu lưu trữ hiếm để theo dõi hành trình chuyển giao. Kết quả cho thấy các cuốn sách được đưa thẳng vào dây chuyền quét tự động tốc độ cao rồi bị xé nhỏ và đưa vào lò tái chế. Trong bối cảnh kho dữ liệu văn bản chất lượng cao trên Internet công cộng gần như đã bị các phòng thí nghiệm AI cào sạch, các tài liệu in ấn độc bản và sách chuyên khảo chưa từng số hoá trở thành “mỏ vàng” vô giá. Tuy nhiên, hành động phá hủy các di sản văn hóa vật thể để đổi lấy vài tỷ token huấn luyện máy móc đang dấy lên làn sóng phẫn nộ gay gắt từ các hiệp hội bảo tồn, thư viện và giới tác giả toàn cầu.

Nguồn: TechCrunch

⚡ OpenAI ký hợp đồng thuê siêu trung tâm dữ liệu 8GW tại Ohio, Nvidia bảo lãnh 105 tỷ USD

OpenAI vừa chính thức đặt bút ký vào thỏa thuận thuê dài hạn 20 năm cho một tổ hợp siêu trung tâm dữ liệu với tổng công suất lên tới 8 gigawatt (GW) tại bang Ohio. Đáng chú ý, tập đoàn phần cứng Nvidia đã đứng ra làm người bảo lãnh tài chính cho giá trị thặng dư của công trình này với cam kết trị giá lên tới 105 tỷ USD, đồng thời trực tiếp đầu tư thêm 1,5 tỷ USD vào nhà phát triển hạ tầng dữ liệu của SoftBank để giữ vững vị thế nhà cung cấp chip độc quyền.

Quy mô 8 gigawatt là một con số chưa từng có tiền lệ trong lịch sử ngành công nghệ, tương đương với tổng sản lượng điện tiêu thụ của cả triệu hộ gia đình hoặc công suất của vài nhà máy điện hạt nhân cỡ lớn cộng lại. Động thái này cho thấy cuộc đua đào tạo các thế hệ mô hình frontier tiếp theo (như GPT-6 hay các hệ thống AGI thế hệ mới) đã vượt ra khỏi phạm vi nâng cấp phần mềm đơn thuần, trở thành một cuộc chiến khốc liệt về tài nguyên năng lượng và đất đai cấp quốc gia. Việc Nvidia đồng ý bảo lãnh một khoản tiền khổng lồ cũng phản ánh mối quan hệ cộng sinh chặt chẽ nhưng cũng đầy rủi ro giữa ông vua phần cứng và startup dẫn đầu làn sóng AI tạo sinh.

Nguồn: The Decoder

🌐 Startup tự động hoá Relay ngừng hoạt động, toàn bộ nhân sự gia nhập nhóm Google Chrome

Relay, startup từng gây tiếng vang trong lĩnh vực tự động hoá quy trình làm việc (workflow automation) bằng AI, đã chính thức thông báo đóng cửa nền tảng độc lập của mình. Toàn bộ đội ngũ kỹ thuật cùng nhà sáng lập kiêm CEO Jacob Bank sẽ chuyển sang đầu quân cho nhóm phát triển trình duyệt Google Chrome nhằm hiện thực hóa tham vọng tích hợp sâu AI Agent vào trình duyệt phổ biến nhất thế giới.

Jacob Bank chia sẻ rằng nhóm sẽ tận dụng kinh nghiệm xây dựng các luồng tác vụ tự động thông minh để giúp người dùng trực tiếp ra lệnh và điều khiển Chrome giải quyết các công việc đa bước trên web. Thay vì chỉ hiển thị các câu trả lời dạng văn bản như hiện nay, trình duyệt trong tương lai sẽ có thể tự động điền biểu mẫu, đối soát dữ liệu qua nhiều tab, đặt vé máy bay hoặc thao tác trên các ứng dụng SaaS phức tạp hoàn toàn tự động theo ngôn ngữ tự nhiên. Động thái này cho thấy Google đang ráo riết củng cố phòng tuyến trình duyệt của mình trước sức ép từ các đối thủ AI Agent độc lập như Operator của OpenAI hay các extension agentic thế hệ mới.

Nguồn: TechCrunch

💡 Groq huy động 350 triệu USD ở định giá 3,5 tỷ USD, mở rộng thần tốc sang mảng Neocloud

Nhà sản xuất vi xử lý suy luận nổi tiếng Groq vừa hoàn tất vòng gọi vốn mới trị giá 350 triệu USD, đưa định giá doanh nghiệp chạm ngưỡng 3,5 tỷ USD. Đáng chú ý, dòng vốn mới này được huy động không chỉ để mở rộng sản xuất dòng chip LPU (Language Processing Unit) độc quyền, mà còn để thúc đẩy quá trình chuyển đổi chiến lược của công ty sang mô hình “Neocloud” – nhà cung cấp dịch vụ đám mây chuyên biệt cho tính toán AI.

Groq từng tạo nên cơn sốt toàn cầu nhờ khả năng xử lý tốc độ suy luận vượt trội lên tới hàng trăm token mỗi giây với chi phí điện năng thấp. Tuy nhiên, việc bán phần cứng nguyên chiếc gặp nhiều rào cản chuỗi cung ứng và cạnh tranh gay gắt từ Nvidia. Bằng cách xây dựng các cụm trung tâm dữ liệu đám mây của riêng mình và thậm chí kết hợp linh hoạt cả các cụm GPU Nvidia song song với LPU, Groq đang biến mình thành một điểm đến toàn diện cho các nhà phát triển cần cả năng lực huấn luyện lẫn tốc độ suy luận thời gian thực cho các agent tự hành.

Nguồn: TechCrunch

🕵️ Phát hiện viện nghiên cứu ảo lập ra nhằm định hướng và thao túng kho dữ liệu chatbot AI

Một báo cáo điều tra từ giới phân tích an ninh mạng vừa vạch trần một chiến dịch tác động thông tin tinh vi: việc thành lập các tổ chức tư vấn và viện nghiên cứu giả mạo (fake think tank) trên không gian mạng không nhằm mục đích thuyết phục độc giả con người, mà chủ yếu để “bơm” các tài liệu phân tích thiên lệch vào kho dữ liệu thu thập của các mô hình AI lớn như ChatGPT, Claude hay Gemini.

Chiến dịch này tạo ra hàng loạt trang web có giao diện học thuật chỉn chu, đăng tải các bài viết chuyên sâu có cấu trúc chặt chẽ và nhồi nhét các quan điểm địa chính trị cụ thể. Khi các trình thu thập dữ liệu web (crawlers) của các công ty AI quét qua mạng để cập nhật tri thức hoặc trả lời truy vấn thời gian thực, các tài liệu ngụy tạo này được thuật toán đánh giá là nguồn uy tín nhờ cấu trúc văn phong học thuật. Đây là lời cảnh tỉnh rõ ràng về hiểm họa “data poisoning” (đầu độc dữ liệu) và thao túng nhận thức thế hệ mới, nơi các thế lực không còn cần phải mua chuộc truyền thông truyền thống mà trực tiếp tác động vào câu trả lời của AI để định hình thế giới quan của hàng trăm triệu người dùng.

Nguồn: Responsible Statecraft

Chia sẻ :