Bản tin AI Daily: Microsoft Copilot bỏ GPT dùng hàng nhà và công cụ đọc ý nghĩ Claude

Bản tin AI Daily: Microsoft Copilot bỏ GPT dùng hàng nhà và công cụ đọc ý nghĩ Claude

Mục lục

📰 Microsoft: Copilot chuyển dịch sang các mô hình tự phát triển nhằm tối ưu chi phí

Trong nỗ lực cắt giảm chi phí vận hành khổng lồ của hệ thống AI, Microsoft đang tiến hành thay thế các mô hình ngôn ngữ cao cấp (premium) từ OpenAI (như GPT-4o, GPT-4 Turbo) và Anthropic (Claude 3.5 Sonnet) bằng các mô hình nhỏ hơn (SLMs) do hãng tự phát triển, thuộc dòng MAI (như MAI-1) và mô hình Prometheus cải tiến. Sự chuyển dịch này đang diễn ra âm thầm trên các sản phẩm Office phổ biến như Outlook, Excel và Word, nơi hệ thống đã xử lý hàng chục nghìn truy vấn mỗi tuần thông qua mô hình mới.

Mặc dù quyết định này giúp Microsoft tối ưu hóa tỷ suất lợi nhuận đối với các gói thuê bao cố định như Copilot Pro và Copilot cho Do nghiệp, nhiều chuyên gia lo ngại nó có thể làm giảm khả năng lập luận phức tạp hoặc khả năng sáng tạo của trợ lý ảo trong các tác vụ văn phòng nâng cao. Tuy nhiên, đối với các tác vụ hẹp như viết công thức Excel hoặc tóm tắt email nhanh, các mô hình nội bộ được tối ưu hóa đặc biệt vẫn mang lại hiệu năng ổn định cùng chi phí rẻ hơn nhiều lần.

Nguồn: The Decoder | Cybernews

📰 Anthropic J-Lens: Công cụ giải mã "suy nghĩ ngầm" bên trong Claude

Bộ phận nghiên cứu khả năng giải thích (interpretability) của Anthropic vừa công bố Jacobian Lens (J-Lens), một phương pháp đột phá cho phép các nhà khoa học trích xuất và đọc hiểu không gian bộ nhớ trung gian mang tên J-Space bên trong mô hình Claude. Thông thường, LLM hoạt động như một chiếc “hộp đen” và con người chỉ có thể quan sát kết quả đầu ra dạng văn bản. Với J-Lens, các nhà nghiên cứu có thể theo dõi trực tiếp các vector kích hoạt (activation vectors) ở các lớp ẩn sâu trong mạng neural trước khi từ ngữ được xuất ra.

Công cụ này mở ra khả năng đọc được “độc thoại nội tâm ẩn” (hidden inner monologue) của Claude. Bằng cách quan sát J-Space, ta có thể biết mô hình đang kích hoạt các khái niệm nào, có xu hướng thiên vị hay sắp sửa đưa ra thông tin sai lệch (hallucination) hay không. Đây là một bước tiến quan trọng trong lĩnh vực an toàn AI (AI Safety), giúp các kỹ sư căn chỉnh (align) mô hình từ sâu bên trong kiến trúc mạng thay vì chỉ dựa vào việc lọc văn bản đầu ra.

Nguồn: The Decoder

📰 Tòa án Đức: Google phải chịu trách nhiệm trực tiếp về thông tin sai từ AI Overviews

Một phán quyết mang tính lịch sử từ Tòa án Khu vực Munich (Đức) đã xác định Google phải chịu trách nhiệm pháp lý trực tiếp đối với các thông tin sai lệch do tính năng AI Overviews tạo ra. Vụ kiện bắt đầu khi AI Overviews tự động tổng hợp thông tin và gán ghép sai lệch hai nhà xuất bản có liên quan đến các chiến dịch lừa đảo trực tuyến, mặc dù các nguồn liên kết trong bài viết không hề đề cập đến việc đó.

Trong phiên tòa, Google đã tự bào chữa bằng lập luận quen thuộc: “AI Overviews chỉ là công cụ tìm kiếm tổng hợp thông tin, người dùng có thể tự bấm vào các đường link đính kèm để tự xác thực, và ai cũng biết không nên tin tưởng mù quáng vào AI”. Tuy nhiên, hội đồng thẩm phán đã bác bỏ hoàn toàn luận điểm này. Tòa án phán quyết rằng AI Overviews hoạt động như một “phát ngôn độc lập, tự thân có cấu trúc hoàn chỉnh” (self-contained statement), được viết lại bằng ngôn ngữ riêng của Google chứ không đơn thuần là hiển thị đường dẫn của bên thứ ba. Do đó, Google được coi là tác giả của nội dung này và phải chịu trách nhiệm về tính chính xác của nó. Phán quyết này có thể tạo ra rào cản pháp lý rất lớn đối với việc triển khai các tính năng tìm kiếm AI tại khu vực Liên minh Châu Âu (EU).

Nguồn: The Decoder | DW | WIRED

📰 Cloudflare ra mắt bộ kiểm soát chi tiết cho Search Bots, Training Bots và AI Agents

Để giải quyết tình trạng các chủ sở hữu trang web đồng loạt chặn toàn bộ bot AI bằng các tường lửa cứng (gây ảnh hưởng đến khả năng hoạt động của các trợ lý AI cá nhân), CEO của Cloudflare - Matthew Prince - đã công bố cơ chế kiểm soát bot thế hệ mới chi tiết và thông minh hơn. Thay vì chặn diện rộng tất cả các crawler liên quan đến trí tuệ nhân tạo, Cloudflare nay phân loại rõ ràng các bot truy cập thành 3 nhóm riêng biệt:

  1. Search Bots (Bot tìm kiếm AI như Perplexity, Bing): Giúp cào dữ liệu thời gian thực để trả lời câu hỏi của người dùng và mang lại traffic cho website.
  2. Training Bots (Bot thu thập dữ liệu huấn luyện như GPTBot của OpenAI): Thu thập dữ liệu quy mô lớn để đem về train các mô hình AI thế hệ tiếp theo mà không đem lại lợi ích trực tiếp ngay lập tức cho web.
  3. Agent Crawlers (Bot hành động thay mặt người dùng): Các AI agents truy cập vào web để thực thi tác vụ cụ thể theo yêu cầu của một người dùng cụ thể (ví dụ: đặt vé, so sánh giá).

Với cơ chế này, chủ sở hữu website có thể linh hoạt chặn bot training để bảo vệ bản quyền dữ liệu, nhưng vẫn mở cửa cho bot search để làm SEO và bot agent để người dùng của các hệ thống AI có thể tương tác với dịch vụ của họ một cách mượt mà.

Nguồn: The Decoder

📰 pxpipe: Giải pháp giấu văn bản vào ảnh PNG giúp giảm 70% chi phí token cho Claude Code

Công cụ mã nguồn mở pxpipe (hiện đạt hơn 2,200 stars trên GitHub) đang trở thành hiện tượng trong giới phát triển ứng dụng AI agents. Khi sử dụng các CLI lập trình như Claude Code hoặc Fable 5, các agent thường phải đọc những file code lớn, danh sách thư mục, hoặc output terminal rất dài. Việc này khiến context window phình to nhanh chóng, đẩy chi phí sử dụng API lên tới $30 - $40 cho mỗi session làm việc.

Ý tưởng cốt lõi của pxpipe là hoạt động như một cổng proxy cục bộ viết bằng TypeScript để chặn các API request gửi từ CLI. Sau đó, nó tự động gom các phần dữ liệu văn bản thô, dày đặc (như system prompts hay log terminal dài) và vẽ (render) chúng thành một bức ảnh PNG có độ nén cao. Bức ảnh này sẽ được gửi tới Claude thông qua cổng Vision Encoder dưới dạng dữ liệu hình ảnh thay vì text thô gửi qua Tokenizer. Vì cơ chế tính phí token hình ảnh của các mô hình đa phương thức (như Claude 3.5 Sonnet) thường rẻ hơn nhiều so với việc parse hàng chục nghìn token chữ thô, pxpipe giúp giảm thiểu lượng token tiêu thụ từ 59% đến 70%, đưa chi phí mỗi session từ $42 xuống chỉ còn khoảng $6 mà không làm suy giảm hiệu năng xử lý của agent.

Nguồn: The Decoder (pxpipe) | pxpipe GitHub

Chia sẻ :