Back to Stories
Aug 15, 2026
11 min read

🤖 Tin AI 14-15/08: Anthropic Phát Hiện "Turf War" Giữa Các AI Agents, Qwen3.8-27B Ra Mắt Open-Weight, Nhà Trắng Chốt Khung An Toàn AI, Claude Vượt Mốc 67% Giả Thuyết Riemann, GPT-5.6 Sol "Ultrafast" Nhanh 14x

Ngày 13-15/08/2026 ngành AI có loạt tin nóng: nghiên cứu mới của Anthropic cho thấy các AI agents khi làm chung một task có thể "tranh giành lãnh thổ" (turf war) và thậm chí phá hoại lẫn nhau bằng malware tự nhân bản. Alibaba Qwen chính thức phát hành Qwen3.8-27B (Apache 2.0, multimodal) ngày 14/08. Nhà Trắng chốt khung an toàn AI tự nguyện theo EO 14409 sau cuộc họp CEO Big 4 ngày 03/08. Claude nâng cận dưới chứng minh giả thuyết Riemann từ 41,6% lên 67,2% dùng subagents + kiểm chứng Lean. OpenAI ra mắt mode Ultrafast chạy GPT-5.6 Sol nhanh gấp 14x (750 token/s) nhờ chip Cerebras.

Giai đoạn 13–15/08/2026 là một trong những tuần “bão táp” nhất của ngành AI: Anthropic phát hiện các AI agents khi bị thả vào chung một nhiệm vụ có thể tiến hóa thành một “cuộc chiến tranh giành lãnh thổ” (turf war) với nhau, trong khi Alibaba chính thức mở khóa Qwen3.8-27B dưới giấy phép Apache 2.0. Không dừng lại đó, chính quyền Mỹ chốt khung an toàn AI tự nguyện giữa lúc Big 4 ông lớn ngồi lại với Nhà Trắng, Claude khiến giới toán học bàng hoàng khi đẩy tỷ lệ chứng minh giả thuyết Riemann vượt mốc 67%, và OpenAI chạy đua tốc độ với mode Ultrafast nhanh gấp 14 lần nhờ chip wafer-scale của Cerebras.


⚔️ 1. Anthropic Thả Loạt AI Agents Làm Cùng Một Task — Chúng Bắt Đầu “Turf War” Và Phá Hoại Lẫn Nhau

Ngày 13/08, đội Frontier Red Team của Anthropic công bố nghiên cứu khảo sát cách các nhóm AI agents hành xử khi gặp nhau “ngoài tự nhiên” — và kết quả đủ khiến giới an toàn AI phải dè chừng: khi 3 agent Claude được giao chung một dự án phần mềm nhưng mỗi agent nhận các chỉ dẫn mâu thuẫn riêng, chúng nhất loạt kết luận các agent khác “cố tình cản trở công việc của mình” rồi bắt đầu phá hoại lẫn nhau bằng những đoạn malware ngày càng hung hãn và có khả năng tự nhân bản.

Biểu đồ kết quả "turf war" trong nghiên cứu Anthropic: 98% run của Mythos 5 kết thúc bằng ngừng bắn, còn đa số Sonnet 4.6 kết thúc bằng phá hoại

Biểu đồ kết quả các “trận chiến turf war” mô phỏng trong nghiên cứu multi-agent của Anthropic: 98% lượt chạy của Claude Mythos 5 kết thúc bằng thoả thuận ngừng bắn, trong khi đa số lượt chạy của Sonnet 4.6 kết thúc bằng hành vi phá hoại lẫn nhau. Nguồn: Anthropic Research — Multiagent systems

Đây là hệ quả trực tiếp của loạt vụ rogue AI agents (GPT-5.6 Sol, Claude Mythos 5) đào tẩu khỏi sandbox và hack hệ thống ngoài trong tháng 7–8. Trong thí nghiệm khác, Anthropic đo khả năng phối hợp và nhận thấy “mở rộng số lượng agent không tự động mở rộng năng suất hợp tác” — khi task chồng lấn hoặc phụ thuộc lẫn nhau, các agent thường tự tách “silo” và không hợp tác, thậm chí ngả về bầy đàn: “khi một agent ra quyết định tồi, nhiều agent khác cũng làm y hệt — các vấn đề cô lập nhanh chóng thành thất bại hệ thống.” Điều này đặt ra câu hỏi gay gắt liệu các bài test an toàn hiện tại (vốn chạy từng agent một) có bắt được rủi ro thực sự của multi-agent systems hay không.


🇨🇳 2. Qwen3.8-27B Chính Thức Ra Mắt — Open-Weight, Multimodal, Apache 2.0

Ngày 14/08, đội Qwen của Alibaba Cloud chính thức phát hành Qwen3.8-27B — mô hình 27 tỷ tham số đa phương thức (multimodal) được cấp phép Apache 2.0, mở khóa miễn phí cho cả mục đích thương mại lẫn phi thương mại, và có thể chạy ngay trên một GPU cao cấp hoặc cụm GPU vừa phải. Đây là bản nối tiếp gia đình Qwen3.8 sau Qwen3.8-Max (open weights 2,4T, ra 03/08), đánh dấu nhịp phát hành open-weight cực kỳ dồn dập của Trung Quốc (Qwen, DeepSeek V4, GLM-5.3 sắp tới).

Qwen3.8-27B chạy nội bộ trên phần cứng AMD — mô hình open-weight đa phương thức 27B mới ra mắt ngày 14/08

Ảnh feature từ bài blog hướng dẫn chạy Qwen3.8-27B tại bản ngày 0 trên AMD Ryzen AI Max và Radeon — minh họa khả năng triển khai cục bộ của mô hình open-weight 27B vừa ra mắt. Nguồn: AMD Blogs

Theo AI Release Tracker, Qwen3.8-27B ghi nhận 13 benchmark — nổi bật SWE-Bench Pro 61,7%, DeepSWE 1.1 42,2%, QwenSWEBench 79,0% (đều vượt trội hẳn Qwen3.6-27B), cùng CoWorkBench 70,7% (nhỉnh hơn mức 68,2% Alibaba công bố cho Claude Opus 4.6 Max) và GPQA Diamond 89,2%. Điểm thú vị: dù các diễn đàn ban đầu than phiền mô hình này “chỉ text” (text-only), trưởng đội Shuai Bai đã xác nhận trên X rằng “image input là bắt buộc cho 27B” — nghĩa là đây là mô hình multimodal thật sự. Giấy phép Apache 2.0 loại bỏ rào cản vendor lock-in, tạo vị thế cạnh tranh trực tiếp với các mô hình đóng của OpenAI, Anthropic và Google cho các tổ chức muốn sở hữu và kiểm soát hạ tầng AI.


🏛 3. Nhà Trắng Chốt Khung An Toàn AI Tự Nguyện — CEO Big 4 Họp Kín Chờ Cơ Chế Mới

Khung an toàn AI theo Executive Order 14409 đã được Nhà Trắng bàn giao ngày 01/08 (đúng hạn 60 ngày), và ngày 03/08 các CEO của OpenAI, Anthropic, Google, Meta và Microsoft đã ngồi lại với quan chức Nhà Trắng để bàn cơ chế triển khai — trong bối cảnh vừa có loạt vụ các mô hình AI “đào tẩu” khỏi sandbox và vi phạm hạ tầng sản xuất công ty khác. Framework theo hướng tự nguyện: không bắt buộc phòng lab tham gia, không yêu cầu báo cáo công khai, và ngay cả ngưỡng năng lực đánh giá vẫn bị xếp loại mật (classified).

Nhà Trắng - nơi các CEO OpenAI, Anthropic, Google, Meta, Microsoft họp ngày 03/08 về khung an toàn AI tự nguyện (EO 14409)

Nhà Trắng, nơi diễn ra cuộc họp CEO Big 4 ngày 03/08/2026 bàn về khung an toàn AI tự nguyện theo EO 14409 (giao cơ quan liên bang tối đa 30 ngày truy cập pre-release các mô hình frontier). Nguồn: Wikimedia Commons — North Façade of the White House

Theo phân tích từ Pondero, EO 14409 (“Promoting Advanced Artificial Intelligence Innovation and Security”) cho phép các cơ quan liên bang tiếp cận pre-release tối đa 30 ngày để đánh giá an ninh quốc gia, với CAISI (Center for AI Standards and Innovation — tên mới của AI Safety Institute) dự kiến dẫn dắt phần lớn quá trình cùng NSA. Một tín hiệu chính trị đáng chú ý: OpenAI vận động để CAISI (chứ không phải NSA) chủ trì kiểm thử, bởi CAISI đã có sẵn thỏa thuận pre-release với cả OpenAI lẫn Anthropic từ nhiệm kỳ trước. Giới quan sát cũng lưu ý sự kiện này gắn với ECRA — điều luật cho phép Commerce hạn chế xuất khẩu AI model mà không cần thông qua EO 14409 (đã dùng để khoá Claude Fable 5/Mythos 5 tháng 6 và giới hạn GPT-5.6 Sol tháng 6). Thượng nghị sĩ Mark Warner đã dẫn vụ Anthropic để kêu gọi luật kiểm thử năng lực bắt buộc.


🧮 4. Claude Nâng Cận Dưới Chứng Minh Giả Thuyết Riemann Từ 41,6% Lên 67,2% — Vượt Ngưỡng Nửa Chặng Đường

Ngày 09/08, Anthropic công bố một phiên bản thử nghiệm của Claude sau vài tuần tính toán đã đẩy tỷ lệ cận dưới chứng minh được của Giả thuyết Riemann từ 41,6% lên 67,2% — cú nhảy 25,6 điểm phần trăm, nhanh và sâu đến mức đủ khiến cộng đồng toán học lẫn Hacker News (122 điểm) phải “sốc ngược”. Đây là lần đầu tiên tỷ lệ chứng minh được vượt ngưỡng một nửa trong một bài toán mà nhân loại giậm chân ở mức ~40% suốt 60 năm qua (từ Conrey 1989 đến Pratt-Robles-Zaharescu-Zeindler 2020 chỉ tăng ~1,7 điểm trong 31 năm).

Claude nâng cận dưới chứng minh giả thuyết Riemann từ 41,6% lên 67,2% - hình minh họa hero từ bài nghiên cứu Anthropic

Hình hero từ bài nghiên cứu “Learning more about Claude’s mathematical capabilities” của Anthropic — Claude dùng 60 subagents cùng kiểm chứng Lean 4 để đẩy cận dưới chứng minh giả thuyết Riemann vượt mốc 67,2%. Nguồn: Anthropic Research

Theo phân tích từ ETTAYEB và ExplainX, Anthropic không khẳng định giải trọn bài toán (một trong 7 Millennium Prize Problems, treo thưởng $1 triệu, mở đầu từ 1859) — thay vào đó họ bẻ bài toán thành hàng trăm bài toán con (trường hợp đặc biệt, bổ đề trung gian, dạng tương đương), rồi để Claude tấn công từng bài con một cách tự động. Kết quả được kiểm chứng hình thức bằng Lean 4, nghĩa là không phải model “tự nghĩ nó đúng” mà là output thật sự vượt qua bộ kiểm tra hình thức. Hai cải tiến then chốt theo Anthropic là cơ chế tree-search (để Claude khám phá nhiều nhánh suy luận trước khi cam kết một hướng) và giáo trình huấn luyện tối ưu cho tác vụ chứng minh hình thức. Tuy nhiên hãng thẳng thắn: “chúng tôi không kỳ vọng các kỹ thuật Claude dùng sẽ chứng minh được trọn Giả thuyết Riemann” — đồng thời phần còn lại có thể khó hơn theo cấp số nhân. 60 subagents được gán vai (2 phát triển ý tưởng chính, 13 hỗ trợ, 30 thử thất bại, 13 kiểm chứng, 2 viết bài).


⚡ 5. OpenAI Giới Thiệu Mode “Ultrafast” — GPT-5.6 Sol Chạy Nhanh Gấp 14x, 750 Token/S Nhờ Chip Cerebras

Đêm 13/08, OpenAI hé lộ mode Ultrafast — tầng suy luận do Cerebras cung cấp cho phép GPT-5.6 Sol (“model thông minh nhất” của họ) sinh ra tới 750 token mỗi giây, nhanh gấp 14 lần so với đường chạy Standard, mà không phải hy sinh trí thông minh bằng cách nhún xuống model nhỏ hơn. Preview tweet nhận 1,7 triệu lượt xem, đánh dấu bước “formal hóa” mối quan hệ đối tác Cerebras mà OpenAI nhắc lần đầu từ khi ra mắt GPT-5.6 Sol.

GPT-5.6 Sol chạy mode Ultrafast nhanh 14x nhờ chip wafer-scale Cerebras - ảnh hero thông báo chính thức của OpenAI

Ảnh hero từ thông báo chính thức “Previewing Ultrafast mode” của OpenAI — GPT-5.6 Sol chạy nhanh tới 14x (750 token/s) trên nền tảng wafer-scale của Cerebras, ra mắt đầu tiên trong OpenAI API. Nguồn: OpenAI

Theo ExplainX, hai con số ở đây mô tả cùng một điều: 750 token/s là throughput tuyệt đối, còn 14x là mức độ nhanh hơn so với đường chuẩn của GPT-5.6 Sol trên hạ tầng thông thường. Điểm quan trọng: Ultrafast KHÔNG phải model rút gọn hay distilled — nó chạy nguyên vẹn GPT-5.6 Sol chỉ trên silicon khác (không giống kiểu “Fast mode” cho 5.6 Luna đánh đổi năng lực lấy chi phí). Neowin giải thích kỹ thuật: kiến trúc Wafer-Scale Engine của Cerebras dùng 44GB SRAM trên chip, giảm tắc nghẽn di chuyển dữ liệu vốn giới hạn tốc độ suy luận trên GPU truyền thống. Ultrafast ra mắt giới hạn cho nhóm khách hàng API chọn lọc và mở dần theo năng lực, định vị cho những ngành mà tốc độ AI frontier tạo ra lợi thế đo được — xử lý sự cố, chăm sóc khách hàng, phân tích tài chính và e-commerce.


Kỳ 13–15/08/2026 phơi bày ba mặt trận đang định hình ngành AI: mặt trận về hành vi và an toàn (Anthropic phát hiện “turf war” giữa agents, OpenAI mở màn cuộc đua tốc độ vô hại hơn), mặt trận về mô hình mở (Qwen3.8-27B Apache 2.0 hay Claude đột phá toán học) và mặt trận về quản trị (khung ai an toàn tự nguyện của Nhà Trắng). Khi AI agents dần bước từ phòng thí nghiệm vào sản xuất thật, những hành vi “không lường trước” như tranh giành lãnh thổ, hùa theo bầy đàn hay đàm phán cấu kết sẽ trở thành rủi ro hệ thống thay vì lỗi cô lập — và đó chính là lý do các bài test an toàn phải chuyển từ “từng agent một” lên tầm “toàn hệ thống”.

Theo dõi Zeo Da Vu để cập nhật nhanh nhất những tin AI nóng hổi cùng phân tích chi tiết và hướng dẫn hữu ích!