Back to Stories
Aug 12, 2026
8 min read

🤖 Tin AI 12/08: Meta Mở Mã Muse Glimmer 30B Chạy Local Trên GPU Dân Dụng, White House Siết GPT-5.6, Loa Donut $300–400 Của OpenAI Lộ Diện, Grok 4.6 Ra Mắt Cùng Lộ Trình Grok 4.7, Claude Tiến Gần Giả Thuyết Riemann

Ngày 10/08 Meta Superintelligence Labs mở mã Apache 2.0 Muse Glimmer - model 30B chạy agent local trên GPU dân dụng từ 24GB, đòn đánh open-source lớn nhất của hãng kể từ bỏ Llama, cùng lời kêu gọi hạ rào cản AI mở từ Zuckerberg. Trong khi đó White House tiếp tục siết rollout GPT-5.6 (Sol/Terra/Luna), OpenAI lộ chi tiết thiết bị phần cứng đầu tiên - loa AI hình donut cỡ hockey puck giá $300-400 ra mắt 2027. xAI ra mắt Grok 4.6 giữ nguyên 1.5T tham số cải thiện post-training, Grok 4.7 (2.1T) đến sau vài tuần. Cuối cùng một model Claude chưa release đã nâng lower bound của Giả thuyết Riemann từ 41.6% lên 67.2% - bước ngoặt AI trong toán học.

Đầu tuần 10–11/08/2026 chứng kiến một loạt cú nước rút lớn của ngành AI: Meta mở mã hoàn toàn Muse Glimmer 30B chạy local trên GPU dân dụng, xAI công bố Grok 4.6 cùng lộ trình Grok 4.7 chỉ vài tuần nữa, OpenAI lộ diện thiết bị phần cứng đầu tiên từng được hé lộ, trong khi White House tiếp tục can thiệp rollout GPT-5.6. Đặc biệt nhất là một model Claude chưa phát hành đã bất ngờ tạo bước tiến lịch sử với Giả thuyết Riemann - một trong bảy bài toán thiên niên kỷ của toán học.


🐘 1. Meta Mở Mã Muse Glimmer 30B — Agent Chạy Local Trên GPU Dân Dụng, Apache 2.0

Ngày 10/08, Meta Superintelligence Labs (MSL) phát hành Muse Glimmer - model 30B tham số, license Apache 2.0, xây dựng từ Muse Spark để chạy agent workflows luôn luôn bật trên một GPU dân dụng 24-32GB. Đây là bản mở mã triệt để đầu tiên của Meta kể từ khi thay dòng mở Llama bằng Muse Spark đóng hồi tháng 4, và license Apache 2.0 còn cởi mở hơn cả Llama (không còn giới hạn 700 triệu user/tháng).

Meta Muse Glimmer - model 30B open-weight chạy agent local trên laptop

Meta mở mã Apache 2.0 Muse Glimmer 30B - model dành cho agent tự động chạy local trên GPU dân dụng, quan trọng nhất là hỗ trợ LLM 131K token, lý luận nhiều mức và chuỗi công cụ OpenClaw/Hermes Agent. Nguồn: VentureBeat

Theo VentureBeat, Muse Glimmer gồm encoder thị giác riêng biệt (~1.8B ViT-G/14), nhập liệu xen kẽ text + ảnh, hỗ trợ 100+ ngôn ngữ và context lên tới 131K token. Bản 4-bit quantized có thể fit trong 24GB VRAM (RTX 3090/4090) với độ suy giảm chỉ 0.2-1%. Cùng lúc Zuckerberg kêu gọi “hạ rào cản cho open-source AI ở Mỹ” để cạnh tranh Trung Quốc, và hé lộ sắp mở mã tiếp Muse Spark 1.2. Đây chính là dấu hiệu rõ nhất về ranh giới Meta vẽ giữa model “giữ lại” và model “công bố”.


🏛 2. White House Tip Tục Siết Rollout GPT-5.6 — Sol/Terra/Luna Bị Giới Hạn

Chính quyền Trump tiếp tục yêu cầu OpenAI giới hạn rollout dòng GPT-5.6 gồm Sol (flagship), Terra (cân bằng) và Luna (nhanh, rẻ), dù OpenAI nhấn mạnh “restrictions shouldn’t be the norm”. GPT-5.6 chỉ mở preview cho nhóm đối tác đã được “chia sẻ với chính phủ” Mỹ, một bước ngoặt hiếm có trong cách định hình thị trường AI frontier.

Sam Altman và chính quyền Trump - White House yêu cầu OpenAI giới hạn rollout GPT-5.6

White House yêu cầu OpenAI giới hạn release GPT-5.6 (Sol/Terra/Luna) cho nhóm đối tác vetted thay vì mở rộng toàn cầu, đánh dấu sự can thiệp trực tiếp của chính phủ vào việc đưa model frontier ra thị trường. Nguồn: TechCrunch

Sol giới thiệu hai chế độ lý luận mới: “max” cho phép dành thêm thời gian cho bài toán phức tạp và “ultra” phối hợp nhiều sub-agent song song. Ngoài ra bản cập nhật mới nhất của GPT-5.6 gồm cả accuracy fixes và mở rộng free tier. Vụ này diễn ra ngay sau khi Bộ Thương mại Mỹ ép Anthropic tắt quyền truy cập Claude Fable 5/Mythos 5 cho người nước ngoài - cho thấy xu hướng chính phủ siết quản lý model frontier đang trở thành “chuẩn mới”.


🔵 3. OpenAI Lộ Diện Thiết Bị Phần Cứng Đầu Tiên — Loa AI Hình Donut $300–400

Theo Bloomberg (06/08), thiết bị phần cứng đầu tiên của OpenAI là một chiếc loa thông minh hình donut cỡ cục hockey puck, giá $300-400, có camera + micro + loa nhưng không màn hình - “vật thể hóa của ChatGPT” dự kiến ra mắt 2027. Jony Ive và studio LoveFrom (đằng sau startup io mà OpenAI mua lại $6.5 tỷ) đảm nhận thiết kế.

OpenAI loa AI hình donut - thiết bị phần cứng đầu tiên không màn hình của OpenAI

Thiết bị đầu tiên của OpenAI là loa AI hình donut cỡ hockey puck giá $300-400, có “moving parts” tạo cá tính, camera và micro, không màn hình - do Jony Ive thiết kế, ra mắt 2027 theo Bloomberg. Nguồn: TechSpot

Thiết bị có “moving parts” tự cử động để biểu hiện khi đang nghe hay phản hồi, giúp cảm giác “sống động” hơn loa thông thường, kết hợp voice mode của ChatGPT với model tiên tiến hơn và trí nhớ cá nhân lâu dài. Tuy nhiên OpenAI đang vướng vụ kiện Apple cáo buộc đánh cắp bí mật thương mại liên quan kỹ thuật gia công kim loại. Ở mức $300-400, liệu người dùng có sẵn sàng trả cho một “chiếc donut nói chuyện” giữa thị trường smart speaker đã bão hòa Amazon/Google là câu hỏi 2027 sẽ trả lời.


🚀 4. Grok 4.6 Ra Mắt 07/08 — Giữ Nguyên 1.5T Tham Số, Tập Trung Post-Training, Grok 4.7 (2.1T) Chuẩn Bị Sau

xAI chính thức phát hành Grok 4.6 vào 07/08/2026 - model giữ nguyên nền tảng V9 1.5T tham số của Grok 4.5 nhưng cải thiện toàn diện qua supervised fine-tuning (SFT) và reinforcement learning (RL) thay vì tăng quy mô. Elon Musk xác nhận Grok 4.7 với khoảng 2.1 nghìn tỷ tham số sẽ ra mắt chỉ vài tuần sau, chung một chu kỳ nhịp độ gần như hằng tháng ở frontier.

Grok 4.6 của xAI - model nâng cấp post-training giữ 1.5T tham số, Grok 4.7 sắp ra mắt

xAI ra mắt Grok 4.6 (07/08) giữ nguyên nền tảng 1.5T tham số V9 nhưng cải thiện SFT/RL, cạnh tranh trực tiếp với Kimi K3 và Claude Opus 4.8; Grok 4.7 (2.1T) dự kiến ra mắt vài tuần sau. Nguồn: Evolink

Grok 4.6 nhắm cạnh tranh với Moonshot AI Kimi K3 (~2.8T) và Claude Opus 4.8, với lập luận rằng một model dense 1.5T được post-training tốt có thể ngang hàng model MoE lớn hơn trong thực tế inference. Model mang lại tốc độ sinh token nhanh hơn 20-30% với độ chính xác tương đương - lợi thế đáng kể cho workload throughput cao. Tất cả dựa trên cụm Colossus ở Memphis đang mở rộng vượt 500.000 GPU, theo đuổi tham vọng 1 triệu GPU.


📐 5. Claude Nâng Bound Giả Thuyết Riemann Từ 41.6% Lên 67.2% — Bước Tiến AI Trong Toán Học

Một model nghiên cứu Claude chưa phát hành đã nâng lower bound của tỉ lệ zero của zeta function thỏa Giả thuyết Riemann từ 41.6% lên 67.2% - lần đầu tiên vượt mốc phân nửa trong một lĩnh vực vốn chỉ tăng vài phần trăm mỗi thập kỷ. Người thách thức chỉ là một nhân viên Anthropic không có nền tảng toán học chuyên sâu, yêu cầu model “thử thật sự” với bài toán thiên niên kỷ này và để nó tự điều phối nhiệm vụ suốt 1,5 ngày.

Hình minh họa chiếc compa toán học - Claude nghiên cứu Giả thuyết Riemann

Model nghiên cứu Claude chưa release đã nâng lower bound của Giả thuyết Riemann từ 41.6% lên 67.2% bằng cách phối hợp ~60 subagent, chạy 2.400 lệnh shell và tạo chứng minh hình thức Lean - bước tiến chưa từng thấy từ một model AI chưa phát hành. Nguồn: Anthropic

Theo nghiên cứu của Anthropic (10/08), Claude dùng tới 31 triệu output tokens, thử qua 650 ý tưởng không thành, rồi điều phối 60 subagent (2 phát triển ý tưởng then chốt, 13 đóng góp, 13 kiểm chứng…), tải 54 bài báo từ arXiv để chắc chắn kết quả chưa ai công bố, và tạo một chứng minh Lean chạy qua validator comparator. Hai nhà toán học Anthropic cùng hai chuyên gia ngoài (Brian Conrey, Dan Goldston) xác nhận kết quả. Anthropic khiêm tốn ghi: “kỹ thuật này khó dẫn tới việc chứng minh trọn vẹn Giả thuyết Riemann” - nhưng đây là minh chứng rõ ràng nhất rằng AI có thể mở rộng tầm với của ý tưởng toán học con người.


Kỳ 10–11/08/2026 củng cố một thực tế: ngành AI đang phân hóa thành nhiều mặt trận song song - cuộc chiến open-weights vs closed (Meta Muse Glimmer vs White House siết GPT-5.6), đua phần cứng (loa donut của OpenAI, Colossus của xAI), và đua năng lực toán học khoa học (Claude và Riemann). Chu kỳ model gần như hằng tháng (Grok 4.5 → 4.6 → 4.7) cùng những bước tiến gây sốc trong nghiên cứu khoa học cho thấy tốc độ AI đang tăng theo cấp số nhân. Hãy theo dõi sát sao mảng nào sẽ bứt phá tiếp theo!

Theo dõi Zeo Da Vu để cập nhật nhanh nhất những tin AI nóng hổi cùng phân tích chi tiết và hướng dẫn hữu ích!