Tuần 12–18/09/2026 là tuần hiếm hoi mà tin lớn nhất của ngành AI không phải một model mới, mà là lời kêu gọi đi chậm lại: CEO Anthropic Dario Amodei công bố kế hoạch “pace the frontier”, OpenAI xác nhận đã bàn với Anthropic và Google DeepMind nhiều tuần về chuẩn an toàn chung. Cùng lúc, Claude gộp Cowork vào chat và ra Docs, Slides; DeepSeek tung V4.1-Flash rẻ hơn 70% mà mạnh hơn bản Pro; OpenAI chốt lịch DevDay 29/09; còn ở Việt Nam, Tech4Life 2026 chỉ ra khoảng cách giữa “đã dùng AI” và “có kết quả kinh doanh”.
TL;DR
- 12/09: Dario Amodei đăng bài kêu gọi ngành AI “phải giảm tốc độ nâng năng lực model”, đề xuất 3 bước; Sam Altman và Elon Musk lên tiếng đồng tình. 15/09: OpenAI xác nhận ba công ty đã đàm phán an toàn “nhiều tuần” (TechCrunch).
- 16/09: Claude Cowork và chat gộp làm một; ra Claude Docs, Claude Slides, Claude Design dùng ngay trong hội thoại; Claude làm việc nền kể cả khi bạn đóng máy. Pro và Max nhận trước, Team và Free sau.
- 17/09: Anthropic công bố 3 thước đo tốc độ phát triển AI trong phòng lab: Claude đang dẫn 26% công việc R&D AI của chính Anthropic; khoảng 6% compute R&D dành cho an toàn. Cùng ngày ra mắt Life Sciences Verification Program (beta).
- 10/09: DeepSeek V4.1-Flash: 552B tham số MoE, chỉ 8B kích hoạt khi đọc, 16B khi sinh; ngữ cảnh 1M token; trọng số MIT; giá giờ thấp điểm 0,15/0,60 USD mỗi triệu token.
- OpenAI: ChatGPT Images 2.5 (08/09) thêm @Sketch, nhanh hơn tới 50%, mở cho mọi gói; DevDay 29/09 tại Fort Mason, keynote livestream miễn phí.
- Google: Gemini 3.8 Flash giá giới thiệu 0,75/3,75 USD mỗi triệu token tới hết 2026; bản Flash Cyber chỉ mở cho “người phòng thủ” qua Fairwind; Google Assistant bắt đầu bị Gemini thay từ 04/09.
- Việt Nam: Tech4Life 2026 (17/09, TP.HCM): 88% doanh nghiệp đã dùng AI ở ít nhất một bộ phận nhưng chỉ 19% đủ “trưởng thành” để biến thành kết quả; AI Awards 2026 chốt trao giải đầu tháng 11 tại Hà Nội.
Vì sao tuần này ba ông lớn AI lại rủ nhau đi chậm?
Câu chuyện bắt đầu ngày thứ Bảy 12/09 khi Dario Amodei, CEO Anthropic, đăng bài luận với câu chốt “chúng ta phải giảm tốc độ nâng năng lực của model AI”. Theo TechCrunch, kế hoạch “pace the frontier” của ông có 3 bước: (1) các tổ chức đánh giá độc lập như METR được “cắm” người vào bên trong công ty AI, có thẻ nhân viên, bàn làm việc và máy tính để kiểm chứng cam kết an toàn và báo cáo sự cố; (2) các công ty AI hàng đầu ở các nước dân chủ lập chuẩn an toàn chung và giới hạn tốc độ tiến bộ không kiểm soát, với chính phủ Mỹ làm trung gian để tránh vấn đề chống độc quyền; (3) phối hợp toàn cầu, kể cả với các chính phủ không dân chủ, về giao thức an toàn và hạn chế ứng dụng nguy hiểm. Anthropic đơn phương cam kết bước 1 ngay; Sam Altman trả lời “tôi đồng ý với Dario rằng chúng ta cần pace the frontier”, còn Elon Musk viết ngắn gọn “Dario đúng”.
Đến thứ Ba 15/09, Chris Lehane, phụ trách chính sách toàn cầu của OpenAI, xác nhận với báo giới rằng OpenAI, Anthropic và Google DeepMind đã trao đổi về an toàn AI “nhiều tuần”, gồm cả việc xây dựng tiêu chuẩn ngành và giảm nhịp phát triển AI tiên phong. OpenAI cũng tuyên bố ủng hộ điều khoản về tổ chức kiểm chứng độc lập trong dự luật FRONTIER Act và sẽ để bên thứ ba vào đánh giá như Anthropic. Phía chính trị không đồng thuận: Tổng thống Trump gọi lo ngại an toàn là “trò bịp”, cố vấn David Sacks cho rằng rủi ro hiện sinh bị thổi phồng.
Góc nhìn cho người dùng Việt: đây chưa phải chuyện model chậm ra hay giá tăng ngay. Nhưng nếu bước 2 thành hiện thực, nhịp “5 model tiên phong trong 10 ngày” như đầu tháng 9 sẽ khó lặp lại, và các tính năng nhạy cảm (an ninh mạng, sinh học) sẽ đi theo đường “xác minh danh tính rồi mới mở” như hai chương trình bên dưới.
Anthropic đo tốc độ phát triển AI bằng 3 con số nào?
Ngày 17/09, Anthropic công bố ba thước đo mà họ cho là có thể giúp công chúng nhìn vào bên trong phòng lab. Số liệu đo trong tháng 7–8/2026:
| Thước đo | Con số Anthropic công bố | Ý nghĩa |
|---|---|---|
| AI tự làm R&D | Claude “dẫn dắt” 26% công việc nghiên cứu và phát triển AI của Anthropic (tháng 8/2026); hơn 90% việc ở mức “cộng tác” trở lên; chưa có mảng nào đạt tự chủ hoàn toàn (AL5) | AI đang tự cải thiện AI ở mức nào |
| Giám sát agent | Khoảng 30.000 agent nghiên cứu và kỹ thuật chạy trên nền tảng nội bộ; bộ giám sát trực tuyến chặn 0,002% hành động (khoảng 1 trên 47.000 quyết định); giám sát ngoại tuyến gắn cờ 1–2 bản ghi mỗi 1.000 | Agent có được theo dõi đủ chặt không |
| Phân bổ compute | Tuần 13–20/07: khoảng 6% compute R&D AI dành cho an toàn; 12% nếu chỉ tính phần R&D do AI dẫn dắt | Lời nói về an toàn có đi kèm tài nguyên không |
Cùng ngày, Anthropic mở beta Life Sciences Verification Program: phòng lab học thuật, startup, công ty dược và tổ chức nghiên cứu qua xác minh (năng lực, chuẩn bảo mật, giám sát đạo đức) sẽ được dùng Claude Mythos, Opus và Sonnet với bộ lọc “nới hơn cho công việc sinh học”, hai mức cấp phép Standard Use và High-risk Use. Đây là mẫu hình “mở theo danh tính” mà mình nghĩ sẽ lan sang nhiều ngành khác.
Claude gộp Cowork vào chat, thêm Docs và Slides: người dùng Việt được gì?
Thông báo ngày 16/09 trên blog Claude: Claude Cowork và chat “giờ là một Claude”. Trước đây người dùng phải tự chọn việc nào làm ở chat, việc nào giao cho Cowork, và cái bắt đầu ở bên này không mang sang bên kia; nay Claude tự quyết định tác vụ cần gì. Ba thứ mới đi kèm:
- Claude Docs: tài liệu viết chung ngay trong hội thoại, bạn và Claude cùng soạn, sửa trực tiếp, để bình luận vào phần đã xong; theo Engadget, tài liệu mặc định riêng tư, chia sẻ được và xuất ra Google Docs hoặc Word.
- Claude Slides: Claude dựng bản nháp slide, bạn sửa tại chỗ, trình chiếu thẳng từ Claude hoặc tải PowerPoint/PDF; slide tạo cùng hội thoại với báo cáo thì “đã khớp sẵn với báo cáo”.
- Claude Design trong chat: việc thiết kế hình ảnh, prototype gọi được từ bất kỳ hội thoại nào, không phải mở Design riêng.
Điểm mình thấy đáng giá nhất không phải Docs hay Slides, mà là “làm việc nền”: bạn hỏi “tuần qua pipeline thay đổi gì”, đóng máy đi ăn trưa, về tới bàn thì báo cáo đã nằm sẵn dưới dạng doc; đặt lịch mỗi thứ Hai thì Claude tự làm mà không cần nhắc. Lộ trình: Pro và Max nhận trước trên web, desktop, mobile “trong vài tuần tới”; Team và Free “sớm”; Enterprise được báo trước ít nhất 30 ngày. Người đang dùng Cowork vẫn thấy chat, project, artifact, connector và skill ở chỗ cũ. Nếu bạn chưa rõ Cowork là gì, bài Claude Cowork là gì và cách dùng để tự động hóa công việc vẫn đúng về cơ chế giao việc, chỉ khác là giờ không cần chuyển tab. Toàn bộ Docs, Slides, Design đều hiện ra dưới dạng artifact, mình giải thích kỹ trong bài Claude Artifacts là gì.
DeepSeek V4.1-Flash rẻ hơn 70% mà mạnh hơn V4-Pro, thật không?
Theo change log chính thức của DeepSeek và bài của SiliconANGLE ngày 10/09, V4.1-Flash là model nhỏ nhất trong kiến trúc mới, đa phương thức (đọc ảnh và chữ) với 552 tỷ tham số kiểu Mixture-of-Experts nhưng chỉ kích hoạt 8 tỷ khi xử lý đầu vào và 16 tỷ khi sinh chữ; bộ nhớ KV cache 890 byte mỗi token, bằng khoảng một phần tư V4-Flash cũ; ngữ cảnh 1 triệu token; trọng số công bố trên Hugging Face theo giấy phép MIT. Điểm số DeepSeek tự công bố: GPQA Diamond 90,9, Terminal-Bench 2.1 90,6, Codeforces 3471; SiliconANGLE dẫn DeepSWE v1.1 74,2% so với 62,7% của V4-Pro và 74% của Claude Opus 5.
Về giá, giờ thấp điểm là 0,15 USD mỗi triệu token đầu vào chưa cache và 0,60 USD mỗi triệu token đầu ra, thấp hơn khoảng 70% so với 3,96 USD đầu ra của V4-Pro giờ cao điểm. DeepSeek ban đầu định chuyển mọi yêu cầu V4-Pro qua API sang V4.1-Flash từ 14/09, nhưng change log đã bổ sung: “theo nhu cầu người dùng”, V4 Pro tiếp tục phục vụ sau 14/09 với cách tính phí không đổi. Với người Việt đang dựng workflow n8n gọi API, đây là lựa chọn đáng thử cho tác vụ tóm tắt, phân loại số lượng lớn; mình đã so sánh chi phí token các nhà trong bài Claude API tiếng Việt và ChatGPT 6 Astra API để bạn đặt cạnh nhau.
OpenAI có gì mới ngoài GPT-6 Astra?
Hai việc. Thứ nhất, ChatGPT Images 2.5 ra ngày 08/09, được OpenAI gọi là model ảnh mạnh nhất của họ: ánh sáng và chất liệu tự nhiên hơn, giữ chủ thể từ ảnh tham chiếu tốt hơn, làm theo chỉnh sửa nhiều lượt ổn định hơn, độ trễ giảm tới 50% so với Images 2.0. Tính năng mới đáng chú ý là Sketch: gõ “@Sketch” để vẽ phác ngay trong chat làm tham chiếu cho ảnh cuối, có mẫu Poster và Merch; bạn cũng có thể ghim bình luận lên ảnh để sửa đúng chỗ. Bản này mở cho mọi gói ChatGPT, ChatGPT Work và Codex. Trên API có hai model GPT-Image-2.5 Flare (mặc định, nhanh) và Sunburst (chậm hơn, sửa chính xác hơn), cùng giá 8 USD mỗi triệu token ảnh đầu vào (2 USD nếu cache), 30 USD mỗi triệu token ảnh đầu ra, 5 USD mỗi triệu token chữ đầu vào.
Thứ hai, DevDay 2026 chốt ngày thứ Ba 29/09 tại Fort Mason, San Francisco: keynote 10:00 giờ Thái Bình Dương (0:00 ngày 30/09 giờ Việt Nam) có Sam Altman và được livestream miễn phí; giới hạn khoảng 1.500 lập trình viên tại chỗ; lần đầu có DevDay Exchanges ở 8 thành phố gồm Bengaluru, Tokyo, Seoul, Paris, Berlin, London, São Paulo, Mexico City. Đây nhiều khả năng là nơi OpenAI nói tiếp về Codex và Astra; bạn có thể ôn lại bối cảnh ở bài GPT-6 Astra ra mắt.
Google: Gemini 3.8 Flash, bản Cyber và ngày Assistant “nghỉ hưu”
Blog Google ngày 02/09 giới thiệu Gemini 3.8 Flash là “model chủ lực thông minh nhất” của hãng: vượt các model lớn hơn trên DeepSWE v1.1, đạt 54,9% HLE-Verified, có trên AI Studio, Android Studio, Antigravity, Gemini Enterprise và cho thuê bao AI Pro/Ultra; giá giới thiệu 0,75 USD mỗi triệu token vào, 3,75 USD mỗi triệu token ra, áp dụng tới 31/12/2026. Bản Gemini 3.8 Flash Cyber đạt trên 70% trên bộ đánh giá nội bộ 20 ngôn ngữ lập trình, 47,2% pass@1 trên CWE-Bench, và theo đội Chrome Security, tạo ra số bản vá đúng gấp 2,6 lần các model thương mại hàng đầu; nhưng chỉ mở cho cơ quan nhà nước, hạ tầng trọng yếu và người bảo trì phần mềm qua chương trình Fairwind, không có API công khai. Cùng chủ đề an ninh mạng, bài tổng hợp của The Hacker News cho biết Astra của OpenAI từ chối 91,5% yêu cầu jailbreak so với 59% của GPT-5.6 Sol, và Anthropic đưa Enterprise Frontier Safeguards cho khách doanh nghiệp.
Tin gần người dùng phổ thông hơn: từ 04/09, Google bắt đầu thay Google Assistant bằng Gemini trên điện thoại, máy tính bảng Android, đồng hồ Wear OS, tai nghe và Android Auto; việc chuyển kéo dài vài tuần và sau đó không quay lại Assistant được (theo The Decoder). Nếu nhà bạn dùng lệnh giọng nói điều khiển đèn, ổ cắm, hãy thử lại các lệnh quen thuộc sau khi máy cập nhật.
Việt Nam tuần này: “dùng AI” và “có kết quả” cách nhau bao xa?
Tại Tech4Life 2026 ở TP.HCM ngày 17/09, bà Nguyễn Thị Thu Giang, Phó Chủ tịch kiêm Tổng Thư ký VINASA, nêu nghịch lý: AI ngày càng phổ biến trong công việc nhưng không phải doanh nghiệp nào cũng đổi được thành kết quả kinh doanh. Các số liệu được dẫn tại sự kiện (theo CafeBiz): 66% người dùng nói AI giúp họ tập trung vào việc giá trị cao hơn, 88% doanh nghiệp đã đưa AI vào ít nhất một bộ phận, nhưng chỉ 19% làm việc ở tổ chức đủ trưởng thành để khai thác, còn doanh thu và chi phí vận hành phần lớn chưa đổi. Thông điệp “AI không tự tạo ROI” đi kèm ví dụ FPT Long Châu: triển khai AI trên hơn 2.000 nhà thuốc với 50 triệu hồ sơ khách hàng, giảm 30% chi phí vận hành, rút thời gian phản hồi khách từ 15 xuống 11 giây. NetNam đề xuất một thước đo mình thấy rất hợp với SME: chi phí trên mỗi tác vụ hoàn thành đúng, thay vì chỉ nhìn tiền token, vì AI rẻ mà người phải kiểm lại nhiều thì vẫn lỗ.
Ngoài ra, AI Awards 2026 do VnExpress tổ chức dưới sự chỉ đạo của Bộ Khoa học và Công nghệ đang ở vòng bình chọn với ba nhóm: sản phẩm và giải pháp AI, tài năng AI dưới 35 tuổi, doanh nghiệp AI; lễ trao giải dự kiến đầu tháng 11 tại Hà Nội trong khuôn khổ AI4VN 2026.
Lịch tuần tới và 5 việc nên làm ngay
| Ngày | Sự kiện | Ai nên để ý |
|---|---|---|
| Vài tuần tới | Claude Docs, Slides, Design về tài khoản Pro/Max | Người viết báo cáo, làm slide bằng Claude |
| 29/09 (0:00 30/09 giờ VN) | OpenAI DevDay keynote livestream | Dev dùng Codex, API Astra |
| 30/09 | Google ngừng endpoint gemini-omni-flash-preview (theo changelog Gemini API) | Ai đang gọi endpoint này trong n8n |
| Đầu tháng 11 | AI Awards 2026 tại Hà Nội | Startup, doanh nghiệp AI Việt |
| 31/12/2026 | Hết giá giới thiệu Gemini 3.8 Flash | Ai đang dựng workflow trên Flash |
- Kiểm tra lại workflow đang gọi Gemini: đổi tên endpoint preview trước 30/09 và tính lại chi phí khi giá 3.8 Flash tăng gấp đôi sau 31/12.
- Thử DeepSeek V4.1-Flash cho tác vụ khối lượng lớn: chạy song song 100 yêu cầu tóm tắt với model bạn đang dùng, so chất lượng và hóa đơn.
- Chuẩn bị đón Claude Docs/Slides: gom quy trình viết báo cáo tuần thành một Project instructions để khi tính năng về là dùng được ngay.
- Thử @Sketch trong ChatGPT: phác bố cục thumbnail hoặc poster rồi để Images 2.5 dựng, đỡ mô tả dài dòng.
- Đo “chi phí mỗi tác vụ đúng”: chọn một việc đang giao cho AI, đếm số lần phải sửa tay trong tuần; đó là con số quyết định gói nào đáng tiền.
Câu hỏi thường gặp
“Pace the frontier” có nghĩa các model mới sẽ ngừng ra không?
Không. Đến nay chỉ có cam kết đơn phương của Anthropic (và lời hứa theo sau của OpenAI) về việc cho bên thứ ba vào đánh giá; bước giới hạn tốc độ chung mới ở giai đoạn đàm phán và cần chính phủ Mỹ làm trung gian.
Tài khoản Claude Free có được Docs và Slides không?
Anthropic nói Team và Free “sẽ có sớm”, nhưng Pro và Max nhận trước trong vài tuần tới. Trang trợ giúp Claude cũng ghi Design, Slides và Docs đang beta và cần gói trả phí.
DeepSeek V4.1-Flash dùng được trong n8n chưa?
Được, qua API với tên model deepseek-flash; các alias cũ deepseek-v4-flash tạm thời được chuyển sang V4.1. Lưu ý giá thấp điểm và cao điểm khác nhau.
ChatGPT Images 2.5 có mất thêm tiền không?
Trong ChatGPT thì không, mở cho mọi gói kể cả Free; chỉ API tính theo token ảnh như bảng giá ở trên.
Google Assistant bị tắt thì loa Google Home có bị ảnh hưởng không?
Đợt này áp dụng cho điện thoại, máy tính bảng, Wear OS, tai nghe và Android Auto; xe dùng Google built-in tạm chưa. Loa thông minh không nằm trong thông báo này.
Xem DevDay ở Việt Nam thế nào?
Keynote 10:00 sáng 29/09 giờ San Francisco tương đương 0:00 ngày 30/09 giờ Việt Nam, livestream miễn phí trên trang devday.openai.com, có thể đăng ký nhận nhắc.
Kết luận
Nếu chỉ nhớ một điều từ tuần này: cuộc đua AI đang chuyển từ “ai ra model nhanh hơn” sang “ai được tin để mở tính năng mạnh hơn”, thể hiện qua các chương trình xác minh danh tính của Anthropic và Google, và qua lời kêu gọi giảm tốc từ chính người dẫn đầu. Với người làm nội dung và SME Việt, việc thực tế hơn là tận dụng làn sóng giá rẻ (DeepSeek, Gemini Flash) cho tác vụ khối lượng lớn, và chuẩn bị quy trình để đón Claude Docs, Slides. Bản tin tuần trước bạn có thể đọc lại ở bài Claude Opus 5 ra mắt và ChatGPT 6 Astra là gì; muốn biến dữ liệu thành báo cáo bằng AI, xem thêm review Julius AI vừa đăng.
Nguồn tham khảo
- TechCrunch – Anthropic CEO outlines plan to pace the frontier (12/09/2026) — 3 bước, cam kết đơn phương, phát biểu Altman/Musk.
- TechCrunch – OpenAI, Anthropic, Google in talks on AI safety (15/09/2026) — xác nhận của Chris Lehane, FRONTIER Act.
- Anthropic Institute – Measurements for understanding the pace of AI development — 26% R&D, 30.000 agent, 6%/12% compute an toàn; Life Sciences Verification Program (17/09/2026).
- Claude Blog – Claude Cowork and chat are now one Claude (16/09/2026) và Engadget — Docs, Slides, Design, lộ trình theo gói.
- DeepSeek API – Change Log (10/09/2026) và SiliconANGLE — thông số, giá, giấy phép V4.1-Flash.
- Unite.AI – OpenAI releases ChatGPT Images 2.5 (08/09/2026) và OpenAI DevDay 2026.
- Google Blog – Introducing Gemini 3.8 Flash and 3.8 Flash Cyber (02/09/2026); The Hacker News; The Decoder – Google Assistant shutdown; Gemini API changelog — ngừng gemini-omni-flash-preview 30/09/2026.
- CafeBiz – Tech4Life 2026 (17/09/2026) và VnExpress – AI Awards 2026.
