Thứ Ba: Cập nhật AI trong tuần
Thứ Sáu: Góc nhìn & phân tích
Tháng 4 vừa qua, ba model lớn ra mắt cùng lúc. Nhưng câu chuyện đáng chú ý nhất lại là một model không bao giờ đến tay người dùng.
Demo thì đẹp, production thì khác
Bạn chắc đã xem ít nhất một video demo AI agent tự đặt vé máy bay, tự tóm tắt email, tự viết code rồi deploy. Trông mượt mà lắm. Rồi bạn thử tự dựng một cái tương tự cho công việc của mình. Và nó vỡ.
Không phải vỡ kiểu crash ngay lập tức. Nó vỡ kiểu tinh vi hơn. Agent tóm tắt email thì bỏ sót một attachment quan trọng. Agent đặt lịch thì chọn đúng múi giờ sai. Agent viết code thì chạy được 3 file đầu, đến file thứ 4 thì quên mất context của file thứ 2.
Vấn đề cốt lõi nằm ở toán học. Mỗi bước riêng lẻ, model đúng khoảng 95%. Nghe cao. Nhưng một workflow 10 bước? 0.95 mũ 10 bằng khoảng 60%. Bốn lần trong mười, agent của bạn sẽ sai ở đâu đó. Và bạn không biết nó sai ở bước nào cho đến khi kết quả cuối cùng ra sai.
Đây không phải do model “ngu”. Đây là bản chất xác suất của LLM. Mỗi lần sinh ra một token, nó đang đoán. Đoán rất giỏi, nhưng vẫn là đoán. Một lần đoán sai trong một cuộc trò chuyện thì không sao. Nhưng khi bạn xâu chuỗi hàng chục quyết định lại với nhau, sai số tích lũy.
Thêm một vấn đề ít người nói đến. Khi agent gặp lỗi, nó không biết mình đang lỗi. Nó không dừng lại hỏi bạn “Chỗ này tôi không chắc, bạn kiểm tra giùm?”. Nó cứ chạy tiếp, tự tin như chưa có gì xảy ra. Giống đồng nghiệp nộp report mà không đọc lại, rồi nói “em chắc chắn đúng rồi anh”.
Agents sẽ tốt hơn. Nhưng ngay lúc này, nếu bạn đang dựng agent cho công việc thật, hãy thiết kế cho trường hợp nó sai, không phải cho trường hợp nó đúng.

Model mạnh nhất tháng 4 là model bạn không được dùng
GPT-5.5 ra ngày 23/4. Claude Opus 4.7 ra ngày 16/4. Gemini 3.1 Pro ra cùng tháng. Ba model lớn, mỗi cái dẫn đầu một benchmark khác nhau. Opus 4.7 mạnh nhất về code (SWE-bench Pro 64.3%). Gemini 3.1 Pro mạnh nhất về suy luận khoa học (GPQA Diamond 94.3%) và rẻ hơn 60%. GPT-5.5 có kiến trúc mới, mạnh về agentic tasks.
Câu hỏi “dùng cái nào?” vẫn không có câu trả lời dễ. Nhưng đó không phải điều thú vị nhất tháng này.
Anthropic xác nhận Claude Mythos tồn tại. Model mạnh nhất họ từng xây. Và họ quyết định không phát hành. Lý do? Trong quá trình test, Mythos phát hiện ra hàng nghìn zero-day vulnerability, những lỗ hổng bảo mật chưa ai biết trong các hệ thống thật. Một model có khả năng tìm lỗ hổng bảo mật tốt đến mức chính nhà phát triển sợ không dám ship.
Hãy nghĩ về điều này một giây. Một công ty AI vừa nhận 40 tỷ đô đầu tư từ Google, đang trong cuộc đua khốc liệt nhất ngành, mà tự chọn không tung ra sản phẩm mạnh nhất của mình.
Có hai cách đọc tín hiệu này. Một, Anthropic thực sự nghiêm túc về an toàn AI, và đây là bằng chứng rõ nhất. Hai, chúng ta đã đến giai đoạn mà model đủ mạnh để nguy hiểm theo những cách rất cụ thể, không còn trừu tượng nữa.
Có thể cả hai đều đúng. Và nếu cả hai đều đúng, thì cuộc đua model lớn nhất sắp tới sẽ không chỉ là “cái nào mạnh hơn”. Mà còn là “cái nào đủ an toàn để được phép ship”.
🎓 Kỹ năng AI tuần này
Kỹ năng: Custom Instructions, thiết lập một lần, dùng mãi mãi
Tại sao học ngay: Mỗi lần mở ChatGPT hay Claude, bạn lại phải giải thích mình là ai, làm gì, muốn trả lời kiểu nào. Custom Instructions giúp bạn nói một lần duy nhất. Mọi cuộc trò chuyện sau đó đều bắt đầu từ đúng ngữ cảnh, không cần nhắc lại.
Hướng dẫn từng bước:
- Xác định 3 thứ cố định. Vai trò công việc của bạn (ví dụ: Product Manager ở công ty fintech). Ngôn ngữ bạn muốn AI dùng (tiếng Việt, tiếng Anh, hay trộn). Phong cách trả lời bạn thích (ngắn gọn, có bullet point, hay giải thích kỹ).
- Viết thành một đoạn ngắn. Không cần dài. 4 đến 6 câu là đủ. Ví dụ cho một content marketer: “Tôi là content marketer tại một startup edtech ở Việt Nam. Đối tượng độc giả là phụ huynh 30-45 tuổi. Trả lời bằng tiếng Việt, giọng gần gũi, không dùng từ hoa mỹ. Khi tôi nhờ viết bài, luôn đề xuất 3 hook khác nhau trước khi viết full.”
- Đặt vào đúng chỗ. ChatGPT thì vào Settings rồi chọn Custom Instructions. Claude thì tạo Project mới, dán vào phần Instructions. Gemini thì tạo một Gem riêng.
- Test bằng một câu hỏi ngắn. Hỏi một thứ đơn giản liên quan đến công việc. Nếu AI trả lời đúng ngữ cảnh mà bạn không cần giải thích thêm, custom instruction đã hoạt động.
- Chỉnh sau 3 ngày dùng. Bạn sẽ nhận ra thiếu gì sau vài lần dùng thật. Thêm vào dần, đừng cố viết hoàn hảo ngay từ đầu.
Thử ngay: Mở AI tool bạn dùng nhiều nhất. Viết custom instruction cho đúng vai trò công việc hiện tại của bạn trong 5 phút. Rồi hỏi nó “Tóm tắt công việc quan trọng nhất tuần này của tôi nên là gì?” Nếu câu trả lời có vẻ hiểu bạn, bạn đã tiết kiệm được vài phút mỗi ngày từ giờ trở đi.
📅 Sự kiện AI tới
Smart City Asia 2026
6–8/05/2026 | SECC, 799 Nguyễn Văn Linh, TP. Hồ Chí Minh
Triển lãm AI, IoT, 5G, Big Data cho đô thị thông minh. Hơn 300 đơn vị tham gia từ 20 quốc gia.
Đăng ký →
ICAIBWA 2026 — International Conference on AI in Bioinformatics Workflow Automation
27/05/2026 | Hà Nội
Hội nghị học thuật về AI ứng dụng trong tự động hóa quy trình sinh tin học.
Chi tiết →
ICMLSCI 2026 — International Conference on Machine Learning for Smart Cities and IoT
02/06/2026 | Huế
Machine learning ứng dụng cho đô thị thông minh và IoT.
Chi tiết →
Bạn có một cách dùng AI giúp công việc hiệu quả hơn? Chia sẻ để mọi người cùng học hỏi
tại đây.

Gửi phản hồi