
Claude 4: Bước nhảy vọt mới nhất của Anthropic trong cuộc đua AI coding
Anthropic vừa chính thức ra mắt Claude 4 bao gồm hai phiên bản Claude Opus 4 và Claude Sonnet 4 vào ngày 22 tháng 5 năm 2025. Đây là thế hệ mô hình ngôn ngữ tiếp theo của Anthropic, thiết lập chuẩn mực mới về lập trình, suy luận nâng cao và khả năng thực thi tác vụ tự động qua AI agents.

Claude Opus 4: Mô hình coding mạnh nhất thế giới hiện tại
Claude Opus 4 được công nhận là mô hình lập trình tốt nhất thế giới hiện tại. Theo Anthropic, Opus 4 dẫn đầu trên hai bảng xếp hạng quan trọng:
- SWE-bench: 72.5% – tỷ lệ giải quyết các bài toán thực tế trên GitHub cao nhất từ trước đến nay
- Terminal-bench: 43.2% – khả năng thực thi tác vụ trên terminal vượt trội so với mọi đối thủ
Một điểm nổi bật khác của Opus 4 là khả năng làm việc liên tục trong thời gian dài – lên đến vài giờ liền với hàng ngàn bước thực thi. Điều này mở ra khả năng mới cho AI agent xử lý các dự án phức tạp kéo dài, điều mà các mô hình Sonnet trước đây chưa thể đạt được.
Claude Sonnet 4: Nâng cấp đáng giá từ Sonnet 3.7
Claude Sonnet 4 là phiên bản nâng cấp toàn diện từ Sonnet 3.7, với điểm số ấn tượng 72.7% trên SWE-bench – thậm chí cao hơn một chút so với Opus 4 trong một số bài toán coding cụ thể. Sonnet 4 cải thiện:
- Khả năng lập trình: Hiệu quả trong việc xử lý các thay đổi đa file phức tạp
- Điều khiển precise hơn: Phản hồi chính xác hơn với các hướng dẫn của người dùng
- Khả năng suy luận: Cải thiện đáng kể so với thế hệ trước

Các tích hợp thực tế với hệ sinh thái developer
Một trong những điểm mạnh lớn nhất của Claude 4 là sự tích hợp sẵn có với các công cụ lập trình phổ biến:
- Cursor: Gọi Opus 4 là “state-of-the-art for coding” và “bước nhảy vọt trong việc hiểu codebase phức tạp”
- Replit: Báo cáo cải thiện độ chính xác và khả năng xử lý các thay đổi phức tạp qua nhiều file
- Block: Đánh giá Opus 4 là mô hình đầu tiên nâng cao chất lượng code trong quá trình chỉnh sửa và debug
- GitHub Copilot: Sẽ tích hợp Sonnet 4 làm model chính cho coding agent mới
Cơ chế hybrid: Trả lời nhanh và suy luận sâu
Cả hai model Claude 4 đều sử dụng cơ chế hybrid với hai chế độ:
- Near-instant responses: Phản hồi nhanh tức thì cho các tác vụ đơn giản
- Extended thinking: Suy luận sâu cho các vấn đề phức tạp cần phân tích kỹ lưỡng
Đặc biệt, phiên bản extended thinking sẽ tóm tắt quá trình suy luận bằng một model nhỏ hơn khi cần thiết – chỉ khoảng 5% trường hợp cần hiển thị toàn bộ quá trình suy nghĩ. Điều này giúp giảm độ phức tạp cho người dùng cuối.
Cải thiện an toàn và giảm hành vi gian lận
Một cải tiến quan trọng khác là khả năng giảm đáng kể hành vi sử dụng “shortcut” hoặc “loophole” để hoàn thành tác vụ. Theo Anthropic, cả hai model Claude 4 đều ít có khả năng thực hiện hành vi gian lận hơn 65% so với Sonnet 3.7 trong các tác vụ AI agent. Điều này rất quan trọng để đảm bảo tính đáng tin cậy khi triển khai AI agents trong môi trường sản xuất.
Khả năng ghi nhớ ấn tượng
Claude Opus 4 cũng vượt trội đáng kể trong khả năng ghi nhớ so với các model trước đây. Khi các nhà phát triển cung cấp quyền truy cập file cục bộ cho Claude, Opus 4 thể hiện khả năng tạo và duy trì các file ghi nhớ để lưu trữ thông tin quan trọng. Điều này mở ra khả năng mới cho các AI agent làm việc với thông tin dài hạn.
Giá cả và khả năng truy cập
Cả hai model đều có sẵn trên:
- API của Anthropic
- Amazon Bedrock
- Google Cloud Vertex AI
Giá cả được giữ nguyên so với các thế hệ trước, giúp người dùng dễ dàng nâng cấp mà không lo về chi phí tăng đột biến.
Đánh giá tổng quan
Claude 4 đánh dấu một bước tiến quan trọng của Anthropic trong cuộc đua AI coding model. Với sự kết hợp giữa hiệu năng vượt trội, khả năng tích hợp rộng rãi và cải thiện về an toàn, đây là lựa chọn đáng chú ý cho các dự án phát triển phần mềm sử dụng AI.
Xem thêm thông tin chi tiết tại trang chính thức của Anthropic: Anthropic Claude 4 Announcement.
