Anthropic thừa nhận lỗi kỹ thuật làm suy giảm hiệu năng Claude Code suốt gần hai tháng qua

Anthropic thừa nhận lỗi kỹ thuật làm suy giảm hiệu năng Claude Code suốt gần hai tháng qua

Thứ 6, 24/04/2026 09:00
Cộng đồng lập trình viên phát hiện Claude Code bỗng trở nên chậm chạp, hay quên và xử lý lỗi qua loa - và họ đúng.

Ngày 23/4, Anthropic công bố kết quả điều tra nội bộ, xác nhận rằng Claude Code - công cụ lập trình AI của hãng - đã trải qua giai đoạn suy giảm hiệu năng thực sự từ đầu tháng 3 đến ngày 20/4. Nguyên nhân không phải do mô hình bị cố tình hạ cấp, mà do ba thay đổi kỹ thuật riêng biệt chồng chéo lên nhau theo cách mà chính Anthropic cũng không lường trước được.

Ba thay đổi, một hệ quả khó nhận ra

Thay đổi đầu tiên diễn ra ngày 4/3: Anthropic hạ mức reasoning effort mặc định của Claude Code từ "high" xuống "medium", với lý do một số người dùng phản ánh giao diện bị đứng hình vì mô hình suy nghĩ quá lâu. Ngay sau khi triển khai, cộng đồng lập trình viên báo cáo Claude Code cảm giác kém thông minh hơn rõ rệt. Anthropic đã hoàn tác thay đổi này vào ngày 7/4, đồng thời nâng mặc định lên "xhigh" cho Opus 4.7 và "high" cho các mô hình còn lại.

Lỗi thứ hai xuất hiện ngày 26/3, khi một bản cập nhật tối ưu bộ nhớ đệm bị cài đặt sai. Thay vì chỉ xóa lịch sử suy luận của phiên làm việc đã dừng hơn một tiếng, đoạn code lỗi khiến Claude xóa lịch sử đó sau mỗi lượt hội thoại, dẫn đến tình trạng mô hình liên tục quên lý do tại sao nó đã thực hiện các thao tác trước đó. Biểu hiện bên ngoài là Claude hay lặp lại thao tác, chọn cách xử lý sai, và ngày càng thiếu nhất quán trong các tác vụ phức tạp. Lỗi này cũng khiến bộ nhớ đệm liên tục bị bỏ qua, đẩy chi phí token lên cao bất thường và làm cạn kiệt giới hạn sử dụng nhanh hơn dự kiến. Anthropic sửa lỗi này vào ngày 10/4.

Thay đổi thứ ba đến ngày 16/4, khi Anthropic thêm vào system prompt một đoạn giới hạn độ dài phản hồi - không quá 25 từ giữa các lần gọi công cụ, và không quá 100 từ cho câu trả lời cuối cùng - nhằm kiềm chế tình trạng Opus 4.7 trả lời quá dài dòng. Kiểm tra nội bộ ban đầu không phát hiện vấn đề, nhưng sau khi triển khai cùng Opus 4.7, các bài đánh giá sâu hơn cho thấy chất lượng lập trình giảm 3% trên cả Opus 4.6 lẫn 4.7. Đoạn lệnh này bị hoàn tác ngày 20/4.

Người dùng cảm nhận đúng - nhưng phải mất hai tháng để được thừa nhận

Điều đáng chú ý là cộng đồng lập trình viên đã phát hiện vấn đề rất sớm, nhưng Anthropic ban đầu phủ nhận có bất kỳ sự thay đổi thực chất nào. Nhân viên của Anthropic, trong nhiều tuần liên tiếp, khăng định mô hình vẫn hoạt động tốt và những gì người dùng phàn nàn chỉ là thay đổi giao diện hiển thị, không ảnh hưởng đến năng lực suy luận thực sự của mô hình.

Bước ngoặt đến từ một báo cáo bất thường. Ngày 2/4, Stella Laurenzo - giám đốc cấp cao nhóm AI tại AMD - đăng lên GitHub một phân tích chi tiết dựa trên 6.852 phiên làm việc Claude Code, 17.871 khối suy luận và 234.760 lượt gọi công cụ, kết luận rằng Claude Code đã không còn đủ tin cậy để thực hiện các tác vụ kỹ thuật phức tạp.

Dữ liệu cho thấy độ sâu suy luận trung bình giảm từ 2.200 ký tự vào tháng 1 xuống còn 600 ký tự vào tháng 3 - tức giảm 73%. Tỷ lệ số file đọc trước khi chỉnh sửa cũng giảm từ 6,6 xuống còn 2,0, cho thấy mô hình đang chuyển từ phong cách "đọc kỹ rồi mới sửa" sang "sửa luôn không cần hiểu bối cảnh". Một đoạn hook tự động mà Stella Laurenzo xây dựng để phát hiện hành vi bỏ giữa chừng hoặc né tránh trách nhiệm chưa kích hoạt lần nào trước ngày 8/3, nhưng sau đó kích hoạt 173 lần chỉ trong 17 ngày.

Stella Laurenzo cho biết đội của bà đã chuyển sang dùng nhà cung cấp khác, đồng thời để lại cảnh báo: "Sáu tháng trước, Claude đứng một mình ở tầng năng lực suy luận và thực thi. Nhưng các đối thủ cần được theo dõi và đánh giá rất cẩn thận. Anthropic không còn đơn độc ở tầng năng lực mà Opus từng chiếm giữ."

Anthropic phản hồi và cam kết thay đổi

Tính đến ngày 23/4, Anthropic đã reset giới hạn sử dụng cho toàn bộ người dùng để bù đắp cho lượng token bị tiêu tốn thừa do các lỗi trên.

Về phòng ngừa trong tương lai, Anthropic cam kết bắt buộc nhiều nhân viên nội bộ hơn phải sử dụng đúng bản public build của Claude Code thay vì bản thử nghiệm nội bộ, đồng thời thắt chặt quy trình kiểm tra trước mỗi thay đổi system prompt và mở tài khoản @ClaudeDevs trên X để thông báo minh bạch hơn về các quyết định sản phẩm.

Sự cố này phơi bày một vấn đề mang tính cấu trúc: các thay đổi ở tầng cấu hình bao quanh mô hình - mức độ suy luận mặc định, cách quản lý bộ nhớ đệm, giới hạn độ dài phản hồi - có thể tác động đến trải nghiệm người dùng đáng kể không kém gì thay đổi trọng số mô hình, nhưng lại ít được kiểm soát và thông báo hơn nhiều.

Thế Duyệt

Cùng chuyên mục

Tuyển Indonesia bị mắng gay gắt ngay tại sân, sao nhập tịch gốc Hà Lan định ăn thua đủ với CĐV

Thứ 7, 08/08/2026 09:02
Đây là lần thứ hai liên tiếp, tuyển Indonesia bị loại khỏi AFF Cup ngay sau vòng bảng.

Tình tế đánh bại thủ môn Campuchia, Đình Bắc giúp HLV Kim Sang-sik lập liền 2 kỷ lục

Thứ 7, 08/08/2026 08:03
HLV Kim Sang-sik đã có thêm 2 kỷ lục cùng đội tuyển Việt Nam.

Cuộc đua Vua phá lưới AFF Cup: Đình Bắc chiếm lại ngôi đầu, thiết lập cột mốc lịch sử

Thứ 7, 08/08/2026 07:47
Đình Bắc trở lại ngôi đầu cuộc đua Vua phá lưới AFF Cup 2026.

NSND Tự Long tặng vợ VinFast VF 5, biển số '5678' đấu giá 80 triệu đồng

Thứ 7, 08/08/2026 06:00
Không chỉ chiếc VinFast VF 5, biển số đấu giá trị giá 80 triệu đồng trên xe của Tự Long cũng trở thành tâm điểm chú ý.

Honda City 2026 lộ nhiều chi tiết ở Việt Nam: Mặt trước khác biệt rất lớn, dễ thêm màn hình to, có hybrid sẽ làm khó Vios, Accent

Thứ 7, 08/08/2026 05:50
Honda City mới vừa xuất hiện trong công báo sở hữu công nghiệp tại Việt Nam. Phiên bản nâng cấp này sở hữu nhiều cải tiến đáng giá về thiết kế lẫn trang bị, hứa hẹn sớm trình làng người tiêu dùng trong nước.
     
Nổi bật trong ngày

Baseus BP1 Ultra: Tai nghe tiền triệu sale còn vài trăm, tính năng nào cũng chưa hoàn hảo nhưng "có cố gắng"

Thứ 6, 07/08/2026 02:16
Sở hữu hàng loạt tính năng hiếm gặp trong tầm giá như LDAC, chống ồn chủ động và AI ghi chú miễn phí, Baseus BP1 Ultra có thông số rất hấp dẫn nhưng trải nghiệm thực tế lại cho thấy tai nghe còn phải rất "cố gắng" để được đánh giá là tốt trong phân khúc.

Huawei bán laptop mới có màn chống nhìn trộm xịn hơn "thương hiệu S": Giữ nguyên độ nét, không giảm độ sáng, có nút bật tắt vật lý

Thứ 6, 07/08/2026 02:20
MateBook Pro S là mẫu laptop đầu tiên của Huawei tích hợp màn hình chống nhìn trộm ngay từ tấm nền OLED. Hãng cho biết công nghệ mới vẫn giữ nguyên chất lượng hiển thị khi kích hoạt, đồng thời so sánh trực tiếp với một mẫu điện thoại "thương hiệu S".

Bán sedan hạng sang mua Kia Sportage HEV, chủ xe chia sẻ: ‘Nội thất rộng, chở gia đình 300-500km/ngày vẫn thoải mái, đi phố như xe điện’

Thứ 6, 07/08/2026 05:00
Khi gia đình chuẩn bị đón thêm thành viên, anh Vũ Việt Hùng nhận thấy một chiếc SUV-crossover đủ rộng rãi, thoải mái, đầy đủ tiện nghi, lại có động cơ hybrid như Kia Sportage mới là lựa chọn phù hợp nhất trong tầm giá khoảng 1 tỷ đồng.

CEO Renova Cloud: "Thách thức lớn nhất của AI nằm ở nền tảng, và đây lại là cơ hội của doanh nghiệp Việt"

Thứ 6, 07/08/2026 08:00
Giữa lúc cả thị trường đổ xô thử nghiệm chatbot và AI agent, người đứng đầu đối tác AWS Premier Tier tại Việt Nam lại nói về thứ ít "hot" hơn nhiều: hạ tầng, dữ liệu và quản trị. Và có lý do để tin ông đúng.

Laptop gaming mạnh nhất lịch sử ROG chính thức bán tại Việt Nam: Đem SH350i ra đổi vẫn phải bù thêm tiền mới rước về được

Thứ 6, 07/08/2026 09:00
ASUS chính thức bán ROG Strix SCAR 18 (2026) tại Việt Nam từ 7/8, trang bị Core Ultra 9 290HX Plus, RTX 5090 và màn Mini-LED 4K 240Hz với mức giá "khóc thét" 179,99 triệu đồng.
xe.nguoiduatin.vn