Thứ hai, 05/10/2026

Điểm khác nhau giữa các mô hình AI của Claude

Fable, Opus, Sonnet và Haiku khác nhau về năng lực, tốc độ, chi phí, cơ chế suy luận và dung lượng ngữ cảnh.

Điểm khác nhau giữa các mô hình AI của Claude

Fable 5.1: Trợ thủ đắc lực cho tác vụ suy luận dài hạn

Claude Fable 5.1 đứng ở cấp cao nhất trong danh sách mô hình hiện hành trên Claude Platform. Anthropic định hướng mô hình này cho yêu cầu suy luận đòi hỏi cao và công việc tác tử kéo dài, nhất là khi Opus 5.5 ở mức nỗ lực cao vẫn chưa đáp ứng yêu cầu đánh giá của người dùng.

Đổi lại, Fable 5.1 có độ trễ cao nhất trong bốn mô hình. Bảng so sánh của Anthropic xếp tốc độ của Fable ở mức chậm hơn, trong khi mức giá công bố là 10 USD cho một triệu token đầu vào và 50 USD cho một triệu token đầu ra. Fable 5.1 sử dụng cơ chế suy luận thích ứng luôn bật, với mức nỗ lực mặc định là cao. Mô hình có cửa sổ ngữ cảnh một triệu token, giới hạn đầu ra 128.000 token.

Opus 5.5 xử lý lập trình và công việc tri thức

Claude Opus 5.5 được Anthropic định hướng cho lập trình bằng tác tử kéo dài và công việc tri thức. Tài liệu khuyến nghị người chưa xác định được mô hình phù hợp có thể bắt đầu với Opus 5.5 cho phần lớn khối lượng công việc.

Độ trễ của Opus 5.5 được xếp ở mức trung bình, thấp hơn Fable nhưng cao hơn Sonnet và Haiku. Mức giá công bố là 4 USD cho một triệu token đầu vào và 20 USD cho một triệu token đầu ra.

Opus 5.5 cũng có cửa sổ ngữ cảnh một triệu token và giới hạn đầu ra 128.000 token. Cơ chế suy luận thích ứng luôn bật, nhưng mức nỗ lực mặc định là trung bình thay vì mức cao như Fable 5.1 và Sonnet 5.5.

Sonnet 5.5 cân bằng tốc độ và năng lực

Claude Sonnet 5.5 được Anthropic mô tả là mô hình kết hợp tốt nhất giữa tốc độ và năng lực. Vị trí này đặt Sonnet ở giữa nhóm mô hình dành cho tác vụ khó và Haiku, lựa chọn ưu tiên tốc độ.

Sonnet 5.5 có độ trễ nhanh và mức giá 2 USD cho một triệu token đầu vào, 10 USD cho một triệu token đầu ra. Dung lượng ngữ cảnh và giới hạn đầu ra vẫn cùng mức một triệu token và 128.000 token.

Mô hình hỗ trợ suy luận thích ứng với mức nỗ lực mặc định là cao. Khác với Fable 5.1 và Opus 5.5, bảng thông số không ghi cơ chế này luôn bật trên Sonnet 5.5.

Haiku 4.5 có tốc độ nhanh nhất

Claude Haiku 4.5 là mô hình nhanh nhất trong danh sách hiện hành, được Anthropic mô tả có năng lực gần nhóm tiên tiến nhất. Mô hình này phù hợp với trường hợp tốc độ phản hồi và chi phí là tiêu chí chính trong quá trình lựa chọn.

Mức giá của Haiku 4.5 là 1 USD cho một triệu token đầu vào và 5 USD cho một triệu token đầu ra, thấp nhất trong bốn mô hình. Đây cũng là mô hình duy nhất trong bảng có cửa sổ ngữ cảnh 200.000 token và giới hạn đầu ra 64.000 token. Haiku 4.5 sử dụng chế độ suy luận mở rộng, nhưng không hỗ trợ tham số mức nỗ lực mặc định như ba mô hình còn lại.

Tốc độ và chi phí tạo bốn cấp lựa chọn

Bốn mô hình tạo thành các cấp lựa chọn khác nhau. Fable 5.1 ưu tiên năng lực cho suy luận và công việc tác tử dài hạn; Opus 5.5 hướng tới lập trình tác tử và công việc tri thức; Sonnet 5.5 cân bằng tốc độ với năng lực; Haiku 4.5 đặt tốc độ và chi phí ở vị trí cao hơn.

Mức giá đầu vào lần lượt là 10 USD, 4 USD, 2 USD và 1 USD cho một triệu token. Ở đầu ra, mức giá tương ứng là 50 USD, 20 USD, 10 USD và 5 USD. Bảng của Anthropic đồng thời xếp độ trễ từ chậm hơn ở Fable đến nhanh nhất ở Haiku.

Dù khác cấp, tất cả mô hình hiện hành đều hỗ trợ văn bản và hình ảnh ở đầu vào, tạo văn bản ở đầu ra, xử lý đa ngôn ngữ, thị giác máy tính và sử dụng công cụ. Khác biệt chính nằm ở mục đích sử dụng, độ trễ, chi phí, cách suy luận và giới hạn token.

TheoBáo Công Thương

Bạn thấy bài này thế nào?

Phản hồi ẩn danh — chúng tôi không lưu thông tin cá nhân.