Tìm hiểu về Claude Haiku 4.5: Chi phí, khả năng và cơ hội từ mô hình multi-agent

Những công nghệ từng được coi là tiên tiến nhất cách đây hai tháng nay đã có mặt trong mô hình hiệu quả nhất của Anthropic. Claude Haiku 4.5 – mô hình mới vừa được Anthropic ra mắt – mang lại hiệu suất tương đương với Sonnet 4 (mô hình từng được xem là đỉnh cao công nghệ khi ra mắt vào tháng 8 năm 2025) với mức chi phí giúp khả năng trí tuệ nhân tạo tiệm cận trình độ tiên tiến nhất trở nên dễ tiếp cận hơn cho các triển khai quy mô lớn.

Haiku 4.5 đã được thử nghiệm kể từ khi mô hình này ra mắt vào ngày 15 tháng 10 năm 2025 và có những ấn tượng rất tích cực. Claude Opus 4.1 ra mắt vào tháng 8 năm 2025 và là mô hình tốt nhất vào thời điểm đó. Claude Sonnet 4.5 xuất hiện vào cuối tháng 9, sở hữu năng lực ngang ngửa Opus 4.1 nhưng với mức giá thấp hơn. Giờ đây, với sự ra mắt của Haiku 4.5 vào giữa tháng 10, chúng ta nhận thấy hiệu suất tiệm cận Sonnet 4.5 (gần như ngang bằng với phiên bản tiền nhiệm Sonnet 4) nhưng chỉ với mức giá bằng khoảng 1/3.

Những khả năng tiên tiến nhất của Anthropic đang lan tỏa xuống các phân khúc mô hình thấp hơn nhanh hơn so với bất kỳ thế hệ nào trước đây. Điều này mở ra những cơ hội thú vị cho việc điều phối agent và triển khai ở quy mô lớn. Trong bài viết này, chúng ta sẽ cùng đi sâu tìm hiểu các khả năng của Claude Haiku 4.5 cũng như vị trí mà mô hình này sẽ đảm nhận trong hệ sinh thái các mô hình AI.

Những điểm mới trên Claude Haiku 4.5

Claude Haiku 4.5 hỗ trợ cửa sổ ngữ cảnh lên tới 200.000 token và khả năng xuất văn bản (output token) lên tới 64.000 token. Mô hình này có thể xử lý cả văn bản lẫn hình ảnh, đồng thời là mô hình dòng Haiku đầu tiên của Anthropic được trang bị các tính năng: Extended thinking, Computer use và Context awareness (nhận thức ngữ cảnh). Các tính năng Extended thinking và Computer use đã có mặt trên các dòng Sonnet và Opus từ nhiều tháng trước, nhưng nhận thức ngữ cảnh lại là một cải tiến mới hơn:

Sonnet 4.5 mới chỉ giới thiệu tính năng này cách đây hai tuần, vào ngày 29 tháng 9 năm 2025. Việc đưa cả ba khả năng này vào dòng Haiku với mức giá hiện tại sẽ thay đổi bài toán kinh tế cho một số trường hợp sử dụng cụ thể. Haiku 4.5 đạt kết quả 73,3% trên SWE-bench Verified – bộ tiêu chuẩn đánh giá mô hình dựa trên các vấn đề thực tế từ các dự án mã nguồn mở trên GitHub.

Để so sánh, Sonnet 4.5 đạt 77,2% trên cùng bộ tiêu chuẩn này; điều đó có nghĩa là Haiku 4.5 mang lại hiệu suất chỉ kém mô hình tốt nhất cùng phân khúc chưa đầy 5 điểm phần trăm, trong khi chi phí chỉ bằng khoảng 1/3 (1 USD/5 USD so với 3 USD/15 USD cho mỗi triệu token đầu vào/đầu ra). Mức điểm 50,7% trên OSWorld về khả năng Computer use là kết quả cao nhất mà bất kỳ mô hình Haiku nào từng đạt được trên bộ tiêu chuẩn này.

Hãy cùng so sánh những thay đổi giữa Haiku 3.5 và Haiku 4.5:

Haiku 3.5 (Thế hệ trước):

  • Không có tính năng tư duy mở rộng (extended thinking)
  • Không có khả năng sử dụng máy tính
  • Không có tính năng nhận thức ngữ cảnh
  • 0,80 USD/4 USD cho mỗi triệu token

Haiku 4.5 (Thế hệ hiện tại):

  • Có tư duy mở rộng (mô hình suy luận trước khi phản hồi)
  • Có khả năng sử dụng máy tính (chụp màn hình, nhấp chuột, điền biểu mẫu)
  • Có nhận thức ngữ cảnh (mô hình biết được lượng token ngữ cảnh đã sử dụng)
  • 1 USD/5 USD cho mỗi triệu token

Các khả năng mới này cũng quan trọng không kém gì điểm số trên những bộ tiêu chuẩn đánh giá. Tính năng tư duy mở rộng cho phép Haiku 4.5 tạm dừng và suy luận về các vấn đề phức tạp trước khi đưa ra phản hồi; những token dùng cho quá trình tư duy này được tính phí như token đầu ra với mức giá 5 USD cho mỗi triệu token. Khả năng nhận thức ngữ cảnh nghĩa là mô hình hiểu rõ mình đã sử dụng bao nhiêu trong tổng số 200.000 token của cửa sổ ngữ cảnh; điều này mở ra các phương thức viết câu lệnh (prompt) tinh vi hơn, cho phép bạn yêu cầu mô hình tự quản lý ngân sách ngữ cảnh của chính nó.

Việc so sánh với Sonnet 4 (chứ không phải Sonnet 4.5) là rất đáng chú ý. Anthropic định vị Haiku 4.5 là mô hình mang lại "hiệu suất tương đương với Sonnet 4"; điều này có nghĩa là mức độ thông minh từng được coi là đỉnh cao công nghệ chỉ mới hai tháng trước (vào tháng 8 năm 2025) nay đã có sẵn với chi phí chỉ bằng khoảng 1/3. Nói cách khác, những gì từng là công nghệ tiên tiến và đắt đỏ nay đã trở nên dễ tiếp cận thông qua dòng mô hình tối ưu nhất về chi phí của Anthropic.

Tìm hiểu về mức tăng giá 25%

Claude Haiku 4.5 có giá 1 USD cho mỗi triệu token đầu vào và 5 USD cho mỗi triệu token đầu ra. Đây là mức tăng 25% so với giá 0,80 USD/4 USD của Haiku 3.5. Tính năng xử lý hàng loạt mang lại mức giảm giá 50% cho token đầu ra, đưa mức giá thực tế về 1 USD/2,50 USD đối với các tác vụ xử lý bất đồng bộ. Chi phí cho tính năng lưu trữ cache prompt là 1,25 USD mỗi triệu token cho thao tác ghi và 0,10 USD mỗi triệu token cho thao tác đọc.

Mức tăng giá 25% khi chuyển từ Haiku 3.5 lên Haiku 4.5 là khá khiêm tốn so với những cải tiến về năng lực, nhưng nó làm thay đổi vị thế của mô hình này trên thị trường xét về tương quan giữa chi phí và hiệu suất. Haiku 3.5 từng là lựa chọn mặc định cho các tác vụ vận hành thực tế không đòi hỏi trí tuệ nhân tạo quá cao siêu, ngay cả sau đợt tăng giá so với phiên bản Claude 3 Haiku trước đó.

Vấn đề chính của việc tăng giá không nằm ở con số cụ thể, mà ở xu hướng mà nó tạo ra. Claude 3 Haiku từng có giá 0,25 USD/1,25 USD cho mỗi triệu token đầu vào/đầu ra, chỉ bằng 1/12 giá của Claude 3 Sonnet. Phiên bản kế tiếp trong dòng Haiku là Haiku 3.5 đã nâng giá lên 0,80 USD/4 USD cho mỗi triệu token, đắt hơn gấp hơn 3 lần so với Claude 3 Haiku. Giờ đây, giá lại tăng thêm 25%, khiến dòng Haiku – vốn từng rẻ hơn Sonnet tới 12 lần – nay chỉ còn rẻ hơn 3 lần. Mức giá này vẫn mang tính cạnh tranh, đặc biệt khi xét đến việc năng lực của nó không thua kém Sonnet quá nhiều, nhưng chúng tôi vẫn lo ngại về xu hướng tăng giá liên tục này.

Với Haiku 4.5, bạn có thể cân nhắc kỹ lưỡng hơn khi lựa chọn. Đây là giải pháp phù hợp khi bạn cần các tính năng nâng cao như khả năng suy luận mở rộng (Extended thinking) hay khả năng điều khiển máy tính (Computer use), hoặc khi bạn muốn hiệu suất tương đương Sonnet 4 và tiệm cận Sonnet 4.5. Đối với các tác vụ đơn giản, mang tính thường nhật mà sự chênh lệch về trí tuệ không quá lớn, việc tiếp tục sử dụng Haiku 3.5 hoặc một mô hình tiết kiệm chi phí hơn thường là lựa chọn hợp lý hơn.

Nếu muốn biết Haiku 4.5 sẽ tiêu tốn bao nhiêu chi phí cho tổ chức của mình, bạn có thể sử dụng công cụ tính toán chi phí token linh hoạt để tự mình ước tính.

Khả năng Computer use trên quy mô lớn

Tính năng tương tác với máy tính (Computer use) mang lại cho Claude Haiku 4.5 khả năng điều khiển các ứng dụng thông qua ảnh chụp màn hình và những thao tác thực tế. Mô hình sẽ phân tích ảnh chụp trạng thái màn hình hiện tại, quyết định hành động cần thực hiện -  chẳng hạn như nhấp vào nút, nhập văn bản, cuộn trang hoặc truy cập một URL - và sau đó thực hiện hành động đó. Tỷ lệ thành công 50,7% trên OSWorld phản ánh hiệu suất của Haiku 4.5 trong một bài kiểm tra benchmark được thiết kế để đánh giá các khả năng này trong những quy trình làm việc thực tế.

Để dễ hình dung, OSWorld đánh giá các mô hình dựa trên những tác vụ như "tìm số liệu doanh thu hàng quý trong bảng điều khiển tài chính này" hoặc "điền thông tin vào biểu mẫu tiếp nhận nhà cung cấp dựa trên dữ liệu được cung cấp". Đây là các kịch bản tự động hóa thực tế, nơi người dùng cần tương tác với những hệ thống không có API (hoặc API không hỗ trợ chức năng cần thiết). Tỷ lệ thành công 50,7% cho thấy Haiku 4.5 hoàn thành thành công khoảng một nửa số tác vụ này trong điều kiện thử nghiệm chuẩn.

Tỷ lệ thành công này rất ấn tượng so với khả năng tương tác với máy tính của 6 tháng trước, nhưng vẫn chưa đủ độ tin cậy để triển khai tự động trong môi trường thực tế. Quy trình này đòi hỏi sự giám sát của con người, các quy trình phê duyệt và các lớp kiểm chứng. Tỷ lệ thất bại 49,3% là một yếu tố quan trọng; nó có nghĩa là cứ hai lần thực hiện thì có khoảng một lần xảy ra sự cố. Mô hình có thể nhấp nhầm nút, hiểu sai trạng thái màn hình hoặc không hoàn thành được chuỗi hành động gồm nhiều bước.

Hiện tại, tính năng tương tác với máy tính phù hợp nhất cho các quy trình vốn đòi hỏi nhiều công sức thao tác thủ công và nơi mà hậu quả của những lỗi phát sinh nằm trong tầm kiểm soát. Nó không phù hợp cho các hoạt động quan trọng mang tính sống còn hoặc yêu cầu xử lý thời gian thực, mà thích hợp hơn cho những tác vụ tốn nhiều thời gian thao tác trên giao diện của con người. Tỷ lệ thành công 50,7%, khi kết hợp với sự giám sát thích hợp, vẫn có thể mang lại giá trị thiết thực.

Các mô hình điều phối multi-agent với Haiku 4.5

Cơ hội thú vị nhất khi sử dụng Haiku 4.5 nằm ở kiến ​​trúc multi-agent, nơi các mô hình được kết hợp một cách chiến lược dựa trên thế mạnh riêng của từng mô hình. Một mô hình phổ biến mà chúng ta đang áp dụng cho các hệ thống thực tế là sử dụng một mô hình tiên tiến hàng đầu như Sonnet 4.5 để lập kế hoạch và điều phối tổng thể, trong khi những mô hình có chi phí thấp hơn như Haiku 4.5 sẽ đảm nhận việc thực thi các tác vụ con cụ thể. Kiến trúc này tận dụng khả năng suy luận vượt trội của Sonnet 4.5 cho các tác vụ lập kế hoạch phức tạp, đồng thời khai thác hiệu quả chi phí của Haiku 4.5 để triển khai thực thi trên quy mô lớn.

Một mô hình khác mà nhiều người đang cân nhắc áp dụng là sử dụng Haiku 4.5 cho các tương tác trực tiếp với người dùng theo thời gian thực, trong khi Sonnet 4.5 đảm nhận việc phân tích và học hỏi ở chế độ nền. Chẳng hạn, một hệ thống hỗ trợ khách hàng có thể dùng Haiku 4.5 để phản hồi các thắc mắc của khách hàng ngay lập tức, đảm bảo độ trễ thấp, chi phí hợp lý và trí thông minh đủ đáp ứng hầu hết các câu hỏi.

Khi gặp vấn đề phức tạp vượt quá khả năng xử lý, Haiku 4.5 có thể chuyển tiếp yêu cầu đó cho Sonnet 4.5. Song song đó, Sonnet 4.5 có thể thực hiện quy trình xử lý hàng loạt vào ban đêm để phân tích các tương tác hỗ trợ trong ngày, nhận diện những xu hướng và cập nhật cơ sở kiến thức mà Haiku 4.5 sử dụng. Cách tiếp cận này mang lại khả năng phản hồi nhanh chóng, tiết kiệm chi phí theo thời gian thực, đồng thời vẫn tận dụng được trí thông minh tiên tiến nhất ở những khâu quan trọng.

Bài toán kinh tế đối với các gói dịch vụ miễn phí cũng mở ra một cơ hội đáng kể khác. Việc xây dựng sản phẩm AI có gói miễn phí sử dụng Sonnet 4.5 gặp nhiều thách thức về mặt tài chính, do bạn phải chi trả mức phí 3 USD/15 USD cho mỗi triệu token đối với các tương tác từ người dùng không trả phí. Với mức giá 1 USD/5 USD của Haiku 4.5, bài toán kinh tế trở nên khả thi hơn nhiều mà vẫn đảm bảo trí thông minh tiệm cận đẳng cấp hàng đầu. Bạn không phải hy sinh quá nhiều về năng lực xử lý so với khi dùng Haiku 3.5, nhưng cũng tránh được việc phải gánh chi phí cao như khi dùng Sonnet cho những người dùng có thể sẽ không chuyển đổi sang gói trả phí.

Khi nào nên chọn Haiku 4.5 (hay Sonnet 4.5, Opus 4.1 hoặc Haiku 3.5)?

Việc lựa chọn mô hình phụ thuộc vào việc đối chiếu các yêu cầu thực tế của bạn với sự cân bằng giữa hiệu suất, chi phí và năng lực của từng mô hình.

Hãy chọn Haiku 4.5 khi:

  • Bạn cần hiệu suất tiệm cận mức cao nhất cho các sub-agent trong kiến ​​trúc multi-agent
  • Bạn đang xây dựng các sản phẩm thuộc gói miễn phí, nơi cần trí tuệ tốt mà không có chi phí cao như Sonnet
  • Độ trễ là yếu tố quan trọng và bạn không cần chất lượng ở mức cao nhất tuyệt đối (Haiku 4.5 nhanh hơn Sonnet 4.5)
  • Bạn đặc biệt cần khả năng tư duy mở rộng (extended thinking) hoặc khả năng sử dụng máy tính (computer use) với mức giá hợp lý
  • Bạn xử lý khối lượng công việc lớn, trong đó yêu cầu về chất lượng nằm ở mức giữa Haiku 3.5 và Sonnet 4.5

Hãy chọn Sonnet 4.5 khi:

  • Bạn đang xây dựng agent lập kế hoạch chính trong hệ thống multi-agent
  • Bạn cần khả năng suy luận chất lượng cao nhất và đã xác nhận rằng Sonnet 4.5 luôn vượt trội hơn Haiku 4.5 đối với trường hợp sử dụng của mình
  • Bạn thực hiện các tác vụ lập trình phức tạp, nơi điểm số SWE-bench 77,2% (so với 73,3% của Haiku 4.5) là yếu tố quan trọng
  • Ngân sách cho phép mức giá $3/$15 và chất lượng là tiêu chí tối ưu hóa hàng đầu

Hãy chọn Opus 4.1 khi:

  • Các câu lệnh (prompt) của bạn đã được tối ưu hóa cho những thế mạnh riêng của Opus 4.1 và bạn đã xác nhận rằng nó hoạt động tốt hơn Sonnet 4.5 cho trường hợp sử dụng của mình
  • Bạn thực hiện các tác vụ sáng tạo hoặc phân tích chuyên sâu mà Opus 4.1 đã chứng minh được ưu thế
  • Chi phí không phải là rào cản chính và bạn cần kết quả đầu ra chất lượng cao nhất cho các công việc có khối lượng thấp nhưng giá trị cao

Tiếp tục sử dụng Haiku 3.5 khi:

  • Bạn thực hiện các tác vụ phân loại, trích xuất thông tin hoặc hỏi đáp đơn giản với khối lượng lớn
  • Khoảng cách về trí tuệ giữa Haiku 3.5 và Haiku 4.5 không ảnh hưởng đến trường hợp sử dụng của bạn
  • Bạn đã xác nhận rằng Haiku 3.5 đáp ứng yêu cầu chất lượng và mức tăng chi phí 25% của Haiku 4.5 không xứng đáng với những cải thiện về khả năng
  • Bạn không cần các tính năng tư duy mở rộng, sử dụng máy tính hoặc nhận thức ngữ cảnh nâng cao
Thứ Năm, 16/10/2025 20:50
51 👨 317
Xác thực tài khoản!

Theo Nghị định 147/2024/ND-CP, bạn cần xác thực tài khoản trước khi sử dụng tính năng này. Chúng tôi sẽ gửi mã xác thực qua SMS hoặc Zalo tới số điện thoại mà bạn nhập dưới đây:

Số điện thoại chưa đúng định dạng!
Số điện thoại này đã được xác thực!
Bạn có thể dùng Sđt này đăng nhập tại đây!
Lỗi gửi SMS, liên hệ Admin
0 Bình luận
Sắp xếp theo
❖ Claude