Phí nền tảng bắt đầu từ 1 token | Đơn giá theo mẫu và quy trình dùng thử với giá gần như 0 yên Nhật (phiên bản 2026)
Các điểm chính của bài viết này Amazon Bedrock là một hệ thống trả tiền theo mức sử dụng, trong đó bạn chỉ trả tiền cho số lượng cuộc gọi bạn thực hiện tới mô hình. Không phải lúc nào cũng có khoản thanh toán ``miễn phí tối đa ◯◯ mã thông báo mỗi tháng'' miễn phí bắt đầu từ mã thông báo đầu tiên. Tuy nhiên, nếu bạn sử dụng khoản tín dụng trị giá lên tới 200 USD trên tài khoản AWS mới của mình, bạn có thể thử nghiệm các mẫu như Nova 2 Micro và Claude Haiku mà hầu như không mất phí. Chúng tôi đã sắp xếp mọi thứ từ cách xác định đơn giá, giá thị trường theo mẫu, ba điều kiện có thể khiến hóa đơn của bạn tăng vọt cùng một lúc cho đến các bước bạn sẽ sử dụng hôm nay trên bảng điều khiển.
Amazon Bedrock là một dịch vụ được quản lý hoàn toàn cho phép bạn gọi các mô hình cơ bản AI tổng hợp do AWS cung cấp cùng một lúc từ một API duy nhất. Phí được trả theo nhu cầu sử dụng dựa trên số lượng token được sử dụng và không cố định hàng tháng cũng như không phải lúc nào cũng miễn phí.
Khi mở màn hình thanh toán AWS, tôi đã dừng lại vì các chữ số khác với những gì tôi mong đợi. Hầu hết mọi người khi xem xét giá của Bedrock đều chỉ còn một bước nữa là làm được điều đó.
Tôi sẽ cho bạn câu trả lời trước. Bedrock là một hệ thống trả tiền theo mức sử dụng, trong đó bạn chỉ trả tiền cho những gì bạn sử dụng và không có phí hàng tháng hoặc phí cố định. Và không phải lúc nào cũng có cấp độ miễn phí. Bạn sẽ bị tính phí từ mã thông báo đầu tiên.
Tuy nhiên, vẫn có cách để dùng thử miễn phí. Tín dụng cho tài khoản AWS mới. Đây là bước ngoặt.
Amazon Bedrock là dịch vụ AWS cho phép bạn gọi nhiều mô hình nền tảng (các mô hình quy mô lớn hình thành nên nền tảng của AI) như Claude, Amazon Nova và Llama cùng một lúc từ một cửa sổ. Ưu điểm lớn nhất là bạn không phải chuẩn bị máy chủ GPU của riêng mình. Tổng quan về dịch vụ cũng được tóm tắt trên trang công cụ Amazon Bedrock.
Những điểm chính cần hiểu trong 30 giây: Không có hạn ngạch miễn phí, gần như 0 yên Nhật khi nạp tiền
Không có cấp độ miễn phí luôn có sẵn dành riêng cho Bedrock. Giải pháp thực sự duy nhất để dùng thử miễn phí là sử dụng hết tín dụng tài khoản mới của bạn.
- Không phải lúc nào cũng có giới hạn miễn phí cho cuộc gọi theo mô hình (trả tiền khi bạn sử dụng từ mã thông báo đầu tiên)
- Khoản tín dụng trị giá lên tới 200 USD cho tài khoản AWS mới hầu như miễn phí.
- Đối với loại Nova 2 Micro rẻ nhất, việc xác minh có thể tốn từ vài chục yên Nhật đến vài trăm yên Nhật.
- Hãy dùng thử Playgrounds trên bảng điều khiển ngay hôm nay, không cần mã
Có ba lý do chính dẫn đến việc thanh toán không mong muốn: Thông lượng được cung cấp, Cơ sở kiến thức và agent. Ngay cả với phương thức thanh toán trả theo mức sử dụng thông thường, chi phí có thể trở nên đắt đỏ nếu số lượng cuộc gọi tích lũy nhưng điều này hầu như có thể được ngăn chặn bằng cách đặt giới hạn đầu ra và cảnh báo ngân sách. Nếu bạn chỉ muốn biết các bước, bạn có thể chuyển sang phần "Các bước để thử trên bảng điều khiển ngay hôm nay" ở nửa sau.
Đầu tiên, hãy lưu ý cách đồng hồ quay.
Giá cả được xác định như thế nào? Đếm đầu vào và đầu ra riêng biệt
Bedrock tính phí cho bạn bằng cách đếm các ký tự bạn gửi tới AI (đầu vào) và các ký tự mà nó trả về (đầu ra), mỗi ký tự bằng mã thông báo.
Mã thông báo là một khối ký tự được xử lý bởi AI. Trong tiếng Nhật, một ký tự xấp xỉ 1 đến 2 mã thông báo. Đơn giá được hiển thị là “◯ đô la trên 1.000 mã thông báo” hoặc “◯ đô la trên một triệu mã thông báo”.
Điều dễ dàng bỏ qua là đơn giá đầu vào và đầu ra khác nhau. Trong hầu hết các mô hình, phía đầu ra được đặt cao hơn nhiều lần. Bạn để AI nói càng lâu thì hóa đơn của bạn sẽ càng nặng.
Trang định giá chính thức của AWS bao gồm ví dụ tính toán sau. Nếu bạn gửi 6.000 mã thông báo đến Lệnh Cohere và yêu cầu nó trả lại 2.000 mã thông báo.
6.000 1.000 × 0,0015 USD + 2.000 1.000 × 0,002 USD = 0,013 USD
Chỉ dưới 2 yên Nhật mỗi phiên. Nếu con số này là 10.000 lần một ngày thì sẽ tăng lên khoảng 300.000 lần một tháng và khoảng 3.900 USD. Nếu mất cảnh giác vì đơn giá nhỏ, bạn sẽ bị trúng đòn không biết bao nhiêu lần.
Nói cách khác, thủ thuật để giảm chi phí lại đơn giản đến mức đáng ngạc nhiên. Giữ những câu bạn gửi ngắn gọn và những câu bạn nhận lại thậm chí còn ngắn hơn. Chỉ cần đặt giới hạn về số lượng mã thông báo đầu ra (mã thông báo tối đa) có thể thay đổi đáng kể số tiền thanh toán.
Vậy đơn giá đồng hồ đo chênh lệch bao nhiêu tùy theo từng model?
Tôi cũng muốn đọc nó
TypingMind là gì? Giá và các tùy chọn lựa chọn bắt đầu từ $39 (phiên bản 2026)
TypingMind là màn hình trò chuyện một lần, nơi bạn có thể sử dụng nhiều AI bằng khóa API của riêng mình. Chúng tôi đã sắp xếp các nội dung của Tiêu chuẩn $39, Mở rộng $79 và Cao cấp $99, phiên bản Nhóm bắt đầu từ $83 mỗi tháng, nơi lưu dữ liệu và mức độ bạn có thể sử dụng miễn phí bằng cách sử dụng thông tin chính thức kể từ tháng 8 năm 2026.
Ngày 7 tháng 8 năm 2026
14 bài toán và giải pháp triển khai AI trong các công ty xây dựng và ngành xây dựng
Phải mất nửa ngày để tạo ước tính và bạn có thể thu thập 20 báo cáo hàng ngày. Chúng tôi đã sắp xếp 14 vấn đề gặp phải khi giới thiệu AI trong ngành xây dựng dưới dạng Hỏi đáp. Hầu hết các nguyên nhân không nằm ở hiệu suất của AI mà nằm ở cách nó được phân phối. Nó bao gồm bản tóm tắt chi tiết về báo cáo hàng ngày, cách bắt đầu sau một tuần, chi phí khoảng 3.000 yên Nhật mỗi tháng và những điểm cần lưu ý về trợ cấp.
Ngày 7 tháng 8 năm 2026
Đơn giá cho mỗi mẫu rẻ hơn gấp 10 lần - nguyên tắc vàng là hãy thử mẫu rẻ nhất trước.
Đơn giá mô hình của Bedrock thay đổi một chữ số giữa mô hình nhẹ và mô hình hàng đầu. Thật lãng phí tiền khi bất ngờ đạt thứ hạng cao nhất ở giai đoạn xác minh.
Bảng dưới đây tóm tắt vị trí của các mẫu máy đại diện tính đến năm 2026. Đơn giá có thể thay đổi, vì vậy hãy nhớ kiểm tra trang giá chính thức của AWS Bedrock.
| dòng dõi kiểu mẫu | tư thế đứng | Đơn giá dự kiến được công bố | Ứng dụng phù hợp cho |
|---|---|---|---|
| Amazon Nova 2 Micro | Chỉ văn bản nhanh nhất và rẻ nhất | Nhập 1.000 mã thông báo từ 0,0001 USD | Phân loại/Xử lý nhật ký/Trả lời tiêu chuẩn |
| Amazon Nova 2 Lite | đa phương thức nhanh chóng | Trên Micro, dưới Pro | Xử lý ánh sáng bao gồm cả hình ảnh |
| Claude Haiku | Nhẹ và nhanh | Rẻ hơn so với các mẫu tầm trung | Trò chuyện/dự thảo/xử lý hàng loạt |
| Claude Sonnet 5 | Trụ cột hiệu suất cao | 1 triệu token $2 / $10 (được mô tả bên dưới) | Tạo văn bản/mã chất lượng cao |
| Claude Opus | cấp cao nhất | Rõ ràng là cao hơn Sonnet | Lý luận khó/nhiệm vụ chuyên môn |
Nói cách khác, đơn giá đầu vào cho Nova 2 Micro bắt đầu ở mức tương đương 0,1 USD trên một triệu token. Ngay cả với cùng 1 triệu token, cảm giác thanh toán hoàn toàn khác so với mô hình cao cấp hơn.
Đối với các tác vụ thông thường như tóm tắt và phân loại, Nova 2 Micro có nhiều khả năng hơn. Nếu chất lượng chưa đủ tốt, hãy nâng dần từng bước một. Theo thứ tự này, khoản tín dụng 200 đô la của bạn sẽ tồn tại trong một thời gian dài đáng ngạc nhiên. Sẽ là khôn ngoan nếu bạn để dành những mẫu xe hàng đầu của mình cho những nhiệm vụ khó khăn hơn khi chúng sẽ tỏa sáng.
Trong thời gian giới hạn cho đến ngày 31 tháng 8 năm 2026, Claude Sonnet 5 sẽ được bán. Theo trang định giá chính thức, giá khuyến mại là 2 USD đầu vào / 10 USD đầu ra cho mỗi triệu token. Sau ngày 1 tháng 9, giá sẽ trở về mức giá tiêu chuẩn là 3 USD đầu vào / 15 USD đầu ra. Đó là đủ lý do để đưa ra xác minh.
Nếu bạn muốn so sánh hệ thống Claude với tùy chọn gọi trực tiếp từ API, hãy đọc bài viết tóm tắt về giá và cách sử dụng API Claude trước, và ý nghĩa của việc sử dụng Bedrock sẽ trở nên rõ ràng. Các tính năng và kế hoạch thực tế cũng được sắp xếp trên trang công cụ Claude API.
Claude là một chatbot AI được phát triển bởi Anthropic, hỗ trợ hiểu, tạo, tóm tắt và phân tích văn bản theo cách trò chuyện tự nhiên. Nó có thế mạnh trong việc đọc các văn bản dài và sắp xếp các vấn đề, đồng thời có thể tóm tắt nội dung giấy tờ, hợp đồng, báo cáo, biên bản, v.v. và rút ra những điểm và rủi ro quan trọng. Chúng tôi cũng có thể trợ giúp soạn thảo email, đề xuất và tài liệu kinh doanh, diễn giải văn bản và tư vấn về quy tắc. Nó phù hợp cho các cá nhân và người dùng doanh nghiệp muốn hợp lý hóa việc nghiên cứu, viết và tạo tài liệu kinh doanh đồng thời nhấn mạnh tính chính xác và giải thích chi tiết.
Tại sao không có bậc miễn phí? Bởi triết lý thiết kế là ''tiền đề sản xuất''
Lý do không có bậc miễn phí cho suy luận mô hình của Bedrock là vì dịch vụ này được thiết kế ngay từ đầu dành cho hoạt động sản xuất của doanh nghiệp.
Khi bạn mở trang định giá chính thức, phần giải thích sẽ bắt đầu bằng các bậc thanh toán: Tiêu chuẩn, Linh hoạt, Ưu tiên và Đặt trước. Không có từ "miễn phí" ở bất cứ đâu. Đó không phải là thiếu sót, đó là cố ý.
Đây là điểm mà nhiều người nhầm lẫn với "bậc miễn phí" tổng thể của AWS. S3 và Lambda có các bậc miễn phí nhưng không bao gồm suy luận mô hình Bedrock. Nếu bạn cho rằng "AWS có cấp độ miễn phí nên nó miễn phí", cuối cùng bạn sẽ phải trả từ vài trăm yên Nhật đến vài nghìn yên Nhật cho hóa đơn đầu tiên của mình.
Tuy nhiên, đây có lẽ là lý do khiến mọi người tiếp tục tìm kiếm "cấp miễn phí Bedrock". Điều tôi muốn không phải là một hệ thống bậc miễn phí mà là một cách để dùng thử miễn phí. Và họ có tồn tại.
Làm thế nào tôi có thể thử nó với giá gần như là 0 yên Nhật? Sử dụng hết tín dụng tài khoản mới của bạn
AWS cung cấp tín dụng cho các tài khoản mới và những khoản tín dụng này cũng có thể được áp dụng cho phí mô hình Bedrock. Số tiền này có giá trị lên tới 200 USD.
Các điều khoản và ngày hết hạn có thể thay đổi, vì vậy hãy nhớ kiểm tra trang Bậc miễn phí chính thức của AWS trước khi đăng ký. Nếu bạn bắt đầu mà không đọc phần này, bạn sẽ dựa vào các khoản tín dụng đã hết hạn.
200 USD là một mức giá rất hợp lý cho lớp Nova 2 Micro. Ngay cả sau khi tạo ra nguyên mẫu và trải qua các bản demo nội bộ, nó vẫn còn đó. Mặt khác, nếu bạn bắt đầu Thông lượng cung cấp dù chỉ một ngày, nó sẽ tan chảy ngay lập tức (chương tiếp theo).
Có ba cách để làm cho tín dụng của bạn tồn tại lâu hơn.
- Việc xác minh bắt đầu với mô hình rẻ nhất. Tải lên sau khi xác nhận thiếu chất lượng
- Đảm bảo đặt giới hạn trên cho mã thông báo đầu ra (không đặt giới hạn này sẽ dẫn đến tai nạn)
- Ngừng sử dụng tài nguyên trong cùng một ngày
Tôi sẽ tóm tắt sự sắp xếp cho đến nay.
Tóm tắt cho đến nay: Bedrock không có cấp độ miễn phí. Đơn giá đầu vào và đầu ra khác nhau. Rộng hơn 10 lần tùy theo kiểu máy. Sử dụng tín dụng tài khoản mới của bạn để dùng thử miễn phí. Nếu bạn làm theo các bước này, hóa đơn hàng tháng của bạn sẽ chỉ còn vài trăm yên Nhật. Chỉ có ba người tiếp theo sẽ bật lên.
Khi nào hóa đơn tăng vọt? 3 cạm bẫy
Ba lý do này chính là nguyên nhân khiến "số tiền khác với những gì tôi mong đợi" xảy ra ở Bedrock. Thanh toán theo giờ và các dịch vụ phụ trợ ngoài thanh toán trả theo mức sử dụng.
- Thông lượng được cung cấp
Đây là hợp đồng đảm bảo khả năng xử lý mô hình theo giờ. Thanh toán theo giờ thay vì thanh toán theo mức sử dụng. Ngay cả khi bạn không sử dụng nó, bạn sẽ tiếp tục bị tính phí miễn là nó vẫn chạy.
Giá tham chiếu được công bố là 7,10 USD mỗi giờ cho Titan Text Lite mà không cần cam kết. Nó có giá khoảng 5.112 USD cho một tháng (720 giờ). Titan Text Express có giá 20,50 USD mỗi giờ nếu không có cam kết hoặc khoảng 14.760 USD cho 720 giờ. Nếu bạn vô tình kích hoạt nó cho mục đích xác minh, khoản tín dụng 200 USD sẽ biến mất sau nửa ngày đối với Express và hơn một ngày đối với Lite.
Đơn giá giảm theo thời gian cam kết (đối với Titan Text Lite, đó là 6,40 USD cho hợp đồng 1 tháng và 5,10 USD cho hợp đồng 6 tháng). Tuy nhiên, đây chỉ là giai đoạn mà bạn có thể đọc được lưu lượng truy cập thực tế. Nó không phải là thứ sẽ được chạm vào trong quá trình xác minh.
- Cơ sở kiến thức
Chức năng này cung cấp một hệ thống được quản lý (RAG) cho phép AI đọc và trả lời các tài liệu nội bộ. Mặc dù thuận tiện nhưng vector DB và bộ lưu trữ hoạt động ngầm với một khoản phí bổ sung. Nếu chỉ nhìn vào bảng đơn giá của Bedrock sẽ không thấy được điều này. Nếu bạn muốn so sánh các tùy chọn liên quan đến RAG cạnh nhau, danh sách các công cụ trong danh mục Tìm kiếm/Nghiên cứu AI sẽ hữu ích.
- agent
Đây là chức năng cho phép AI tự động thực hiện nhiều bước. Điều đáng sợ là bạn không thể đọc được số lượng cuộc gọi vì mô hình được gọi nội bộ nhiều lần chỉ với một lệnh duy nhất. Bạn có thể kiểm tra hoạt động trên trang agent Bedrock, nhưng từ góc độ quản lý chi phí, đây là chức năng nên được đưa vào cuối quá trình thử nghiệm.
Điểm chung của cả ba không phải là đơn giá cao mà là đơn vị tính phí khác nhau. Nếu bạn hiểu điều này, bạn có thể ngăn ngừa tai nạn.
Mẹo đưa chi phí xuống gần một nửa
Ngay cả khi quy trình giống nhau, chỉ cần thay đổi tên cũng có thể tạo ra sự khác biệt lớn trong khoản thanh toán. Dưới đây là ba thứ tự hiệu quả.
Sử dụng suy luận hàng loạt. Các mức giá chính thức cung cấp khả năng xử lý hàng loạt với mức giá thấp hơn 50% so với suy luận theo yêu cầu. Không có lý do gì để không sử dụng tính năng này cho các ứng dụng không yêu cầu câu trả lời ngay lập tức - tóm tắt hàng đêm, phân loại lượng lớn dữ liệu, tạo bản thảo bài báo. Giảm một nửa giá chỉ bằng cách từ bỏ tính năng thời gian thực. Thật không thể tin được.
Sử dụng Flex/Ưu tiên đúng cách. Ngoài Tiêu chuẩn, còn có Flex, rẻ hơn để đổi lấy khả năng chịu đựng sự chậm trễ và Ưu tiên, cung cấp khả năng xử lý ưu tiên. Chạy mọi thứ ở cùng cấp độ cũng giống như đưa mọi người lên taxi.
Giữ hướng dẫn ngắn gọn. Nếu lần nào bạn cũng gửi cùng một lời giới thiệu dài thì bạn sẽ bị tính phí. Chỉ bằng cách loại bỏ các phần chung, số lượng mã thông báo đầu vào sẽ giảm đi rõ rệt. Nó có hiệu quả khiêm tốn.
| bột | Hiệu quả | |
|---|---|---|
| suy luận hàng loạt | Lớn (giảm tới 50%) | Xử lý hàng loạt mà không có phản hồi ngay lập tức |
| Hạ cấp mô hình | Lớn (chênh lệch hơn 10 lần) | Phân loại/Tóm tắt/Văn bản chuẩn |
| Đặt giới hạn trên đầu ra | Trung bình | Tất cả công dụng |
| Nén hướng dẫn | Nhỏ đến trung bình | Nếu bạn gửi cùng một lời giới thiệu mỗi lần |
Nói cách khác, giảm chi phí là vấn đề thiết kế chứ không phải vấn đề điều chỉnh. Nếu ngay từ đầu bạn quyết định xử lý nào sẽ được gửi đến lớp nào thì không cần phải vội vàng thu hẹp nó sau này. Nếu bạn muốn xem lại chi phí LLM tổng thể của mình, vui lòng xem xét việc thay đổi sang một điểm đến sẽ giảm chi phí.
Các bước để thử trên bảng điều khiển ngay hôm nay
Xem phản hồi của Bedrock ngay trong trình duyệt của bạn mà không cần viết một dòng mã nào. Phải mất khoảng 10 phút.
- Đăng nhập vào Bảng điều khiển quản lý AWS và chọn khu vực (các mô hình có thể sử dụng ở khu vực Tokyo bị giới hạn, vì vậy nếu bạn không tìm thấy mô hình mình muốn, hãy chọn Bắc Virginia)
- Mở “Bedrock” trong tìm kiếm dịch vụ
- Từ "Truy cập mô hình" trên menu bên trái, hãy gửi đơn đăng ký cho mô hình bạn muốn sử dụng (hầu hết là ngay lập tức, một số đang chờ phê duyệt)
- Mở "Sân chơi" → "Trò chuyện" và chọn model rẻ nhất như Nova 2 Micro
- Đặt câu hỏi và kiểm tra câu trả lời. Đồng thời kiểm tra số tiền phát sinh tại mục “Thanh toán”
Điều quan trọng là phải chắc chắn thực hiện số 5. Khi bạn đã có thói quen kiểm tra và chạm vào số tiền mình đã chi tiêu, các hoạt động trong tương lai của bạn sẽ thay đổi.
Nếu muốn chuyển sang giai đoạn gọi từ API, bạn sẽ cần cài đặt xác thực AWS CLI và quyền IAM (chẳng hạn như AmazonBedrockFullAccess). Từ đây trở đi, chúng ta sẽ chuyển sang thiết kế ứng dụng, vì vậy tốt nhất bạn nên thu hẹp các công cụ trong danh mục chatbot AI thành một mô hình gần với trường hợp sử dụng của bạn trước khi tiếp tục.
Đánh giá biên tập
Tôi sẽ viết đánh giá trung thực dựa trên cơ cấu phí được công bố và kết quả nghiên cứu.
Điểm tốt. Khả năng kết hợp nhiều mô hình nhà cung cấp với một hóa đơn và một chứng nhận là không ai sánh kịp. Nếu bạn cố gắng tự mình tạo ra một môi trường nơi bạn có thể so sánh và chọn Claude, Nova và Llama thì hợp đồng và kiểm toán sẽ khác. Đối với mục đích sử dụng của công ty, chỉ riêng việc tập trung hóa này đã có giá trị. Thực tế là tùy chọn giảm 50% suy luận hàng loạt có sẵn ngay từ đầu giúp việc lập kế hoạch chi phí dễ dàng hơn.
Một điểm tinh tế. Thành thật mà nói, triển vọng kém về giá cả là không tốt. Chỉ đọc bảng đơn giá cũng không thể hiểu được tổng số tiền khi Cơ sở tri thức và agent được tập hợp. Khi mọi người phàn nàn rằng hóa đơn của họ đã tăng vọt mặc dù đơn giá mã thông báo thấp, thì đó thường là do nguyên nhân nào đó bên ngoài hóa đơn thanh toán theo mức sử dụng. Đây là lúc mà lời giải thích chính thức lẽ ra phải tử tế hơn.
Hãy cẩn thận với Thông lượng cung cấp. Rất khó để biết từ bảng giá đơn vị rằng đó là khoản phí tính theo giờ và nếu bạn chạm vào nó vì mục đích xác minh, khoản tín dụng sẽ biến mất chỉ sau một cú nhấp chuột. Đối với các cá nhân và nhóm nhỏ, lựa chọn tốt nhất là không chạm vào nó vào lúc này.
Phần kết luận. Để xác minh cá nhân, "tín dụng + mô hình rẻ nhất + Sân chơi" là đủ. Đối với việc triển khai của doanh nghiệp, sẽ hiệu quả hơn nếu quyết định quá trình xử lý nào có thể được chuyển thành lô trước khi so sánh đơn giá.
Các câu hỏi thường gặp (FAQ)
H. Bedrock có bậc miễn phí không?
Không phải lúc nào cũng có cấp độ miễn phí cho suy luận mô hình. Bạn sẽ bị tính phí từ mã thông báo đầu tiên. Nếu bạn muốn dùng thử miễn phí, tùy chọn thực sự là sử dụng khoản tín dụng trị giá lên tới 200 USD sẽ được cấp cho tài khoản AWS mới của bạn. Vui lòng kiểm tra các điều kiện trên trang chính thức.
Q. Chi phí cho một cuộc gọi là bao nhiêu?
Nó phụ thuộc vào mô hình và số lượng văn bản. Trong ví dụ tính toán chính thức của AWS, việc gửi 6.000 mã thông báo đến Lệnh Cohere và yêu cầu lệnh này trả lại 2.000 mã thông báo sẽ tốn 0,013 USD. Loại Nova 2 Micro thậm chí còn rẻ hơn, bắt đầu từ 0,0001 USD trên 1.000 mã thông báo đầu vào.
Q. Thời gian giảm giá cho Claude Sonnet 5 sẽ kéo dài bao lâu?
Theo trang định giá chính thức, giá khuyến mại của 2 USD đầu vào / 10 USD đầu ra cho mỗi 1 triệu token kéo dài đến ngày 31 tháng 8 năm 2026. Sau ngày 1 tháng 9, giá tiêu chuẩn sẽ là 3 USD đầu vào / 15 USD đầu ra.
H. Có cài đặt nào để ngăn chặn việc sử dụng quá mức không?
Điều cơ bản là đặt số tiền ngân sách và cảnh báo trong Ngân sách AWS. Ngoài ra, không đặt giới hạn trên cho mã thông báo đầu ra và bật Thông lượng cung cấp. Với ba điều này, bạn gần như có thể tránh được những khoản phí không mong muốn.
Câu hỏi: Nó có rẻ hơn so với Azure OpenAI và Vertex AI không?
Đơn giá riêng không quyết định được sự ưu việt hay kém cỏi. Điều này là do ngay cả đối với cùng một mô hình, nó thay đổi gần như hai lần tùy theo thứ bậc (Tiêu chuẩn / Flex / Lô). Nếu bạn muốn so sánh, trước tiên bạn nên phân biệt xem liệu quy trình xử lý của công ty bạn có yêu cầu phản hồi ngay lập tức hay không sẽ nhanh hơn. Sự so sánh từ góc độ doanh nghiệp được tóm tắt trong bài viết so sánh Azure OpenAI và Bedrock. Nếu bạn muốn biết về chính môi trường Azure, hãy xem hướng dẫn Azure AI Studio.
Đọc cái này lần sau
Nếu bạn muốn xem xét nó song song với cơ cấu định giá của Google, hướng dẫn định giá của Vertex AI là một lối tắt. Mặc dù chúng có cùng cấu trúc "gọi mô hình qua đám mây", nhưng khái niệm về bậc miễn phí và đơn vị thanh toán là khác nhau. Khi bạn nhìn hai công ty cạnh nhau, bạn sẽ thấy ngay công ty nào phù hợp với mục đích sử dụng của bạn. Nếu muốn hiểu nó từ quan điểm chức năng, bạn có thể đọc hướng dẫn giới thiệu về chính Vertex AI.
Trang web chính thức của từng công cụ (thông tin chính)
Giá cả, chức năng và phạm vi hỗ trợ là thông tin chính được cung cấp bởi trang web chính thức của mỗi công ty. Bài viết này dựa trên xác minh tại thời điểm xuất bản, nhưng hãy nhớ kiểm tra từng trang chính thức để biết các điều kiện chính xác và mới nhất.
- Amazon Bedrock — Trang web chính thức (xem chi tiết)
- Claude — Trang web chính thức (xem chi tiết)
- Claude API — Trang web chính thức (xem chi tiết)
Một dịch vụ được quản lý hoàn toàn cho phép bạn xây dựng các ứng dụng AI tổng quát và AI agent bằng cách gọi hàng trăm mô hình cơ bản như Anthropic Claude, Meta Llama và OpenAI GPT-5.5 bằng một API duy nhất trên AWS. Phí được trả khi bạn sử dụng dựa trên số lượng mô hình và mã thông báo.