RunPod, Lambda và Vast.ai là ba GPU cloud mà phần lớn đội phát triển đưa vào danh sách rút gọn ở tầng dưới các hyperscaler, và chúng chiếm ba điểm khác biệt trên đường cong giá - độ tin cậy. Vast.ai rẻ nhất — một marketplace ngang hàng với H100 quanh $1,53-1,87/giờ và không có SLA. RunPod là lối đi giữa — một nền tảng hướng lập trình viên với H100 từ $1,99/giờ, tính tiền theo giây, và tầng Secure Cloud đạt tuân thủ SOC 2/HIPAA. Lambda là AI cloud có quản lý ở phân khúc cao cấp — H100 SXM ở $3,99-4,29/giờ với SLA 99,9% và các cụm InfiniBand lên tới 2.000+ GPU. Hãy chọn theo khả năng chịu gián đoạn của khối lượng công việc, chứ không chỉ theo giá niêm yết. Đây là dữ liệu.
So sánh giá GPU (theo yêu cầu, mỗi giờ mỗi GPU)
Các mức giá dưới đây là giá theo yêu cầu do nhà cung cấp công bố tính tới giữa năm 2026; con số của Vast.ai là trung bình marketplace và thay đổi theo thời gian thực. Mức giá trực tiếp trên các nhà cung cấp này cùng những bên khác được theo dõi trong chỉ số giá GPU của chúng tôi.
| GPU | Vast.ai (marketplace) | RunPod Community | RunPod Secure | Lambda |
|---|---|---|---|---|
| A100 80GB PCIe | ~$0,80-1,20 | $1,19 | $1,39 | $1,99-2,79 (SXM/PCIe) |
| H100 PCIe | ~$1,53-1,87 | $1,99 | $2,89 | — |
| H100 SXM | ~$1,90-2,30 | $2,69 | $2,99 | $3,99-4,29 |
| H200 (141GB) | thay đổi theo nguồn cung | $3,59 | $4,39 | ~$4,49 khi có niêm yết |
| B200 (180GB) | thay đổi theo nguồn cung | $5,89 | $5,89 | $6,69-6,99 |
Nguồn: giá RunPod, giá Lambda, so sánh của Spheron, ComputePrices.
Ba cơ chế giá quan trọng nằm ngoài bảng trên:
- Tầng có thể bị ngắt của Vast.ai mới là đáy thật. Các máy dựa trên đấu giá và có thể bị ngắt chạy thấp hơn 50%+ so với mức theo yêu cầu của marketplace ở trên. Với huấn luyện thân thiện với checkpoint, điều đó có thể nghĩa là năng lực tính toán H100 dưới $1/giờ — nhưng tác vụ của bạn có thể bị chiếm chỗ bất cứ khi nào có giá cao hơn.
- Chiết khấu đặt trước và spot ở đâu cũng là 30-50%. Cả ba đều có giá theo cam kết; máy đặt trước của Vast.ai chiết khấu tới 50%, còn gói tiết kiệm của RunPod cộng dồn với mức giá Community Cloud.
- Độ mịn khi tính tiền có lợi cho người nhỏ. Vast.ai và RunPod tính theo giây, Lambda theo phút. Với suy luận bùng nổ theo đợt và các thử nghiệm ngắn, tính theo giây cộng chế độ serverless của RunPod cắt lãng phí một cách đáng kể.
Ba mô hình kinh doanh khác nhau
Vast.ai là một marketplace. Họ không sở hữu GPU nào; họ ghép người thuê với 40+ trung tâm dữ liệu và hàng nghìn host độc lập chào 68+ loại GPU, và giá do cung cầu quyết định chứ không phải do Vast. Đó là lý do nó rẻ nhất — và cũng là lý do chất lượng dao động từ các host trung tâm dữ liệu chuyên nghiệp tới dàn máy tiêu dùng. Điểm tin cậy của host, huy hiệu đã xác minh trung tâm dữ liệu và bộ lọc secure cloud chính là công cụ kiểm soát chất lượng của bạn, theo bản so sánh của Lyceum.
RunPod là một nền tảng lai. Community Cloud gom công suất bên thứ ba đã thẩm định (kinh tế kiểu marketplace, thời gian hoạt động ~97-99%, không SLA); Secure Cloud chạy trên hạ tầng trung tâm dữ liệu được chứng nhận ở mức ~99,5% với phần cứng riêng. Phía trên là các tiện ích cho lập trình viên: 18+ lớp GPU, template, một tầng serverless tự co giãn cho suy luận, tính tiền theo giây, và các chứng nhận tuân thủ (SOC 2, HIPAA, GDPR) khiến nó là lựa chọn tiết kiệm dùng được nhất cho doanh nghiệp, theo GPUCloudList.
Lambda là một AI cloud có quản lý. Danh mục hẹp một cách có chủ đích — H100, H200, B200, A100, chủ yếu là SXM với NVLink — bán dưới dạng máy đơn hoặc 1-Click Clusters từ 16 tới 2.000+ GPU nối bằng InfiniBand. Đây là bên duy nhất trong ba bên được xây sẵn cho huấn luyện phân tán đa node nghiêm túc, và là bên duy nhất có SLA thời gian hoạt động 99,9% theo hợp đồng cộng hỗ trợ bởi người thật qua Slack, email và điện thoại. Bạn trả cao hơn mức giá của RunPod/Vast 40-100% cho điều đó.
Độ tin cậy, hỗ trợ và chi phí ẩn
| Yếu tố | Vast.ai | RunPod | Lambda |
|---|---|---|---|
| Bảo đảm thời gian hoạt động | Không (tùy host) | ~99,5% Secure; 97-99% Community (không SLA) | SLA 99,9% |
| Rủi ro gián đoạn | Cao ở tầng có thể bị ngắt; thấp ở tầng theo yêu cầu | Thấp trên Secure Cloud | Tối thiểu |
| Huấn luyện đa node | Hạn chế; thiên về đơn node | Đa node vừa phải | 1-Click Clusters, 16-2.000+ GPU, InfiniBand |
| Phí egress | Băng thông do host định giá | Không | Không |
| Lưu trữ | Do host định giá | $0,05-0,14/GB/tháng | NVMe kèm sẵn theo máy |
| Tuân thủ | Tùy host; có bộ lọc DC đã xác minh | SOC 2, HIPAA, GDPR | SOC 2; hợp đồng doanh nghiệp |
| Hỗ trợ | Cộng đồng + tài liệu | Ticket, Discord; tài liệu tốt | Hỗ trợ bởi người thật (Slack/email/điện thoại) |
| Tính tiền | Theo giây | Theo giây | Theo phút |
Bức tranh chi phí ẩn ở bộ ba này sạch sẽ một cách bất thường so với hyperscaler: không có phí egress ở Lambda hay RunPod nghĩa là chuyển tập dữ liệu và checkpoint là miễn phí, trong khi cùng lưu lượng đó trên một cloud thuộc nhóm ba ông lớn bị tính $0,08-0,12/GB. Chi phí ẩn thật sự là thời gian kỹ thuật: trông chừng các tác vụ Vast.ai bị chiếm chỗ, hoặc xếp hàng lại chờ công suất khi một vùng Community Cloud giá rẻ bán hết. Hãy định giá thời gian đó một cách trung thực trước khi tuyên bố marketplace rẻ hơn. Nếu mức sử dụng của bạn cao và duy trì liên tục từ 12 tháng trở lên, hãy làm luôn phép tính thuê so với colo — sở hữu GPU trong không gian colocation có thể rẻ hơn cả ba; xem danh mục trung tâm dữ liệu và chỉ số giá colocation của chúng tôi để lấy dữ liệu đầu vào.
Một ví dụ tính toán: một tháng tinh chỉnh mô hình
Các con số làm cho đánh đổi trở nên cụ thể. Hãy lấy một tác vụ cỡ trung điển hình: tinh chỉnh một mô hình 70 tỷ tham số trên 8x H100 SXM trong 200 giờ GPU tính toán, cộng 2 TB lưu trữ dữ liệu/checkpoint và 3 TB dữ liệu ra vào trong tháng.
| Thành phần chi phí | Vast.ai (có thể bị ngắt) | RunPod Secure | Lambda |
|---|---|---|---|
| Tính toán (200 giờ GPU x 8) | ~$1,10/giờ x 1.600 = ~$1.760 | $2,99/giờ x 1.600 = $4.784 | $3,99/giờ x 1.600 = $6.384 |
| Lưu trữ (2 TB-tháng) | do host định giá, ~$100-200 | $0,05-0,07/GB = $100-140 | NVMe kèm sẵn = $0 |
| Truyền dữ liệu (3 TB) | do host định giá, thường ~$0 | $0 | $0 |
| Chi phí phát sinh do bị chiếm chỗ | +10-25% chạy lại = $175-440 | ~$0 | ~$0 |
| Tổng xấp xỉ | ~$2.050-2.400 | ~$4.900 | ~$6.400 |
Marketplace tiết kiệm khoảng 55-60% so với Lambda ngay cả sau khi trả khoản thuế cho việc bị chiếm chỗ — nếu tác vụ tạo checkpoint gọn gàng và không ai đang chờ kết quả. Lật ngược giả định (chạy theo hạn chót, đa node với lưu lượng giữa các GPU lớn, có yêu cầu tuân thủ) thì mức phụ trội của Lambda mua về thời gian thực tế và sự chắc chắn đáng giá hơn phần chênh lệch. Phép so sánh trung thực không bao giờ là giá giờ đối giá giờ; nó là tổng chi phí cho mỗi tác vụ hoàn thành.
Nguồn cung: ràng buộc mà các bảng giá giấu đi
Giá công bố giả định rằng bạn thực sự lấy được GPU, và trong năm 2026 đó là giả định yếu nhất trong cả chuỗi. Công suất B200 vẫn bị giới hạn phân bổ ở khắp nơi: Lambda đưa khối lượng lớn qua các cuộc trao đổi bán hàng và hợp đồng đặt trước, các pool B200 của RunPod bán hết theo từng vùng, còn tin đăng B200 trên Vast.ai xuất hiện rồi biến mất theo từng host. Ngược lại, H100 đã nới lỏng rõ rệt khi các đội máy A100 nghỉ hưu và Blackwell tăng tốc — và đó chính xác là lý do giá H100 trên marketplace đã trôi xuống dưới $2/giờ.
Ba hệ quả thực tiễn. Thứ nhất, nếu lịch huấn luyện của bạn cố định, hãy đặt trước — chiết khấu 30-50% cho cam kết cũng đồng thời là một bảo đảm về công suất. Thứ hai, sự linh hoạt đa vùng đáng tiền thật trên RunPod và Vast.ai; các đội có thể chạy ở bất kỳ vùng nào sẽ bắt được công suất giá rẻ mà đội một vùng bỏ lỡ. Thứ ba, hãy theo dõi đường cong: thuê GPU là góc định giá lại nhanh nhất của thị trường trung tâm dữ liệu, và đó là lý do chúng tôi theo dõi nó liên tục trong chỉ số giá GPU song song với chỉ số colocation vốn chuyển động chậm hơn.
Nên chọn bên nào nếu…
- Bạn là người chơi nghiệp dư, nhà nghiên cứu, hoặc chạy các tác vụ theo lô chịu được gián đoạn → Vast.ai. H100 rẻ nhất thị trường (~$1,53-1,87/giờ, còn thấp hơn ở tầng có thể bị ngắt), tính tiền theo giây, không cam kết. Hãy tạo checkpoint thường xuyên, lọc lấy host độ tin cậy cao, và coi mọi máy đơn lẻ là thứ dùng xong bỏ được.
- Bạn là startup đang ra mắt một sản phẩm AI → RunPod. Cân bằng tốt nhất: Community Cloud cho thử nghiệm ($1,99/giờ H100 PCIe), Secure Cloud cho sản xuất (~99,5% thời gian hoạt động, SOC 2/HIPAA), serverless cho suy luận bùng nổ theo đợt, và không phí egress. Đây là khuyến nghị mặc định cho phần lớn đội nhỏ.
- Bạn là doanh nghiệp lớn hoặc ngành chịu quản lý → RunPod Secure Cloud hoặc Lambda. RunPod nếu chi phí quan trọng và đơn node/đa node vừa phải là đủ; Lambda nếu bạn cần SLA 99,9% theo hợp đồng, người hỗ trợ có tên tuổi, và hồ sơ giấy tờ thân thiện với bộ phận mua sắm.
- Bạn đang huấn luyện mô hình lớn trên nhiều node → Lambda. 1-Click Clusters với InfiniBand từ 16 tới 2.000+ GPU H100/B200 là điểm khác biệt; không đối thủ nào chào được kết nối tương đương ở quy mô đó. Mức phụ trội theo giờ 40-100% thường vẫn rẻ hơn thời gian thực tế mất đi vì mạng giữa các node chậm.
- Bạn đang tối ưu chi phí cho một pipeline sẵn có → hãy chia theo giai đoạn. Một mô thức phổ biến: tiền xử lý dữ liệu và các thí nghiệm loại trừ chạy trên Vast.ai tầng có thể bị ngắt, các lần huấn luyện chính chạy trên cụm Lambda, suy luận sản xuất chạy trên RunPod serverless. Chẳng có gì khóa chân bạn — cả ba đều tính tiền theo phút hoặc theo giây.
- Bạn đang cân nhắc thuê hay sở hữu → hãy tính theo mức sử dụng của mình. Ở mức $2/giờ, một H100 tốn ~$17.500/năm nếu dùng hết công suất; ở mức sử dụng 50% khi đi thuê, việc sở hữu trong colo bắt đầu thắng trong vòng 18-24 tháng. Hãy yêu cầu báo giá và chúng tôi sẽ đối chiếu các phương án colo với mức giá thuê hiện thời.
Một ghi chú cuối về việc bị khóa chân: về cơ bản là không có, và đó chính là điểm chiến lược của tầng thị trường này. Cả ba nhà cung cấp đều hỗ trợ container Docker tiêu chuẩn, truy cập SSH và cấp phát qua API, nên một pipeline dựng trên bất kỳ bên nào cũng chuyển sang bên khác trong vài ngày, chứ không phải vài tháng. Hãy chạy khối lượng công việc nghiêm túc đầu tiên song song trên hai trong ba bên, đo thông lượng thực trên mỗi đô la thay vì nhìn giá niêm yết, rồi để dữ liệu chọn ra người thắng.
Giá ở thị trường này thay đổi hằng tháng — riêng mức giá B200 đã và đang giảm khi nguồn cung tăng tốc. Hãy kiểm tra công cụ theo dõi GPU trực tiếp trước khi cam kết các điều khoản đặt trước.
Câu hỏi thường gặp
Thuê H100 ở đâu rẻ nhất: RunPod, Lambda hay Vast.ai?
Vast.ai, ở khoảng $1,53-1,87/giờ cho H100 trên marketplace, còn các máy có thể bị ngắt lại rẻ hơn 50%+ nữa. RunPod đứng kế tiếp: H100 PCIe từ $1,99/giờ (Community Cloud) và H100 SXM từ $2,69/giờ. Lambda tính $3,99-4,29/giờ cho H100 SXM — cao hơn hai bên kia 40-100% — đổi lại là SLA thời gian hoạt động 99,9% và các cụm nối bằng InfiniBand.
Một B200 tốn bao nhiêu mỗi giờ trong năm 2026?
RunPod niêm yết B200 (180GB) ở mức $5,89/giờ trên cả Community lẫn Secure Cloud. B200 SXM6 theo yêu cầu của Lambda chạy $6,69-6,99 mỗi GPU mỗi giờ tùy kích thước máy. Giá B200 trên marketplace Vast.ai dao động theo nguồn cung nhưng nhìn chung thấp hơn cả hai khi còn hàng. Để có bối cảnh, mức giá B200 trên nhiều nhà cung cấp hơn được theo dõi trong chỉ số giá GPU của chúng tôi.
Vast.ai có đủ tin cậy cho khối lượng công việc sản xuất không?
Không, với những tác vụ đòi thời gian hoạt động liên tục. Vast.ai là một marketplace ngang hàng không có SLA ở cấp nền tảng — độ tin cậy phụ thuộc vào từng host, trải từ nhà vận hành đạt chuẩn trung tâm dữ liệu tới phần cứng tiêu dùng. Điểm tin cậy của host và bộ lọc đã xác minh trung tâm dữ liệu giúp giảm thiểu rủi ro, và các máy theo yêu cầu (không bị ngắt) trên thực tế khá ổn định, nhưng bất cứ thứ gì cần bảo đảm thời gian hoạt động thì thuộc về RunPod Secure Cloud (~99,5%) hoặc Lambda (SLA 99,9%).
Khác biệt giữa RunPod Community Cloud và Secure Cloud là gì?
Community Cloud chạy trên các host bên thứ ba đã được thẩm định, không có SLA và thời gian hoạt động quanh 97-99%, với giá thấp hơn Secure Cloud 10-30% (ví dụ H100 PCIe $1,99 so với $2,89/giờ; H200 $3,59 so với $4,39/giờ). Secure Cloud chạy trong các trung tâm dữ liệu được chứng nhận với thời gian hoạt động ~99,5%, phần cứng riêng, và mức độ tuân thủ (SOC 2, HIPAA, GDPR) mà doanh nghiệp và các ngành chịu quản lý đòi hỏi.
Các GPU cloud này có thu phí egress không?
Lambda nói rõ là không thu phí egress, và RunPod cũng không tính tiền truyền dữ liệu — một khoản tiết kiệm đáng kể so với hyperscaler, nơi việc chuyển vài TB checkpoint ra ngoài có thể tốn hàng trăm đô la. Trên Vast.ai, giá băng thông do từng host đặt, nên hãy kiểm tra tin đăng. Về lưu trữ: network volume của RunPod ở mức $0,05-0,07/GB/tháng (loại hiệu năng cao $0,14); Lambda kèm sẵn dung lượng NVMe lớn theo máy; lưu trữ trên Vast.ai do host định giá.
GPU cloud nào tốt nhất cho huấn luyện đa node?
Lambda. 1-Click Clusters của họ cấp phát từ 16 tới 2.000+ GPU HGX H100/B200 nối bằng InfiniBand với tính tiền theo phút, điều mà cả pod tiêu chuẩn của RunPod lẫn marketplace của Vast.ai đều không sánh được cho huấn luyện phân tán quy mô lớn. RunPod xử lý tốt các tác vụ đơn node và đa node vừa phải; Vast.ai mạnh nhất cho tác vụ đơn node, chịu được gián đoạn.
Nguồn
Các nguồn sơ cấp được trích dẫn trong bài. Mọi con số đều dẫn tới nơi xuất phát.
- RunPod: GPU Cloud Pricing
- Lambda: GPU Cloud Pricing and 1-Click Clusters
- Vast.ai: Marketplace Pricing Model
- GPUCloudList: Lambda Labs vs RunPod vs Vast.ai — Complete Comparison 2026
- Spheron: GPU Cloud Pricing Comparison 2026 — H100 from $2.01/hr
- Lyceum Technology: Lambda Labs vs RunPod vs Vast.ai — GPU Cloud Comparison
- RunPod: RunPod vs Vast.ai — GPU Cloud Platform Comparison
- ComputePrices: Lambda Labs GPU Pricing
Nhận báo giá
Cho chúng tôi biết nhu cầu của bạn — chúng tôi ghép nối với các trung tâm dữ liệu trong danh mục và gửi lại báo giá thực. Miễn phí cho người mua.

