{"data":{"model_id":"nousresearch-hermes-4-llama-3-1-70b","cloud":"all","quantization":"fp16","required_vram_mb":172032,"subscription_required":true,"instances":[{"cloud":"azure","instance_type":"Standard_NP40s","gpu_type":"AMD Alveo U250 FPGA (64GB)","gpu_count":4,"gpu_memory_mb":262144,"price_per_hour_usd":6.6,"region":"westus2"},{"cloud":"aws","instance_type":"g7e.12xlarge","gpu_type":"RTX PRO Server 6000","gpu_count":2,"gpu_memory_mb":196608,"price_per_hour_usd":8.28608,"region":"us-east-1"},{"cloud":"aws","instance_type":"g6e.12xlarge","gpu_type":"L40S","gpu_count":4,"gpu_memory_mb":183104,"price_per_hour_usd":10.49264,"region":"us-east-1"}]},"meta":{"updated_at":"2026-09-21","request_id":"6df4e0e0-3952-4029-b8b4-41140e6caf75","execution_ms":8}}