[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"model-gpt-oss-120b":3},{"id":4,"slug":5,"name":6,"hf_id":6,"organization":7,"architecture":8,"architecture_config":9,"parameters":14,"parameters_label":15,"context_length":16,"license":17,"downloads":18,"likes":19,"status":20,"description":17,"huggingface_url":21,"created_at":22,"seo":23,"category":26,"family":29,"score":31,"variants":32,"quantizations":33,"requirements":59,"gpu_recommendations":143,"fitting_gpus":209,"community":225},162,"gpt-oss-120b","openai\u002Fgpt-oss-120b","openai","gpt_oss",{"layers":10,"head_dim":11,"kv_heads":12,"hidden_size":13},36,64,8,2880,4162314240,"4.2B",131072,null,4322626,5103,"published","https:\u002F\u002Fhuggingface.co\u002Fopenai\u002Fgpt-oss-120b","2026-08-12T03:11:14+00:00",{"title":6,"description":24,"image":17,"robots":25,"canonical_url":17},"AI 模型部署决策引擎——开源 AI 的 GPU 需求、云端价格与成本分析。","index, follow",{"name":27,"slug":28},"LLM","llm",{"name":30,"slug":7},"Openai",0.0632,[],[34,39,44,48,52,56],{"format":35,"bits":36,"size_factor":37,"quality_loss":38},"AWQ",4,0.263,0.03,{"format":40,"bits":41,"size_factor":42,"quality_loss":43},"FP16",16,1,0,{"format":45,"bits":12,"size_factor":46,"quality_loss":47},"FP8",0.5,0.01,{"format":49,"bits":36,"size_factor":50,"quality_loss":51},"GGUF",0.25,0.05,{"format":53,"bits":36,"size_factor":54,"quality_loss":55},"GPTQ",0.275,0.04,{"format":57,"bits":12,"size_factor":46,"quality_loss":58},"INT8",0.02,{"FP16":60,"FP8":83,"INT8":97,"AWQ":101,"GPTQ":115,"GGUF":129},{"minimum":61,"production":70,"recommended":76},{"scenario":62,"context_length":63,"batch_size":42,"weight_gb":64,"kv_cache_gb":46,"vram_gb":65,"ram_gb":66,"disk_gb":67,"requirement_source":68,"confidence":69},"minimum",4096,217.93,280.63,420.95,378.97,"estimated",0.95,{"scenario":71,"context_length":72,"batch_size":36,"weight_gb":64,"kv_cache_gb":11,"vram_gb":73,"ram_gb":74,"disk_gb":75,"requirement_source":68,"confidence":69},"production",16384,418.34,627.51,443.97,{"scenario":77,"context_length":78,"batch_size":79,"weight_gb":64,"kv_cache_gb":12,"vram_gb":80,"ram_gb":81,"disk_gb":82,"requirement_source":68,"confidence":69},"recommended",8192,2,308.91,463.37,404.97,{"minimum":84,"production":89,"recommended":93},{"scenario":62,"context_length":63,"batch_size":42,"weight_gb":85,"kv_cache_gb":46,"vram_gb":86,"ram_gb":87,"disk_gb":88,"requirement_source":68,"confidence":69},108.96,142.79,214.19,208.98,{"scenario":71,"context_length":72,"batch_size":36,"weight_gb":85,"kv_cache_gb":11,"vram_gb":90,"ram_gb":91,"disk_gb":92,"requirement_source":68,"confidence":69},267.97,401.96,273.98,{"scenario":77,"context_length":78,"batch_size":79,"weight_gb":85,"kv_cache_gb":12,"vram_gb":94,"ram_gb":95,"disk_gb":96,"requirement_source":68,"confidence":69},164.81,247.21,234.98,{"minimum":98,"production":99,"recommended":100},{"scenario":62,"context_length":63,"batch_size":42,"weight_gb":85,"kv_cache_gb":46,"vram_gb":86,"ram_gb":87,"disk_gb":88,"requirement_source":68,"confidence":69},{"scenario":71,"context_length":72,"batch_size":36,"weight_gb":85,"kv_cache_gb":11,"vram_gb":90,"ram_gb":91,"disk_gb":92,"requirement_source":68,"confidence":69},{"scenario":77,"context_length":78,"batch_size":79,"weight_gb":85,"kv_cache_gb":12,"vram_gb":94,"ram_gb":95,"disk_gb":96,"requirement_source":68,"confidence":69},{"minimum":102,"production":107,"recommended":111},{"scenario":62,"context_length":63,"batch_size":42,"weight_gb":103,"kv_cache_gb":46,"vram_gb":104,"ram_gb":105,"disk_gb":106,"requirement_source":68,"confidence":69},56.53,76.45,114.68,127.18,{"scenario":71,"context_length":72,"batch_size":36,"weight_gb":103,"kv_cache_gb":11,"vram_gb":108,"ram_gb":109,"disk_gb":110,"requirement_source":68,"confidence":69},195.61,293.41,192.18,{"scenario":77,"context_length":78,"batch_size":79,"weight_gb":103,"kv_cache_gb":12,"vram_gb":112,"ram_gb":113,"disk_gb":114,"requirement_source":68,"confidence":69},95.45,143.18,153.18,{"minimum":116,"production":121,"recommended":125},{"scenario":62,"context_length":63,"batch_size":42,"weight_gb":117,"kv_cache_gb":46,"vram_gb":118,"ram_gb":119,"disk_gb":120,"requirement_source":68,"confidence":69},57.21,77.32,115.97,128.24,{"scenario":71,"context_length":72,"batch_size":36,"weight_gb":117,"kv_cache_gb":11,"vram_gb":122,"ram_gb":123,"disk_gb":124,"requirement_source":68,"confidence":69},196.54,294.82,193.24,{"scenario":77,"context_length":78,"batch_size":79,"weight_gb":117,"kv_cache_gb":12,"vram_gb":126,"ram_gb":127,"disk_gb":128,"requirement_source":68,"confidence":69},96.36,144.53,154.24,{"minimum":130,"production":135,"recommended":139},{"scenario":62,"context_length":63,"batch_size":42,"weight_gb":131,"kv_cache_gb":46,"vram_gb":132,"ram_gb":133,"disk_gb":134,"requirement_source":68,"confidence":69},58.57,79.04,118.56,130.37,{"scenario":71,"context_length":72,"batch_size":36,"weight_gb":131,"kv_cache_gb":11,"vram_gb":136,"ram_gb":137,"disk_gb":138,"requirement_source":68,"confidence":69},198.42,297.64,195.37,{"scenario":77,"context_length":78,"batch_size":79,"weight_gb":131,"kv_cache_gb":12,"vram_gb":140,"ram_gb":141,"disk_gb":142,"requirement_source":68,"confidence":69},98.16,147.24,156.37,{"recommended":144,"cheapest":164,"performance":177,"min_complexity":186,"cluster_options":195,"no_match":206,"required_vram_gb":112,"candidate_count":207,"usage":208},{"gpu_model":145,"gpu_model_id":146,"gpu_count":36,"total_vram_gb":147,"hour_price":148,"monthly_cost":149,"providers":150,"bandwidth_gbps":152,"fp16_tflops":153,"interconnect_score":154,"parallel_efficiency":155,"score":156,"tier":157,"perf_metric":158,"perf_label":159,"perf_value":160,"workload":17,"cost_metric":161},"H200 SXM",11,564,3.5,10220,[151],"lambda",4800,989,40,0.6,0.3145,"balanced","tok\u002Fs","203.8 tok\u002Fs",203.8,{"effective_value":162,"effective_unit":158,"capacity_factor":163},142.7,0.7,{"gpu_model":165,"gpu_model_id":166,"gpu_count":12,"total_vram_gb":167,"hour_price":168,"monthly_cost":169,"providers":170,"bandwidth_gbps":43,"fp16_tflops":43,"interconnect_score":154,"parallel_efficiency":172,"score":173,"tier":174,"perf_metric":158,"perf_label":175,"perf_value":43,"workload":17,"cost_metric":176},"Tesla V100",17,128,0.0272,158.85,[171],"vast",0.4,0.5555,"cheapest","0 tok\u002Fs",{"effective_value":43,"effective_unit":158,"capacity_factor":163},{"gpu_model":145,"gpu_model_id":146,"gpu_count":12,"total_vram_gb":178,"hour_price":148,"monthly_cost":179,"providers":180,"bandwidth_gbps":152,"fp16_tflops":153,"interconnect_score":154,"parallel_efficiency":172,"score":181,"tier":157,"perf_metric":158,"perf_label":182,"perf_value":183,"workload":17,"cost_metric":184},1128,20440,[151],0.2197,"271.7 tok\u002Fs",271.7,{"effective_value":185,"effective_unit":158,"capacity_factor":163},190.2,{"gpu_model":145,"gpu_model_id":146,"gpu_count":42,"total_vram_gb":187,"hour_price":148,"monthly_cost":188,"providers":189,"bandwidth_gbps":152,"fp16_tflops":153,"interconnect_score":154,"parallel_efficiency":42,"score":190,"tier":157,"perf_metric":158,"perf_label":191,"perf_value":192,"workload":17,"cost_metric":193},141,2555,[151],0.6516,"84.9 tok\u002Fs",84.9,{"effective_value":194,"effective_unit":158,"capacity_factor":163},59.4,[196],{"gpu_model":197,"gpu_model_id":198,"gpu_count":12,"total_vram_gb":11,"hour_price":199,"monthly_cost":200,"providers":201,"bandwidth_gbps":202,"fp16_tflops":198,"interconnect_score":154,"parallel_efficiency":172,"insufficient":203,"vram_shortfall_gb":204,"score":205,"tier":157},"RTX 5060 Ti",24,0.0554,323.54,[171],448,true,31.45,0.5102,false,18,"value",[210,214,222],{"name":145,"vram_gb":187,"cheapest_hour":148,"cost":211,"provider":151,"estimated_tps":192},{"hourly":148,"daily":212,"monthly":188,"yearly":213},84,30660,{"name":215,"vram_gb":216,"cheapest_hour":217,"cost":218,"provider":171,"estimated_tps":43},"B200",180,4.1271,{"hourly":217,"daily":219,"monthly":220,"yearly":221},99.05,3012.78,36153.4,{"name":223,"vram_gb":216,"cheapest_hour":17,"cost":17,"provider":17,"estimated_tps":224},"B200 SXM",138,{"posts_count":43,"benchmarks_count":43}]