[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"model-kimi-k3":3},{"id":4,"slug":5,"name":6,"hf_id":7,"organization":8,"architecture":9,"architecture_config":10,"parameters":11,"parameters_label":12,"context_length":13,"license":14,"downloads":15,"likes":16,"status":17,"description":10,"huggingface_url":18,"created_at":19,"seo":20,"category":23,"family":26,"score":29,"variants":30,"quantizations":31,"requirements":58,"gpu_recommendations":142,"fitting_gpus":355,"community":356},193,"kimi-k3","Kimi K3","moonshotai\u002FKimi-K3","moonshotai","moe_transformer",null,2800000000000,"2800B",1048576,"MIT",1565484,10524,"published","https:\u002F\u002Fhuggingface.co\u002Fmoonshotai\u002FKimi-K3","2026-08-12T03:11:16+00:00",{"title":6,"description":21,"image":10,"robots":22,"canonical_url":10},"AI 模型部署决策引擎——开源 AI 的 GPU 需求、云端价格与成本分析。","index, follow",{"name":24,"slug":25},"OCR \u002F Vision","ocr-vision",{"name":27,"slug":28},"Kimi","kimi",0.2899,[],[32,37,42,47,51,55],{"format":33,"bits":34,"size_factor":35,"quality_loss":36},"AWQ",4,0.263,0.03,{"format":38,"bits":39,"size_factor":40,"quality_loss":41},"FP16",16,1,0,{"format":43,"bits":44,"size_factor":45,"quality_loss":46},"FP8",8,0.5,0.01,{"format":48,"bits":34,"size_factor":49,"quality_loss":50},"GGUF",0.25,0.05,{"format":52,"bits":34,"size_factor":53,"quality_loss":54},"GPTQ",0.275,0.04,{"format":56,"bits":44,"size_factor":45,"quality_loss":57},"INT8",0.02,{"FP16":59,"FP8":82,"INT8":96,"AWQ":100,"GPTQ":114,"GGUF":128},{"minimum":60,"production":69,"recommended":76},{"scenario":61,"context_length":62,"batch_size":40,"weight_gb":63,"kv_cache_gb":49,"vram_gb":64,"ram_gb":65,"disk_gb":66,"requirement_source":67,"confidence":68},"minimum",2048,5215.41,6601.06,9901.6,8175.03,"estimated",0.95,{"scenario":70,"context_length":71,"batch_size":72,"weight_gb":63,"kv_cache_gb":44,"vram_gb":73,"ram_gb":74,"disk_gb":75,"requirement_source":67,"confidence":68},"production",8192,2,7218.86,10828.29,8240.03,{"scenario":77,"context_length":78,"batch_size":40,"weight_gb":63,"kv_cache_gb":40,"vram_gb":79,"ram_gb":80,"disk_gb":81,"requirement_source":67,"confidence":68},"recommended",4096,6903.12,10354.69,8201.03,{"minimum":83,"production":88,"recommended":92},{"scenario":61,"context_length":62,"batch_size":40,"weight_gb":84,"kv_cache_gb":49,"vram_gb":85,"ram_gb":86,"disk_gb":87,"requirement_source":67,"confidence":68},2607.7,3302.32,4953.48,4107.02,{"scenario":70,"context_length":71,"batch_size":72,"weight_gb":84,"kv_cache_gb":44,"vram_gb":89,"ram_gb":90,"disk_gb":91,"requirement_source":67,"confidence":68},3620.23,5430.35,4172.02,{"scenario":77,"context_length":78,"batch_size":40,"weight_gb":84,"kv_cache_gb":40,"vram_gb":93,"ram_gb":94,"disk_gb":95,"requirement_source":67,"confidence":68},3454.44,5181.66,4133.02,{"minimum":97,"production":98,"recommended":99},{"scenario":61,"context_length":62,"batch_size":40,"weight_gb":84,"kv_cache_gb":49,"vram_gb":85,"ram_gb":86,"disk_gb":87,"requirement_source":67,"confidence":68},{"scenario":70,"context_length":71,"batch_size":72,"weight_gb":84,"kv_cache_gb":44,"vram_gb":89,"ram_gb":90,"disk_gb":91,"requirement_source":67,"confidence":68},{"scenario":77,"context_length":78,"batch_size":40,"weight_gb":84,"kv_cache_gb":40,"vram_gb":93,"ram_gb":94,"disk_gb":95,"requirement_source":67,"confidence":68},{"minimum":101,"production":106,"recommended":110},{"scenario":61,"context_length":62,"batch_size":40,"weight_gb":102,"kv_cache_gb":49,"vram_gb":103,"ram_gb":104,"disk_gb":105,"requirement_source":67,"confidence":68},1352.75,1714.8,2572.2,2149.28,{"scenario":70,"context_length":71,"batch_size":72,"weight_gb":102,"kv_cache_gb":44,"vram_gb":107,"ram_gb":108,"disk_gb":109,"requirement_source":67,"confidence":68},1888.39,2832.58,2214.28,{"scenario":77,"context_length":78,"batch_size":40,"weight_gb":102,"kv_cache_gb":40,"vram_gb":111,"ram_gb":112,"disk_gb":113,"requirement_source":67,"confidence":68},1794.76,2692.13,2175.28,{"minimum":115,"production":120,"recommended":124},{"scenario":61,"context_length":62,"batch_size":40,"weight_gb":116,"kv_cache_gb":49,"vram_gb":117,"ram_gb":118,"disk_gb":119,"requirement_source":67,"confidence":68},1369.04,1735.42,2603.12,2174.71,{"scenario":70,"context_length":71,"batch_size":72,"weight_gb":116,"kv_cache_gb":44,"vram_gb":121,"ram_gb":122,"disk_gb":123,"requirement_source":67,"confidence":68},1910.88,2866.32,2239.71,{"scenario":77,"context_length":78,"batch_size":40,"weight_gb":116,"kv_cache_gb":40,"vram_gb":125,"ram_gb":126,"disk_gb":127,"requirement_source":67,"confidence":68},1816.31,2724.47,2200.71,{"minimum":129,"production":134,"recommended":138},{"scenario":61,"context_length":62,"batch_size":40,"weight_gb":130,"kv_cache_gb":49,"vram_gb":131,"ram_gb":132,"disk_gb":133,"requirement_source":67,"confidence":68},1401.64,1776.65,2664.98,2225.56,{"scenario":70,"context_length":71,"batch_size":72,"weight_gb":130,"kv_cache_gb":44,"vram_gb":135,"ram_gb":136,"disk_gb":137,"requirement_source":67,"confidence":68},1955.86,2933.8,2290.56,{"scenario":77,"context_length":78,"batch_size":40,"weight_gb":130,"kv_cache_gb":40,"vram_gb":139,"ram_gb":140,"disk_gb":141,"requirement_source":67,"confidence":68},1859.42,2789.13,2251.56,{"recommended":10,"cheapest":10,"performance":10,"min_complexity":10,"cluster_options":143,"no_match":154,"required_vram_gb":111,"candidate_count":41,"usage":354},[144,158,170,183,192,203,212,219,226,236,247,255,263,272,281,288,298,303,312,319,326,333,344],{"gpu_model":145,"gpu_model_id":146,"gpu_count":44,"total_vram_gb":147,"hour_price":148,"monthly_cost":149,"providers":150,"bandwidth_gbps":41,"fp16_tflops":41,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":155,"score":156,"tier":157},"B200",27,1440,4.1271,24102.26,[151],"vast",40,0.4,true,354.76,0.2567,"balanced",{"gpu_model":159,"gpu_model_id":160,"gpu_count":44,"total_vram_gb":161,"hour_price":162,"monthly_cost":163,"providers":164,"bandwidth_gbps":166,"fp16_tflops":167,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":168,"score":169,"tier":157},"H200 SXM",11,1128,3.5,20440,[165],"lambda",4800,989,666.76,0.3664,{"gpu_model":171,"gpu_model_id":172,"gpu_count":44,"total_vram_gb":173,"hour_price":174,"monthly_cost":175,"providers":176,"bandwidth_gbps":179,"fp16_tflops":180,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":181,"score":182,"tier":157},"A100 80GB",9,640,1.2,7008,[151,177,178,165],"tensordock","runpod",2039,77.97,1154.76,0.4073,{"gpu_model":184,"gpu_model_id":185,"gpu_count":44,"total_vram_gb":173,"hour_price":186,"monthly_cost":187,"providers":188,"bandwidth_gbps":189,"fp16_tflops":190,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":181,"score":191,"tier":157},"H100 SXM",10,1.6059,9378.46,[151,177,178,165],3350,66.9,0.3879,{"gpu_model":193,"gpu_model_id":194,"gpu_count":44,"total_vram_gb":195,"hour_price":196,"monthly_cost":197,"providers":198,"bandwidth_gbps":199,"fp16_tflops":200,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":201,"score":202,"tier":157},"RTX A6000",6,384,0.2874,1678.42,[151,165],768,77,1410.76,0.4893,{"gpu_model":204,"gpu_model_id":205,"gpu_count":44,"total_vram_gb":195,"hour_price":206,"monthly_cost":207,"providers":208,"bandwidth_gbps":209,"fp16_tflops":210,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":201,"score":211,"tier":157},"L40S",12,0.4004,2338.34,[151,177,178],864,362,0.4777,{"gpu_model":213,"gpu_model_id":214,"gpu_count":44,"total_vram_gb":195,"hour_price":215,"monthly_cost":216,"providers":217,"bandwidth_gbps":41,"fp16_tflops":41,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":201,"score":218,"tier":157},"RTX PRO 6000 WS",19,0.6689,3906.38,[151],0.4253,{"gpu_model":220,"gpu_model_id":221,"gpu_count":44,"total_vram_gb":195,"hour_price":222,"monthly_cost":223,"providers":224,"bandwidth_gbps":41,"fp16_tflops":41,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":201,"score":225,"tier":157},"RTX PRO 6000 S",20,0.7339,4285.98,[151],0.4174,{"gpu_model":227,"gpu_model_id":72,"gpu_count":44,"total_vram_gb":228,"hour_price":229,"monthly_cost":230,"providers":231,"bandwidth_gbps":232,"fp16_tflops":233,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":234,"score":235,"tier":157},"RTX 5090",256,0.337,1968.08,[151,178],1792,209,1538.76,0.5066,{"gpu_model":237,"gpu_model_id":238,"gpu_count":44,"total_vram_gb":239,"hour_price":240,"monthly_cost":241,"providers":242,"bandwidth_gbps":243,"fp16_tflops":244,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":245,"score":246,"tier":157},"RTX 3090",3,192,0.0678,395.95,[151,177],936,71,1602.76,0.5198,{"gpu_model":248,"gpu_model_id":40,"gpu_count":44,"total_vram_gb":239,"hour_price":249,"monthly_cost":250,"providers":251,"bandwidth_gbps":252,"fp16_tflops":253,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":245,"score":254,"tier":157},"RTX 4090",0.1344,784.9,[151,177,178,165],1008,165,0.5134,{"gpu_model":256,"gpu_model_id":257,"gpu_count":44,"total_vram_gb":239,"hour_price":258,"monthly_cost":259,"providers":260,"bandwidth_gbps":252,"fp16_tflops":261,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":245,"score":262,"tier":157},"RTX 4090D",5,0.1602,935.57,[151],82.6,0.5102,{"gpu_model":264,"gpu_model_id":265,"gpu_count":44,"total_vram_gb":239,"hour_price":266,"monthly_cost":267,"providers":268,"bandwidth_gbps":269,"fp16_tflops":270,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":245,"score":271,"tier":157},"A10",7,0.2015,1176.76,[151,178],600,125,0.4959,{"gpu_model":273,"gpu_model_id":274,"gpu_count":44,"total_vram_gb":239,"hour_price":275,"monthly_cost":276,"providers":277,"bandwidth_gbps":278,"fp16_tflops":279,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":245,"score":280,"tier":157},"L4",13,0.2022,1180.85,[151],300,121,0.4889,{"gpu_model":282,"gpu_model_id":283,"gpu_count":44,"total_vram_gb":239,"hour_price":284,"monthly_cost":285,"providers":286,"bandwidth_gbps":41,"fp16_tflops":41,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":245,"score":287,"tier":157},"RTX PRO 5000",26,0.483,2820.72,[151],0.4479,{"gpu_model":289,"gpu_model_id":290,"gpu_count":44,"total_vram_gb":291,"hour_price":292,"monthly_cost":293,"providers":294,"bandwidth_gbps":41,"fp16_tflops":41,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":295,"score":296,"tier":297},"Tesla V100",17,128,0.0272,158.85,[151],1666.76,0.5034,"cheapest",{"gpu_model":299,"gpu_model_id":300,"gpu_count":44,"total_vram_gb":291,"hour_price":240,"monthly_cost":241,"providers":301,"bandwidth_gbps":41,"fp16_tflops":41,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":295,"score":302,"tier":157},"RTX 4070S Ti",22,[151],0.4984,{"gpu_model":304,"gpu_model_id":305,"gpu_count":44,"total_vram_gb":291,"hour_price":306,"monthly_cost":307,"providers":308,"bandwidth_gbps":309,"fp16_tflops":310,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":295,"score":311,"tier":157},"RTX 5070 Ti",18,0.0849,495.82,[151],896,88,0.5168,{"gpu_model":313,"gpu_model_id":314,"gpu_count":44,"total_vram_gb":291,"hour_price":315,"monthly_cost":316,"providers":317,"bandwidth_gbps":41,"fp16_tflops":41,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":295,"score":318,"tier":157},"RTX 4080S",21,0.1192,696.13,[151],0.4922,{"gpu_model":320,"gpu_model_id":321,"gpu_count":44,"total_vram_gb":291,"hour_price":249,"monthly_cost":250,"providers":322,"bandwidth_gbps":323,"fp16_tflops":324,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":295,"score":325,"tier":157},"RTX 5080",23,[151],960,113,0.5123,{"gpu_model":327,"gpu_model_id":328,"gpu_count":44,"total_vram_gb":291,"hour_price":329,"monthly_cost":330,"providers":331,"bandwidth_gbps":41,"fp16_tflops":41,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":295,"score":332,"tier":157},"RTX PRO 4500",25,0.3222,1881.65,[151],0.4675,{"gpu_model":334,"gpu_model_id":335,"gpu_count":44,"total_vram_gb":336,"hour_price":337,"monthly_cost":338,"providers":339,"bandwidth_gbps":340,"fp16_tflops":341,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":342,"score":343,"tier":297},"RTX 5070",28,96,0.0101,58.98,[151],672,61,1698.76,0.5208,{"gpu_model":345,"gpu_model_id":346,"gpu_count":44,"total_vram_gb":347,"hour_price":348,"monthly_cost":349,"providers":350,"bandwidth_gbps":351,"fp16_tflops":346,"interconnect_score":152,"parallel_efficiency":153,"insufficient":154,"vram_shortfall_gb":352,"score":353,"tier":157},"RTX 5060 Ti",24,64,0.0544,317.7,[151],448,1730.76,0.5103,"value",[],{"posts_count":41,"benchmarks_count":41}]