state: generation 11623 (result)

This commit is contained in:
2026-09-21 19:05:52 +00:00
parent b7cd9f2240
commit 273d143137
5 changed files with 64 additions and 35 deletions

View File

@@ -1185,3 +1185,20 @@
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-decay-g8-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030882272, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": 1015108684, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039244968}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T18:38:19.149007+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5005588", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "nm-testing/tinyllama-one-shot-w4a16-group-packed", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "d8df464812ff2fd3c46dc89b0fc6a96370e694fab8e52179f1ada2cdd0ea92b9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1047023664, "estimatedRequiredGiB": 1.172, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 1048871402, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 1048871402}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T18:50:52.306184+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005756", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "nm-testing/Qwen2-1.5B-Instruct-FP8W8", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2245332464, "estimatedRequiredGiB": 2.522, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 2256814377, "modelscopeLicense": null, "modelscopeParams": 1777088000, "modelscopeTags": ["model_type:qwen2", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2256814377}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T18:50:52.437033+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005783", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.435859+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006054", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.391206+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006051", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.437924+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006050", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-decay-g2-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030713792, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039076183}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.390059+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006055", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2037838088, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2041445091}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.444516+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006053", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2018871528, "estimatedRequiredGiB": 2.26, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2022478516}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.453502+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006052", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-attnres-block2-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042625829}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.446409+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006046", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030685704, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039047610}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.457742+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006045", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031556216, "estimatedRequiredGiB": 2.28, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039918195}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.449911+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006044", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-decay-g4-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030769952, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039132310}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.451970+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006042", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-decay-g64-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2032454776, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2040816815}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.455644+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006043", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-kda-kernel-32-v2_D", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2038896936, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042511760}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.456721+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006041", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-kda-kernel-8-v2_D", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034915504, "estimatedRequiredGiB": 2.278, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2038530279}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.748445+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006048", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2009388256, "estimatedRequiredGiB": 2.25, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2012995244}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:51.057293+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006049", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19329296879}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.745520+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006056", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-decay-g8-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030882272, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": 1015108684, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039244968}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.750203+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006047", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "prithivMLmods/Qwen-Image-2.1-PE-T2I-MLX", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 35196531592, "estimatedRequiredGiB": 39.403, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "other", "modelscopeParams": 1411666624, "modelscopeTags": ["license:other", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:text-generation-inference", "custom_tag:qwen3_5", "custom_tag:mlx-vlm", "custom_tag:prompt-rewriter", "custom_tag:prompt enhancer", "custom_tag:apple-silicon", "custom_tag:4-bit", "custom_tag:8-bit"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 35256868927}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T19:05:50.963205+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006057", "taskType": "text-generation", "verifyResult": null}