state: generation 11679 (cycle_no_slots)

This commit is contained in:
2026-09-21 19:59:37 +00:00
parent d5ff3440e8
commit 501ff027f7
8 changed files with 2181 additions and 2067 deletions

View File

@@ -1007,6 +1007,25 @@
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation"
},
"cambricon_mlu-370-x8|vllm|text-generation|model_type:gemma4": {
"architectureSignature": "model_type:gemma4",
"architectures": [],
"evidenceCount": 1,
"expiresAt": "2026-10-20T04:26:51.246271+00:00",
"framework": "vllm",
"latestFailureAt": "2026-09-20T04:26:51.246271+00:00",
"latestSuccessfulAt": null,
"matchType": "model_type",
"modelType": "gemma4",
"sourceModelIds": [
"mlx-community/gemma-4-e4b-it-OptiQ-4bit"
],
"sourceTaskIds": [
"4970731"
],
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation"
},
"cambricon_mlu-370-x8|vllm|text-generation|model_type:gemma4_unified": {
"architectureSignature": "model_type:gemma4_unified",
"architectures": [],
@@ -2787,9 +2806,9 @@
"taskType": "text-generation"
}
},
"generatedAt": "2026-09-21T19:57:12.255712+00:00",
"generatedAt": "2026-09-21T19:58:46.444035+00:00",
"summary": {
"activeBlockCount": 140,
"activeBlockCount": 141,
"byGpuFramework": {
"Ascend_910-b3|vllm": 13,
"Ascend_910-b3|vllm_tokenizer_patch": 5,
@@ -2797,7 +2816,7 @@
"Ascend_910-b4|vllm_tokenizer_patch": 5,
"Biren_166m|vllm": 3,
"Cambricon_mlu-370-x4|vllm": 2,
"Cambricon_mlu-370-x8|vllm": 15,
"Cambricon_mlu-370-x8|vllm": 16,
"Cambricon_mlu-370-x8|vllm-customized": 2,
"Cambricon_mlu-370-x8|vllm-mlu": 5,
"Iluvatar_bi-150|transformers": 4,

View File

@@ -1,6 +1,6 @@
{
"generatedAt": "2026-09-21T19:57:12.166601+00:00",
"lastSyncTime": "2026-09-21T19:57:11.769139+00:00",
"generatedAt": "2026-09-21T19:58:46.334949+00:00",
"lastSyncTime": "2026-09-21T19:58:46.051807+00:00",
"recentLimit": 300,
"report": {
"architectureCompatibilityBlocks": {
@@ -1011,6 +1011,25 @@
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation"
},
"cambricon_mlu-370-x8|vllm|text-generation|model_type:gemma4": {
"architectureSignature": "model_type:gemma4",
"architectures": [],
"evidenceCount": 1,
"expiresAt": "2026-10-20T04:26:51.246271+00:00",
"framework": "vllm",
"latestFailureAt": "2026-09-20T04:26:51.246271+00:00",
"latestSuccessfulAt": null,
"matchType": "model_type",
"modelType": "gemma4",
"sourceModelIds": [
"mlx-community/gemma-4-e4b-it-OptiQ-4bit"
],
"sourceTaskIds": [
"4970731"
],
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation"
},
"cambricon_mlu-370-x8|vllm|text-generation|model_type:gemma4_unified": {
"architectureSignature": "model_type:gemma4_unified",
"architectures": [],
@@ -2792,7 +2811,7 @@
}
},
"architectureCompatibilitySummary": {
"activeBlockCount": 140,
"activeBlockCount": 141,
"byGpuFramework": {
"Ascend_910-b3|vllm": 13,
"Ascend_910-b3|vllm_tokenizer_patch": 5,
@@ -2800,7 +2819,7 @@
"Ascend_910-b4|vllm_tokenizer_patch": 5,
"Biren_166m|vllm": 3,
"Cambricon_mlu-370-x4|vllm": 2,
"Cambricon_mlu-370-x8|vllm": 15,
"Cambricon_mlu-370-x8|vllm": 16,
"Cambricon_mlu-370-x8|vllm-customized": 2,
"Cambricon_mlu-370-x8|vllm-mlu": 5,
"Iluvatar_bi-150|transformers": 4,
@@ -3485,17 +3504,17 @@
"unresolvedFailureCount": 43
},
"Cambricon_mlu-370-x8|vllm|text-generation": {
"attributableFailureCount": 20,
"attributableFailureCount": 21,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 20,
"decisionTotal": 21,
"failureBreakdown": {
"ambiguous_runtime": 19,
"framework_architecture_unsupported": 19,
"framework_architecture_unsupported": 20,
"memory_capacity": 1,
"参数/模板问题": 12
},
"failureCount": 51,
"failureCount": 52,
"failureRate": 1.0,
"framework": "vllm",
"pendingCount": 0,
@@ -3505,7 +3524,7 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 51,
"total": 52,
"unresolvedFailureCount": 31
},
"Iluvatar_bi-100|transformers|text-generation": {
@@ -5440,17 +5459,17 @@
"unresolvedFailureCount": 6446
},
"vllm": {
"attributableFailureCount": 3543,
"attributableFailureCount": 3544,
"decisionFailureRate": 0.9758,
"decisionSuccessRate": 0.0242,
"decisionTotal": 3631,
"decisionTotal": 3632,
"failureBreakdown": {
"ambiguous_runtime": 1497,
"architecture_compatibility": 112,
"attention_backend": 1,
"backend_operator": 84,
"context_length": 161,
"framework_architecture_unsupported": 1310,
"framework_architecture_unsupported": 1311,
"memory_capacity": 722,
"model_load": 207,
"platform_infrastructure": 865,
@@ -5459,14 +5478,14 @@
"tokenizer_compatibility": 412,
"参数/模板问题": 46
},
"failureCount": 5951,
"failureCount": 5952,
"failureRate": 0.9854,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 865,
"successCount": 88,
"successRate": 0.0146,
"total": 6039,
"total": 6040,
"unresolvedFailureCount": 1543
},
"vllm-customized": {
@@ -5613,7 +5632,7 @@
"unresolvedFailureCount": 108
}
},
"generatedAt": "2026-09-21T19:57:12.116575+00:00",
"generatedAt": "2026-09-21T19:58:46.321250+00:00",
"gpuSummaries": {
"Ascend_910-b3": {
"attributableFailureCount": 99,
@@ -5729,27 +5748,27 @@
"unresolvedFailureCount": 774
},
"Cambricon_mlu-370-x8": {
"attributableFailureCount": 51,
"decisionFailureRate": 0.7846,
"decisionSuccessRate": 0.2154,
"decisionTotal": 65,
"attributableFailureCount": 52,
"decisionFailureRate": 0.7879,
"decisionSuccessRate": 0.2121,
"decisionTotal": 66,
"failureBreakdown": {
"ambiguous_runtime": 109,
"framework_architecture_unsupported": 42,
"framework_architecture_unsupported": 43,
"memory_capacity": 4,
"model_load": 3,
"tokenizer_compatibility": 2,
"参数/模板问题": 34,
"验证失败": 22
},
"failureCount": 216,
"failureRate": 0.9391,
"failureCount": 217,
"failureRate": 0.9394,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 14,
"successRate": 0.0609,
"total": 230,
"successRate": 0.0606,
"total": 231,
"unresolvedFailureCount": 165
},
"Iluvatar_bi-100": {
@@ -10535,6 +10554,29 @@
"total": 1,
"unresolvedFailureCount": 0
},
"Cambricon_mlu-370-x8|vllm|text-generation|gemma4|none": {
"attributableFailureCount": 1,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"failureBreakdown": {
"framework_architecture_unsupported": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm",
"modelType": "gemma4",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "none",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
},
"Cambricon_mlu-370-x8|vllm|text-generation|hrm_text|none": {
"attributableFailureCount": 0,
"decisionFailureRate": 0.0,
@@ -17629,15 +17671,15 @@
"unresolvedFailureCount": 7
},
"Cambricon_mlu-370-x8|vllm|text-generation": {
"attributableFailureCount": 6,
"consecutiveFailures": 6,
"attributableFailureCount": 7,
"consecutiveFailures": 7,
"consecutivePlatformFailures": 0,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 6,
"decisionTotal": 7,
"failureBreakdown": {
"ambiguous_runtime": 13,
"framework_architecture_unsupported": 5,
"ambiguous_runtime": 12,
"framework_architecture_unsupported": 6,
"memory_capacity": 1,
"参数/模板问题": 1
},
@@ -17654,7 +17696,7 @@
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 20,
"unresolvedFailureCount": 14
"unresolvedFailureCount": 13
},
"Iluvatar_bi-100|transformers|text-generation": {
"attributableFailureCount": 0,
@@ -19279,6 +19321,31 @@
"total": 1,
"unresolvedFailureCount": 0
},
"Cambricon_mlu-370-x8|vllm|text-generation|gemma4|none": {
"attributableFailureCount": 1,
"consecutiveFailures": 1,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"failureBreakdown": {
"framework_architecture_unsupported": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm",
"lastTerminalAt": "2026-09-21T19:58:46.051796+00:00",
"modelType": "gemma4",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "none",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
},
"Cambricon_mlu-370-x8|vllm|text-generation|lfm2_moe|none": {
"attributableFailureCount": 1,
"consecutiveFailures": 1,
@@ -19604,31 +19671,6 @@
"total": 1,
"unresolvedFailureCount": 1
},
"Cambricon_mlu-370-x8|vllm|text-generation|stablelm|none": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm",
"lastTerminalAt": "2026-09-20T22:43:47.754882+00:00",
"modelType": "stablelm",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "none",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
},
"Cambricon_mlu-370-x8|vllm|text-generation|starcoder2|compressed-tensors": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
@@ -27959,6 +28001,30 @@
"total": 1,
"unresolvedFailureCount": 0
},
"Cambricon_mlu-370-x8|vllm|text-generation|gemma4|none|32": {
"attributableFailureCount": 1,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"failureBreakdown": {
"framework_architecture_unsupported": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm",
"loadSizeLog2Bucket": 32,
"modelType": "gemma4",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "none",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
},
"Cambricon_mlu-370-x8|vllm|text-generation|hrm_text|none|31": {
"attributableFailureCount": 0,
"decisionFailureRate": 0.0,
@@ -37703,20 +37769,20 @@
"unresolvedFailureCount": 0
}
},
"terminalRecords": 16391,
"totalRecords": 16585,
"terminalRecords": 16392,
"totalRecords": 16586,
"totals": {
"attributableFailureCount": 5910,
"attributableFailureCount": 5911,
"decisionFailureRate": 0.862,
"decisionSuccessRate": 0.138,
"decisionTotal": 6856,
"decisionTotal": 6857,
"failureBreakdown": {
"ambiguous_runtime": 4026,
"architecture_compatibility": 212,
"attention_backend": 1,
"backend_operator": 104,
"context_length": 321,
"framework_architecture_unsupported": 2088,
"framework_architecture_unsupported": 2089,
"memory_capacity": 1199,
"model_load": 499,
"platform_infrastructure": 925,
@@ -37727,31 +37793,31 @@
"日志缺失": 719,
"验证失败": 674
},
"failureCount": 15445,
"failureCount": 15446,
"failureRate": 0.9423,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 925,
"successCount": 946,
"successRate": 0.0577,
"total": 16391,
"total": 16392,
"unresolvedFailureCount": 8610
},
"warnings": [
"GPU Iluvatar_mrv-100 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Kunlunxin_p-800 本地统计失败率偏高≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Biren_166m 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-100 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高≥50%),建议重点关注。",
"GPU hygon_k100-ai 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高≥50%),建议重点关注。",
"组合 Iluvatar_bi-150|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -37791,6 +37857,6 @@
]
},
"storageMode": "decision_state_only",
"summarizedRecords": 16585,
"summarizedRecords": 16586,
"version": 1
}

View File

@@ -14,13 +14,13 @@
100
],
"accounts": 12,
"activeScanned": 1198,
"activeScanned": 1200,
"ageCleanupMode": "admission_only",
"agePolicySkipped": {
"cleanupDisabled": true,
"reason": "admission_only"
},
"architectureBlockCount": 140,
"architectureBlockCount": 141,
"architectureFrameworkCatalog": {
"ascend_910-b3|text-generation": [
"llamacpp",
@@ -38,11 +38,27 @@
"vllm_fix_tokenizer",
"vllm_tokenizer_patch"
],
"cambricon_mlu-370-x4|text-generation": [
"vllm",
"vllm-customized",
"vllm-mlu"
],
"cambricon_mlu-370-x8|text-generation": [
"vllm",
"vllm-customized",
"vllm-mlu"
],
"hygon_k100-ai|text-generation": [
"llamacpp",
"vllm",
"vllm-patch-tokenizer"
],
"iluvatar_bi-100|text-generation": [
"transformers",
"vllm",
"vllm-patch-tokenizer",
"vllm_fix_tokenizer"
],
"iluvatar_bi-150|text-generation": [
"llamacpp",
"transformers",
@@ -51,11 +67,19 @@
"vllm_fix_tokenizer",
"vllm_tokenizer_patch"
],
"iluvatar_mrv-100|text-generation": [
"transformers",
"vllm"
],
"kunlunxin_p-800|text-generation": [
"vllm",
"vllm_fix_tokenizer",
"vllm_tokenizer_patch"
],
"metax_c-500|text-generation": [
"vllm",
"vllm_tokenizer_patch"
],
"mthreads_s4000|text-generation": [
"llamacpp",
"vllm",
@@ -65,6 +89,10 @@
"sglang",
"vllm",
"vllm_fix_tokenizer"
],
"vastai_va16|text-generation": [
"vllm",
"vllm_fix_tokenizer"
]
},
"architectureFrameworkCatalogErrors": {},
@@ -93,12 +121,12 @@
"z-lab/Qwen3.8-27B-DFlash2-GGUF": "HttpJsonError: HTTP request failed for https://modelscope.cn/models/z-lab/Qwen3.8-27B-DFlash2-GGUF/resolve/master/config.json (status=404)"
},
"architectureModelConfigsComplete": 57,
"architectureOnly": true,
"architectureOnly": false,
"architecturePolicySkipped": {
"frameworkCatalogUnknown": 0,
"frameworkContextUnknown": 63,
"modelArchitectureUnknown": 133,
"noMatchingBlock": 1045,
"noMatchingBlock": 1047,
"partiallyBlockedFrameworkSet": 20,
"runningMatchedProtected": 0,
"submissionContextMismatch": 0,
@@ -138,12 +166,14 @@
"policyNoLongerAppliesTasks": [],
"recentModelDays": 7,
"recentModelReserveSlots": 5,
"repositorySizeErrors": {},
"repositorySizesComplete": 0,
"repositorySizeErrors": {
"empero-ai/Qwen3.8-9B-GGUF": "recursive_repository_size_incomplete"
},
"repositorySizesComplete": 382,
"skipped": {
"fitsKnownCapacity": 0,
"fitsKnownCapacity": 1198,
"gpuCapacityUnknown": 0,
"repositorySizeUnknown": 0
"repositorySizeUnknown": 2
},
"stopErrors": [],
"uniqueModels": 383

View File

@@ -226,6 +226,7 @@
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-20T12:46:14.462925+00:00", "modelId": "mlx-community/LFM2.5-1.2B-Instruct-4bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 658540250, "estimatedRequiredGiB": 0.741, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 663396475, "modelscopeLicense": "other", "modelscopeParams": 182975232, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 663396475}, "outcome": "failed", "status": "success", "submitTime": "2026-09-20T04:31:05.666143+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4970790", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-20T12:46:14.462980+00:00", "modelId": "mlx-community/gemma-4-e2b-it-OptiQ-4bit", "modelProfile": {"architectures": ["Gemma4ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5226595850, "estimatedRequiredGiB": 5.878, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma4", "modelscopeFileSize": 5259113427, "modelscopeLicense": "gemma", "modelscopeParams": 1141165347, "modelscopeTags": ["license:gemma", "model_type:gemma4", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:mixed-precision", "custom_tag:4bit", "custom_tag:8bit", "custom_tag:optiq", "custom_tag:apple-silicon", "custom_tag:text-generation", "custom_tag:gemma-4"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5259113427}, "outcome": "failed", "status": "success", "submitTime": "2026-09-20T04:27:06.277205+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4970734", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "missing_structured_error_code", "failureCode": null, "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-21T13:30:37.066051+00:00", "modelId": "Arain119/Sophia", "modelProfile": {"architectures": ["SophiaForCausalLM"], "configFingerprint": "6db01b5037d5ed2db74875d2113f8582c97f34bd825637161e54174c9f2cabed", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2226652224, "estimatedRequiredGiB": 7.28, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "sophia_hybrid", "modelscopeFileSize": 6513869659, "modelscopeLicense": "Apache License 2.0", "modelscopeParams": 1113293776, "modelscopeTags": ["license:Apache License 2.0", "model_type:sophia_hybrid", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 6513869659}, "outcome": "failed", "status": "success", "submitTime": "2026-09-20T04:26:58.076866+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4970733", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["gemma4"], "framework": "vllm", "lastSyncTime": "2026-09-21T19:58:46.051796+00:00", "modelId": "mlx-community/gemma-4-e4b-it-OptiQ-4bit", "modelProfile": {"architectures": ["Gemma4ForConditionalGeneration"], "configFingerprint": "6db01b5037d5ed2db74875d2113f8582c97f34bd825637161e54174c9f2cabed", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7486327132, "estimatedRequiredGiB": 8.403, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma4", "modelscopeFileSize": 7518908360, "modelscopeLicense": "gemma", "modelscopeParams": 2227418442, "modelscopeTags": ["license:gemma", "model_type:gemma4", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:mixed-precision", "custom_tag:4bit", "custom_tag:8bit", "custom_tag:optiq", "custom_tag:apple-silicon", "custom_tag:text-generation", "custom_tag:gemma-4"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 7518908360}, "outcome": "failed", "status": "success", "submitTime": "2026-09-20T04:26:51.246271+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4970731", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-20T12:46:14.462946+00:00", "modelId": "mlx-community/Devstral-Small-2-24B-Instruct-2512-OptiQ-4bit", "modelProfile": {"architectures": ["Mistral3ForConditionalGeneration"], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 17367755740, "estimatedRequiredGiB": 19.429, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mistral3", "modelscopeFileSize": 17385072379, "modelscopeLicense": "apache-2.0", "modelscopeParams": 4929899520, "modelscopeTags": ["license:apache-2.0", "model_type:mistral3", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:mixed-precision", "custom_tag:4bit", "custom_tag:8bit", "custom_tag:optiq", "custom_tag:apple-silicon", "custom_tag:text-generation", "custom_tag:mistral", "custom_tag:mistral3", "custom_tag:devstral"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 17385072379}, "outcome": "failed", "status": "success", "submitTime": "2026-09-20T04:26:45.153348+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4970732", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["gemma4_unified"], "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-20T12:46:14.462967+00:00", "modelId": "mlx-community/gemma-4-12B-it-qat-OptiQ-4bit", "modelProfile": {"architectures": ["Gemma4UnifiedForConditionalGeneration"], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9003966484, "estimatedRequiredGiB": 10.099, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma4_unified", "modelscopeFileSize": 9036402901, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2463563824, "modelscopeTags": ["license:apache-2.0", "model_type:gemma4_unified", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:mixed-precision", "custom_tag:4bit", "custom_tag:8bit", "custom_tag:optiq", "custom_tag:qat", "custom_tag:apple-silicon", "custom_tag:text-generation", "custom_tag:image-text-to-text", "custom_tag:gemma-4"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 9036402901}, "outcome": "failed", "status": "success", "submitTime": "2026-09-20T04:26:45.138158+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4970728", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "memory_capacity", "failureAction": "reject_if_estimated_load_exceeds_memory", "failureCategory": "memory_capacity", "failureClassificationReason": "structured_oom", "failureCode": "PREFLIGHT_OOM", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureObservedGpuMemoryGiB": 24.0, "failureScope": "model_gpu", "framework": "vllm", "lastSyncTime": "2026-09-21T17:22:47.256921+00:00", "modelId": "inclusionAI/Ling-3.0-tiny", "modelProfile": {"architectures": ["BailingMoeV3ForCausalLM"], "configFingerprint": "6db01b5037d5ed2db74875d2113f8582c97f34bd825637161e54174c9f2cabed", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 15787992416, "estimatedRequiredGiB": 17.659, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "bailing_hybrid", "modelscopeFileSize": 15801179822, "modelscopeLicense": "mit", "modelscopeParams": 7893392800, "modelscopeTags": ["license:mit", "model_type:bailing_hybrid", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 15801179822}, "outcome": "failed", "status": "success", "submitTime": "2026-09-20T04:19:00.606791+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4970641", "taskType": "text-generation", "verifyResult": -1}
@@ -297,4 +298,3 @@
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-21T19:45:40.057896+00:00", "modelId": "RedHatAI/Phi-3-medium-128k-instruct-quantized.w4a16", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7686303632, "estimatedRequiredGiB": 8.592, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 7688299781, "modelscopeLicense": "llama2", "modelscopeParams": 13960238080, "modelscopeTags": ["license:llama2", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7688299781}, "outcome": "failed", "status": "success", "submitTime": "2026-09-20T03:57:31.539712+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4970317", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "driver_error", "failureCode": "DRIVER_ERROR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-21T15:02:24.876345+00:00", "modelId": "neuralmagic/starcoder2-15b-FP8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 16564748304, "estimatedRequiredGiB": 18.516, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 16568142341, "modelscopeLicense": "other", "modelscopeParams": 15957889024, "modelscopeTags": ["license:other", "model_type:starcoder2", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 16568142341}, "outcome": "failed", "status": "success", "submitTime": "2026-09-20T03:57:31.484685+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4970312", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "repository_structure", "failureAction": "require_framework_specific_root_files", "failureCategory": "repository_structure", "failureClassificationReason": "structured_missing_files", "failureCode": "MODEL_FILE_NOT_FOUND", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-21T16:21:18.661407+00:00", "modelId": "aisingapore/SEA-LION-v1-7B-IT-Research", "modelProfile": {"architectures": ["MPTForCausalLM"], "configFingerprint": "ecd31d4ed4e0e92b9deabe3de0f18c75dc252004ba68826e4cfd561549549074", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 15003361968, "estimatedRequiredGiB": 16.773, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mpt", "modelscopeFileSize": 15008118474, "modelscopeLicense": "cc-by-nc-sa-4.0", "modelscopeParams": 7501651968, "modelscopeTags": ["license:cc-by-nc-sa-4.0", "model_type:mpt", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 15008118474}, "outcome": "failed", "status": "success", "submitTime": "2026-09-20T03:53:33.643969+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4970234", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-20T22:43:47.754882+00:00", "modelId": "IntervitensInc/kek_mk3", "modelProfile": {"architectures": ["StableLmForCausalLM"], "configFingerprint": "6db01b5037d5ed2db74875d2113f8582c97f34bd825637161e54174c9f2cabed", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 3289069288, "estimatedRequiredGiB": 3.683, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "stablelm", "modelscopeFileSize": 3295875324, "modelscopeLicense": null, "modelscopeParams": 1644515328, "modelscopeTags": ["model_type:stablelm", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 3295875324}, "outcome": "failed", "status": "success", "submitTime": "2026-09-20T03:46:35.813804+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4970120", "taskType": "text-generation", "verifyResult": -1}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff