state: generation 5066 (cycle)

This commit is contained in:
2026-09-10 08:04:08 +00:00
parent d0d67f0faf
commit 54d7a176c4
11 changed files with 2033 additions and 2129 deletions

View File

@@ -1317,7 +1317,7 @@
"taskType": "text-generation"
}
},
"generatedAt": "2026-09-10T08:01:06.270728+00:00",
"generatedAt": "2026-09-10T08:04:07.903250+00:00",
"summary": {
"activeBlockCount": 66,
"byGpuFramework": {

View File

@@ -51,7 +51,7 @@
"4": {
"complete": false,
"lastError": "ModelHubAPIError: 系统错误",
"listingErrors": 359,
"listingErrors": 360,
"nextPage": 1,
"recordsScanned": 0,
"uniqueRecords": 0
@@ -102,12 +102,12 @@
"cutoffAt": "2026-09-04T03:55:51.365685+00:00",
"failureLogsInspected": 0,
"mode": "incremental_decision_only",
"nextAccountIndex": 4,
"nextAccountIndex": 5,
"recordsScanned": 0,
"seenTaskIds": [],
"startedAt": "2026-09-04T03:55:51.365685+00:00",
"terminalRecords": 0,
"uniqueRecords": 0,
"updatedAt": "2026-09-10T08:01:06.245418+00:00",
"updatedAt": "2026-09-10T08:04:07.876037+00:00",
"version": 1
}

View File

@@ -416,7 +416,7 @@
}
},
"frameworkUpdatedAt": null,
"generatedAt": "2026-09-10T07:59:34.195652+00:00",
"generatedAt": "2026-09-10T08:02:29.084423+00:00",
"gpuStats": {
"Ascend_910-b3": {
"available": true,

File diff suppressed because it is too large Load Diff

View File

@@ -1,6 +1,6 @@
{
"generatedAt": "2026-09-10T07:53:10.960863+00:00",
"lastSyncTime": "2026-09-10T07:53:10.699435+00:00",
"generatedAt": "2026-09-10T08:02:07.265881+00:00",
"lastSyncTime": "2026-09-10T08:02:07.004701+00:00",
"recentLimit": 300,
"report": {
"architectureCompatibilityBlocks": {
@@ -1872,10 +1872,10 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 24,
"ambiguous_runtime": 25,
"参数/模板问题": 1
},
"failureCount": 25,
"failureCount": 26,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"pendingCount": 0,
@@ -1885,8 +1885,8 @@
"successRate": 0.0,
"targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation",
"total": 25,
"unresolvedFailureCount": 25
"total": 26,
"unresolvedFailureCount": 26
},
"MetaX_c-500|unknown|text-generation": {
"attributableFailureCount": 0,
@@ -1911,29 +1911,29 @@
"unresolvedFailureCount": 56
},
"MetaX_c-500|vllm|text-generation": {
"attributableFailureCount": 39,
"decisionFailureRate": 0.975,
"decisionSuccessRate": 0.025,
"decisionTotal": 40,
"attributableFailureCount": 40,
"decisionFailureRate": 0.9756,
"decisionSuccessRate": 0.0244,
"decisionTotal": 41,
"failureBreakdown": {
"ambiguous_runtime": 7,
"backend_operator": 20,
"backend_operator": 21,
"framework_architecture_unsupported": 14,
"memory_capacity": 1,
"model_load": 4,
"参数/模板问题": 9
},
"failureCount": 55,
"failureRate": 0.9821,
"failureCount": 56,
"failureRate": 0.9825,
"framework": "vllm",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 1,
"successRate": 0.0179,
"successRate": 0.0175,
"targetGpu": "MetaX_c-500",
"taskType": "text-generation",
"total": 56,
"total": 57,
"unresolvedFailureCount": 16
},
"Mthreads_s4000|llamacpp|text-generation": {
@@ -2320,13 +2320,13 @@
"unresolvedFailureCount": 841
},
"vllm": {
"attributableFailureCount": 230,
"attributableFailureCount": 231,
"decisionFailureRate": 0.9957,
"decisionSuccessRate": 0.0043,
"decisionTotal": 231,
"decisionTotal": 232,
"failureBreakdown": {
"ambiguous_runtime": 150,
"backend_operator": 24,
"backend_operator": 25,
"framework_architecture_unsupported": 169,
"memory_capacity": 6,
"model_load": 18,
@@ -2336,14 +2336,14 @@
"tokenizer_compatibility": 3,
"参数/模板问题": 21
},
"failureCount": 402,
"failureCount": 403,
"failureRate": 0.9975,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 1,
"successCount": 1,
"successRate": 0.0025,
"total": 403,
"total": 404,
"unresolvedFailureCount": 171
},
"vllm-mlu": {
@@ -2411,22 +2411,22 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 32,
"failureBreakdown": {
"ambiguous_runtime": 25,
"ambiguous_runtime": 26,
"framework_architecture_unsupported": 4,
"model_load": 1,
"platform_infrastructure": 1,
"tokenizer_compatibility": 27,
"参数/模板问题": 7
},
"failureCount": 65,
"failureCount": 66,
"failureRate": 1.0,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 1,
"successCount": 0,
"successRate": 0.0,
"total": 65,
"unresolvedFailureCount": 32
"total": 66,
"unresolvedFailureCount": 33
},
"vllm_tokenizer_patch": {
"attributableFailureCount": 0,
@@ -2447,7 +2447,7 @@
"unresolvedFailureCount": 1
}
},
"generatedAt": "2026-09-10T07:53:10.956424+00:00",
"generatedAt": "2026-09-10T08:02:07.261719+00:00",
"gpuSummaries": {
"Ascend_910-b3": {
"attributableFailureCount": 26,
@@ -2638,43 +2638,43 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"failureBreakdown": {
"ambiguous_runtime": 56,
"ambiguous_runtime": 57,
"memory_capacity": 1,
"参数/模板问题": 1,
"验证失败": 23
},
"failureCount": 81,
"failureCount": 82,
"failureRate": 1.0,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 0,
"successRate": 0.0,
"total": 81,
"unresolvedFailureCount": 80
"total": 82,
"unresolvedFailureCount": 81
},
"MetaX_c-500": {
"attributableFailureCount": 39,
"decisionFailureRate": 0.7959,
"decisionSuccessRate": 0.2041,
"decisionTotal": 49,
"attributableFailureCount": 40,
"decisionFailureRate": 0.8,
"decisionSuccessRate": 0.2,
"decisionTotal": 50,
"failureBreakdown": {
"ambiguous_runtime": 7,
"backend_operator": 20,
"backend_operator": 21,
"framework_architecture_unsupported": 14,
"memory_capacity": 1,
"model_load": 4,
"参数/模板问题": 17,
"验证失败": 48
},
"failureCount": 111,
"failureRate": 0.9174,
"failureCount": 112,
"failureRate": 0.918,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 10,
"successRate": 0.0826,
"total": 121,
"successRate": 0.082,
"total": 122,
"unresolvedFailureCount": 72
},
"Mthreads_s4000": {
@@ -3279,9 +3279,9 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 6
"ambiguous_runtime": 7
},
"failureCount": 6,
"failureCount": 7,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"modelType": "llama",
@@ -3293,8 +3293,8 @@
"successRate": 0.0,
"targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation",
"total": 6,
"unresolvedFailureCount": 6
"total": 7,
"unresolvedFailureCount": 7
},
"Kunlunxin_p-800|vllm_fix_tokenizer|text-generation|phi3small|compressed-tensors": {
"attributableFailureCount": 0,
@@ -3504,15 +3504,15 @@
"unresolvedFailureCount": 0
},
"MetaX_c-500|vllm|text-generation|llama|compressed-tensors": {
"attributableFailureCount": 10,
"decisionFailureRate": 0.9091,
"decisionSuccessRate": 0.0909,
"decisionTotal": 11,
"attributableFailureCount": 11,
"decisionFailureRate": 0.9167,
"decisionSuccessRate": 0.0833,
"decisionTotal": 12,
"failureBreakdown": {
"backend_operator": 10
"backend_operator": 11
},
"failureCount": 10,
"failureRate": 0.9091,
"failureCount": 11,
"failureRate": 0.9167,
"framework": "vllm",
"modelType": "llama",
"pendingCount": 0,
@@ -3520,10 +3520,10 @@
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 1,
"successRate": 0.0909,
"successRate": 0.0833,
"targetGpu": "MetaX_c-500",
"taskType": "text-generation",
"total": 11,
"total": 12,
"unresolvedFailureCount": 0
},
"MetaX_c-500|vllm|text-generation|phi3small|compressed-tensors": {
@@ -4315,9 +4315,9 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 12
"ambiguous_runtime": 13
},
"failureCount": 12,
"failureCount": 13,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"lastPlatformFailureAt": null,
@@ -4329,8 +4329,8 @@
"successRate": 0.0,
"targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation",
"total": 12,
"unresolvedFailureCount": 12
"total": 13,
"unresolvedFailureCount": 13
},
"MetaX_c-500|unknown|text-generation": {
"attributableFailureCount": 0,
@@ -4950,9 +4950,9 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 2
"ambiguous_runtime": 3
},
"failureCount": 2,
"failureCount": 3,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"lastTerminalAt": "2026-09-09T11:33:22.442275+00:00",
@@ -4965,8 +4965,8 @@
"successRate": 0.0,
"targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation",
"total": 2,
"unresolvedFailureCount": 2
"total": 3,
"unresolvedFailureCount": 3
},
"Kunlunxin_p-800|vllm_fix_tokenizer|text-generation|phi3small|compressed-tensors": {
"attributableFailureCount": 0,
@@ -5912,6 +5912,30 @@
"total": 1,
"unresolvedFailureCount": 1
},
"Kunlunxin_p-800|vllm_fix_tokenizer|text-generation|llama|compressed-tensors|32": {
"attributableFailureCount": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"loadSizeLog2Bucket": 32,
"modelType": "llama",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
},
"Kunlunxin_p-800|vllm_fix_tokenizer|text-generation|llama|compressed-tensors|33": {
"attributableFailureCount": 0,
"decisionFailureRate": 0.0,
@@ -6319,14 +6343,14 @@
"unresolvedFailureCount": 0
},
"MetaX_c-500|vllm|text-generation|llama|compressed-tensors|32": {
"attributableFailureCount": 1,
"attributableFailureCount": 2,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"decisionTotal": 2,
"failureBreakdown": {
"backend_operator": 1
"backend_operator": 2
},
"failureCount": 1,
"failureCount": 2,
"failureRate": 1.0,
"framework": "vllm",
"loadSizeLog2Bucket": 32,
@@ -6339,7 +6363,7 @@
"successRate": 0.0,
"targetGpu": "MetaX_c-500",
"taskType": "text-generation",
"total": 1,
"total": 2,
"unresolvedFailureCount": 0
},
"MetaX_c-500|vllm|text-generation|llama|compressed-tensors|33": {
@@ -6919,16 +6943,16 @@
"unresolvedFailureCount": 0
}
},
"terminalRecords": 1533,
"totalRecords": 1620,
"terminalRecords": 1535,
"totalRecords": 1622,
"totals": {
"attributableFailureCount": 400,
"decisionFailureRate": 0.8889,
"decisionSuccessRate": 0.1111,
"decisionTotal": 450,
"attributableFailureCount": 401,
"decisionFailureRate": 0.8891,
"decisionSuccessRate": 0.1109,
"decisionTotal": 451,
"failureBreakdown": {
"ambiguous_runtime": 313,
"backend_operator": 29,
"ambiguous_runtime": 314,
"backend_operator": 30,
"framework_architecture_unsupported": 271,
"memory_capacity": 11,
"model_load": 46,
@@ -6939,21 +6963,21 @@
"参数/模板问题": 95,
"验证失败": 673
},
"failureCount": 1483,
"failureCount": 1485,
"failureRate": 0.9674,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 2,
"successCount": 50,
"successRate": 0.0326,
"total": 1533,
"unresolvedFailureCount": 1081
"total": 1535,
"unresolvedFailureCount": 1082
},
"warnings": [
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_mrv-100 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高≥50%),建议重点关注。",
@@ -6961,7 +6985,7 @@
"GPU hygon_k100-ai 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高≥50%),建议重点关注。",
"组合 Iluvatar_mrv-100|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Biren_166m|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -6982,6 +7006,6 @@
]
},
"storageMode": "decision_state_only",
"summarizedRecords": 1620,
"summarizedRecords": 1622,
"version": 1
}

View File

@@ -32,6 +32,16 @@
"vllm",
"vllm_tokenizer_patch"
],
"biren_166m|text-generation": [
"vllm",
"vllm_fix_tokenizer",
"vllm_tokenizer_patch"
],
"cambricon_mlu-370-x4|text-generation": [
"vllm",
"vllm-customized",
"vllm-mlu"
],
"cambricon_mlu-370-x8|text-generation": [
"vllm",
"vllm-customized",
@@ -50,6 +60,15 @@
"vllm_fix_tokenizer",
"vllm_tokenizer_patch"
],
"iluvatar_mrv-100|text-generation": [
"transformers",
"vllm"
],
"kunlunxin_p-800|text-generation": [
"vllm",
"vllm_fix_tokenizer",
"vllm_tokenizer_patch"
],
"metax_c-500|text-generation": [
"vllm"
],
@@ -69,72 +88,8 @@
]
},
"architectureFrameworkCatalogErrors": {},
"architectureIncompatibleCount": 3,
"architectureIncompatibleTasks": [
{
"accountIndex": 4,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-10T04:01:22+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:rwkv7",
"architectureSignatures": [
"model_type:rwkv7"
],
"evaluatedFrameworks": [
"vllm"
],
"framework": "vllm",
"gpuType": "Mthreads_s4000",
"modelId": "RWKV/RWKV7-13.3B-20260805",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 4634664,
"taskType": "text-generation"
},
{
"accountIndex": 6,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-10T04:01:22+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:rwkv7",
"architectureSignatures": [
"model_type:rwkv7"
],
"evaluatedFrameworks": [
"vllm"
],
"framework": "vllm",
"gpuType": "Mthreads_s4000",
"modelId": "RWKV/RWKV7-2.9B-20260805",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 4635039,
"taskType": "text-generation"
},
{
"accountIndex": 7,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-10T04:01:22+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:rwkv7",
"architectureSignatures": [
"model_type:rwkv7"
],
"evaluatedFrameworks": [
"vllm"
],
"framework": "vllm",
"gpuType": "Mthreads_s4000",
"modelId": "RWKV/RWKV7-7.2B-20260805",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 4635148,
"taskType": "text-generation"
}
],
"architectureIncompatibleCount": 0,
"architectureIncompatibleTasks": [],
"architectureModelConfigErrors": {
"GestaltLabs/Ornstein-3.5-9B-V2-GGUF": "HttpJsonError: HTTP request failed for https://modelscope.cn/models/GestaltLabs/Ornstein-3.5-9B-V2-GGUF/resolve/master/config.json (status=404)",
"LiquidAI/LFM2-2.6B-Transcript-GGUF": "HttpJsonError: HTTP request failed for https://modelscope.cn/models/LiquidAI/LFM2-2.6B-Transcript-GGUF/resolve/master/config.json (status=404)",
@@ -161,96 +116,23 @@
"unsloth/LFM2-2.6B-Exp-GGUF": "HttpJsonError: HTTP request failed for https://modelscope.cn/models/unsloth/LFM2-2.6B-Exp-GGUF/resolve/master/config.json (status=404)",
"z-lab/Qwen3.8-27B-DFlash2-GGUF": "HttpJsonError: HTTP request failed for https://modelscope.cn/models/z-lab/Qwen3.8-27B-DFlash2-GGUF/resolve/master/config.json (status=404)"
},
"architectureModelConfigsComplete": 132,
"architectureOnly": true,
"architectureModelConfigsComplete": 131,
"architectureOnly": false,
"architecturePolicySkipped": {
"frameworkCatalogUnknown": 121,
"frameworkContextUnknown": 423,
"modelArchitectureUnknown": 163,
"noMatchingBlock": 714,
"frameworkCatalogUnknown": 2,
"frameworkContextUnknown": 409,
"modelArchitectureUnknown": 165,
"noMatchingBlock": 834,
"partiallyBlockedFrameworkSet": 102,
"runningMatchedProtected": 0,
"submissionContextMismatch": 0,
"submissionContextUnknown": 0
},
"cancelledCount": 3,
"cancelledTasks": [
{
"accountIndex": 4,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-10T04:01:22+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:rwkv7",
"architectureSignatures": [
"model_type:rwkv7"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm"
],
"framework": "vllm",
"gpuType": "Mthreads_s4000",
"modelId": "RWKV/RWKV7-13.3B-20260805",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 4634664,
"taskType": "text-generation"
},
{
"accountIndex": 6,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-10T04:01:22+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:rwkv7",
"architectureSignatures": [
"model_type:rwkv7"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm"
],
"framework": "vllm",
"gpuType": "Mthreads_s4000",
"modelId": "RWKV/RWKV7-2.9B-20260805",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 4635039,
"taskType": "text-generation"
},
{
"accountIndex": 7,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-10T04:01:22+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:rwkv7",
"architectureSignatures": [
"model_type:rwkv7"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm"
],
"framework": "vllm",
"gpuType": "Mthreads_s4000",
"modelId": "RWKV/RWKV7-7.2B-20260805",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 4635148,
"taskType": "text-generation"
}
],
"cancelledCount": 0,
"cancelledTasks": [],
"certainOomCount": 0,
"certainOomTasks": [],
"cleanupCandidateCount": 3,
"cleanupCandidateCount": 0,
"dryRun": false,
"listingErrors": {},
"modelAgeErrors": {},
@@ -275,18 +157,20 @@
],
"oldOverflowCount": 0,
"oldOverflowTasks": [],
"policyCancelledRecorded": 3,
"policyCancelledRecorded": 0,
"policyNoLongerAppliesCount": 0,
"policyNoLongerAppliesTasks": [],
"recentModelDays": 7,
"recentModelReserveSlots": 5,
"repositorySizeErrors": {},
"repositorySizesComplete": 0,
"repositorySizeErrors": {
"empero-ai/Qwen3.8-9B-GGUF": "recursive_repository_size_incomplete"
},
"repositorySizesComplete": 268,
"skipped": {
"fitsKnownCapacity": 0,
"fitsKnownCapacity": 1101,
"gpuCapacityUnknown": 0,
"repositorySizeUnknown": 0
"repositorySizeUnknown": 2
},
"stopErrors": [],
"uniqueModels": 264
"uniqueModels": 269
}

View File

@@ -135,6 +135,7 @@
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-09T13:53:30.308247+00:00", "modelId": "FlagRelease/Qwen3.5-35B-A3B-iluvatar-FlagOS", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 71903878016, "estimatedRequiredGiB": 80.385, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 71927003609, "modelscopeLicense": null, "modelscopeParams": 35951822704, "modelscopeTags": ["model_type:qwen3_5_moe", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 71927003609}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T23:02:51.822402+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729511", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-09T11:33:22.442275+00:00", "modelId": "nm-testing/Meta-llama3-8b-Instruct-SmoothQuant-Fp8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9081287016, "estimatedRequiredGiB": 10.159, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9090490505, "modelscopeLicense": null, "modelscopeParams": 8030261248, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-07T02:37:59.437448+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 9090490505}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T23:02:45.784701+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729501", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-09T14:42:07.646504+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-FP8-compressed-tensors-test-bos", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9081287016, "estimatedRequiredGiB": 10.159, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9090490459, "modelscopeLicense": null, "modelscopeParams": 8030261248, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-07T02:37:59.437448+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 9090490459}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T23:02:45.697968+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729508", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-10T08:02:07.004675+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-W4A16-compressed-tensors-test", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5700679600, "estimatedRequiredGiB": 6.381, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5709884743, "modelscopeLicense": null, "modelscopeParams": 8030261248, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-07T02:37:59.437448+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 5709884743}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T23:02:45.685300+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729504", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-08T22:32:41.015088+00:00", "modelId": "amd/Qwen3-4B-awq-quant-onnx-hybrid", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T22:31:21+00:00", "targetGpu": "MetaX_c-500", "taskId": "4079127", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "missing_structured_error_code", "failureCode": null, "failureDetectedFramework": "transformers", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "transformers", "lastSyncTime": "2026-09-08T21:43:22.342466+00:00", "modelId": "BAAI/AquilaMed-RL", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T21:41:21+00:00", "targetGpu": "Iluvatar_bi-100", "taskId": "4477978", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-08T21:43:22.342491+00:00", "modelId": "neuralmagic/Mistral-7B-Instruct-v0.3-quantized.w8a8", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T21:37:22+00:00", "targetGpu": "Vastai_va16", "taskId": "4080288", "taskType": "text-generation", "verifyResult": -1}
@@ -297,4 +298,3 @@
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-07T16:06:52.110340+00:00", "modelId": "fla-hub/rwkv7-1.5B-world", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-07T15:55:22+00:00", "targetGpu": "Vastai_va16", "taskId": "4079301", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "", "lastSyncTime": "2026-09-07T16:06:52.110299+00:00", "modelId": "LLM-Research/Phi-3-medium-128k-instruct", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-07T15:51:46+00:00", "targetGpu": "Vastai_va16", "taskId": "4079303", "taskType": "text-generation", "verifyResult": null}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mellum"], "framework": "", "lastSyncTime": "2026-09-07T16:06:52.110321+00:00", "modelId": "JetBrains/Mellum2-12B-A2.5B-Thinking", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-07T15:51:21+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "4148307", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-07T14:48:12.111065+00:00", "modelId": "dickeyli/llmrec-onereason-8b-sh2-grpo4-step240", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-07T14:29:21+00:00", "targetGpu": "Vastai_va16", "taskId": "4458046", "taskType": "text-generation", "verifyResult": -1}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -1,24 +1,24 @@
{
"agentVersion": "2026.09.04.4",
"checksums": {
".modelhub_state/architecture_compatibility_blacklist.json": "73f27e209f70d1b78774b92728b23454e3f73d0b32f8826dfef9582e14a7bb8b",
".modelhub_state/architecture_history_backfill.json": "5787f7401d7ef0b1bd5392758bae970bce7f335a2387023c3fef7f5968f09796",
".modelhub_state/market_intelligence.json": "49bdea1b0c1984e7f6f18bca92ca4f4ea8418a788e96e4d54539a4289f847786",
".modelhub_state/official_capabilities.json": "39d337cf08ca1e6c1c81b8801ea6837664ee9cf1f0c0947254c16d80e2c31d34",
".modelhub_state/outcome_checkpoint.json": "f636aa59918cb4b23355a5a53047b6584b648709c0dbee0b0cfe054e95ae65a1",
".modelhub_state/queue_cleanup_latest.json": "b251e2ff52f1e826ed4fc9723e1765d93287b92341cb7f593f01eb5e88982f99",
".modelhub_state/recent_outcomes.jsonl": "06407523c3a9cc5b207be90fac5264d8893710a3dea96c00107c95c45ca4f396",
".modelhub_state/recovery_active_tasks.jsonl": "8ff27a5acdb59e0a9472aabeedb22f0956fe91830e01d5ef04464241a8668eca",
".modelhub_state/recovery_intents.jsonl": "55c9c307b906914ce23924ae9434bd6225e9aa6e6fc6849ae6d98d98c888c3f0",
".modelhub_state/architecture_compatibility_blacklist.json": "841f65de1756138589e728dcffd77e97303ef7803425509766ea1e28ae23fc41",
".modelhub_state/architecture_history_backfill.json": "ad2905675f88f34c0d4a0e89c407a55139d5cf85e1cf33c68b739451f768aad6",
".modelhub_state/market_intelligence.json": "3618e1634bae526856f98c882c860800fff4bf3ab6b80a4c1a08d60088400373",
".modelhub_state/official_capabilities.json": "337cc2d5e1201071f913938eef433d92ebdd88b6216c0246b03a161ec29b8093",
".modelhub_state/outcome_checkpoint.json": "90675262b0d3cd3009abd1917a29a90cbee14dd51a312a5c46283387e2ce0d86",
".modelhub_state/queue_cleanup_latest.json": "b9038630dc67feced29c6931cb43d6d94c28bb175e6dcf80fac9c625a52887d5",
".modelhub_state/recent_outcomes.jsonl": "aabfa8b6cb55f991ed845ffcbec637ffab473f7f48b29e20b082818f5ee2dc00",
".modelhub_state/recovery_active_tasks.jsonl": "6026f08ffad693283dc6a9d2ea1ecc1bff15be1e462efa5cf83143ee058ecb0e",
".modelhub_state/recovery_intents.jsonl": "96b511edfc93b8bfe0485cef76827ad774dd049a308de606a7e2dcac50adbdc7",
".modelhub_state/routing_intelligence.json": "8a52419d4402861a79d360da797632830eb2c915c1cd189832eea085096de774",
".modelhub_state/submission_exclusions.jsonl": "b2de1125bf1f3e0597cd50cc30b563a5bfee39459e843767163eb72101cebc03",
".modelhub_state/worker_crashes.jsonl": "d1c3f447ce0377ed5e820c2b5ff730d29f84a96af4fd14332b138f78c0ddde76",
"ledger/submissions.jsonl": "ae2d6630dc3b5048885517330e9530c50fe5e0c1ea4c5a17488ad884d16de042",
"outcomes/submissions.jsonl": "cb24db13bdbf2c66aef5f7e91a82ecf791f7e4f2e71f312ddc3b8f04e8aac3ab"
"outcomes/submissions.jsonl": "63123fb37e89e8bb42d6003a318dcdb692e3ccc7256bfca4f7c1671cf39e1633"
},
"generation": 5065,
"generation": 5066,
"phase": "cycle",
"schemaVersion": 1,
"updatedAt": "2026-09-10T08:01:06.374781+00:00",
"updatedAt": "2026-09-10T08:04:08.589380+00:00",
"writerId": "58ff5dc2a2d64b119ad1e4560700f977"
}

View File

@@ -118,7 +118,6 @@
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T17:46:46.041785+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-Non-Uniform-compressed-tensors", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 20041566112, "estimatedRequiredGiB": 22.408, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 20050750527, "modelscopeLicense": null, "modelscopeParams": 8030261248, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"backend_operator": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm", "lastTerminalAt": "2026-09-05T03:28:46.602358+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "MetaX_c-500", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 20050750527}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T09:38:43.506267+00:00", "targetGpu": "MetaX_c-500", "taskId": "4645748", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T17:46:46.041804+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-FP8-K-V", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9081293776, "estimatedRequiredGiB": 10.159, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9090504091, "modelscopeLicense": "llama3", "modelscopeParams": 8030261312, "modelscopeTags": ["license:llama3", "model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"backend_operator": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm", "lastTerminalAt": "2026-09-05T03:28:46.602358+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "MetaX_c-500", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 9090504091}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T09:38:43.485599+00:00", "targetGpu": "MetaX_c-500", "taskId": "4645738", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-05T17:46:46.041763+00:00", "modelId": "Jackrong/DeepSeek-V4-Pro-Qwen3.5-9B", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306310880, "estimatedRequiredGiB": 21.599, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 19326449341, "modelscopeLicense": "apache-2.0", "modelscopeParams": 9653104368, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:transformers", "custom_tag:unsloth", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:distillation", "custom_tag:deepseek", "custom_tag:sft", "custom_tag:rl", "custom_tag:gspo", "custom_tag:math", "custom_tag:stem", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:mtp"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19326449341}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T09:43:33.758884+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4645816", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T18:34:58.235083+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-W4A16-compressed-tensors-test", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5700679600, "estimatedRequiredGiB": 6.381, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5709884743, "modelscopeLicense": null, "modelscopeParams": 8030261248, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"backend_operator": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm", "lastTerminalAt": "2026-09-05T03:28:46.602358+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "MetaX_c-500", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 5709884743}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T10:33:51.489696+00:00", "targetGpu": "MetaX_c-500", "taskId": "4646504", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T18:34:58.235126+00:00", "modelId": "zstack/qwen3-4b-fake", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 25165824, "estimatedRequiredGiB": 0.028, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 25169485, "modelscopeLicense": null, "modelscopeParams": 25165435, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 25169485}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T10:33:51.484756+00:00", "targetGpu": "MetaX_c-500", "taskId": "4646505", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T19:13:04.549009+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-W4A16-ACTORDER-compressed-tensors-test", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5705684944, "estimatedRequiredGiB": 6.387, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5714910031, "modelscopeLicense": null, "modelscopeParams": 8031506432, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"backend_operator": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm", "lastTerminalAt": "2026-09-05T03:28:46.602358+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "MetaX_c-500", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 5714910031}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T11:12:23.284350+00:00", "targetGpu": "MetaX_c-500", "taskId": "4647279", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "llamacpp", "lastSyncTime": "2026-09-05T20:12:28.913845+00:00", "modelId": "LiquidAI/LFM2.5-8B-A1B-DSpark-GGUF", "modelProfile": {"architectures": [], "configFingerprint": "e023b149992af42872de3c0c0c07dafd6a98d965e5bdb5a29ec5869e58d45725", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 356491104, "estimatedRequiredGiB": 1.363, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": null, "modelscopeFileSize": 1219879026, "modelscopeLicense": "other", "modelscopeParams": 327707521, "modelscopeTags": ["license:other", "library:gguf", "library:pytorch", "task:text-generation", "custom_tag:speculative-decoding", "custom_tag:dspark", "custom_tag:lfm2", "custom_tag:draft-model", "custom_tag:gguf", "deploy:swingdeploy"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 1219879026}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T12:03:37.084154+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4648146", "taskType": "text-generation", "verifyResult": null}
@@ -386,7 +385,6 @@
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-09T06:50:35.321517+00:00", "modelId": "whq1111/M2RL-RL_IF", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044981832, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912185, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8060912185}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T22:49:56.923972+00:00", "targetGpu": "Biren_166m", "taskId": "4729274", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-09T06:50:35.321512+00:00", "modelId": "TokenRhythm/NeoHorse-1-4B", "modelProfile": {"architectures": ["Qwen3_5ForCausalLM"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8411552560, "estimatedRequiredGiB": 9.428, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_text", "modelscopeFileSize": 8435794148, "modelscopeLicense": "Apache License 2.0", "modelscopeParams": null, "modelscopeTags": ["license:Apache License 2.0", "model_type:qwen3_5_text", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:agentic", "custom_tag:tool-use", "custom_tag:coding", "custom_tag:reasoning", "custom_tag:instruction-following"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8435794148}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T22:49:56.925801+00:00", "targetGpu": "Biren_166m", "taskId": "4729275", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-09T07:05:13.504572+00:00", "modelId": "OpenBMB/MiniCPM5-2B", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557096, "estimatedRequiredGiB": 5.637, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5043809154, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5043809154}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T23:02:45.687861+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729507", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-09T07:05:13.504552+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-W4A16-compressed-tensors-test", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5700679600, "estimatedRequiredGiB": 6.381, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5709884743, "modelscopeLicense": null, "modelscopeParams": 8030261248, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-07T02:37:59.437448+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 5709884743}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T23:02:45.685300+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729504", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-09T07:05:13.504658+00:00", "modelId": "whq1111/M2RL-SFT", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044982008, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912361, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-07T05:31:35.012313+00:00", "modelType": "qwen3", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 8060912361}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T23:02:45.664222+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729503", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-09T07:05:13.504520+00:00", "modelId": "whq1111/M2RL-RL_Math", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044981872, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912225, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-07T05:31:35.012313+00:00", "modelType": "qwen3", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 8060912225}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T23:02:45.690523+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729502", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-09T07:05:13.504454+00:00", "modelId": "whq1111/M2RL-RL_Science", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044981832, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912185, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-07T05:31:35.012313+00:00", "modelType": "qwen3", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 8060912185}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T23:02:45.686402+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729506", "taskType": "text-generation", "verifyResult": null}