state: generation 22003 (cycle)
This commit is contained in:
@@ -943,7 +943,7 @@
|
|||||||
"cambricon_mlu-370-x8|vllm-mlu|text-generation|model_type:mini_k3": {
|
"cambricon_mlu-370-x8|vllm-mlu|text-generation|model_type:mini_k3": {
|
||||||
"architectureSignature": "model_type:mini_k3",
|
"architectureSignature": "model_type:mini_k3",
|
||||||
"architectures": [],
|
"architectures": [],
|
||||||
"evidenceCount": 2,
|
"evidenceCount": 3,
|
||||||
"expiresAt": "2026-10-21T19:52:49.757664+00:00",
|
"expiresAt": "2026-10-21T19:52:49.757664+00:00",
|
||||||
"framework": "vllm-mlu",
|
"framework": "vllm-mlu",
|
||||||
"latestFailureAt": "2026-09-21T19:52:49.757664+00:00",
|
"latestFailureAt": "2026-09-21T19:52:49.757664+00:00",
|
||||||
@@ -952,10 +952,12 @@
|
|||||||
"modelType": "mini_k3",
|
"modelType": "mini_k3",
|
||||||
"sourceModelIds": [
|
"sourceModelIds": [
|
||||||
"nkkbr/Mini-K3-1H-decay-g16-v2_B",
|
"nkkbr/Mini-K3-1H-decay-g16-v2_B",
|
||||||
|
"nkkbr/Mini-K3-1H-attnres-block6-v1_C",
|
||||||
"nkkbr/Mini-K3-1H-decay-g2-v2_C"
|
"nkkbr/Mini-K3-1H-decay-g2-v2_C"
|
||||||
],
|
],
|
||||||
"sourceTaskIds": [
|
"sourceTaskIds": [
|
||||||
"5006516",
|
"5006516",
|
||||||
|
"5006518",
|
||||||
"5006512"
|
"5006512"
|
||||||
],
|
],
|
||||||
"targetGpu": "Cambricon_mlu-370-x8",
|
"targetGpu": "Cambricon_mlu-370-x8",
|
||||||
@@ -2880,7 +2882,7 @@
|
|||||||
"taskType": "text-generation"
|
"taskType": "text-generation"
|
||||||
}
|
}
|
||||||
},
|
},
|
||||||
"generatedAt": "2026-10-07T23:17:42.860827+00:00",
|
"generatedAt": "2026-10-07T23:36:57.612899+00:00",
|
||||||
"summary": {
|
"summary": {
|
||||||
"activeBlockCount": 145,
|
"activeBlockCount": 145,
|
||||||
"byGpuFramework": {
|
"byGpuFramework": {
|
||||||
|
|||||||
@@ -1,8 +1,8 @@
|
|||||||
{
|
{
|
||||||
"communityAttemptedAt": "2026-10-07T23:19:15.769719+00:00",
|
"communityAttemptedAt": "2026-10-07T23:38:20.969622+00:00",
|
||||||
"communityError": null,
|
"communityError": null,
|
||||||
"communitySample": {},
|
"communitySample": {},
|
||||||
"communityUpdatedAt": "2026-10-07T23:19:15.769719+00:00",
|
"communityUpdatedAt": "2026-10-07T23:38:20.969622+00:00",
|
||||||
"frameworkAttemptedAt": "2026-10-07T20:58:42.772583+00:00",
|
"frameworkAttemptedAt": "2026-10-07T20:58:42.772583+00:00",
|
||||||
"frameworkError": null,
|
"frameworkError": null,
|
||||||
"frameworkStats": {
|
"frameworkStats": {
|
||||||
@@ -434,7 +434,7 @@
|
|||||||
}
|
}
|
||||||
},
|
},
|
||||||
"frameworkUpdatedAt": null,
|
"frameworkUpdatedAt": null,
|
||||||
"generatedAt": "2026-10-07T23:33:17.267156+00:00",
|
"generatedAt": "2026-10-07T23:38:20.969622+00:00",
|
||||||
"gpuStats": {
|
"gpuStats": {
|
||||||
"Ascend_910-b3": {
|
"Ascend_910-b3": {
|
||||||
"available": true,
|
"available": true,
|
||||||
|
|||||||
File diff suppressed because it is too large
Load Diff
@@ -1,6 +1,6 @@
|
|||||||
{
|
{
|
||||||
"generatedAt": "2026-10-07T23:17:42.770324+00:00",
|
"generatedAt": "2026-10-07T23:36:57.524328+00:00",
|
||||||
"lastSyncTime": "2026-10-07T23:17:42.455387+00:00",
|
"lastSyncTime": "2026-10-07T23:36:57.259705+00:00",
|
||||||
"recentLimit": 300,
|
"recentLimit": 300,
|
||||||
"report": {
|
"report": {
|
||||||
"architectureCompatibilityBlocks": {
|
"architectureCompatibilityBlocks": {
|
||||||
@@ -947,7 +947,7 @@
|
|||||||
"cambricon_mlu-370-x8|vllm-mlu|text-generation|model_type:mini_k3": {
|
"cambricon_mlu-370-x8|vllm-mlu|text-generation|model_type:mini_k3": {
|
||||||
"architectureSignature": "model_type:mini_k3",
|
"architectureSignature": "model_type:mini_k3",
|
||||||
"architectures": [],
|
"architectures": [],
|
||||||
"evidenceCount": 2,
|
"evidenceCount": 3,
|
||||||
"expiresAt": "2026-10-21T19:52:49.757664+00:00",
|
"expiresAt": "2026-10-21T19:52:49.757664+00:00",
|
||||||
"framework": "vllm-mlu",
|
"framework": "vllm-mlu",
|
||||||
"latestFailureAt": "2026-09-21T19:52:49.757664+00:00",
|
"latestFailureAt": "2026-09-21T19:52:49.757664+00:00",
|
||||||
@@ -956,10 +956,12 @@
|
|||||||
"modelType": "mini_k3",
|
"modelType": "mini_k3",
|
||||||
"sourceModelIds": [
|
"sourceModelIds": [
|
||||||
"nkkbr/Mini-K3-1H-decay-g16-v2_B",
|
"nkkbr/Mini-K3-1H-decay-g16-v2_B",
|
||||||
|
"nkkbr/Mini-K3-1H-attnres-block6-v1_C",
|
||||||
"nkkbr/Mini-K3-1H-decay-g2-v2_C"
|
"nkkbr/Mini-K3-1H-decay-g2-v2_C"
|
||||||
],
|
],
|
||||||
"sourceTaskIds": [
|
"sourceTaskIds": [
|
||||||
"5006516",
|
"5006516",
|
||||||
|
"5006518",
|
||||||
"5006512"
|
"5006512"
|
||||||
],
|
],
|
||||||
"targetGpu": "Cambricon_mlu-370-x8",
|
"targetGpu": "Cambricon_mlu-370-x8",
|
||||||
@@ -3587,28 +3589,28 @@
|
|||||||
"unresolvedFailureCount": 47
|
"unresolvedFailureCount": 47
|
||||||
},
|
},
|
||||||
"Cambricon_mlu-370-x8|vllm-mlu|text-generation": {
|
"Cambricon_mlu-370-x8|vllm-mlu|text-generation": {
|
||||||
"attributableFailureCount": 21,
|
"attributableFailureCount": 22,
|
||||||
"decisionFailureRate": 0.6176,
|
"decisionFailureRate": 0.6286,
|
||||||
"decisionSuccessRate": 0.3824,
|
"decisionSuccessRate": 0.3714,
|
||||||
"decisionTotal": 34,
|
"decisionTotal": 35,
|
||||||
"failureBreakdown": {
|
"failureBreakdown": {
|
||||||
"ambiguous_runtime": 54,
|
"ambiguous_runtime": 54,
|
||||||
"framework_architecture_unsupported": 17,
|
"framework_architecture_unsupported": 18,
|
||||||
"model_load": 3,
|
"model_load": 3,
|
||||||
"tokenizer_compatibility": 1,
|
"tokenizer_compatibility": 1,
|
||||||
"参数/模板问题": 3
|
"参数/模板问题": 3
|
||||||
},
|
},
|
||||||
"failureCount": 78,
|
"failureCount": 79,
|
||||||
"failureRate": 0.8571,
|
"failureRate": 0.8587,
|
||||||
"framework": "vllm-mlu",
|
"framework": "vllm-mlu",
|
||||||
"pendingCount": 0,
|
"pendingCount": 0,
|
||||||
"pendingRate": 0.0,
|
"pendingRate": 0.0,
|
||||||
"platformFailureCount": 0,
|
"platformFailureCount": 0,
|
||||||
"successCount": 13,
|
"successCount": 13,
|
||||||
"successRate": 0.1429,
|
"successRate": 0.1413,
|
||||||
"targetGpu": "Cambricon_mlu-370-x8",
|
"targetGpu": "Cambricon_mlu-370-x8",
|
||||||
"taskType": "text-generation",
|
"taskType": "text-generation",
|
||||||
"total": 91,
|
"total": 92,
|
||||||
"unresolvedFailureCount": 57
|
"unresolvedFailureCount": 57
|
||||||
},
|
},
|
||||||
"Cambricon_mlu-370-x8|vllm|text-generation": {
|
"Cambricon_mlu-370-x8|vllm|text-generation": {
|
||||||
@@ -5661,27 +5663,27 @@
|
|||||||
"unresolvedFailureCount": 51
|
"unresolvedFailureCount": 51
|
||||||
},
|
},
|
||||||
"vllm-mlu": {
|
"vllm-mlu": {
|
||||||
"attributableFailureCount": 47,
|
"attributableFailureCount": 48,
|
||||||
"decisionFailureRate": 0.6812,
|
"decisionFailureRate": 0.6857,
|
||||||
"decisionSuccessRate": 0.3188,
|
"decisionSuccessRate": 0.3143,
|
||||||
"decisionTotal": 69,
|
"decisionTotal": 70,
|
||||||
"failureBreakdown": {
|
"failureBreakdown": {
|
||||||
"ambiguous_runtime": 103,
|
"ambiguous_runtime": 103,
|
||||||
"framework_architecture_unsupported": 39,
|
"framework_architecture_unsupported": 40,
|
||||||
"model_load": 7,
|
"model_load": 7,
|
||||||
"platform_infrastructure": 1,
|
"platform_infrastructure": 1,
|
||||||
"tokenizer_compatibility": 1,
|
"tokenizer_compatibility": 1,
|
||||||
"参数/模板问题": 4,
|
"参数/模板问题": 4,
|
||||||
"验证失败": 3
|
"验证失败": 3
|
||||||
},
|
},
|
||||||
"failureCount": 158,
|
"failureCount": 159,
|
||||||
"failureRate": 0.8778,
|
"failureRate": 0.8785,
|
||||||
"pendingCount": 0,
|
"pendingCount": 0,
|
||||||
"pendingRate": 0.0,
|
"pendingRate": 0.0,
|
||||||
"platformFailureCount": 1,
|
"platformFailureCount": 1,
|
||||||
"successCount": 22,
|
"successCount": 22,
|
||||||
"successRate": 0.1222,
|
"successRate": 0.1215,
|
||||||
"total": 180,
|
"total": 181,
|
||||||
"unresolvedFailureCount": 110
|
"unresolvedFailureCount": 110
|
||||||
},
|
},
|
||||||
"vllm-patch-tokenizer": {
|
"vllm-patch-tokenizer": {
|
||||||
@@ -5785,7 +5787,7 @@
|
|||||||
"unresolvedFailureCount": 257
|
"unresolvedFailureCount": 257
|
||||||
}
|
}
|
||||||
},
|
},
|
||||||
"generatedAt": "2026-10-07T23:17:42.752835+00:00",
|
"generatedAt": "2026-10-07T23:36:57.510845+00:00",
|
||||||
"gpuSummaries": {
|
"gpuSummaries": {
|
||||||
"Ascend_910-b3": {
|
"Ascend_910-b3": {
|
||||||
"attributableFailureCount": 121,
|
"attributableFailureCount": 121,
|
||||||
@@ -5902,13 +5904,13 @@
|
|||||||
"unresolvedFailureCount": 856
|
"unresolvedFailureCount": 856
|
||||||
},
|
},
|
||||||
"Cambricon_mlu-370-x8": {
|
"Cambricon_mlu-370-x8": {
|
||||||
"attributableFailureCount": 67,
|
"attributableFailureCount": 68,
|
||||||
"decisionFailureRate": 0.8171,
|
"decisionFailureRate": 0.8193,
|
||||||
"decisionSuccessRate": 0.1829,
|
"decisionSuccessRate": 0.1807,
|
||||||
"decisionTotal": 82,
|
"decisionTotal": 83,
|
||||||
"failureBreakdown": {
|
"failureBreakdown": {
|
||||||
"ambiguous_runtime": 158,
|
"ambiguous_runtime": 158,
|
||||||
"framework_architecture_unsupported": 54,
|
"framework_architecture_unsupported": 55,
|
||||||
"memory_capacity": 4,
|
"memory_capacity": 4,
|
||||||
"model_load": 6,
|
"model_load": 6,
|
||||||
"platform_infrastructure": 2,
|
"platform_infrastructure": 2,
|
||||||
@@ -5916,14 +5918,14 @@
|
|||||||
"参数/模板问题": 41,
|
"参数/模板问题": 41,
|
||||||
"验证失败": 22
|
"验证失败": 22
|
||||||
},
|
},
|
||||||
"failureCount": 290,
|
"failureCount": 291,
|
||||||
"failureRate": 0.9508,
|
"failureRate": 0.951,
|
||||||
"pendingCount": 0,
|
"pendingCount": 0,
|
||||||
"pendingRate": 0.0,
|
"pendingRate": 0.0,
|
||||||
"platformFailureCount": 2,
|
"platformFailureCount": 2,
|
||||||
"successCount": 15,
|
"successCount": 15,
|
||||||
"successRate": 0.0492,
|
"successRate": 0.049,
|
||||||
"total": 305,
|
"total": 306,
|
||||||
"unresolvedFailureCount": 221
|
"unresolvedFailureCount": 221
|
||||||
},
|
},
|
||||||
"Iluvatar_bi-100": {
|
"Iluvatar_bi-100": {
|
||||||
@@ -13429,14 +13431,14 @@
|
|||||||
"unresolvedFailureCount": 1
|
"unresolvedFailureCount": 1
|
||||||
},
|
},
|
||||||
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mini_k3|none": {
|
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mini_k3|none": {
|
||||||
"attributableFailureCount": 2,
|
"attributableFailureCount": 3,
|
||||||
"decisionFailureRate": 1.0,
|
"decisionFailureRate": 1.0,
|
||||||
"decisionSuccessRate": 0.0,
|
"decisionSuccessRate": 0.0,
|
||||||
"decisionTotal": 2,
|
"decisionTotal": 3,
|
||||||
"failureBreakdown": {
|
"failureBreakdown": {
|
||||||
"framework_architecture_unsupported": 2
|
"framework_architecture_unsupported": 3
|
||||||
},
|
},
|
||||||
"failureCount": 2,
|
"failureCount": 3,
|
||||||
"failureRate": 1.0,
|
"failureRate": 1.0,
|
||||||
"framework": "vllm-mlu",
|
"framework": "vllm-mlu",
|
||||||
"modelType": "mini_k3",
|
"modelType": "mini_k3",
|
||||||
@@ -13448,7 +13450,7 @@
|
|||||||
"successRate": 0.0,
|
"successRate": 0.0,
|
||||||
"targetGpu": "Cambricon_mlu-370-x8",
|
"targetGpu": "Cambricon_mlu-370-x8",
|
||||||
"taskType": "text-generation",
|
"taskType": "text-generation",
|
||||||
"total": 2,
|
"total": 3,
|
||||||
"unresolvedFailureCount": 0
|
"unresolvedFailureCount": 0
|
||||||
},
|
},
|
||||||
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mistral|compressed-tensors": {
|
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mistral|compressed-tensors": {
|
||||||
@@ -25546,11 +25548,11 @@
|
|||||||
"decisionSuccessRate": 0.0,
|
"decisionSuccessRate": 0.0,
|
||||||
"decisionTotal": 7,
|
"decisionTotal": 7,
|
||||||
"failureBreakdown": {
|
"failureBreakdown": {
|
||||||
"ambiguous_runtime": 12,
|
"ambiguous_runtime": 11,
|
||||||
"context_length": 3,
|
"context_length": 3,
|
||||||
"framework_architecture_unsupported": 4
|
"framework_architecture_unsupported": 4
|
||||||
},
|
},
|
||||||
"failureCount": 19,
|
"failureCount": 18,
|
||||||
"failureRate": 1.0,
|
"failureRate": 1.0,
|
||||||
"framework": "vllm_tokenizer_patch",
|
"framework": "vllm_tokenizer_patch",
|
||||||
"lastPlatformFailureAt": null,
|
"lastPlatformFailureAt": null,
|
||||||
@@ -25562,8 +25564,8 @@
|
|||||||
"successRate": 0.0,
|
"successRate": 0.0,
|
||||||
"targetGpu": "Ascend_910-b3",
|
"targetGpu": "Ascend_910-b3",
|
||||||
"taskType": "text-generation",
|
"taskType": "text-generation",
|
||||||
"total": 19,
|
"total": 18,
|
||||||
"unresolvedFailureCount": 12
|
"unresolvedFailureCount": 11
|
||||||
},
|
},
|
||||||
"Ascend_910-b3|vllm|text-generation": {
|
"Ascend_910-b3|vllm|text-generation": {
|
||||||
"attributableFailureCount": 2,
|
"attributableFailureCount": 2,
|
||||||
@@ -25824,17 +25826,17 @@
|
|||||||
"unresolvedFailureCount": 16
|
"unresolvedFailureCount": 16
|
||||||
},
|
},
|
||||||
"Cambricon_mlu-370-x8|vllm-mlu|text-generation": {
|
"Cambricon_mlu-370-x8|vllm-mlu|text-generation": {
|
||||||
"attributableFailureCount": 3,
|
"attributableFailureCount": 4,
|
||||||
"consecutiveFailures": 3,
|
"consecutiveFailures": 4,
|
||||||
"consecutivePlatformFailures": 0,
|
"consecutivePlatformFailures": 0,
|
||||||
"decisionFailureRate": 1.0,
|
"decisionFailureRate": 1.0,
|
||||||
"decisionSuccessRate": 0.0,
|
"decisionSuccessRate": 0.0,
|
||||||
"decisionTotal": 3,
|
"decisionTotal": 4,
|
||||||
"failureBreakdown": {
|
"failureBreakdown": {
|
||||||
"ambiguous_runtime": 1,
|
"ambiguous_runtime": 1,
|
||||||
"framework_architecture_unsupported": 3
|
"framework_architecture_unsupported": 4
|
||||||
},
|
},
|
||||||
"failureCount": 4,
|
"failureCount": 5,
|
||||||
"failureRate": 1.0,
|
"failureRate": 1.0,
|
||||||
"framework": "vllm-mlu",
|
"framework": "vllm-mlu",
|
||||||
"lastPlatformFailureAt": null,
|
"lastPlatformFailureAt": null,
|
||||||
@@ -25846,7 +25848,7 @@
|
|||||||
"successRate": 0.0,
|
"successRate": 0.0,
|
||||||
"targetGpu": "Cambricon_mlu-370-x8",
|
"targetGpu": "Cambricon_mlu-370-x8",
|
||||||
"taskType": "text-generation",
|
"taskType": "text-generation",
|
||||||
"total": 4,
|
"total": 5,
|
||||||
"unresolvedFailureCount": 1
|
"unresolvedFailureCount": 1
|
||||||
},
|
},
|
||||||
"Iluvatar_bi-150|transformers|text-generation": {
|
"Iluvatar_bi-150|transformers|text-generation": {
|
||||||
@@ -26382,9 +26384,9 @@
|
|||||||
"decisionSuccessRate": 0.0,
|
"decisionSuccessRate": 0.0,
|
||||||
"decisionTotal": 0,
|
"decisionTotal": 0,
|
||||||
"failureBreakdown": {
|
"failureBreakdown": {
|
||||||
"ambiguous_runtime": 2
|
"ambiguous_runtime": 1
|
||||||
},
|
},
|
||||||
"failureCount": 2,
|
"failureCount": 1,
|
||||||
"failureRate": 1.0,
|
"failureRate": 1.0,
|
||||||
"framework": "vllm_tokenizer_patch",
|
"framework": "vllm_tokenizer_patch",
|
||||||
"lastTerminalAt": "2026-10-01T01:11:13.658662+00:00",
|
"lastTerminalAt": "2026-10-01T01:11:13.658662+00:00",
|
||||||
@@ -26397,8 +26399,8 @@
|
|||||||
"successRate": 0.0,
|
"successRate": 0.0,
|
||||||
"targetGpu": "Ascend_910-b3",
|
"targetGpu": "Ascend_910-b3",
|
||||||
"taskType": "text-generation",
|
"taskType": "text-generation",
|
||||||
"total": 2,
|
"total": 1,
|
||||||
"unresolvedFailureCount": 2
|
"unresolvedFailureCount": 1
|
||||||
},
|
},
|
||||||
"Ascend_910-b3|vllm_tokenizer_patch|text-generation|gpt_oss|none": {
|
"Ascend_910-b3|vllm_tokenizer_patch|text-generation|gpt_oss|none": {
|
||||||
"attributableFailureCount": 0,
|
"attributableFailureCount": 0,
|
||||||
@@ -27402,15 +27404,15 @@
|
|||||||
"unresolvedFailureCount": 3
|
"unresolvedFailureCount": 3
|
||||||
},
|
},
|
||||||
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mini_k3|none": {
|
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mini_k3|none": {
|
||||||
"attributableFailureCount": 2,
|
"attributableFailureCount": 3,
|
||||||
"consecutiveFailures": 2,
|
"consecutiveFailures": 3,
|
||||||
"decisionFailureRate": 1.0,
|
"decisionFailureRate": 1.0,
|
||||||
"decisionSuccessRate": 0.0,
|
"decisionSuccessRate": 0.0,
|
||||||
"decisionTotal": 2,
|
"decisionTotal": 3,
|
||||||
"failureBreakdown": {
|
"failureBreakdown": {
|
||||||
"framework_architecture_unsupported": 2
|
"framework_architecture_unsupported": 3
|
||||||
},
|
},
|
||||||
"failureCount": 2,
|
"failureCount": 3,
|
||||||
"failureRate": 1.0,
|
"failureRate": 1.0,
|
||||||
"framework": "vllm-mlu",
|
"framework": "vllm-mlu",
|
||||||
"lastTerminalAt": "2026-10-07T20:46:38.448824+00:00",
|
"lastTerminalAt": "2026-10-07T20:46:38.448824+00:00",
|
||||||
@@ -27423,7 +27425,7 @@
|
|||||||
"successRate": 0.0,
|
"successRate": 0.0,
|
||||||
"targetGpu": "Cambricon_mlu-370-x8",
|
"targetGpu": "Cambricon_mlu-370-x8",
|
||||||
"taskType": "text-generation",
|
"taskType": "text-generation",
|
||||||
"total": 2,
|
"total": 3,
|
||||||
"unresolvedFailureCount": 0
|
"unresolvedFailureCount": 0
|
||||||
},
|
},
|
||||||
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mistral|compressed-tensors": {
|
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mistral|compressed-tensors": {
|
||||||
@@ -41030,14 +41032,14 @@
|
|||||||
"unresolvedFailureCount": 0
|
"unresolvedFailureCount": 0
|
||||||
},
|
},
|
||||||
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mini_k3|none|30": {
|
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mini_k3|none|30": {
|
||||||
"attributableFailureCount": 2,
|
"attributableFailureCount": 3,
|
||||||
"decisionFailureRate": 1.0,
|
"decisionFailureRate": 1.0,
|
||||||
"decisionSuccessRate": 0.0,
|
"decisionSuccessRate": 0.0,
|
||||||
"decisionTotal": 2,
|
"decisionTotal": 3,
|
||||||
"failureBreakdown": {
|
"failureBreakdown": {
|
||||||
"framework_architecture_unsupported": 2
|
"framework_architecture_unsupported": 3
|
||||||
},
|
},
|
||||||
"failureCount": 2,
|
"failureCount": 3,
|
||||||
"failureRate": 1.0,
|
"failureRate": 1.0,
|
||||||
"framework": "vllm-mlu",
|
"framework": "vllm-mlu",
|
||||||
"loadSizeLog2Bucket": 30,
|
"loadSizeLog2Bucket": 30,
|
||||||
@@ -41050,7 +41052,7 @@
|
|||||||
"successRate": 0.0,
|
"successRate": 0.0,
|
||||||
"targetGpu": "Cambricon_mlu-370-x8",
|
"targetGpu": "Cambricon_mlu-370-x8",
|
||||||
"taskType": "text-generation",
|
"taskType": "text-generation",
|
||||||
"total": 2,
|
"total": 3,
|
||||||
"unresolvedFailureCount": 0
|
"unresolvedFailureCount": 0
|
||||||
},
|
},
|
||||||
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mistral|compressed-tensors|33": {
|
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mistral|compressed-tensors|33": {
|
||||||
@@ -58998,20 +59000,20 @@
|
|||||||
"unresolvedFailureCount": 0
|
"unresolvedFailureCount": 0
|
||||||
}
|
}
|
||||||
},
|
},
|
||||||
"terminalRecords": 17438,
|
"terminalRecords": 17439,
|
||||||
"totalRecords": 17820,
|
"totalRecords": 17821,
|
||||||
"totals": {
|
"totals": {
|
||||||
"attributableFailureCount": 6262,
|
"attributableFailureCount": 6263,
|
||||||
"decisionFailureRate": 0.8648,
|
"decisionFailureRate": 0.8648,
|
||||||
"decisionSuccessRate": 0.1352,
|
"decisionSuccessRate": 0.1352,
|
||||||
"decisionTotal": 7241,
|
"decisionTotal": 7242,
|
||||||
"failureBreakdown": {
|
"failureBreakdown": {
|
||||||
"ambiguous_runtime": 4581,
|
"ambiguous_runtime": 4581,
|
||||||
"architecture_compatibility": 212,
|
"architecture_compatibility": 212,
|
||||||
"attention_backend": 3,
|
"attention_backend": 3,
|
||||||
"backend_operator": 130,
|
"backend_operator": 130,
|
||||||
"context_length": 327,
|
"context_length": 327,
|
||||||
"framework_architecture_unsupported": 2280,
|
"framework_architecture_unsupported": 2281,
|
||||||
"memory_capacity": 1206,
|
"memory_capacity": 1206,
|
||||||
"model_load": 571,
|
"model_load": 571,
|
||||||
"platform_infrastructure": 955,
|
"platform_infrastructure": 955,
|
||||||
@@ -59022,14 +59024,14 @@
|
|||||||
"日志缺失": 719,
|
"日志缺失": 719,
|
||||||
"验证失败": 676
|
"验证失败": 676
|
||||||
},
|
},
|
||||||
"failureCount": 16459,
|
"failureCount": 16460,
|
||||||
"failureRate": 0.9439,
|
"failureRate": 0.9439,
|
||||||
"pendingCount": 0,
|
"pendingCount": 0,
|
||||||
"pendingRate": 0.0,
|
"pendingRate": 0.0,
|
||||||
"platformFailureCount": 955,
|
"platformFailureCount": 955,
|
||||||
"successCount": 979,
|
"successCount": 979,
|
||||||
"successRate": 0.0561,
|
"successRate": 0.0561,
|
||||||
"total": 17438,
|
"total": 17439,
|
||||||
"unresolvedFailureCount": 9242
|
"unresolvedFailureCount": 9242
|
||||||
},
|
},
|
||||||
"warnings": [
|
"warnings": [
|
||||||
@@ -59039,14 +59041,14 @@
|
|||||||
"GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。",
|
"GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||||
"GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。",
|
"GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||||
"GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。",
|
"GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||||
"GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。",
|
"GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||||
"GPU Kunlunxin_p-800 本地统计失败率偏高(≥50%),建议重点关注。",
|
"GPU Kunlunxin_p-800 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||||
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。",
|
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||||
"GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。",
|
"GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||||
"GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。",
|
"GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||||
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。",
|
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||||
"GPU Iluvatar_bi-100 本地统计失败率偏高(≥50%),建议重点关注。",
|
"GPU Iluvatar_bi-100 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||||
"GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。",
|
"GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||||
"组合 Vastai_va16|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
"组合 Vastai_va16|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||||
"组合 Ascend_910-b3|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
"组合 Ascend_910-b3|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||||
"组合 Iluvatar_mrv-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
"组合 Iluvatar_mrv-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||||
@@ -59092,6 +59094,6 @@
|
|||||||
]
|
]
|
||||||
},
|
},
|
||||||
"storageMode": "decision_state_only",
|
"storageMode": "decision_state_only",
|
||||||
"summarizedRecords": 17820,
|
"summarizedRecords": 17821,
|
||||||
"version": 1
|
"version": 1
|
||||||
}
|
}
|
||||||
|
|||||||
@@ -111,6 +111,7 @@
|
|||||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T15:52:48.873111+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T20:16:38.547857+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5006761", "taskType": "text-generation", "verifyResult": -1}
|
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T15:52:48.873111+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T20:16:38.547857+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5006761", "taskType": "text-generation", "verifyResult": -1}
|
||||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T13:29:11.757302+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T20:12:49.394711+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5006730", "taskType": "text-generation", "verifyResult": -1}
|
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T13:29:11.757302+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T20:12:49.394711+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5006730", "taskType": "text-generation", "verifyResult": -1}
|
||||||
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm-mlu", "lastSyncTime": "2026-10-07T20:46:38.448824+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:52:49.757664+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006516", "taskType": "text-generation", "verifyResult": -1}
|
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm-mlu", "lastSyncTime": "2026-10-07T20:46:38.448824+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:52:49.757664+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006516", "taskType": "text-generation", "verifyResult": -1}
|
||||||
|
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm-mlu", "lastSyncTime": "2026-10-07T23:36:57.259705+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:52:49.751148+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006518", "taskType": "text-generation", "verifyResult": -1}
|
||||||
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm-mlu", "lastSyncTime": "2026-10-07T20:46:38.448855+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g2-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030713792, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039076183}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:52:49.749531+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006512", "taskType": "text-generation", "verifyResult": -1}
|
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm-mlu", "lastSyncTime": "2026-10-07T20:46:38.448855+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g2-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030713792, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039076183}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:52:49.749531+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006512", "taskType": "text-generation", "verifyResult": -1}
|
||||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-25T01:41:30.953868+00:00", "modelId": "mlx-community/LFM2.5-1.2B-Thinking-6bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 951093016, "estimatedRequiredGiB": 1.068, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 955857175, "modelscopeLicense": "other", "modelscopeParams": 256113408, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"ambiguous_runtime": 4, "model_load": 1}, "failureCount": 5, "failureRate": 1.0, "framework": "vllm-customized", "lastTerminalAt": "2026-09-21T19:49:37.657075+00:00", "modelType": "lfm2", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Cambricon_mlu-370-x8", "taskType": "text-generation", "total": 5, "unresolvedFailureCount": 4}, "repositoryOnDiskBytes": 955857175}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:49:53.770533+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006460", "taskType": "text-generation", "verifyResult": -1}
|
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-25T01:41:30.953868+00:00", "modelId": "mlx-community/LFM2.5-1.2B-Thinking-6bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 951093016, "estimatedRequiredGiB": 1.068, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 955857175, "modelscopeLicense": "other", "modelscopeParams": 256113408, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"ambiguous_runtime": 4, "model_load": 1}, "failureCount": 5, "failureRate": 1.0, "framework": "vllm-customized", "lastTerminalAt": "2026-09-21T19:49:37.657075+00:00", "modelType": "lfm2", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Cambricon_mlu-370-x8", "taskType": "text-generation", "total": 5, "unresolvedFailureCount": 4}, "repositoryOnDiskBytes": 955857175}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:49:53.770533+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006460", "taskType": "text-generation", "verifyResult": -1}
|
||||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T11:42:31.164621+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 5}, "failureCount": 5, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-21T16:50:30.559192+00:00", "modelType": "qwen3_5", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Biren_166m", "taskType": "text-generation", "total": 5, "unresolvedFailureCount": 5}, "repositoryOnDiskBytes": 19329296879}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:37:12.653471+00:00", "targetGpu": "Biren_166m", "taskId": "5006368", "taskType": "text-generation", "verifyResult": -1}
|
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T11:42:31.164621+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 5}, "failureCount": 5, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-21T16:50:30.559192+00:00", "modelType": "qwen3_5", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Biren_166m", "taskType": "text-generation", "total": 5, "unresolvedFailureCount": 5}, "repositoryOnDiskBytes": 19329296879}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:37:12.653471+00:00", "targetGpu": "Biren_166m", "taskId": "5006368", "taskType": "text-generation", "verifyResult": -1}
|
||||||
@@ -297,4 +298,3 @@
|
|||||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-22T08:17:47.558862+00:00", "modelId": "RedHatAI/gemma-2-9b-it-quantized.w4a16", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7963207224, "estimatedRequiredGiB": 8.924, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 7985124576, "modelscopeLicense": "llama2", "modelscopeParams": 10159209984, "modelscopeTags": ["license:llama2", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7985124576}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:49:55.866013+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4998525", "taskType": "text-generation", "verifyResult": -1}
|
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-22T08:17:47.558862+00:00", "modelId": "RedHatAI/gemma-2-9b-it-quantized.w4a16", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7963207224, "estimatedRequiredGiB": 8.924, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 7985124576, "modelscopeLicense": "llama2", "modelscopeParams": 10159209984, "modelscopeTags": ["license:llama2", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7985124576}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:49:55.866013+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4998525", "taskType": "text-generation", "verifyResult": -1}
|
||||||
{"failReason": "runtime_memory", "failureAction": "lower_memory_risk_or_reject_combination", "failureCategory": "runtime_memory", "failureClassificationReason": "structured_device_oom", "failureCode": "DEVICE_OOM", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu", "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-24T13:31:51.262642+00:00", "modelId": "neuralmagic/starcoder2-7b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7857298896, "estimatedRequiredGiB": 8.785, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 7860673858, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 7400416256, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7860673858}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:46:02.415434+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4998415", "taskType": "text-generation", "verifyResult": -1}
|
{"failReason": "runtime_memory", "failureAction": "lower_memory_risk_or_reject_combination", "failureCategory": "runtime_memory", "failureClassificationReason": "structured_device_oom", "failureCode": "DEVICE_OOM", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu", "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-24T13:31:51.262642+00:00", "modelId": "neuralmagic/starcoder2-7b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7857298896, "estimatedRequiredGiB": 8.785, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 7860673858, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 7400416256, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7860673858}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:46:02.415434+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4998415", "taskType": "text-generation", "verifyResult": -1}
|
||||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-22T22:37:24.242959+00:00", "modelId": "neuralmagic/starcoder2-7b-FP8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7855165704, "estimatedRequiredGiB": 8.783, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 7858541078, "modelscopeLicense": "other", "modelscopeParams": 7400416256, "modelscopeTags": ["license:other", "model_type:starcoder2", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7858541078}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:45:53.481324+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4998407", "taskType": "text-generation", "verifyResult": -1}
|
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-22T22:37:24.242959+00:00", "modelId": "neuralmagic/starcoder2-7b-FP8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7855165704, "estimatedRequiredGiB": 8.783, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 7858541078, "modelscopeLicense": "other", "modelscopeParams": 7400416256, "modelscopeTags": ["license:other", "model_type:starcoder2", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7858541078}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:45:53.481324+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4998407", "taskType": "text-generation", "verifyResult": -1}
|
||||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "driver_error", "failureCode": "DRIVER_ERROR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-30T15:29:22.559055+00:00", "modelId": "RedHatAI/gemma-2-2b-quantized.w8a16", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 6746735136, "estimatedRequiredGiB": 7.565, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 6768615358, "modelscopeLicense": "gemma", "modelscopeParams": 3204165888, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 6768615358}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:41:35.705044+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4998344", "taskType": "text-generation", "verifyResult": -1}
|
|
||||||
|
|||||||
File diff suppressed because it is too large
Load Diff
File diff suppressed because it is too large
Load Diff
@@ -2,24 +2,24 @@
|
|||||||
"agentVersion": "2026.09.04.4",
|
"agentVersion": "2026.09.04.4",
|
||||||
"checksums": {
|
"checksums": {
|
||||||
".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1",
|
".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1",
|
||||||
".modelhub_state/architecture_compatibility_blacklist.json": "0dba2964eb01f144eb4c4e7a25d4e460dd91860bfde1daa5820ab8d7b97a3382",
|
".modelhub_state/architecture_compatibility_blacklist.json": "4181453b220f0031163e46493147c9aab819dce157f8301bfca8532a6e440ce4",
|
||||||
".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab",
|
".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab",
|
||||||
".modelhub_state/market_intelligence.json": "c15d6be27c6e9ead5e910d96489802fab80fbc29a6e9b99914a241cbe7d399f6",
|
".modelhub_state/market_intelligence.json": "44c4fde559793b94eae3d9d0b5554bc66f86706af6837a37fdb847f6a4fafea9",
|
||||||
".modelhub_state/official_capabilities.json": "fde092d379baf782dc597d06ac63e81cf4a37bac1d3e6a22f8b613b2e241dc33",
|
".modelhub_state/official_capabilities.json": "4497146120ec338d2d911a6931e07e56153a00700603f1868cf81f6dd9f4d138",
|
||||||
".modelhub_state/outcome_checkpoint.json": "cb4a7240ed7263813c12c7b9e9a90757c5a545fc13bce967022773a541656aa7",
|
".modelhub_state/outcome_checkpoint.json": "80042b9b6e66fb76b8d79b495e226f4acec377fca0a551856984c05da35915f0",
|
||||||
".modelhub_state/queue_cleanup_latest.json": "568ae8813ea4bc8c494aef8be02f77b1c9756ab49dd7d307b81483e6cca30468",
|
".modelhub_state/queue_cleanup_latest.json": "568ae8813ea4bc8c494aef8be02f77b1c9756ab49dd7d307b81483e6cca30468",
|
||||||
".modelhub_state/recent_outcomes.jsonl": "58d5b9642c968a3447f8c14f170e10302de6374b163d9e293c598f0811417585",
|
".modelhub_state/recent_outcomes.jsonl": "aeac56a19e87b523a3f86e3e8d3561fbf0c54c151fd5730b040e5a79c1822fc8",
|
||||||
".modelhub_state/recovery_active_tasks.jsonl": "0030bd01212d3fc8492c6ba1b8cb6991454ebce59d273095169fd3c6f960aff1",
|
".modelhub_state/recovery_active_tasks.jsonl": "235fcdcba72a9a1eba57655968d3e67e7fab1f1ac1d273976773423d55856d83",
|
||||||
".modelhub_state/recovery_intents.jsonl": "3da6e363ca39c25d2994a33e185070029a134680faee8cfdbfbcb73578afd5da",
|
".modelhub_state/recovery_intents.jsonl": "4650a52379e1f52ec7b03992ffa40ce2826559d7ed790dcafa7da727763304e4",
|
||||||
".modelhub_state/routing_intelligence.json": "a312187abffa011156b64da1fed551d1816329b725ab3f38c5221900b7cc793e",
|
".modelhub_state/routing_intelligence.json": "a312187abffa011156b64da1fed551d1816329b725ab3f38c5221900b7cc793e",
|
||||||
".modelhub_state/submission_exclusions.jsonl": "dca7091e8b1da8bf9b3ecb95fe573b2a41666601edf86cea13ce9ce738b9eb7b",
|
".modelhub_state/submission_exclusions.jsonl": "dca7091e8b1da8bf9b3ecb95fe573b2a41666601edf86cea13ce9ce738b9eb7b",
|
||||||
".modelhub_state/worker_crashes.jsonl": "b321ea3648ae6b322601ed30ef8c3b1da0f13612af1bde3a64b0d41dc18a7b9f",
|
".modelhub_state/worker_crashes.jsonl": "b321ea3648ae6b322601ed30ef8c3b1da0f13612af1bde3a64b0d41dc18a7b9f",
|
||||||
"ledger/submissions.jsonl": "7b3ec696e3d8527e36b8d59aaddda9f698e1b28cd97a98e92207515122f4f9a3",
|
"ledger/submissions.jsonl": "7b3ec696e3d8527e36b8d59aaddda9f698e1b28cd97a98e92207515122f4f9a3",
|
||||||
"outcomes/submissions.jsonl": "5637e87cd5628d8b3fc32102455e8386f2def673a8b4d7b86cb775f9be6da417"
|
"outcomes/submissions.jsonl": "6c2d87a2fec127fe7adbc51b7e4d902ffb2bddd209207cf87bb94369d33dea11"
|
||||||
},
|
},
|
||||||
"generation": 22002,
|
"generation": 22003,
|
||||||
"phase": "cycle",
|
"phase": "cycle",
|
||||||
"schemaVersion": 1,
|
"schemaVersion": 1,
|
||||||
"updatedAt": "2026-10-07T23:35:55.678472+00:00",
|
"updatedAt": "2026-10-07T23:42:18.458717+00:00",
|
||||||
"writerId": "33ed03361c5848e88b8ce6204fb4f7d2"
|
"writerId": "33ed03361c5848e88b8ce6204fb4f7d2"
|
||||||
}
|
}
|
||||||
|
|||||||
@@ -225,7 +225,6 @@
|
|||||||
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T03:37:52.600714+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:37:12.388268+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006357", "taskType": "text-generation", "verifyResult": null}
|
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T03:37:52.600714+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:37:12.388268+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006357", "taskType": "text-generation", "verifyResult": null}
|
||||||
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T03:37:52.600703+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:37:12.384898+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006356", "taskType": "text-generation", "verifyResult": null}
|
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T03:37:52.600703+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:37:12.384898+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006356", "taskType": "text-generation", "verifyResult": null}
|
||||||
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T03:37:52.600649+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2037838088, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2041445091}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:37:12.449585+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006359", "taskType": "text-generation", "verifyResult": null}
|
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T03:37:52.600649+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2037838088, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2041445091}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:37:12.449585+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006359", "taskType": "text-generation", "verifyResult": null}
|
||||||
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-22T03:53:42.966053+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:52:49.751148+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006518", "taskType": "text-generation", "verifyResult": null}
|
|
||||||
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-22T03:53:42.966083+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:52:49.710413+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006510", "taskType": "text-generation", "verifyResult": null}
|
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-22T03:53:42.966083+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:52:49.710413+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006510", "taskType": "text-generation", "verifyResult": null}
|
||||||
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-22T03:53:42.966096+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2018871528, "estimatedRequiredGiB": 2.26, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2022478516}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:52:49.747539+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006511", "taskType": "text-generation", "verifyResult": null}
|
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-22T03:53:42.966096+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2018871528, "estimatedRequiredGiB": 2.26, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2022478516}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:52:49.747539+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006511", "taskType": "text-generation", "verifyResult": null}
|
||||||
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T03:53:42.966069+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19329296879}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:52:49.754157+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5006513", "taskType": "text-generation", "verifyResult": null}
|
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T03:53:42.966069+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19329296879}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:52:49.754157+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5006513", "taskType": "text-generation", "verifyResult": null}
|
||||||
|
|||||||
Reference in New Issue
Block a user