state: generation 19613 (cycle)
This commit is contained in:
@@ -3322,7 +3322,7 @@
|
||||
"taskType": "text-generation"
|
||||
}
|
||||
},
|
||||
"generatedAt": "2026-10-02T10:30:45.456029+00:00",
|
||||
"generatedAt": "2026-10-02T10:43:41.229378+00:00",
|
||||
"summary": {
|
||||
"activeBlockCount": 167,
|
||||
"byGpuFramework": {
|
||||
|
||||
@@ -434,7 +434,7 @@
|
||||
}
|
||||
},
|
||||
"frameworkUpdatedAt": null,
|
||||
"generatedAt": "2026-10-02T10:40:13.868806+00:00",
|
||||
"generatedAt": "2026-10-02T10:46:13.752738+00:00",
|
||||
"gpuStats": {
|
||||
"Ascend_910-b3": {
|
||||
"available": true,
|
||||
|
||||
@@ -1,5 +1,5 @@
|
||||
{
|
||||
"catalogUpdatedAt": "2026-10-02T10:40:13.868806+00:00",
|
||||
"catalogUpdatedAt": "2026-10-02T10:46:13.752738+00:00",
|
||||
"configuredTaskTypes": [
|
||||
"text-generation"
|
||||
],
|
||||
@@ -56,7 +56,7 @@
|
||||
"time-series-forecasting"
|
||||
],
|
||||
"errors": [],
|
||||
"generatedAt": "2026-10-02T10:40:13.868806+00:00",
|
||||
"generatedAt": "2026-10-02T10:46:13.752738+00:00",
|
||||
"gpuCatalog": {
|
||||
"Ascend_910-b3": {
|
||||
"canVerify": true,
|
||||
@@ -6603,6 +6603,6 @@
|
||||
"updateTime": "2025-12-22 08:59:53"
|
||||
}
|
||||
],
|
||||
"taskTreeUpdatedAt": "2026-10-02T10:40:13.868806+00:00",
|
||||
"taskTreeUpdatedAt": "2026-10-02T10:46:13.752738+00:00",
|
||||
"version": 1
|
||||
}
|
||||
|
||||
@@ -1,6 +1,6 @@
|
||||
{
|
||||
"generatedAt": "2026-10-02T09:19:26.361889+00:00",
|
||||
"lastSyncTime": "2026-10-02T09:19:26.046616+00:00",
|
||||
"generatedAt": "2026-10-02T10:43:41.156399+00:00",
|
||||
"lastSyncTime": "2026-10-02T10:43:40.858838+00:00",
|
||||
"recentLimit": 300,
|
||||
"report": {
|
||||
"architectureCompatibilityBlocks": {
|
||||
@@ -3476,24 +3476,24 @@
|
||||
"decisionSuccessRate": 0.1358,
|
||||
"decisionTotal": 81,
|
||||
"failureBreakdown": {
|
||||
"ambiguous_runtime": 66,
|
||||
"ambiguous_runtime": 67,
|
||||
"framework_architecture_unsupported": 65,
|
||||
"memory_capacity": 1,
|
||||
"repository_structure": 1,
|
||||
"tokenizer_compatibility": 3
|
||||
},
|
||||
"failureCount": 136,
|
||||
"failureRate": 0.9252,
|
||||
"failureCount": 137,
|
||||
"failureRate": 0.9257,
|
||||
"framework": "vllm",
|
||||
"pendingCount": 0,
|
||||
"pendingRate": 0.0,
|
||||
"platformFailureCount": 0,
|
||||
"successCount": 11,
|
||||
"successRate": 0.0748,
|
||||
"successRate": 0.0743,
|
||||
"targetGpu": "Ascend_910-b3",
|
||||
"taskType": "text-generation",
|
||||
"total": 147,
|
||||
"unresolvedFailureCount": 66
|
||||
"total": 148,
|
||||
"unresolvedFailureCount": 67
|
||||
},
|
||||
"Ascend_910-b3|vllm|visual-multi-modal": {
|
||||
"attributableFailureCount": 1,
|
||||
@@ -6026,7 +6026,7 @@
|
||||
"decisionSuccessRate": 0.0275,
|
||||
"decisionTotal": 3744,
|
||||
"failureBreakdown": {
|
||||
"ambiguous_runtime": 1595,
|
||||
"ambiguous_runtime": 1596,
|
||||
"architecture_compatibility": 112,
|
||||
"attention_backend": 3,
|
||||
"backend_operator": 93,
|
||||
@@ -6040,15 +6040,15 @@
|
||||
"tokenizer_compatibility": 420,
|
||||
"参数/模板问题": 50
|
||||
},
|
||||
"failureCount": 6162,
|
||||
"failureCount": 6163,
|
||||
"failureRate": 0.9836,
|
||||
"pendingCount": 0,
|
||||
"pendingRate": 0.0,
|
||||
"platformFailureCount": 876,
|
||||
"successCount": 103,
|
||||
"successRate": 0.0164,
|
||||
"total": 6265,
|
||||
"unresolvedFailureCount": 1645
|
||||
"total": 6266,
|
||||
"unresolvedFailureCount": 1646
|
||||
},
|
||||
"vllm-customized": {
|
||||
"attributableFailureCount": 15,
|
||||
@@ -6198,7 +6198,7 @@
|
||||
"unresolvedFailureCount": 227
|
||||
}
|
||||
},
|
||||
"generatedAt": "2026-10-02T09:19:26.347890+00:00",
|
||||
"generatedAt": "2026-10-02T10:43:41.144279+00:00",
|
||||
"gpuSummaries": {
|
||||
"Ascend_910-b3": {
|
||||
"attributableFailureCount": 115,
|
||||
@@ -6206,7 +6206,7 @@
|
||||
"decisionSuccessRate": 0.1606,
|
||||
"decisionTotal": 137,
|
||||
"failureBreakdown": {
|
||||
"ambiguous_runtime": 154,
|
||||
"ambiguous_runtime": 155,
|
||||
"context_length": 9,
|
||||
"framework_architecture_unsupported": 100,
|
||||
"memory_capacity": 2,
|
||||
@@ -6217,15 +6217,15 @@
|
||||
"日志缺失": 3,
|
||||
"验证失败": 27
|
||||
},
|
||||
"failureCount": 339,
|
||||
"failureRate": 0.9391,
|
||||
"failureCount": 340,
|
||||
"failureRate": 0.9392,
|
||||
"pendingCount": 0,
|
||||
"pendingRate": 0.0,
|
||||
"platformFailureCount": 1,
|
||||
"successCount": 22,
|
||||
"successRate": 0.0609,
|
||||
"total": 361,
|
||||
"unresolvedFailureCount": 223
|
||||
"successRate": 0.0608,
|
||||
"total": 362,
|
||||
"unresolvedFailureCount": 224
|
||||
},
|
||||
"Ascend_910-b4": {
|
||||
"attributableFailureCount": 328,
|
||||
@@ -7772,9 +7772,9 @@
|
||||
"decisionSuccessRate": 0.0,
|
||||
"decisionTotal": 0,
|
||||
"failureBreakdown": {
|
||||
"ambiguous_runtime": 1
|
||||
"ambiguous_runtime": 2
|
||||
},
|
||||
"failureCount": 1,
|
||||
"failureCount": 2,
|
||||
"failureRate": 1.0,
|
||||
"framework": "vllm",
|
||||
"modelType": "llama",
|
||||
@@ -7786,8 +7786,8 @@
|
||||
"successRate": 0.0,
|
||||
"targetGpu": "Ascend_910-b3",
|
||||
"taskType": "text-generation",
|
||||
"total": 1,
|
||||
"unresolvedFailureCount": 1
|
||||
"total": 2,
|
||||
"unresolvedFailureCount": 2
|
||||
},
|
||||
"Ascend_910-b3|vllm|text-generation|llama|none": {
|
||||
"attributableFailureCount": 1,
|
||||
@@ -24244,9 +24244,9 @@
|
||||
"decisionSuccessRate": 0.0,
|
||||
"decisionTotal": 0,
|
||||
"failureBreakdown": {
|
||||
"参数/模板问题": 6
|
||||
"参数/模板问题": 5
|
||||
},
|
||||
"failureCount": 6,
|
||||
"failureCount": 5,
|
||||
"failureRate": 1.0,
|
||||
"framework": "unknown",
|
||||
"lastPlatformFailureAt": null,
|
||||
@@ -24258,8 +24258,8 @@
|
||||
"successRate": 0.0,
|
||||
"targetGpu": "Ascend_910-b3",
|
||||
"taskType": "text-generation",
|
||||
"total": 6,
|
||||
"unresolvedFailureCount": 6
|
||||
"total": 5,
|
||||
"unresolvedFailureCount": 5
|
||||
},
|
||||
"Ascend_910-b3|vllm_tokenizer_patch|text-generation": {
|
||||
"attributableFailureCount": 5,
|
||||
@@ -24296,10 +24296,10 @@
|
||||
"decisionSuccessRate": 0.0,
|
||||
"decisionTotal": 2,
|
||||
"failureBreakdown": {
|
||||
"ambiguous_runtime": 4,
|
||||
"ambiguous_runtime": 5,
|
||||
"framework_architecture_unsupported": 2
|
||||
},
|
||||
"failureCount": 6,
|
||||
"failureCount": 7,
|
||||
"failureRate": 1.0,
|
||||
"framework": "vllm",
|
||||
"lastPlatformFailureAt": null,
|
||||
@@ -24311,8 +24311,8 @@
|
||||
"successRate": 0.0,
|
||||
"targetGpu": "Ascend_910-b3",
|
||||
"taskType": "text-generation",
|
||||
"total": 6,
|
||||
"unresolvedFailureCount": 4
|
||||
"total": 7,
|
||||
"unresolvedFailureCount": 5
|
||||
},
|
||||
"Ascend_910-b4|unknown|text-generation": {
|
||||
"attributableFailureCount": 0,
|
||||
@@ -25302,9 +25302,9 @@
|
||||
"decisionSuccessRate": 0.0,
|
||||
"decisionTotal": 0,
|
||||
"failureBreakdown": {
|
||||
"ambiguous_runtime": 1
|
||||
"ambiguous_runtime": 2
|
||||
},
|
||||
"failureCount": 1,
|
||||
"failureCount": 2,
|
||||
"failureRate": 1.0,
|
||||
"framework": "vllm",
|
||||
"lastTerminalAt": "2026-09-22T08:01:56.366395+00:00",
|
||||
@@ -25317,8 +25317,8 @@
|
||||
"successRate": 0.0,
|
||||
"targetGpu": "Ascend_910-b3",
|
||||
"taskType": "text-generation",
|
||||
"total": 1,
|
||||
"unresolvedFailureCount": 1
|
||||
"total": 2,
|
||||
"unresolvedFailureCount": 2
|
||||
},
|
||||
"Ascend_910-b4|vllm_tokenizer_patch|text-generation|gpt_oss|none": {
|
||||
"attributableFailureCount": 0,
|
||||
@@ -30213,6 +30213,30 @@
|
||||
"total": 1,
|
||||
"unresolvedFailureCount": 1
|
||||
},
|
||||
"Ascend_910-b3|vllm|text-generation|llama|compressed-tensors|30": {
|
||||
"attributableFailureCount": 0,
|
||||
"decisionFailureRate": 0.0,
|
||||
"decisionSuccessRate": 0.0,
|
||||
"decisionTotal": 0,
|
||||
"failureBreakdown": {
|
||||
"ambiguous_runtime": 1
|
||||
},
|
||||
"failureCount": 1,
|
||||
"failureRate": 1.0,
|
||||
"framework": "vllm",
|
||||
"loadSizeLog2Bucket": 30,
|
||||
"modelType": "llama",
|
||||
"pendingCount": 0,
|
||||
"pendingRate": 0.0,
|
||||
"platformFailureCount": 0,
|
||||
"quantizationMethod": "compressed-tensors",
|
||||
"successCount": 0,
|
||||
"successRate": 0.0,
|
||||
"targetGpu": "Ascend_910-b3",
|
||||
"taskType": "text-generation",
|
||||
"total": 1,
|
||||
"unresolvedFailureCount": 1
|
||||
},
|
||||
"Ascend_910-b3|vllm|text-generation|llama|none|30": {
|
||||
"attributableFailureCount": 1,
|
||||
"decisionFailureRate": 1.0,
|
||||
@@ -55258,15 +55282,15 @@
|
||||
"unresolvedFailureCount": 0
|
||||
}
|
||||
},
|
||||
"terminalRecords": 17238,
|
||||
"totalRecords": 17459,
|
||||
"terminalRecords": 17239,
|
||||
"totalRecords": 17460,
|
||||
"totals": {
|
||||
"attributableFailureCount": 6181,
|
||||
"decisionFailureRate": 0.8636,
|
||||
"decisionSuccessRate": 0.1364,
|
||||
"decisionTotal": 7157,
|
||||
"failureBreakdown": {
|
||||
"ambiguous_runtime": 4511,
|
||||
"ambiguous_runtime": 4512,
|
||||
"architecture_compatibility": 212,
|
||||
"attention_backend": 3,
|
||||
"backend_operator": 128,
|
||||
@@ -55282,74 +55306,74 @@
|
||||
"日志缺失": 719,
|
||||
"验证失败": 676
|
||||
},
|
||||
"failureCount": 16262,
|
||||
"failureCount": 16263,
|
||||
"failureRate": 0.9434,
|
||||
"pendingCount": 0,
|
||||
"pendingRate": 0.0,
|
||||
"platformFailureCount": 947,
|
||||
"successCount": 976,
|
||||
"successRate": 0.0566,
|
||||
"total": 17238,
|
||||
"unresolvedFailureCount": 9134
|
||||
"total": 17239,
|
||||
"unresolvedFailureCount": 9135
|
||||
},
|
||||
"warnings": [
|
||||
"GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Biren_166m 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU MetaX_c-500 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Iluvatar_bi-100 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Kunlunxin_p-800 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Iluvatar_bi-150 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"组合 Ascend_910-b4|llamacpp|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Kunlunxin_p-800|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_mrv-100|unknown|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x4|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 hygon_k100-ai|vllm-patch-tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Sunrise_pt-200-x1|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Ascend_910-b3|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Ascend_910-b3|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Mthreads_s4000|llamacpp|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Mthreads_s4000|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|vllm_0_17_0_corex_4_4_0|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Biren_166m|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_mrv-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Ascend_910-b4|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|llamacpp|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 MetaX_c-500|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x4|vllm-customized|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x4|vllm-mlu|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x4|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Kunlunxin_p-800 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Iluvatar_bi-100 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU MetaX_c-500 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"GPU Iluvatar_bi-150 本地统计失败率偏高(≥50%),建议重点关注。",
|
||||
"组合 Vastai_va16|vllm_fix_tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x8|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Sunrise_pt-200-x1|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_mrv-100|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Kunlunxin_p-800|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x8|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x8|vllm-customized|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|vllm_fix_tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Ascend_910-b4|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x4|unknown|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|transformers|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Biren_166m|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 MetaX_c-500|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 hygon_k100-ai|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Kunlunxin_p-800|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Ascend_910-b4|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Sunrise_pt-200-x1|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Ascend_910-b4|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Kunlunxin_p-800|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x4|vllm-customized|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x8|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 MetaX_c-500|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|vllm_0_17_0_corex_4_4_0|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 hygon_k100-ai|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x8|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Biren_166m|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Ascend_910-b3|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|vllm_fix_tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_mrv-100|unknown|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|llamacpp|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Vastai_va16|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 hygon_k100-ai|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。"
|
||||
"组合 Cambricon_mlu-370-x4|unknown|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Mthreads_s4000|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Ascend_910-b4|llamacpp|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x4|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x4|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_bi-150|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x4|vllm-mlu|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_mrv-100|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 MetaX_c-500|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Cambricon_mlu-370-x8|vllm-customized|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Sunrise_pt-200-x1|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Iluvatar_mrv-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 hygon_k100-ai|vllm-patch-tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 hygon_k100-ai|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Mthreads_s4000|llamacpp|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Ascend_910-b3|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
|
||||
"组合 Biren_166m|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。"
|
||||
]
|
||||
},
|
||||
"storageMode": "decision_state_only",
|
||||
"summarizedRecords": 17459,
|
||||
"summarizedRecords": 17460,
|
||||
"version": 1
|
||||
}
|
||||
|
||||
@@ -226,6 +226,7 @@
|
||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-22T21:50:30.559334+00:00", "modelId": "solidrust/Llama-3-16B-Instruct-v0.1-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 10261168632, "estimatedRequiredGiB": 11.478, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 10270608122, "modelscopeLicense": "other", "modelscopeParams": 16754741248, "modelscopeTags": ["license:other", "model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible - mergekit - merge - facebook - meta - pytorch - llama - llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 10270608122}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:33:26.659264+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4998167", "taskType": "text-generation", "verifyResult": -1}
|
||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-23T10:48:31.671315+00:00", "modelId": "nm-testing/tinyllama-oneshot-w8a8-dynamic-token-v2", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "d8df464812ff2fd3c46dc89b0fc6a96370e694fab8e52179f1ada2cdd0ea92b9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1231252716, "estimatedRequiredGiB": 1.378, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 1233101396, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-21T08:44:09.587569+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 1233101396}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:19:32.876555+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4997864", "taskType": "text-generation", "verifyResult": -1}
|
||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-mlu", "lastSyncTime": "2026-09-27T13:43:22.766786+00:00", "modelId": "RedHatAI/Mistral-Nemo-Instruct-2407-quantized.w8a16", "modelProfile": {"architectures": ["MistralForCausalLM"], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 13594088584, "estimatedRequiredGiB": 15.203, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mistral", "modelscopeFileSize": 13603621925, "modelscopeLicense": "apache-2.0", "modelscopeParams": 12247782400, "modelscopeTags": ["license:apache-2.0", "model_type:mistral", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 13603621925}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:19:32.873304+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4997863", "taskType": "text-generation", "verifyResult": -1}
|
||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "driver_error", "failureCode": "DRIVER_ERROR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-10-02T10:43:40.858838+00:00", "modelId": "nm-testing/tinyllama-oneshot-w8a8-static-v2", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "c25be7d7c1bf173abe564916f8a370d9b648beb3aea2a79522523aaa6b69ee29", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1231270112, "estimatedRequiredGiB": 1.378, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 1233118759, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 1233118759}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:19:32.868721+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4997865", "taskType": "text-generation", "verifyResult": -1}
|
||||
{"failReason": "platform_infrastructure", "failureAction": "open_short_gpu_framework_circuit_and_retry_other_models", "failureCategory": "platform_infrastructure", "failureClassificationReason": "platform_io_transient", "failureCode": "STORAGE_ERROR", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-23T12:29:42.455438+00:00", "modelId": "RedHatAI/Qwen2-1.5B-Instruct-quantized.w8a8", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2245331488, "estimatedRequiredGiB": 2.522, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 2256941144, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1777088000, "modelscopeTags": ["license:apache-2.0", "model_type:qwen2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2256941144}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:13:58.610056+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4997803", "taskType": "text-generation", "verifyResult": -1}
|
||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "driver_error", "failureCode": "DRIVER_ERROR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-24T10:43:18.860153+00:00", "modelId": "nm-testing/Meta-Llama-3.1-8B-Instruct-FP8-hf", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9081287016, "estimatedRequiredGiB": 10.159, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9090504988, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9090504988}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:13:51.958882+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4997802", "taskType": "text-generation", "verifyResult": -1}
|
||||
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "driver_error", "failureCode": "DRIVER_ERROR", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-22T01:48:12.547533+00:00", "modelId": "XHToken/Spark-X2.5-1.7B", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 3415340496, "estimatedRequiredGiB": 3.834, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 3430847031, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1707657216, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 3430847031}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T09:10:32.259004+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4997718", "taskType": "text-generation", "verifyResult": -1}
|
||||
@@ -297,4 +298,3 @@
|
||||
{"failReason": "参数/模板问题", "framework": "", "lastSyncTime": "2026-09-21T04:36:00.569325+00:00", "modelId": "apodex/Apodex-1.1-mini-GPTQ-Int4", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T04:16:35+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4969061", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": "参数/模板问题", "framework": "", "lastSyncTime": "2026-09-21T04:36:00.569017+00:00", "modelId": "primitive-ai/Nex-N2.5-mini-FP8", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T04:16:34+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4753715", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": "参数/模板问题", "framework": "", "lastSyncTime": "2026-09-21T04:36:00.569262+00:00", "modelId": "barozp/Qwen3.8-Whittle-MoE-27B-MLX-4bit", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T04:16:34+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4938618", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": "参数/模板问题", "framework": "", "lastSyncTime": "2026-09-21T04:36:00.569272+00:00", "modelId": "Edge0/Edge0-35B-A3B-preview", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T04:16:34+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4845402", "taskType": "text-generation", "verifyResult": null}
|
||||
|
||||
File diff suppressed because it is too large
Load Diff
File diff suppressed because it is too large
Load Diff
@@ -2,24 +2,24 @@
|
||||
"agentVersion": "2026.09.22.1",
|
||||
"checksums": {
|
||||
".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1",
|
||||
".modelhub_state/architecture_compatibility_blacklist.json": "b56fd8e4140b36a90bd5c5a13d7d62c694c87e158977833ad65664f6a40429d6",
|
||||
".modelhub_state/architecture_compatibility_blacklist.json": "3e3377fd79c9c2883eda179a59a50fc9f707e69253dcefc6ee3a1cdc24948461",
|
||||
".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab",
|
||||
".modelhub_state/market_intelligence.json": "f25dbde46fd5360040a4d387a4fb64d2383231f9fc83b3f34a83334ad654a567",
|
||||
".modelhub_state/official_capabilities.json": "2d09f9b85f50fb267542bf027be8d466a5c2e71d0081a1c0482f6c520f6eadb9",
|
||||
".modelhub_state/outcome_checkpoint.json": "fad4ee1294d4254760a83d515401ea1e1810ce6d6a37e498a4ec55c28c648c92",
|
||||
".modelhub_state/market_intelligence.json": "b346336e754fd3c5bea874d84d77023459711f27edcc1d958794630fda4c434e",
|
||||
".modelhub_state/official_capabilities.json": "31344d4734c7046dbeec181143a1b81e6db52e222c24a72f99ccda483c2b3200",
|
||||
".modelhub_state/outcome_checkpoint.json": "e12c3e724dbea54a2f1979cd69f467bed573522ebf60c5b020e64e78e684ad88",
|
||||
".modelhub_state/queue_cleanup_latest.json": "8aee31004f558d632da6a153b43d4dad7d369528a86bdebd0e34bbe90da0a185",
|
||||
".modelhub_state/recent_outcomes.jsonl": "46ba903864c20bcb8c740303ed82aef3581120fbc65f1e55b14f49e961116871",
|
||||
".modelhub_state/recovery_active_tasks.jsonl": "c82e23bda873e227ce3fedc9086c10c68f78f189c2b918b7e4dc8d9d547e0f81",
|
||||
".modelhub_state/recovery_intents.jsonl": "e6f1c3c44bcb7b3dd8cff705445db2393c81f6c6fbb4f1fe29aaa4a957d37f24",
|
||||
".modelhub_state/recent_outcomes.jsonl": "c5ecabe8cf06ef03b0509cf954d67fc0d28f74bef6b3a43eafcd6f3b953aeea7",
|
||||
".modelhub_state/recovery_active_tasks.jsonl": "1d7721fd2e24168e90f135bc67db44d6d0465c131cf146774c35bbe972c32a85",
|
||||
".modelhub_state/recovery_intents.jsonl": "5a328aa2223c40b51b5de8aeb5fabf3678fcdf4cd05e34a0ab4102e737a92354",
|
||||
".modelhub_state/routing_intelligence.json": "05e69235b2ce10b8959596dd3b7d9364981f5f59c1dc5c2d15082e2aa26b6b67",
|
||||
".modelhub_state/submission_exclusions.jsonl": "1e62f6ba5bd2ba5f2f360bc134b44f7b69190230dd0e274919a87a73ea66761c",
|
||||
".modelhub_state/worker_crashes.jsonl": "50ffe2fb7a8d9d9967ff97b47af26f97753a0bbeae8a68113a221474751d9c2d",
|
||||
"ledger/submissions.jsonl": "b720736b9e9ad8b81a058102e9e4bb562a27b7a61cc8d038f27bf5fde2123e96",
|
||||
"outcomes/submissions.jsonl": "1dcfda2a6358a66304bfaa4e6d34d791d3c929792bd13b249ff3c913fb1a3896"
|
||||
"outcomes/submissions.jsonl": "cf188a78c7e24cd844d5bb29769cf26906e649439df17a9978dfe018e0389b58"
|
||||
},
|
||||
"generation": 19612,
|
||||
"generation": 19613,
|
||||
"phase": "cycle",
|
||||
"schemaVersion": 1,
|
||||
"updatedAt": "2026-10-02T10:42:37.202651+00:00",
|
||||
"updatedAt": "2026-10-02T10:46:23.803845+00:00",
|
||||
"writerId": "c0c4908e2c04449cb9bfab68b1eacb61"
|
||||
}
|
||||
|
||||
@@ -308,7 +308,6 @@
|
||||
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-21T16:50:30.559312+00:00", "modelId": "blue2star/Qwen-Image-2.1-PE-I2I-ComfyUI", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 29306922460, "estimatedRequiredGiB": 32.775, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 29326959151, "modelscopeLicense": "other", "modelscopeParams": 18821595084, "modelscopeTags": ["license:other", "model_type:qwen3_5", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:qwen", "custom_tag:prompt-rewriting", "custom_tag:image-editing"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 29326959151}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T08:43:01.432709+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4997305", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-21T17:22:47.256894+00:00", "modelId": "blue2star/Qwen-Image-2.1-PE-I2I-ComfyUI", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 29306922460, "estimatedRequiredGiB": 32.775, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 29326959151, "modelscopeLicense": "other", "modelscopeParams": 18821595084, "modelscopeTags": ["license:other", "model_type:qwen3_5", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:qwen", "custom_tag:prompt-rewriting", "custom_tag:image-editing"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 29326959151}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T08:59:28.154388+00:00", "targetGpu": "Biren_166m", "taskId": "4997528", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-21T17:22:47.256807+00:00", "modelId": "nm-testing/tinyllama-oneshot-w8w8-test-static-shape-change", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "4d80215b8854e486ecf078eda8f5db649838852684b9429ab6d7b0d91bb411cf", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1231270112, "estimatedRequiredGiB": 1.378, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 1233120748, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 1233120748}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T09:07:46.198212+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4997684", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T17:22:47.256927+00:00", "modelId": "nm-testing/tinyllama-oneshot-w8a8-static-v2", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "c25be7d7c1bf173abe564916f8a370d9b648beb3aea2a79522523aaa6b69ee29", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1231270112, "estimatedRequiredGiB": 1.378, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 1233118759, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 1233118759}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T09:19:32.868721+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4997865", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T18:39:29.750789+00:00", "modelId": "blue2star/Qwen-Image-2.1-PE-I2I-ComfyUI", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 29306922460, "estimatedRequiredGiB": 32.775, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 29326959151, "modelscopeLicense": "other", "modelscopeParams": 18821595084, "modelscopeTags": ["license:other", "model_type:qwen3_5", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:qwen", "custom_tag:prompt-rewriting", "custom_tag:image-editing"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 29326959151}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T10:34:34.644445+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4999238", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-21T19:05:56.948982+00:00", "modelId": "LiquidAI/LFM2.5-1.2B-Thinking-MLX-bf16", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2340697867, "estimatedRequiredGiB": 2.621, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 2345554722, "modelscopeLicense": "other", "modelscopeParams": 1170340608, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx", "custom_tag:reasoning"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2345554722}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T10:52:01.384099+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4999444", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-21T19:05:56.949059+00:00", "modelId": "RedHatAI/gemma-2-27b-it-quantized.w8a16", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 30775446656, "estimatedRequiredGiB": 34.419, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 30797371689, "modelscopeLicense": "gemma", "modelscopeParams": 28406776320, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 30797371689}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T10:52:10.635641+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4999447", "taskType": "text-generation", "verifyResult": null}
|
||||
|
||||
Reference in New Issue
Block a user