state: generation 16611 (cycle)

This commit is contained in:
2026-09-26 14:38:47 +00:00
parent cfa07cb094
commit f1827b819c
10 changed files with 1713 additions and 1692 deletions

View File

@@ -3261,7 +3261,7 @@
"taskType": "text-generation"
}
},
"generatedAt": "2026-09-26T14:31:43.258657+00:00",
"generatedAt": "2026-09-26T14:37:53.964437+00:00",
"summary": {
"activeBlockCount": 164,
"byGpuFramework": {

View File

@@ -396,7 +396,7 @@
}
},
"frameworkUpdatedAt": null,
"generatedAt": "2026-09-26T14:36:50.376113+00:00",
"generatedAt": "2026-09-26T14:38:43.255915+00:00",
"gpuStats": {
"Ascend_910-b4": {
"available": true,

View File

@@ -1,5 +1,5 @@
{
"catalogUpdatedAt": "2026-09-26T14:36:50.376113+00:00",
"catalogUpdatedAt": "2026-09-26T14:38:43.255915+00:00",
"configuredTaskTypes": [
"text-generation"
],
@@ -56,7 +56,7 @@
"time-series-forecasting"
],
"errors": [],
"generatedAt": "2026-09-26T14:36:50.376113+00:00",
"generatedAt": "2026-09-26T14:38:43.255915+00:00",
"gpuCatalog": {
"Ascend_910-b3": {
"canVerify": true,
@@ -6446,6 +6446,6 @@
"updateTime": "2025-12-22 08:59:53"
}
],
"taskTreeUpdatedAt": "2026-09-26T14:36:50.376113+00:00",
"taskTreeUpdatedAt": "2026-09-26T14:38:43.255915+00:00",
"version": 1
}

View File

@@ -1,6 +1,6 @@
{
"generatedAt": "2026-09-26T13:43:51.440640+00:00",
"lastSyncTime": "2026-09-26T13:43:51.353267+00:00",
"generatedAt": "2026-09-26T14:37:53.885916+00:00",
"lastSyncTime": "2026-09-26T14:37:53.556324+00:00",
"recentLimit": 300,
"report": {
"architectureCompatibilityBlocks": {
@@ -3870,12 +3870,12 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 24,
"failureBreakdown": {
"ambiguous_runtime": 31,
"ambiguous_runtime": 32,
"framework_architecture_unsupported": 23,
"memory_capacity": 1,
"参数/模板问题": 1
},
"failureCount": 56,
"failureCount": 57,
"failureRate": 1.0,
"framework": "vllm",
"pendingCount": 0,
@@ -3885,8 +3885,8 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x4",
"taskType": "text-generation",
"total": 56,
"unresolvedFailureCount": 32
"total": 57,
"unresolvedFailureCount": 33
},
"Cambricon_mlu-370-x8|unknown|feature_emb": {
"attributableFailureCount": 0,
@@ -5961,7 +5961,7 @@
"decisionSuccessRate": 0.0261,
"decisionTotal": 3717,
"failureBreakdown": {
"ambiguous_runtime": 1571,
"ambiguous_runtime": 1572,
"architecture_compatibility": 112,
"attention_backend": 3,
"backend_operator": 92,
@@ -5975,15 +5975,15 @@
"tokenizer_compatibility": 415,
"参数/模板问题": 50
},
"failureCount": 6110,
"failureCount": 6111,
"failureRate": 0.9844,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 869,
"successCount": 97,
"successRate": 0.0156,
"total": 6207,
"unresolvedFailureCount": 1621
"total": 6208,
"unresolvedFailureCount": 1622
},
"vllm-customized": {
"attributableFailureCount": 13,
@@ -6133,7 +6133,7 @@
"unresolvedFailureCount": 196
}
},
"generatedAt": "2026-09-26T13:43:51.421846+00:00",
"generatedAt": "2026-09-26T14:37:53.871506+00:00",
"gpuSummaries": {
"Ascend_910-b3": {
"attributableFailureCount": 102,
@@ -6225,7 +6225,7 @@
"decisionSuccessRate": 0.0894,
"decisionTotal": 817,
"failureBreakdown": {
"ambiguous_runtime": 485,
"ambiguous_runtime": 486,
"architecture_compatibility": 53,
"context_length": 48,
"framework_architecture_unsupported": 297,
@@ -6238,15 +6238,15 @@
"日志缺失": 13,
"验证失败": 42
},
"failureCount": 1586,
"failureCount": 1587,
"failureRate": 0.956,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 16,
"successCount": 73,
"successRate": 0.044,
"total": 1659,
"unresolvedFailureCount": 826
"total": 1660,
"unresolvedFailureCount": 827
},
"Cambricon_mlu-370-x8": {
"attributableFailureCount": 60,
@@ -11457,9 +11457,9 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
"ambiguous_runtime": 2
},
"failureCount": 1,
"failureCount": 2,
"failureRate": 1.0,
"framework": "vllm",
"modelType": "phi3",
@@ -11471,8 +11471,8 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x4",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
"total": 2,
"unresolvedFailureCount": 2
},
"Cambricon_mlu-370-x4|vllm|text-generation|qwen2|compressed-tensors": {
"attributableFailureCount": 0,
@@ -22652,9 +22652,9 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 11
"ambiguous_runtime": 10
},
"failureCount": 11,
"failureCount": 10,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"lastPlatformFailureAt": null,
@@ -22666,8 +22666,8 @@
"successRate": 0.0,
"targetGpu": "Biren_166m",
"taskType": "text-generation",
"total": 11,
"unresolvedFailureCount": 11
"total": 10,
"unresolvedFailureCount": 10
},
"Cambricon_mlu-370-x4|unknown|text-generation": {
"attributableFailureCount": 0,
@@ -22727,10 +22727,10 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"failureBreakdown": {
"ambiguous_runtime": 8,
"ambiguous_runtime": 9,
"framework_architecture_unsupported": 1
},
"failureCount": 9,
"failureCount": 10,
"failureRate": 1.0,
"framework": "vllm",
"lastPlatformFailureAt": null,
@@ -22742,8 +22742,8 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x4",
"taskType": "text-generation",
"total": 9,
"unresolvedFailureCount": 8
"total": 10,
"unresolvedFailureCount": 9
},
"Cambricon_mlu-370-x8|unknown|text-generation": {
"attributableFailureCount": 0,
@@ -23597,31 +23597,6 @@
"total": 1,
"unresolvedFailureCount": 1
},
"Biren_166m|vllm_fix_tokenizer|text-generation|qwen3_5|escha": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"lastTerminalAt": "2026-09-22T13:30:17.459483+00:00",
"modelType": "qwen3_5",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "escha",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Biren_166m",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
},
"Biren_166m|vllm_fix_tokenizer|text-generation|qwen3_5|none": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
@@ -23822,6 +23797,31 @@
"total": 3,
"unresolvedFailureCount": 3
},
"Cambricon_mlu-370-x4|vllm|text-generation|phi3|compressed-tensors": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm",
"lastTerminalAt": "2026-09-26T14:37:53.556324+00:00",
"modelType": "phi3",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x4",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
},
"Cambricon_mlu-370-x4|vllm|text-generation|starcoder2|compressed-tensors": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
@@ -34054,6 +34054,30 @@
"total": 1,
"unresolvedFailureCount": 0
},
"Cambricon_mlu-370-x4|vllm|text-generation|phi3|compressed-tensors|32": {
"attributableFailureCount": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm",
"loadSizeLog2Bucket": 32,
"modelType": "phi3",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x4",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
},
"Cambricon_mlu-370-x4|vllm|text-generation|phi3|compressed-tensors|33": {
"attributableFailureCount": 0,
"decisionFailureRate": 0.0,
@@ -50766,15 +50790,15 @@
"unresolvedFailureCount": 0
}
},
"terminalRecords": 17035,
"totalRecords": 17256,
"terminalRecords": 17036,
"totalRecords": 17257,
"totals": {
"attributableFailureCount": 6109,
"decisionFailureRate": 0.8636,
"decisionSuccessRate": 0.1364,
"decisionTotal": 7074,
"failureBreakdown": {
"ambiguous_runtime": 4404,
"ambiguous_runtime": 4405,
"architecture_compatibility": 212,
"attention_backend": 3,
"backend_operator": 127,
@@ -50790,30 +50814,30 @@
"日志缺失": 719,
"验证失败": 676
},
"failureCount": 16070,
"failureCount": 16071,
"failureRate": 0.9434,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 935,
"successCount": 965,
"successRate": 0.0566,
"total": 17035,
"unresolvedFailureCount": 9026
"total": 17036,
"unresolvedFailureCount": 9027
},
"warnings": [
"GPU Biren_166m 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_bi-100 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Kunlunxin_p-800 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。",
"组合 Iluvatar_bi-150|llamacpp|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Sunrise_pt-200-x1|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -50826,7 +50850,6 @@
"组合 Iluvatar_bi-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Ascend_910-b4|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x4|vllm-mlu|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 hygon_k100-ai|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Ascend_910-b4|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|vllm-customized|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -50852,10 +50875,11 @@
"组合 Cambricon_mlu-370-x4|unknown|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Ascend_910-b4|llamacpp|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 MetaX_c-500|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。"
]
},
"storageMode": "decision_state_only",
"summarizedRecords": 17256,
"summarizedRecords": 17257,
"version": 1
}

View File

@@ -293,8 +293,8 @@
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-23T14:22:36.780059+00:00", "modelId": "RedHatAI/Meta-Llama-3.1-8B-quantized.w8a8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "ef4c08c913d3f64cae22550f0c4a189795901d4b11e26d8e640e07e857659fb9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9084013360, "estimatedRequiredGiB": 10.162, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9093203965, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm", "custom_tag:quantized", "custom_tag:8-bit"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9093203965}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T02:09:49.393439+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4991868", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-26T01:14:46.157779+00:00", "modelId": "neuralmagic/gemma-2-2b-it-quantized.w8a8", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "ef4c08c913d3f64cae22550f0c4a189795901d4b11e26d8e640e07e857659fb9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4385522016, "estimatedRequiredGiB": 4.926, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 4407346497, "modelscopeLicense": "gemma", "modelscopeParams": 3204165888, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4407346497}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T02:09:48.974589+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4991863", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-25T09:35:33.057165+00:00", "modelId": "neuralmagic/starcoder2-7b-FP8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "ef4c08c913d3f64cae22550f0c4a189795901d4b11e26d8e640e07e857659fb9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7855165704, "estimatedRequiredGiB": 8.783, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 7858541078, "modelscopeLicense": "other", "modelscopeParams": 7400416256, "modelscopeTags": ["license:other", "model_type:starcoder2", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7858541078}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T02:09:37.383882+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4991862", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-26T14:37:53.556324+00:00", "modelId": "neuralmagic/Phi-3-medium-128k-instruct-quantized.w4a16", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "ef4c08c913d3f64cae22550f0c4a189795901d4b11e26d8e640e07e857659fb9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7686303632, "estimatedRequiredGiB": 8.592, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 7688299919, "modelscopeLicense": "llama2", "modelscopeParams": 13960238080, "modelscopeTags": ["license:llama2", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7688299919}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T02:09:36.977617+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4991858", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-26T01:14:46.157767+00:00", "modelId": "neuralmagic/SmolLM-1.7B-Instruct-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "f49713b9fe8e3e7683ab2722544c85a44993bcd72b9421c1599f634e68b3a2f7", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2014810120, "estimatedRequiredGiB": 2.256, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 2018195521, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1812039680, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2018195521}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T02:09:20.980304+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4991857", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "runtime_memory", "failureAction": "lower_memory_risk_or_reject_combination", "failureCategory": "runtime_memory", "failureClassificationReason": "structured_device_oom", "failureCode": "DEVICE_OOM", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu", "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-24T04:50:24.455191+00:00", "modelId": "neuralmagic/starcoder2-15b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 17785269848, "estimatedRequiredGiB": 19.88, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 17788663867, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 15957889024, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 17788663867}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T02:09:20.778237+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4991855", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "runtime_memory", "failureAction": "lower_memory_risk_or_reject_combination", "failureCategory": "runtime_memory", "failureClassificationReason": "structured_device_oom", "failureCode": "DEVICE_OOM", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu", "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-23T18:31:34.566350+00:00", "modelId": "neuralmagic/Llama-3.2-1B-Instruct-quantized.w8a8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2024670536, "estimatedRequiredGiB": 2.273, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 2033824885, "modelscopeLicense": "llama3.2", "modelscopeParams": 1498482688, "modelscopeTags": ["license:llama3.2", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:llama", "custom_tag:llama-3", "custom_tag:neuralmagic", "custom_tag:llmcompressor"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2033824885}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T02:09:20.683565+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4991854", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-21T21:08:12.157607+00:00", "modelId": "neuralmagic/starcoder2-15b-quantized.w8a8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 17785240496, "estimatedRequiredGiB": 19.88, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 17788612744, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 15957889024, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 17788612744}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T02:09:20.580117+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "4991853", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T13:30:17.459483+00:00", "modelId": "EschaLabs/Qwen3.8-27B-Escha-W2", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11002488632, "estimatedRequiredGiB": 12.322, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 10176447713, "modelscopeLicense": "apache-2.0", "modelscopeParams": 6340437856, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:pytorch", "library:safetensors", "task:text-generation", "custom_tag:qwen3", "custom_tag:2-bit", "custom_tag:quantization", "custom_tag:escha", "custom_tag:sglang", "custom_tag:code", "custom_tag:reasoning", "custom_tag:conversational"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "escha", "repositoryOnDiskBytes": 11025855102}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T02:09:08.626910+00:00", "targetGpu": "Biren_166m", "taskId": "4991849", "taskType": "text-generation", "verifyResult": -1}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -355,7 +355,6 @@
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/RedHatAI/Meta-Llama-3.1-70B-Instruct-quantized.w8a16", "modelId": "RedHatAI/Meta-Llama-3.1-70B-Instruct-quantized.w8a16", "submitTime": "2026-09-20T04:14:34.788367+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4970568", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-kunlunxin-p-800"}
{"framework": "vllm_tokenizer_patch", "modelAddress": "https://modelscope.cn/models/neuralmagic/starcoder2-7b-quantized.w8a16", "modelId": "neuralmagic/starcoder2-7b-quantized.w8a16", "submitTime": "2026-09-20T04:14:34.922099+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4970574", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-tokenizer-patch-ascend-910-b3"}
{"framework": "vllm_tokenizer_patch", "modelAddress": "https://modelscope.cn/models/RedHatAI/Qwen2-1.5B-Instruct-quantized.w8a8", "modelId": "RedHatAI/Qwen2-1.5B-Instruct-quantized.w8a8", "submitTime": "2026-09-20T04:14:34.856488+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4970570", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-tokenizer-patch-ascend-910-b3"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/neuralmagic/starcoder2-15b-FP8", "modelId": "neuralmagic/starcoder2-15b-FP8", "submitTime": "2026-09-20T04:14:41.835421+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4970584", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-cambricon-mlu-370-x4"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/RedHatAI/gemma-2-27b-it-quantized.w8a16", "modelId": "RedHatAI/gemma-2-27b-it-quantized.w8a16", "submitTime": "2026-09-20T04:14:42.093442+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4970600", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-mthreads-s4000"}
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/RedHatAI/gemma-4-12B-it-FP8-Dynamic", "modelId": "RedHatAI/gemma-4-12B-it-FP8-Dynamic", "submitTime": "2026-09-20T04:15:36.946953+00:00", "targetGpu": "Vastai_va16", "taskId": "4970616", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-vastai-va16"}
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/inceptionai/Jais-2-8B-Chat", "modelId": "inceptionai/Jais-2-8B-Chat", "submitTime": "2026-09-20T04:26:45.109939+00:00", "targetGpu": "Vastai_va16", "taskId": "4970729", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-vastai-va16"}

View File

@@ -2,24 +2,24 @@
"agentVersion": "2026.09.22.1",
"checksums": {
".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1",
".modelhub_state/architecture_compatibility_blacklist.json": "fe239a37926d16b1b1a66d9fabe6b62e8563a86708f6cc2c08357b9e1c2c97ba",
".modelhub_state/architecture_compatibility_blacklist.json": "d2c7b60b1a2625c56cc827d263cbbc9edfe2789361fb3465347263c997a4e31e",
".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab",
".modelhub_state/market_intelligence.json": "29b4f035fa706213d8e192c25ce3ab24cfd7cffa8f398a432003b499d8eaf882",
".modelhub_state/official_capabilities.json": "cdf68c2ef4e41ebba5f76a925f1005bb997dbb8a887d236c98e6a5b2a4e0a755",
".modelhub_state/outcome_checkpoint.json": "b96a151687cc02dfd27fea6473365e9099535830a907f3da2dab08b8bec9b719",
".modelhub_state/market_intelligence.json": "d1ac2a775d283c13910ab5860c8d212db16741ccd4f0c4fc4a2d9590010f9c65",
".modelhub_state/official_capabilities.json": "96a35561b0bdd50680851d4bd53548eb2e398679b60af1990ab57c37ba38115a",
".modelhub_state/outcome_checkpoint.json": "09681864ab9df2430b201b8ae01a7efd03988a2d28d87eaf9c83ac5c6ee0e699",
".modelhub_state/queue_cleanup_latest.json": "dec10eb574f7da548f3ba2d81064346ebac4cd728c834ece356077b765895663",
".modelhub_state/recent_outcomes.jsonl": "b65a8637809936e8d8672436bc65a6880a573622f141f051aadc1337d9a18235",
".modelhub_state/recovery_active_tasks.jsonl": "ab0ec1236546c9c7d7dc3355b576c08d496ffc6ab1e5b845347401629e7400c5",
".modelhub_state/recovery_intents.jsonl": "eb329d30349b389e9d57d4c6326cbebe86fae64a8976a218764f1063703bb2a2",
".modelhub_state/recent_outcomes.jsonl": "3154a7224e0e5049c727193e42b84d90ffd2cb33f6245c0559509865b726ba29",
".modelhub_state/recovery_active_tasks.jsonl": "d527b0fa3d31d224ab216d8d2cd476be233eb38e82a5d87605118bba1a828418",
".modelhub_state/recovery_intents.jsonl": "5cedf5e4e26472da6df331af9b4a79b1db39ae4141c68cdf0e24a39fdcd1a0d4",
".modelhub_state/routing_intelligence.json": "7f3d15e1c1e9113dfc2493e34f73d8e07c46d34f696bc0bae6472c4e34a9338c",
".modelhub_state/submission_exclusions.jsonl": "2cd0731cd4d31bc6d844f4f0a1e510e2fc839ca66f2ce07d2664110b33374799",
".modelhub_state/worker_crashes.jsonl": "ccd40ad86ab5068ea1c3520a48fa733cf2e4b357ae5abb95ff00728d5d1b5487",
"ledger/submissions.jsonl": "3471e4353345fe5d44b592a246ee9ea84fe99079631d0554e74e8dfa83d9de3c",
"outcomes/submissions.jsonl": "21efb79cdd73a515275424281d27b7abc69d15aeccf3c9b0149085a314b1a254"
"ledger/submissions.jsonl": "6627329e243e5c13e0a0f8e36209f00c6ec53dd7087caa57ce0c048f30ce87df",
"outcomes/submissions.jsonl": "1285ef51ea17ca7bd5e2ccdbbbebc7c864d497187c6e38338d2030389e2f6871"
},
"generation": 16610,
"generation": 16611,
"phase": "cycle",
"schemaVersion": 1,
"updatedAt": "2026-09-26T14:36:51.126452+00:00",
"updatedAt": "2026-09-26T14:38:47.604994+00:00",
"writerId": "08206cb1993a433e83f1d3e297db2d2e"
}

View File

@@ -450,7 +450,6 @@
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-21T10:09:08.998195+00:00", "modelId": "RedHatAI/gemma-2-27b-it-quantized.w8a16", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 30775446656, "estimatedRequiredGiB": 34.419, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 30797371689, "modelscopeLicense": "gemma", "modelscopeParams": 28406776320, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 30797371689}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T02:08:13.509125+00:00", "targetGpu": "Biren_166m", "taskId": "4991811", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-21T10:33:30.477748+00:00", "modelId": "inceptionai/Jais-2-8B-Chat", "modelProfile": {"architectures": ["Jais2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 16180861064, "estimatedRequiredGiB": 18.097, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "jais2", "modelscopeFileSize": 16193187697, "modelscopeLicense": "apache-2.0", "modelscopeParams": 8090401280, "modelscopeTags": ["license:apache-2.0", "model_type:jais2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 16193187697}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T02:09:08.713395+00:00", "targetGpu": "Biren_166m", "taskId": "4991852", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T10:33:30.477723+00:00", "modelId": "OpenBMB/BitCPM-CANN-8B", "modelProfile": {"architectures": ["MiniCPMForCausalLM"], "configFingerprint": "ef4c08c913d3f64cae22550f0c4a189795901d4b11e26d8e640e07e857659fb9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 16370604914, "estimatedRequiredGiB": 18.305, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "minicpm", "modelscopeFileSize": 16378634956, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:minicpm", "library:pytorch", "library:transformer", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 16378634956}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T02:09:20.876763+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4991856", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T10:33:30.477662+00:00", "modelId": "neuralmagic/Phi-3-medium-128k-instruct-quantized.w4a16", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "ef4c08c913d3f64cae22550f0c4a189795901d4b11e26d8e640e07e857659fb9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7686303632, "estimatedRequiredGiB": 8.592, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 7688299919, "modelscopeLicense": "llama2", "modelscopeParams": 13960238080, "modelscopeTags": ["license:llama2", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7688299919}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T02:09:36.977617+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4991858", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T10:33:30.477654+00:00", "modelId": "neuralmagic/Meta-Llama-3.1-8B-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "ef4c08c913d3f64cae22550f0c4a189795901d4b11e26d8e640e07e857659fb9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9084040952, "estimatedRequiredGiB": 10.163, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9093251901, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9093251901}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T02:09:37.095468+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4991859", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T10:33:30.477648+00:00", "modelId": "neuralmagic/gemma-2-9b-it-quantized.w4a16", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "ef4c08c913d3f64cae22550f0c4a189795901d4b11e26d8e640e07e857659fb9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7963207224, "estimatedRequiredGiB": 8.924, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 7985124714, "modelscopeLicense": "llama2", "modelscopeParams": 10159209984, "modelscopeTags": ["license:llama2", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7985124714}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T02:09:37.185982+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4991860", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T10:33:30.477642+00:00", "modelId": "neuralmagic/Meta-Llama-3.1-8B-Instruct-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "ef4c08c913d3f64cae22550f0c4a189795901d4b11e26d8e640e07e857659fb9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9084040952, "estimatedRequiredGiB": 10.163, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9093261938, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9093261938}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T02:09:37.284265+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4991861", "taskType": "text-generation", "verifyResult": null}