state: generation 5989 (cycle)

This commit is contained in:
2026-09-12 02:50:01 +00:00
parent 25d3e972ca
commit 2399015bd3
10 changed files with 2174 additions and 2128 deletions

View File

@@ -1326,7 +1326,7 @@
"taskType": "text-generation"
}
},
"generatedAt": "2026-09-12T02:47:10.345386+00:00",
"generatedAt": "2026-09-12T02:50:01.084880+00:00",
"summary": {
"activeBlockCount": 67,
"byGpuFramework": {

View File

@@ -27,7 +27,7 @@
"11": {
"complete": false,
"lastError": "ModelHubAPIError: 系统错误",
"listingErrors": 429,
"listingErrors": 430,
"nextPage": 1,
"recordsScanned": 0,
"uniqueRecords": 0
@@ -102,12 +102,12 @@
"cutoffAt": "2026-09-04T03:55:51.365685+00:00",
"failureLogsInspected": 0,
"mode": "incremental_decision_only",
"nextAccountIndex": 11,
"nextAccountIndex": 0,
"recordsScanned": 0,
"seenTaskIds": [],
"startedAt": "2026-09-04T03:55:51.365685+00:00",
"terminalRecords": 0,
"uniqueRecords": 0,
"updatedAt": "2026-09-12T02:47:10.320887+00:00",
"updatedAt": "2026-09-12T02:50:01.057671+00:00",
"version": 1
}

View File

@@ -416,7 +416,7 @@
}
},
"frameworkUpdatedAt": null,
"generatedAt": "2026-09-12T02:45:09.892693+00:00",
"generatedAt": "2026-09-12T02:48:19.298862+00:00",
"gpuStats": {
"Ascend_910-b3": {
"available": true,

File diff suppressed because it is too large Load Diff

View File

@@ -1,6 +1,6 @@
{
"generatedAt": "2026-09-12T02:39:29.471961+00:00",
"lastSyncTime": "2026-09-12T02:39:29.219629+00:00",
"generatedAt": "2026-09-12T02:48:11.405538+00:00",
"lastSyncTime": "2026-09-12T02:48:11.158163+00:00",
"recentLimit": 300,
"report": {
"architectureCompatibilityBlocks": {
@@ -2082,17 +2082,17 @@
"unresolvedFailureCount": 33
},
"Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation": {
"attributableFailureCount": 39,
"attributableFailureCount": 41,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 39,
"decisionTotal": 41,
"failureBreakdown": {
"framework_architecture_unsupported": 3,
"platform_infrastructure": 2,
"tokenizer_compatibility": 36,
"tokenizer_compatibility": 38,
"参数/模板问题": 6
},
"failureCount": 47,
"failureCount": 49,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"pendingCount": 0,
@@ -2102,7 +2102,7 @@
"successRate": 0.0,
"targetGpu": "Sunrise_pt-200-x1",
"taskType": "text-generation",
"total": 47,
"total": 49,
"unresolvedFailureCount": 6
},
"Sunrise_pt-200-x1|vllm|text-generation": {
@@ -2442,26 +2442,26 @@
"unresolvedFailureCount": 4
},
"vllm_fix_tokenizer": {
"attributableFailureCount": 42,
"attributableFailureCount": 44,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 42,
"decisionTotal": 44,
"failureBreakdown": {
"ambiguous_runtime": 36,
"framework_architecture_unsupported": 5,
"model_load": 1,
"platform_infrastructure": 2,
"tokenizer_compatibility": 36,
"tokenizer_compatibility": 38,
"参数/模板问题": 7
},
"failureCount": 87,
"failureCount": 89,
"failureRate": 1.0,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 2,
"successCount": 0,
"successRate": 0.0,
"total": 87,
"total": 89,
"unresolvedFailureCount": 43
},
"vllm_tokenizer_patch": {
@@ -2483,7 +2483,7 @@
"unresolvedFailureCount": 1
}
},
"generatedAt": "2026-09-12T02:39:29.466891+00:00",
"generatedAt": "2026-09-12T02:48:11.401315+00:00",
"gpuSummaries": {
"Ascend_910-b3": {
"attributableFailureCount": 26,
@@ -2741,26 +2741,26 @@
"unresolvedFailureCount": 77
},
"Sunrise_pt-200-x1": {
"attributableFailureCount": 41,
"decisionFailureRate": 0.9762,
"decisionSuccessRate": 0.0238,
"decisionTotal": 42,
"attributableFailureCount": 43,
"decisionFailureRate": 0.9773,
"decisionSuccessRate": 0.0227,
"decisionTotal": 44,
"failureBreakdown": {
"ambiguous_runtime": 1,
"framework_architecture_unsupported": 4,
"platform_infrastructure": 3,
"tokenizer_compatibility": 37,
"tokenizer_compatibility": 39,
"参数/模板问题": 9,
"验证失败": 32
},
"failureCount": 86,
"failureRate": 0.9885,
"failureCount": 88,
"failureRate": 0.9888,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 3,
"successCount": 1,
"successRate": 0.0115,
"total": 87,
"successRate": 0.0112,
"total": 89,
"unresolvedFailureCount": 42
},
"Vastai_va16": {
@@ -3930,6 +3930,29 @@
"total": 3,
"unresolvedFailureCount": 3
},
"Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation|hrm_text|none": {
"attributableFailureCount": 1,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"failureBreakdown": {
"tokenizer_compatibility": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"modelType": "hrm_text",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "none",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Sunrise_pt-200-x1",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
},
"Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation|qwen3_5|none": {
"attributableFailureCount": 1,
"decisionFailureRate": 1.0,
@@ -4543,7 +4566,7 @@
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"lastPlatformFailureAt": "2026-09-10T11:01:21+00:00",
"lastTerminalAt": "2026-09-12T02:39:29.219599+00:00",
"lastTerminalAt": "2026-09-12T02:48:11.158114+00:00",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 2,
@@ -6857,6 +6880,30 @@
"total": 3,
"unresolvedFailureCount": 3
},
"Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation|hrm_text|none|31": {
"attributableFailureCount": 1,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"failureBreakdown": {
"tokenizer_compatibility": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"loadSizeLog2Bucket": 31,
"modelType": "hrm_text",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "none",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Sunrise_pt-200-x1",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
},
"Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation|qwen3_5|none|32": {
"attributableFailureCount": 1,
"decisionFailureRate": 1.0,
@@ -7074,13 +7121,13 @@
"unresolvedFailureCount": 0
}
},
"terminalRecords": 1675,
"totalRecords": 1762,
"terminalRecords": 1677,
"totalRecords": 1764,
"totals": {
"attributableFailureCount": 447,
"decisionFailureRate": 0.8887,
"decisionSuccessRate": 0.1113,
"decisionTotal": 503,
"attributableFailureCount": 449,
"decisionFailureRate": 0.8891,
"decisionSuccessRate": 0.1109,
"decisionTotal": 505,
"failureBreakdown": {
"ambiguous_runtime": 394,
"backend_operator": 40,
@@ -7090,24 +7137,25 @@
"platform_infrastructure": 4,
"repository_structure": 5,
"runtime_memory": 6,
"tokenizer_compatibility": 43,
"tokenizer_compatibility": 45,
"参数/模板问题": 101,
"验证失败": 673
},
"failureCount": 1619,
"failureCount": 1621,
"failureRate": 0.9666,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 4,
"successCount": 56,
"successRate": 0.0334,
"total": 1675,
"total": 1677,
"unresolvedFailureCount": 1168
},
"warnings": [
"GPU Ascend_910-b3 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高≥50%),建议重点关注。",
"GPU hygon_k100-ai 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_mrv-100 本地统计失败率偏高≥50%),建议重点关注。",
@@ -7116,7 +7164,6 @@
"GPU MetaX_c-500 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Biren_166m 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高≥50%),建议重点关注。",
"组合 hygon_k100-ai|vllm-patch-tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 hygon_k100-ai|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Ascend_910-b4|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -7137,6 +7184,6 @@
]
},
"storageMode": "decision_state_only",
"summarizedRecords": 1762,
"summarizedRecords": 1764,
"version": 1
}

View File

@@ -1,3 +1,4 @@
{"failReason": "tokenizer_compatibility", "failureAction": "check_tokenizer_files_then_llm", "failureCategory": "tokenizer_compatibility", "failureClassificationReason": "broad_tokenizer_error", "failureCode": "TOKENIZER_FAILED", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_framework", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-12T02:48:11.158114+00:00", "modelId": "RedHatAI/SmolLM-360M-Instruct-quantized.w8a8", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-12T02:43:21+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4458009", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "tokenizer_compatibility", "failureAction": "check_tokenizer_files_then_llm", "failureCategory": "tokenizer_compatibility", "failureClassificationReason": "broad_tokenizer_error", "failureCode": "TOKENIZER_FAILED", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_framework", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-12T02:39:29.219599+00:00", "modelId": "RedHatAI/Qwen2.5-3B-quantized.w4a16", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-12T02:39:21+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4100876", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mellum"], "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-12T02:39:29.219629+00:00", "modelId": "JetBrains/Mellum2-12B-A2.5B-Thinking", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-12T02:35:21+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4152611", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-12T02:30:20.417896+00:00", "modelId": "nightmedia/Qwen3-4B-Thinking-2507-Gemini-3-Pro-Preview-High-Reasoning-Distill-Heretic-qx86-hi-mlx", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-12T02:27:21+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4079970", "taskType": "text-generation", "verifyResult": -1}
@@ -297,4 +298,3 @@
{"failReason": "tokenizer_compatibility", "failureAction": "check_tokenizer_files_then_llm", "failureCategory": "tokenizer_compatibility", "failureClassificationReason": "broad_tokenizer_error", "failureCode": "TOKENIZER_FAILED", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_framework", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-08T12:42:19.103221+00:00", "modelId": "RedHatAI/Llama-2-7b-chat-quantized.w8a8", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T12:19:21+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4107014", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5"], "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-08T12:42:19.103172+00:00", "modelId": "iic/UEmbed-4B", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T12:15:21+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4152744", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "tokenizer_compatibility", "failureAction": "check_tokenizer_files_then_llm", "failureCategory": "tokenizer_compatibility", "failureClassificationReason": "broad_tokenizer_error", "failureCode": "TOKENIZER_FAILED", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_framework", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-08T12:11:42.795229+00:00", "modelId": "RedHatAI/starcoder2-3b-quantized.w8a8", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T12:11:21+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4101032", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "tokenizer_compatibility", "failureAction": "check_tokenizer_files_then_llm", "failureCategory": "tokenizer_compatibility", "failureClassificationReason": "broad_tokenizer_error", "failureCode": "TOKENIZER_FAILED", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_framework", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-08T12:11:42.795269+00:00", "modelId": "neuralmagic/starcoder2-7b-quantized.w8a8", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T12:07:21+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4101082", "taskType": "text-generation", "verifyResult": -1}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -1,24 +1,24 @@
{
"agentVersion": "2026.09.04.4",
"checksums": {
".modelhub_state/architecture_compatibility_blacklist.json": "f063a7f0202b5a1f4068bc291b206781db4fb04cd8b5b7ddc5670c67c1a8fb47",
".modelhub_state/architecture_history_backfill.json": "0a1ee367202f52c5e9d5e469faf00236b68396bb49c1074f14a87dc80000daa5",
".modelhub_state/market_intelligence.json": "0c40da0702e8996a56a724c904b8984dd26d4cc3c849de4a16fac95b07df77ab",
".modelhub_state/official_capabilities.json": "19bb8f16c7d1f550636399edea29f0b51be9b02783431d5cee3d13aa25d5d837",
".modelhub_state/outcome_checkpoint.json": "2b49331b45dd5f0208cae294fcb85553911c5581c4fa7e29ff34d16852423d48",
".modelhub_state/architecture_compatibility_blacklist.json": "9939a560b86e2003d3216dc263f4b70ecdc7d6ac28154f942dfd7b92f8e2f2e9",
".modelhub_state/architecture_history_backfill.json": "c2786e25a38aa0334bced366a27b9119e6bcc6cc48e16834f3d47df628b8ba02",
".modelhub_state/market_intelligence.json": "b5d0e85ff94fc8080c4a905f3d4f6dbfe13e0bcf128e110b225efc58388d1fe2",
".modelhub_state/official_capabilities.json": "13df3c54d4485b15a67ea198f2bf48f944f8ee4e6a4bbdd56a94738d7313b5f0",
".modelhub_state/outcome_checkpoint.json": "267592fed01a3ba5fb68028d166d6fe5c608ecec7c2b32b1985bc4f6099f8d69",
".modelhub_state/queue_cleanup_latest.json": "384aaa478516df0fbe81d4231e5cdb026ef79a424962096f691840bfd3cb6931",
".modelhub_state/recent_outcomes.jsonl": "24a9a94e8242b5fb54653dd432912d9ea9d05c29c0ad1d4654b9b431e56b5ea7",
".modelhub_state/recovery_active_tasks.jsonl": "f9aeaf7a3d6b891df6a10c5f0ef9c93a8ec57ddf7e7842ae28c60302548950cd",
".modelhub_state/recovery_intents.jsonl": "2b2894e3d5d73fee9b54cdf297fd489a6132d12ea60efab684dceea5dc21f94e",
".modelhub_state/recent_outcomes.jsonl": "f40a93b9569ca8a0358c678853f3510722522feb6de5c702465195362b816654",
".modelhub_state/recovery_active_tasks.jsonl": "809d9b049c3245950f42f45c35800399af62b9854ae42055db6811592158e5b2",
".modelhub_state/recovery_intents.jsonl": "74ebea4b0eafef707cdb83c55ad4ad7b0ac81b3545e148e9bdbf592a944c91cd",
".modelhub_state/routing_intelligence.json": "316b7d02e32cf2dd3f7c0ca452f58d571a371863ac4d1c1b5193456035ce3a53",
".modelhub_state/submission_exclusions.jsonl": "14480c58228be6b76e21e98008960b815d20d16132dcab7a11e5b449c5e2d220",
".modelhub_state/worker_crashes.jsonl": "9693a31a13cc18a3136ff5373f9569dc2fecaa274aaf91d3b1c8a67f31fe0162",
"ledger/submissions.jsonl": "8abcf838f382e71b9140db2901b93972a33b043c4c67a56473d00af9ccd9be3c",
"outcomes/submissions.jsonl": "cf290a62579fe7a5d537f1aaa98055d0343871d84f09a26a615363eae8adf637"
"outcomes/submissions.jsonl": "c53f6ac33f79e616e13d79bc0ead6c3f607869ad8325b1aec0fae42c5c18de72"
},
"generation": 5988,
"generation": 5989,
"phase": "cycle",
"schemaVersion": 1,
"updatedAt": "2026-09-12T02:47:10.423931+00:00",
"updatedAt": "2026-09-12T02:50:01.760859+00:00",
"writerId": "e5dd59a4c84a4f21926bad61448789e2"
}

View File

@@ -47,7 +47,6 @@
{"failReason": null, "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-04T16:50:26.817445+00:00", "modelId": "Mia-AiLab/Qwen3.8-27B-EXL3-3.5bpw", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 15338408461, "estimatedRequiredGiB": 17.168, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 15362064483, "modelscopeLicense": "apache-2.0", "modelscopeParams": 7669052656, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:exl3", "custom_tag:exllamav3", "custom_tag:quantization", "custom_tag:long-context", "custom_tag:speculative-decoding"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "exl3", "repositoryOnDiskBytes": 15362064483}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T08:44:58.161709+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4623226", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-04T20:39:27.718139+00:00", "modelId": "ornith-ai/Ornith-1.5-9B-NVFP4", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8818103892, "estimatedRequiredGiB": 9.883, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:8"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 8842796317, "modelscopeLicense": "mit", "modelscopeParams": 6728625904, "modelscopeTags": ["license:mit", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "modelopt", "repositoryOnDiskBytes": 8842796317}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T12:34:49.403585+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4626360", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-04T21:36:16.816860+00:00", "modelId": "siliconflow/gpt-oss-20b-FP8", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 22109595640, "estimatedRequiredGiB": 24.741, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:29"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 22137550529, "modelscopeLicense": "Apache License 2.0", "modelscopeParams": 20921584848, "modelscopeTags": ["license:Apache License 2.0", "model_type:gpt_oss", "library:safetensors", "library:other", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "mxfp4", "repositoryOnDiskBytes": 22137550529}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T13:34:49.450482+00:00", "targetGpu": "MetaX_c-500", "taskId": "4627250", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T21:46:36.195225+00:00", "modelId": "sapientinc/HRM-Text-1B", "modelProfile": {"architectures": ["HrmTextForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2365606568, "estimatedRequiredGiB": 2.651, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "hrm_text", "modelscopeFileSize": 2371660433, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1182795264, "modelscopeTags": ["license:apache-2.0", "model_type:hrm_text", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:hrm", "custom_tag:hierarchical-reasoning", "custom_tag:prefix-lm", "custom_tag:pre-alignment", "custom_tag:non-chat", "custom_tag:non-instruction-tuned"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2371660433}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T13:43:30.537609+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4627500", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T22:10:06.209357+00:00", "modelId": "neuralmagic/Llama-3.2-1B-Instruct-FP8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2023929984, "estimatedRequiredGiB": 2.272, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 2033083373, "modelscopeLicense": "llama3.2", "modelscopeParams": 1498482688, "modelscopeTags": ["license:llama3.2", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:llama", "custom_tag:llama-3", "custom_tag:neuralmagic", "custom_tag:llmcompressor"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2033083377}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T14:08:46.692566+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4627849", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T22:53:17.234593+00:00", "modelId": "amd/gpt-oss-20b-BF16-w8a8-llmcompressor", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 44193251544, "estimatedRequiredGiB": 49.422, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 22125413673, "modelscopeLicense": "apache-2.0", "modelscopeParams": 20914757184, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:quantized", "custom_tag:int8", "custom_tag:w8a8", "custom_tag:dynamic-quantization", "custom_tag:8-bit", "custom_tag:llm-compressor", "custom_tag:compressed-tensors", "custom_tag:zendnn", "custom_tag:amd", "custom_tag:cpu-inference"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 44221632439}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T14:46:47.882785+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4628625", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-04T23:04:36.601749+00:00", "modelId": "amd/gpt-oss-20b-BF16-w8a8-llmcompressor", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 44193251544, "estimatedRequiredGiB": 49.422, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "published_card_spec", "sourceUrl": "https://aclanthology.org/2025.emnlp-main.1630.pdf"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 22125413673, "modelscopeLicense": "apache-2.0", "modelscopeParams": 20914757184, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:quantized", "custom_tag:int8", "custom_tag:w8a8", "custom_tag:dynamic-quantization", "custom_tag:8-bit", "custom_tag:llm-compressor", "custom_tag:compressed-tensors", "custom_tag:zendnn", "custom_tag:amd", "custom_tag:cpu-inference"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 44221632439}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T15:01:53.788146+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4628814", "taskType": "text-generation", "verifyResult": null}