state: generation 8373 (cycle)

This commit is contained in:
2026-09-16 20:14:56 +00:00
parent a91de98e36
commit 90012a6b47
9 changed files with 2039 additions and 2040 deletions

View File

@@ -1695,7 +1695,7 @@
"taskType": "text-generation" "taskType": "text-generation"
} }
}, },
"generatedAt": "2026-09-16T20:12:06.905258+00:00", "generatedAt": "2026-09-16T20:14:55.681631+00:00",
"summary": { "summary": {
"activeBlockCount": 82, "activeBlockCount": 82,
"byGpuFramework": { "byGpuFramework": {

View File

@@ -19,7 +19,7 @@
"10": { "10": {
"complete": false, "complete": false,
"lastError": "ModelHubAPIError: 系统错误", "lastError": "ModelHubAPIError: 系统错误",
"listingErrors": 610, "listingErrors": 611,
"nextPage": 1, "nextPage": 1,
"recordsScanned": 0, "recordsScanned": 0,
"uniqueRecords": 0 "uniqueRecords": 0
@@ -102,12 +102,12 @@
"cutoffAt": "2026-09-04T03:55:51.365685+00:00", "cutoffAt": "2026-09-04T03:55:51.365685+00:00",
"failureLogsInspected": 0, "failureLogsInspected": 0,
"mode": "incremental_decision_only", "mode": "incremental_decision_only",
"nextAccountIndex": 10, "nextAccountIndex": 11,
"recordsScanned": 0, "recordsScanned": 0,
"seenTaskIds": [], "seenTaskIds": [],
"startedAt": "2026-09-04T03:55:51.365685+00:00", "startedAt": "2026-09-04T03:55:51.365685+00:00",
"terminalRecords": 0, "terminalRecords": 0,
"uniqueRecords": 0, "uniqueRecords": 0,
"updatedAt": "2026-09-16T20:12:06.880730+00:00", "updatedAt": "2026-09-16T20:14:55.655752+00:00",
"version": 1 "version": 1
} }

View File

@@ -1,8 +1,8 @@
{ {
"communityAttemptedAt": "2026-09-16T19:57:57.052907+00:00", "communityAttemptedAt": "2026-09-16T20:13:16.094732+00:00",
"communityError": null, "communityError": null,
"communitySample": {}, "communitySample": {},
"communityUpdatedAt": "2026-09-16T19:57:57.052907+00:00", "communityUpdatedAt": "2026-09-16T20:13:16.094732+00:00",
"frameworkAttemptedAt": "2026-09-16T14:37:17.574684+00:00", "frameworkAttemptedAt": "2026-09-16T14:37:17.574684+00:00",
"frameworkError": null, "frameworkError": null,
"frameworkStats": { "frameworkStats": {
@@ -416,7 +416,7 @@
} }
}, },
"frameworkUpdatedAt": null, "frameworkUpdatedAt": null,
"generatedAt": "2026-09-16T20:10:10.614652+00:00", "generatedAt": "2026-09-16T20:13:16.094732+00:00",
"gpuStats": { "gpuStats": {
"Ascend_910-b3": { "Ascend_910-b3": {
"available": true, "available": true,

File diff suppressed because it is too large Load Diff

View File

@@ -1,6 +1,6 @@
{ {
"generatedAt": "2026-09-16T19:54:49.143345+00:00", "generatedAt": "2026-09-16T20:13:09.798746+00:00",
"lastSyncTime": "2026-09-16T19:54:46.652476+00:00", "lastSyncTime": "2026-09-16T20:13:07.726284+00:00",
"recentLimit": 300, "recentLimit": 300,
"report": { "report": {
"architectureCompatibilityBlocks": { "architectureCompatibilityBlocks": {
@@ -1982,9 +1982,9 @@
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 0, "decisionTotal": 0,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 3 "ambiguous_runtime": 4
}, },
"failureCount": 3, "failureCount": 4,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm-mlu", "framework": "vllm-mlu",
"pendingCount": 0, "pendingCount": 0,
@@ -1994,8 +1994,8 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x4", "targetGpu": "Cambricon_mlu-370-x4",
"taskType": "text-generation", "taskType": "text-generation",
"total": 3, "total": 4,
"unresolvedFailureCount": 3 "unresolvedFailureCount": 4
}, },
"Cambricon_mlu-370-x8|unknown|text-generation": { "Cambricon_mlu-370-x8|unknown|text-generation": {
"attributableFailureCount": 8, "attributableFailureCount": 8,
@@ -2820,20 +2820,20 @@
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 9, "decisionTotal": 9,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 30, "ambiguous_runtime": 31,
"framework_architecture_unsupported": 8, "framework_architecture_unsupported": 8,
"tokenizer_compatibility": 1, "tokenizer_compatibility": 1,
"参数/模板问题": 3 "参数/模板问题": 3
}, },
"failureCount": 42, "failureCount": 43,
"failureRate": 1.0, "failureRate": 1.0,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 0, "platformFailureCount": 0,
"successCount": 0, "successCount": 0,
"successRate": 0.0, "successRate": 0.0,
"total": 42, "total": 43,
"unresolvedFailureCount": 33 "unresolvedFailureCount": 34
}, },
"vllm-patch-tokenizer": { "vllm-patch-tokenizer": {
"attributableFailureCount": 6, "attributableFailureCount": 6,
@@ -2922,7 +2922,7 @@
"unresolvedFailureCount": 5 "unresolvedFailureCount": 5
} }
}, },
"generatedAt": "2026-09-16T19:54:49.138247+00:00", "generatedAt": "2026-09-16T20:13:09.790657+00:00",
"gpuSummaries": { "gpuSummaries": {
"Ascend_910-b3": { "Ascend_910-b3": {
"attributableFailureCount": 49, "attributableFailureCount": 49,
@@ -3004,22 +3004,22 @@
"decisionSuccessRate": 0.1176, "decisionSuccessRate": 0.1176,
"decisionTotal": 34, "decisionTotal": 34,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 41, "ambiguous_runtime": 42,
"framework_architecture_unsupported": 27, "framework_architecture_unsupported": 27,
"memory_capacity": 1, "memory_capacity": 1,
"tokenizer_compatibility": 2, "tokenizer_compatibility": 2,
"参数/模板问题": 1, "参数/模板问题": 1,
"验证失败": 39 "验证失败": 39
}, },
"failureCount": 111, "failureCount": 112,
"failureRate": 0.9652, "failureRate": 0.9655,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 0, "platformFailureCount": 0,
"successCount": 4, "successCount": 4,
"successRate": 0.0348, "successRate": 0.0345,
"total": 115, "total": 116,
"unresolvedFailureCount": 81 "unresolvedFailureCount": 82
}, },
"Cambricon_mlu-370-x8": { "Cambricon_mlu-370-x8": {
"attributableFailureCount": 20, "attributableFailureCount": 20,
@@ -3695,9 +3695,9 @@
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 0, "decisionTotal": 0,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 3 "ambiguous_runtime": 4
}, },
"failureCount": 3, "failureCount": 4,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm-mlu", "framework": "vllm-mlu",
"modelType": "llama", "modelType": "llama",
@@ -3709,8 +3709,8 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x4", "targetGpu": "Cambricon_mlu-370-x4",
"taskType": "text-generation", "taskType": "text-generation",
"total": 3, "total": 4,
"unresolvedFailureCount": 3 "unresolvedFailureCount": 4
}, },
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|deepseek_v4_dspark|none": { "Cambricon_mlu-370-x8|vllm-mlu|text-generation|deepseek_v4_dspark|none": {
"attributableFailureCount": 1, "attributableFailureCount": 1,
@@ -7438,9 +7438,9 @@
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 0, "decisionTotal": 0,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 3 "ambiguous_runtime": 4
}, },
"failureCount": 3, "failureCount": 4,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm-mlu", "framework": "vllm-mlu",
"loadSizeLog2Bucket": 32, "loadSizeLog2Bucket": 32,
@@ -7453,8 +7453,8 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x4", "targetGpu": "Cambricon_mlu-370-x4",
"taskType": "text-generation", "taskType": "text-generation",
"total": 3, "total": 4,
"unresolvedFailureCount": 3 "unresolvedFailureCount": 4
}, },
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|deepseek_v4_dspark|none|33": { "Cambricon_mlu-370-x8|vllm-mlu|text-generation|deepseek_v4_dspark|none|33": {
"attributableFailureCount": 1, "attributableFailureCount": 1,
@@ -11139,15 +11139,15 @@
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
} }
}, },
"terminalRecords": 2044, "terminalRecords": 2045,
"totalRecords": 2138, "totalRecords": 2139,
"totals": { "totals": {
"attributableFailureCount": 662, "attributableFailureCount": 662,
"decisionFailureRate": 0.891, "decisionFailureRate": 0.891,
"decisionSuccessRate": 0.109, "decisionSuccessRate": 0.109,
"decisionTotal": 743, "decisionTotal": 743,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 494, "ambiguous_runtime": 495,
"backend_operator": 45, "backend_operator": 45,
"framework_architecture_unsupported": 435, "framework_architecture_unsupported": 435,
"memory_capacity": 12, "memory_capacity": 12,
@@ -11159,15 +11159,15 @@
"参数/模板问题": 124, "参数/模板问题": 124,
"验证失败": 673 "验证失败": 673
}, },
"failureCount": 1963, "failureCount": 1964,
"failureRate": 0.9604, "failureRate": 0.9604,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 10, "platformFailureCount": 10,
"successCount": 81, "successCount": 81,
"successRate": 0.0396, "successRate": 0.0396,
"total": 2044, "total": 2045,
"unresolvedFailureCount": 1291 "unresolvedFailureCount": 1292
}, },
"warnings": [ "warnings": [
"GPU Mthreads_s4000 本地统计失败率偏高≥50%),建议重点关注。", "GPU Mthreads_s4000 本地统计失败率偏高≥50%),建议重点关注。",
@@ -11177,11 +11177,11 @@
"GPU Biren_166m 本地统计失败率偏高≥50%),建议重点关注。", "GPU Biren_166m 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。", "GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。",
"GPU hygon_k100-ai 本地统计失败率偏高≥50%),建议重点关注。", "GPU hygon_k100-ai 本地统计失败率偏高≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高≥50%),建议重点关注。", "GPU Vastai_va16 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高≥50%),建议重点关注。", "GPU Cambricon_mlu-370-x4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高≥50%),建议重点关注。", "GPU Ascend_910-b3 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高≥50%),建议重点关注。", "GPU Cambricon_mlu-370-x8 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高≥50%),建议重点关注。", "GPU MetaX_c-500 本地统计失败率偏高≥50%),建议重点关注。",
"组合 Biren_166m|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Biren_166m|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Biren_166m|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Biren_166m|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Vastai_va16|vllm_fix_tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Vastai_va16|vllm_fix_tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -11206,6 +11206,6 @@
] ]
}, },
"storageMode": "decision_state_only", "storageMode": "decision_state_only",
"summarizedRecords": 2138, "summarizedRecords": 2139,
"version": 1 "version": 1
} }

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -1,24 +1,24 @@
{ {
"agentVersion": "2026.09.04.4", "agentVersion": "2026.09.04.4",
"checksums": { "checksums": {
".modelhub_state/architecture_compatibility_blacklist.json": "6f284c4fa15acc29bed171d0c3152671aa928c1a26325245e6122c1f0d6e0e1c", ".modelhub_state/architecture_compatibility_blacklist.json": "2fcd4f40e23dfcfb0c886b89354b7774807011e7132e5924bd67ef98010782ae",
".modelhub_state/architecture_history_backfill.json": "15fa8b856a47122e1924a567d6855b485a077d0342cc3337a17c51397e4f7db3", ".modelhub_state/architecture_history_backfill.json": "2b5a6790d85c6bd1daaf26dae6a1c9c95d6869b48bbb14bc83e0a53749091487",
".modelhub_state/market_intelligence.json": "1143a17ea13702be3531e13b67a15c41e3f21680554bd3f848f3ed1238dc3102", ".modelhub_state/market_intelligence.json": "5fa79968515d9c6a8193b8e0f0b2ae0f3b97cb30882ba90b7e4e9c23227f65e8",
".modelhub_state/official_capabilities.json": "6945d42fcc1c670635bcc70559bae800e019f505b5a6f807d249a3cb6e2209d0", ".modelhub_state/official_capabilities.json": "8149014dda7da71f7562c7c6db1ee0b3aa9d5106e31124da108ddbff0fa20fdf",
".modelhub_state/outcome_checkpoint.json": "abf8b4e9d81dd4259a8b2a9a8178d5e67cd77580f9febfd0611b779569aa1e6c", ".modelhub_state/outcome_checkpoint.json": "0ffeb32542b0b3e9ff3b1aedc07da950a43122010d963cc46b42f7336a871ffc",
".modelhub_state/queue_cleanup_latest.json": "6efc9c53e83b721aeef2737f2e8d2302bafc1b418ea8a73a5e15fec5b4fb2912", ".modelhub_state/queue_cleanup_latest.json": "6efc9c53e83b721aeef2737f2e8d2302bafc1b418ea8a73a5e15fec5b4fb2912",
".modelhub_state/recent_outcomes.jsonl": "77d876f72fb09fe7d99f4dfbfe2b21eaa3b392263e5acc4dca78498b24786f85", ".modelhub_state/recent_outcomes.jsonl": "77d876f72fb09fe7d99f4dfbfe2b21eaa3b392263e5acc4dca78498b24786f85",
".modelhub_state/recovery_active_tasks.jsonl": "ced45d8611e9c950f6a21e2158a80a5214a0d20595bfec3bbcb35859dd8e64b1", ".modelhub_state/recovery_active_tasks.jsonl": "c97046f2c604ceab7cdd564e5f213f92446ef8889a2655eae0e3722ea8408447",
".modelhub_state/recovery_intents.jsonl": "72381e629fb5827fb4d4c6fa54ca83660c4eb23d1f72ac9869a74e5f32f22048", ".modelhub_state/recovery_intents.jsonl": "db29ee63f8871dcb45872830a3486dcfebe03ab8cd753e6ded6d597a14e06254",
".modelhub_state/routing_intelligence.json": "008e6b54a9b7e1bc15577d1efc269953cea31d9de94d820a59dc3a61a5e8019c", ".modelhub_state/routing_intelligence.json": "008e6b54a9b7e1bc15577d1efc269953cea31d9de94d820a59dc3a61a5e8019c",
".modelhub_state/submission_exclusions.jsonl": "632739c6cd6a2dd2237572ba18e6a390c5aa37ce56a18a2c1341d78569421552", ".modelhub_state/submission_exclusions.jsonl": "632739c6cd6a2dd2237572ba18e6a390c5aa37ce56a18a2c1341d78569421552",
".modelhub_state/worker_crashes.jsonl": "b41d1dda7bab11bedd96de40fecd2d416e47396901b3283f48a56de5d6348983", ".modelhub_state/worker_crashes.jsonl": "b41d1dda7bab11bedd96de40fecd2d416e47396901b3283f48a56de5d6348983",
"ledger/submissions.jsonl": "3b61b453072f18e2753111224ea4908619d137da4e25b2d84b9dca9737a986d4", "ledger/submissions.jsonl": "3b61b453072f18e2753111224ea4908619d137da4e25b2d84b9dca9737a986d4",
"outcomes/submissions.jsonl": "f0d7c33dd4428ec460a875fe35feceac4702c7949cd3c27531b4495c05427e50" "outcomes/submissions.jsonl": "c3fced5c5cae58dad5ebdea0286c8fa63ec97767f6b58dfd037989b1683d03cb"
}, },
"generation": 8372, "generation": 8373,
"phase": "cycle", "phase": "cycle",
"schemaVersion": 1, "schemaVersion": 1,
"updatedAt": "2026-09-16T20:12:06.989970+00:00", "updatedAt": "2026-09-16T20:14:56.281704+00:00",
"writerId": "eccb3e0018f640d19e578c271a207b5c" "writerId": "eccb3e0018f640d19e578c271a207b5c"
} }

View File

@@ -25,7 +25,6 @@
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T02:32:00.692571+00:00", "modelId": "ornith-ai/Ornith-1.5-35B-A3B-NVFP4", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 23420419700, "estimatedRequiredGiB": 26.214, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 23455515266, "modelscopeLicense": "mit", "modelscopeParams": 19528501104, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "modelopt", "repositoryOnDiskBytes": 23455515266}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T18:26:16.665549+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4632117", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T02:32:00.692571+00:00", "modelId": "ornith-ai/Ornith-1.5-35B-A3B-NVFP4", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 23420419700, "estimatedRequiredGiB": 26.214, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 23455515266, "modelscopeLicense": "mit", "modelscopeParams": 19528501104, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "modelopt", "repositoryOnDiskBytes": 23455515266}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T18:26:16.665549+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4632117", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T03:05:43.096396+00:00", "modelId": "neuralmagic/gemma-2-9b-it-quantized.w8a8", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11998609696, "estimatedRequiredGiB": 13.434, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 12020499228, "modelscopeLicense": "gemma", "modelscopeParams": 10159209984, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 12020499228}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T19:03:47.678567+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4632579", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T03:05:43.096396+00:00", "modelId": "neuralmagic/gemma-2-9b-it-quantized.w8a8", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11998609696, "estimatedRequiredGiB": 13.434, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 12020499228, "modelscopeLicense": "gemma", "modelscopeParams": 10159209984, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 12020499228}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T19:03:47.678567+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4632579", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T03:32:15.596901+00:00", "modelId": "neuralmagic/Llama-3.2-3B-Instruct-FP8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4395007696, "estimatedRequiredGiB": 4.922, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 4404161088, "modelscopeLicense": "llama3.2", "modelscopeParams": 3606752256, "modelscopeTags": ["license:llama3.2", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:llama", "custom_tag:llama-3", "custom_tag:neuralmagic", "custom_tag:llmcompressor"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4404161088}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T19:29:42.987166+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4632974", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T03:32:15.596901+00:00", "modelId": "neuralmagic/Llama-3.2-3B-Instruct-FP8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4395007696, "estimatedRequiredGiB": 4.922, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 4404161088, "modelscopeLicense": "llama3.2", "modelscopeParams": 3606752256, "modelscopeTags": ["license:llama3.2", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:llama", "custom_tag:llama-3", "custom_tag:neuralmagic", "custom_tag:llmcompressor"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4404161088}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T19:29:42.987166+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4632974", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-05T04:49:26.595714+00:00", "modelId": "solidrust/Llama-3-13B-Instruct-v0.1-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8447876488, "estimatedRequiredGiB": 9.452, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "modelhub_preflight_oom:49"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 8457284244, "modelscopeLicense": "other", "modelscopeParams": 13264949248, "modelscopeTags": ["license:other", "model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible", "custom_tag:mergekit", "custom_tag:merge", "custom_tag:facebook", "custom_tag:meta", "custom_tag:pytorch", "custom_tag:llama", "custom_tag:llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 8457284244}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T20:48:49.542529+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4634053", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-05T05:30:50.210768+00:00", "modelId": "ornith-ai/Ornith-1.5-9B-NVFP4", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8818103892, "estimatedRequiredGiB": 9.883, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "modelhub_preflight_oom:49"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 8842796317, "modelscopeLicense": "mit", "modelscopeParams": 6728625904, "modelscopeTags": ["license:mit", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "modelopt", "repositoryOnDiskBytes": 8842796317}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T21:21:22.785475+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4634506", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-05T05:30:50.210768+00:00", "modelId": "ornith-ai/Ornith-1.5-9B-NVFP4", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8818103892, "estimatedRequiredGiB": 9.883, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "modelhub_preflight_oom:49"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 8842796317, "modelscopeLicense": "mit", "modelscopeParams": 6728625904, "modelscopeTags": ["license:mit", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "modelopt", "repositoryOnDiskBytes": 8842796317}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T21:21:22.785475+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4634506", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-05T06:47:43.600970+00:00", "modelId": "ornith-ai/Ornith-1.5-9B-NVFP4", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8818103892, "estimatedRequiredGiB": 9.883, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "published_card_spec", "sourceUrl": "https://aclanthology.org/2025.emnlp-main.1630.pdf"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 8842796317, "modelscopeLicense": "mit", "modelscopeParams": 6728625904, "modelscopeTags": ["license:mit", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "modelopt", "repositoryOnDiskBytes": 8842796317}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T22:37:50.462232+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4635609", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-05T06:47:43.600970+00:00", "modelId": "ornith-ai/Ornith-1.5-9B-NVFP4", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8818103892, "estimatedRequiredGiB": 9.883, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "published_card_spec", "sourceUrl": "https://aclanthology.org/2025.emnlp-main.1630.pdf"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 8842796317, "modelscopeLicense": "mit", "modelscopeParams": 6728625904, "modelscopeTags": ["license:mit", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "modelopt", "repositoryOnDiskBytes": 8842796317}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T22:37:50.462232+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4635609", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T07:14:11.020096+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-W4A16-ACTORDER-compressed-tensors-test", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5705684944, "estimatedRequiredGiB": 6.387, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5714910031, "modelscopeLicense": null, "modelscopeParams": 8031506432, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 5714910031}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T23:12:29.786627+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4636099", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T07:14:11.020096+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-W4A16-ACTORDER-compressed-tensors-test", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5705684944, "estimatedRequiredGiB": 6.387, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5714910031, "modelscopeLicense": null, "modelscopeParams": 8031506432, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 5714910031}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T23:12:29.786627+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4636099", "taskType": "text-generation", "verifyResult": null}