state: generation 11659 (cycle)

This commit is contained in:
2026-09-21 19:42:15 +00:00
parent e64ccf5e13
commit 39f242f56c
8 changed files with 1988 additions and 1939 deletions

View File

@@ -2768,7 +2768,7 @@
"taskType": "text-generation"
}
},
"generatedAt": "2026-09-21T19:38:20.571817+00:00",
"generatedAt": "2026-09-21T19:42:01.285599+00:00",
"summary": {
"activeBlockCount": 139,
"byGpuFramework": {

View File

@@ -434,7 +434,7 @@
}
},
"frameworkUpdatedAt": null,
"generatedAt": "2026-09-21T19:40:59.296547+00:00",
"generatedAt": "2026-09-21T19:42:13.414170+00:00",
"gpuStats": {
"Ascend_910-b3": {
"available": true,

View File

@@ -1,5 +1,5 @@
{
"catalogUpdatedAt": "2026-09-21T19:40:59.296547+00:00",
"catalogUpdatedAt": "2026-09-21T19:42:13.414170+00:00",
"configuredTaskTypes": [
"text-generation"
],
@@ -56,7 +56,7 @@
"time-series-forecasting"
],
"errors": [],
"generatedAt": "2026-09-21T19:40:59.296547+00:00",
"generatedAt": "2026-09-21T19:42:13.414170+00:00",
"gpuCatalog": {
"Ascend_910-b3": {
"canVerify": true,
@@ -6896,6 +6896,6 @@
"updateTime": "2025-12-22 08:59:53"
}
],
"taskTreeUpdatedAt": "2026-09-21T19:40:59.296547+00:00",
"taskTreeUpdatedAt": "2026-09-21T19:42:13.414170+00:00",
"version": 1
}

View File

@@ -1,6 +1,6 @@
{
"generatedAt": "2026-09-21T19:38:20.494912+00:00",
"lastSyncTime": "2026-09-21T19:38:20.253843+00:00",
"generatedAt": "2026-09-21T19:42:01.208198+00:00",
"lastSyncTime": "2026-09-21T19:42:00.658395+00:00",
"recentLimit": 300,
"report": {
"architectureCompatibilityBlocks": {
@@ -4012,7 +4012,7 @@
"decisionSuccessRate": 0.3158,
"decisionTotal": 57,
"failureBreakdown": {
"ambiguous_runtime": 22,
"ambiguous_runtime": 23,
"backend_operator": 6,
"framework_architecture_unsupported": 17,
"memory_capacity": 1,
@@ -4020,18 +4020,18 @@
"runtime_memory": 9,
"参数/模板问题": 2
},
"failureCount": 63,
"failureRate": 0.7778,
"failureCount": 64,
"failureRate": 0.7805,
"framework": "vllm_0_17_0_corex_4_4_0",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 18,
"successRate": 0.2222,
"successRate": 0.2195,
"targetGpu": "Iluvatar_bi-150",
"taskType": "text-generation",
"total": 81,
"unresolvedFailureCount": 24
"total": 82,
"unresolvedFailureCount": 25
},
"Iluvatar_bi-150|vllm_fix_tokenizer|text-generation": {
"attributableFailureCount": 7,
@@ -4401,10 +4401,10 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 107,
"ambiguous_runtime": 108,
"参数/模板问题": 3
},
"failureCount": 110,
"failureCount": 111,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"pendingCount": 0,
@@ -4414,8 +4414,8 @@
"successRate": 0.0,
"targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation",
"total": 110,
"unresolvedFailureCount": 110
"total": 111,
"unresolvedFailureCount": 111
},
"Kunlunxin_p-800|vllm_tokenizer_patch|text-generation": {
"attributableFailureCount": 17,
@@ -5523,7 +5523,7 @@
"decisionSuccessRate": 0.3158,
"decisionTotal": 57,
"failureBreakdown": {
"ambiguous_runtime": 22,
"ambiguous_runtime": 23,
"backend_operator": 6,
"framework_architecture_unsupported": 17,
"memory_capacity": 1,
@@ -5531,15 +5531,15 @@
"runtime_memory": 9,
"参数/模板问题": 2
},
"failureCount": 63,
"failureRate": 0.7778,
"failureCount": 64,
"failureRate": 0.7805,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 18,
"successRate": 0.2222,
"total": 81,
"unresolvedFailureCount": 24
"successRate": 0.2195,
"total": 82,
"unresolvedFailureCount": 25
},
"vllm_fix_tokenizer": {
"attributableFailureCount": 123,
@@ -5547,7 +5547,7 @@
"decisionSuccessRate": 0.0391,
"decisionTotal": 128,
"failureBreakdown": {
"ambiguous_runtime": 193,
"ambiguous_runtime": 194,
"backend_operator": 8,
"framework_architecture_unsupported": 23,
"memory_capacity": 7,
@@ -5556,15 +5556,15 @@
"tokenizer_compatibility": 82,
"参数/模板问题": 13
},
"failureCount": 346,
"failureCount": 347,
"failureRate": 0.9858,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 17,
"successCount": 5,
"successRate": 0.0142,
"total": 351,
"unresolvedFailureCount": 206
"total": 352,
"unresolvedFailureCount": 207
},
"vllm_tokenizer_patch": {
"attributableFailureCount": 74,
@@ -5594,7 +5594,7 @@
"unresolvedFailureCount": 104
}
},
"generatedAt": "2026-09-21T19:38:20.482780+00:00",
"generatedAt": "2026-09-21T19:42:01.195902+00:00",
"gpuSummaries": {
"Ascend_910-b3": {
"attributableFailureCount": 99,
@@ -5762,7 +5762,7 @@
"decisionSuccessRate": 0.1672,
"decisionTotal": 891,
"failureBreakdown": {
"ambiguous_runtime": 619,
"ambiguous_runtime": 620,
"architecture_compatibility": 15,
"backend_operator": 12,
"context_length": 29,
@@ -5777,15 +5777,15 @@
"日志缺失": 155,
"验证失败": 30
},
"failureCount": 1887,
"failureRate": 0.9268,
"failureCount": 1888,
"failureRate": 0.9269,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 21,
"successCount": 149,
"successRate": 0.0732,
"total": 2036,
"unresolvedFailureCount": 1124
"successRate": 0.0731,
"total": 2037,
"unresolvedFailureCount": 1125
},
"Iluvatar_mrv-100": {
"attributableFailureCount": 967,
@@ -5824,7 +5824,7 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 19,
"failureBreakdown": {
"ambiguous_runtime": 184,
"ambiguous_runtime": 185,
"backend_operator": 1,
"framework_architecture_unsupported": 15,
"memory_capacity": 1,
@@ -5833,15 +5833,15 @@
"日志缺失": 1,
"验证失败": 23
},
"failureCount": 247,
"failureCount": 248,
"failureRate": 1.0,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 0,
"successRate": 0.0,
"total": 247,
"unresolvedFailureCount": 228
"total": 248,
"unresolvedFailureCount": 229
},
"Kunlunxin_r-200-8f": {
"attributableFailureCount": 0,
@@ -11627,9 +11627,11 @@
"decisionFailureRate": 0.0,
"decisionSuccessRate": 1.0,
"decisionTotal": 1,
"failureBreakdown": {},
"failureCount": 0,
"failureRate": 0.0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 0.5,
"framework": "vllm_0_17_0_corex_4_4_0",
"modelType": "cohere2",
"pendingCount": 0,
@@ -11637,11 +11639,11 @@
"platformFailureCount": 0,
"quantizationMethod": "none",
"successCount": 1,
"successRate": 1.0,
"successRate": 0.5,
"targetGpu": "Iluvatar_bi-150",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
"total": 2,
"unresolvedFailureCount": 1
},
"Iluvatar_bi-150|vllm_0_17_0_corex_4_4_0|text-generation|deepseek_v4_dspark|none": {
"attributableFailureCount": 1,
@@ -13599,6 +13601,29 @@
"total": 3,
"unresolvedFailureCount": 3
},
"Kunlunxin_p-800|vllm_fix_tokenizer|text-generation|gemma3|compressed-tensors": {
"attributableFailureCount": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"modelType": "gemma3",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
},
"Kunlunxin_p-800|vllm_fix_tokenizer|text-generation|gemma4|none": {
"attributableFailureCount": 0,
"decisionFailureRate": 0.0,
@@ -29179,9 +29204,11 @@
"decisionFailureRate": 0.0,
"decisionSuccessRate": 1.0,
"decisionTotal": 1,
"failureBreakdown": {},
"failureCount": 0,
"failureRate": 0.0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 0.5,
"framework": "vllm_0_17_0_corex_4_4_0",
"loadSizeLog2Bucket": 32,
"modelType": "cohere2",
@@ -29190,11 +29217,11 @@
"platformFailureCount": 0,
"quantizationMethod": "none",
"successCount": 1,
"successRate": 1.0,
"successRate": 0.5,
"targetGpu": "Iluvatar_bi-150",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
"total": 2,
"unresolvedFailureCount": 1
},
"Iluvatar_bi-150|vllm_0_17_0_corex_4_4_0|text-generation|deepseek_v4_dspark|none|33": {
"attributableFailureCount": 1,
@@ -31987,6 +32014,30 @@
"total": 2,
"unresolvedFailureCount": 2
},
"Kunlunxin_p-800|vllm_fix_tokenizer|text-generation|gemma3|compressed-tensors|34": {
"attributableFailureCount": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm_fix_tokenizer",
"loadSizeLog2Bucket": 34,
"modelType": "gemma3",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
},
"Kunlunxin_p-800|vllm_fix_tokenizer|text-generation|gemma4|none|32": {
"attributableFailureCount": 0,
"decisionFailureRate": 0.0,
@@ -37402,15 +37453,15 @@
"unresolvedFailureCount": 0
}
},
"terminalRecords": 16375,
"totalRecords": 16569,
"terminalRecords": 16377,
"totalRecords": 16571,
"totals": {
"attributableFailureCount": 5908,
"decisionFailureRate": 0.862,
"decisionSuccessRate": 0.138,
"decisionTotal": 6854,
"failureBreakdown": {
"ambiguous_runtime": 4012,
"ambiguous_runtime": 4014,
"architecture_compatibility": 212,
"attention_backend": 1,
"backend_operator": 104,
@@ -37426,31 +37477,31 @@
"日志缺失": 719,
"验证失败": 674
},
"failureCount": 15429,
"failureCount": 15431,
"failureRate": 0.9422,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 925,
"successCount": 946,
"successRate": 0.0578,
"total": 16375,
"unresolvedFailureCount": 8596
"total": 16377,
"unresolvedFailureCount": 8598
},
"warnings": [
"GPU Iluvatar_mrv-100 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Kunlunxin_p-800 本地统计失败率偏高≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Biren_166m 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-100 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高≥50%),建议重点关注。",
"GPU hygon_k100-ai 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高≥50%),建议重点关注。",
"组合 Iluvatar_bi-150|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -37490,6 +37541,6 @@
]
},
"storageMode": "decision_state_only",
"summarizedRecords": 16569,
"summarizedRecords": 16571,
"version": 1
}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -2,24 +2,24 @@
"agentVersion": "2026.09.20.2",
"checksums": {
".modelhub_state/account_capacity.json": "68d2a8390ad022f2ddcd30841f3860c4535387fa64cb46dc7507eb16837e798f",
".modelhub_state/architecture_compatibility_blacklist.json": "696d93ca0c6be5dde36c1ecc0269a0cd6bb56bc210b6abf32c01105d54f60252",
".modelhub_state/architecture_compatibility_blacklist.json": "17863854768e8d14b147f0dc9544b98258822ce073afafc2fee253af49f08299",
".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab",
".modelhub_state/market_intelligence.json": "c9116d5d94ed5a1e4751072eeea18dd2692b0045ab912c6ae02180f1652b0509",
".modelhub_state/official_capabilities.json": "30c1cf9ba3b76997fc31628bd1b376b1c1241babf8b1d90e552ca1991c0f3e00",
".modelhub_state/outcome_checkpoint.json": "dda11e5da29336c3c5bc6aee3b8b806f5fa4c6542981662912432aaa4d6c8ad6",
".modelhub_state/market_intelligence.json": "ea16ed318853c9563a734b84636d9a47f5432d39cfc53552c701f63a6ea72348",
".modelhub_state/official_capabilities.json": "f40ee9b8004ddeac57c6fdad293ac8a8baa15fe33a244b05ddd88d29bf42db26",
".modelhub_state/outcome_checkpoint.json": "0708e5ce405223c866d9f0e755900733d1065e075a8c60247936fb47757bdbab",
".modelhub_state/queue_cleanup_latest.json": "fab470f2bbf8c39d73c8917d9fdab78c775c47a597aa2530a529e5a7ae55d4ec",
".modelhub_state/recent_outcomes.jsonl": "a62acfa64b4e7602c68217fdee9fa27df4649fbdb548e1da00eebd92efff142e",
".modelhub_state/recovery_active_tasks.jsonl": "e1ec357454c7e12cfee28c29bc34ee7ef6bef05e383ef71bd80b1a9011d39b21",
".modelhub_state/recovery_intents.jsonl": "1185418cd1dd1f0c3b2b9f2177c56f8b43fb3b86620ae5d52b2269c6f391f709",
".modelhub_state/recovery_active_tasks.jsonl": "3daa4ab6f228f207b1d4fc4c65a9813e5b38bbf7ae0e7bf95f9acfa69fd6db93",
".modelhub_state/recovery_intents.jsonl": "2c1524069f1285bc664bd9202df32d5c48408cdcd32ec1279cf4d58aa9655e4e",
".modelhub_state/routing_intelligence.json": "93ad575e3d114fb5633ccd1450a26b636b4ae40cd8b1ac57ef541bbb1edfdc7c",
".modelhub_state/submission_exclusions.jsonl": "80315f370e9cc3cdadaf390e12573ef887794214779379c50b7b37b7631e8989",
".modelhub_state/worker_crashes.jsonl": "07505b69e0b050da5f90f8b046a3069d3e1ca2574ca39896bc7d8a66293167f7",
"ledger/submissions.jsonl": "fa750701ce66a72f48255ab2c7568f3a163cc05950dd46fb3649896782601f6e",
"outcomes/submissions.jsonl": "a314491032744d00cb1e5a224d8f73facc5f819904ffa1bcb07f89d0cdf03e72"
"outcomes/submissions.jsonl": "ca53d088416fd3c38ebc27b433c5a7db94499d508604d7394e4ac11a87a39635"
},
"generation": 11658,
"generation": 11659,
"phase": "cycle",
"schemaVersion": 1,
"updatedAt": "2026-09-21T19:40:59.821125+00:00",
"updatedAt": "2026-09-21T19:42:14.943816+00:00",
"writerId": "8b35139af6674067a339a670222d4b67"
}

View File

@@ -163,7 +163,6 @@
{"failReason": null, "framework": "llamacpp", "lastSyncTime": "2026-09-13T01:37:55.613775+00:00", "modelId": "cloudlnk/Spark-X2.5-4B-GGUF", "modelProfile": {"architectures": [], "configFingerprint": "29d7b6bec2440988a150b8d521c28df4707bcfe119f537490a5dfe23b9f8d11f", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2405581632, "estimatedRequiredGiB": 17.589, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": null, "modelscopeFileSize": 15737975890, "modelscopeLicense": "apache-2.0", "modelscopeParams": 4112079360, "modelscopeTags": ["license:apache-2.0", "library:gguf", "task:text-generation", "custom_tag:gguf", "custom_tag:llama.cpp", "custom_tag:spark-x2.5", "custom_tag:long-context", "custom_tag:1m-context", "deploy:swingdeploy"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 15737975890}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-12T17:35:57.210723+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4805660", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "llamacpp", "lastSyncTime": "2026-09-13T01:55:03.245431+00:00", "modelId": "cloudlnk/Spark-X2.5-4B-GGUF", "modelProfile": {"architectures": [], "configFingerprint": "1e79b01d449f51953bad4aed5c8fa69cb99c8886275d952e7bc8585bd98fa275", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2405581632, "estimatedRequiredGiB": 17.589, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": null, "modelscopeFileSize": 15737975890, "modelscopeLicense": "apache-2.0", "modelscopeParams": 4112079360, "modelscopeTags": ["license:apache-2.0", "library:gguf", "task:text-generation", "custom_tag:gguf", "custom_tag:llama.cpp", "custom_tag:spark-x2.5", "custom_tag:long-context", "custom_tag:1m-context", "deploy:swingdeploy"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 15737975890}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-12T17:53:40.152278+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4805869", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "llamacpp", "lastSyncTime": "2026-09-13T12:45:24.349519+00:00", "modelId": "cloudlnk/Spark-X2.5-4B-GGUF", "modelProfile": {"architectures": [], "configFingerprint": "79ee05d2f9945abf429c945f84a314444c4004617b3dd41343d3404019c31d6c", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2405581632, "estimatedRequiredGiB": 17.589, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": null, "modelscopeFileSize": 15737975890, "modelscopeLicense": "apache-2.0", "modelscopeParams": 4112079360, "modelscopeTags": ["license:apache-2.0", "library:gguf", "task:text-generation", "custom_tag:gguf", "custom_tag:llama.cpp", "custom_tag:spark-x2.5", "custom_tag:long-context", "custom_tag:1m-context", "deploy:swingdeploy"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 15737975890}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-13T04:41:29.954503+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4817350", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-13T12:45:24.349544+00:00", "modelId": "CohereLabs/tiny-aya-base-32K", "modelProfile": {"architectures": ["Cohere2ForCausalLM"], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 6700539432, "estimatedRequiredGiB": 7.522, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "cohere2", "modelscopeFileSize": 6730839322, "modelscopeLicense": "cc-by-nc-4.0", "modelscopeParams": 3350243328, "modelscopeTags": ["license:cc-by-nc-4.0", "model_type:cohere2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:aya", "custom_tag:multilingual", "custom_tag:long-context", "custom_tag:tiny-aya"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 6730839322}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-13T04:41:29.963690+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4817349", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-13T13:00:14.407763+00:00", "modelId": "XHToken/Spark-X2.5-4B-INT8", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4454282952, "estimatedRequiredGiB": 4.995, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 4469587176, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4469587176}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-13T04:51:53.062775+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4817454", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-13T13:17:31.149592+00:00", "modelId": "XHToken/Spark-X2.5-4B-INT8", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4454282952, "estimatedRequiredGiB": 4.995, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 4469587176, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4469587176}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-13T05:10:44.864092+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4817675", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-13T13:34:15.409837+00:00", "modelId": "XHToken/Spark-X2.5-4B-INT8", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4454282952, "estimatedRequiredGiB": 4.995, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 4469587176, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4469587176}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-13T05:29:18.044774+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4817992", "taskType": "text-generation", "verifyResult": null}
@@ -455,7 +454,6 @@
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-20T11:30:54.600087+00:00", "modelId": "ddalcu/Muse-Glimmer-30B-MLX-Serve-4bit", "modelProfile": {"architectures": ["MuseGlimmerForConditionalGeneration"], "configFingerprint": "8b3c0a82b858cf26b1a0f6075074234a66487d5734741dbbfd4743963b967faa", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 21407235494, "estimatedRequiredGiB": 23.956, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "muse_glimmer", "modelscopeFileSize": 21435726263, "modelscopeLicense": "apache-2.0", "modelscopeParams": 5792290816, "modelscopeTags": ["license:apache-2.0", "model_type:muse_glimmer", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:mlx-serve", "custom_tag:muse_glimmer"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 21435726263}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T03:25:32.989906+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4969688", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-20T11:30:54.600264+00:00", "modelId": "whcl412/mlx-LycheeAI-coder-1.7b", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "8b3c0a82b858cf26b1a0f6075074234a66487d5734741dbbfd4743963b967faa", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 968080210, "estimatedRequiredGiB": 1.095, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 979581804, "modelscopeLicense": "apache-2.0", "modelscopeParams": 268944384, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3", "library:lora", "library:safetensors", "task:text-generation", "custom_tag:qwen3", "custom_tag:coder", "custom_tag:lora", "custom_tag:code", "custom_tag:lychee", "custom_tag:finetune", "custom_tag:multilingual"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 979581804}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T03:25:32.988231+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4969691", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-20T11:30:54.600326+00:00", "modelId": "mlx-community/LFM2.5-1.2B-Instruct-4bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 658540250, "estimatedRequiredGiB": 0.741, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 663396475, "modelscopeLicense": "other", "modelscopeParams": 182975232, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 663396475}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T03:25:33.097294+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4969695", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-20T11:30:54.599961+00:00", "modelId": "aisingapore/Gemma-SEA-LION-v4-27B-IT-FP8-Dynamic", "modelProfile": {"architectures": ["Gemma3ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 29274355224, "estimatedRequiredGiB": 32.761, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma3", "modelscopeFileSize": 29314389092, "modelscopeLicense": "gemma", "modelscopeParams": 27432406640, "modelscopeTags": ["license:gemma", "model_type:gemma3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 29314389092}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T03:30:23.739592+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4969806", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T11:30:54.600197+00:00", "modelId": "IntervitensInc/kek_mk3", "modelProfile": {"architectures": ["StableLmForCausalLM"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 3289069288, "estimatedRequiredGiB": 3.683, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "stablelm", "modelscopeFileSize": 3295875324, "modelscopeLicense": null, "modelscopeParams": 1644515328, "modelscopeTags": ["model_type:stablelm", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 3295875324}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T03:30:23.839811+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4969805", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-20T11:30:54.600320+00:00", "modelId": "sbintuitions/sarashina2.2-3b-instruct-v0.1", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 6711252896, "estimatedRequiredGiB": 7.503, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 6713123803, "modelscopeLicense": "mit", "modelscopeParams": 3355609600, "modelscopeTags": ["license:mit", "model_type:llama", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 6713123803}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T03:30:23.758933+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4969807", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-20T11:30:54.599773+00:00", "modelId": "aisingapore/Gemma-SEA-LION-v4-27B-IT", "modelProfile": {"architectures": ["Gemma3ForConditionalGeneration"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 54864980000, "estimatedRequiredGiB": 61.361, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma3", "modelscopeFileSize": 54904930780, "modelscopeLicense": "gemma", "modelscopeParams": 27432406640, "modelscopeTags": ["license:gemma", "model_type:gemma3", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 54904930780}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T03:30:23.763321+00:00", "targetGpu": "MetaX_c-500", "taskId": "4969808", "taskType": "text-generation", "verifyResult": null}
@@ -1004,9 +1002,9 @@
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-21T19:21:35.063199+00:00", "modelId": "RedHatAI/Meta-Llama-3.1-8B-Instruct-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9084040952, "estimatedRequiredGiB": 10.163, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9093261800, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"ambiguous_runtime": 1, "context_length": 1}, "failureCount": 2, "failureRate": 1.0, "framework": "vllm_tokenizer_patch", "lastTerminalAt": "2026-09-21T10:33:30.477761+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Ascend_910-b3", "taskType": "text-generation", "total": 2, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 9093261800}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T11:18:21.958399+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4999764", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-21T19:21:35.063181+00:00", "modelId": "RedHatAI/Phi-3-small-128k-instruct-quantized.w8a16", "modelProfile": {"architectures": ["Phi3SmallForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8630134648, "estimatedRequiredGiB": 9.647, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3small", "modelscopeFileSize": 8632060880, "modelscopeLicense": "mit", "modelscopeParams": 7803314176, "modelscopeTags": ["license:mit", "model_type:phi3small", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 8632060880}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T11:18:21.960935+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4999762", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-21T19:21:35.063192+00:00", "modelId": "aisingapore/Qwen-SEA-LION-v4-32B-IT-8BIT", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 34327989512, "estimatedRequiredGiB": 38.385, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 34346039951, "modelscopeLicense": "mit", "modelscopeParams": 32762123264, "modelscopeTags": ["license:mit", "model_type:qwen3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 34346039951}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T11:18:21.963694+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4999765", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": null, "modelId": "RedHatAI/Phi-3-mini-128k-instruct-FP8", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4018332584, "estimatedRequiredGiB": 4.494, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 4020783717, "modelscopeLicense": "mit", "modelscopeParams": 3821079552, "modelscopeTags": ["license:mit", "model_type:phi3", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4020783717}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T11:40:35.034782+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5000088", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "JANGQ-AI/Ling-2.6-flash-JANGTQ", "modelProfile": {"architectures": ["BailingMoeV2_5ForCausalLM"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 30593642304, "estimatedRequiredGiB": 34.208, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "bailing_hybrid", "modelscopeFileSize": 30608423891, "modelscopeLicense": "mit", "modelscopeParams": null, "modelscopeTags": ["license:mit", "model_type:bailing_hybrid", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:moe", "custom_tag:mixture-of-experts", "custom_tag:hybrid-attention", "custom_tag:mla", "custom_tag:lightning-attention", "custom_tag:jangtq", "custom_tag:jangq-ai", "custom_tag:mlx", "custom_tag:bailing", "custom_tag:ling", "custom_tag:apple-silicon"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 30608423891}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T11:40:34.995530+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5000087", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "webAI-Official/TwIL-LM3", "modelProfile": {"architectures": ["SmolLM3ForCausalLM"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 6150235096, "estimatedRequiredGiB": 24.879, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "smollm3", "modelscopeFileSize": 22261451381, "modelscopeLicense": "other", "modelscopeParams": 3075098624, "modelscopeTags": ["license:other", "model_type:smollm3", "library:pytorch", "library:transformer", "library:lora", "library:safetensors", "library:gguf", "task:text-generation", "custom_tag:formal-logic", "custom_tag:reasoning", "custom_tag:lora", "custom_tag:model-merging", "custom_tag:wise-ft", "custom_tag:reinforcement-learning", "custom_tag:grpo", "custom_tag:smollm3", "custom_tag:twil-lm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 22261451381}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T11:40:35.004115+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5000089", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-21T19:42:00.658367+00:00", "modelId": "RedHatAI/Phi-3-mini-128k-instruct-FP8", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4018332584, "estimatedRequiredGiB": 4.494, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 4020783717, "modelscopeLicense": "mit", "modelscopeParams": 3821079552, "modelscopeTags": ["license:mit", "model_type:phi3", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4020783717}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T11:40:35.034782+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5000088", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-21T19:42:00.658387+00:00", "modelId": "JANGQ-AI/Ling-2.6-flash-JANGTQ", "modelProfile": {"architectures": ["BailingMoeV2_5ForCausalLM"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 30593642304, "estimatedRequiredGiB": 34.208, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "bailing_hybrid", "modelscopeFileSize": 30608423891, "modelscopeLicense": "mit", "modelscopeParams": null, "modelscopeTags": ["license:mit", "model_type:bailing_hybrid", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:moe", "custom_tag:mixture-of-experts", "custom_tag:hybrid-attention", "custom_tag:mla", "custom_tag:lightning-attention", "custom_tag:jangtq", "custom_tag:jangq-ai", "custom_tag:mlx", "custom_tag:bailing", "custom_tag:ling", "custom_tag:apple-silicon"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 30608423891}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T11:40:34.995530+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5000087", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-21T19:42:00.658349+00:00", "modelId": "webAI-Official/TwIL-LM3", "modelProfile": {"architectures": ["SmolLM3ForCausalLM"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 6150235096, "estimatedRequiredGiB": 24.879, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "smollm3", "modelscopeFileSize": 22261451381, "modelscopeLicense": "other", "modelscopeParams": 3075098624, "modelscopeTags": ["license:other", "model_type:smollm3", "library:pytorch", "library:transformer", "library:lora", "library:safetensors", "library:gguf", "task:text-generation", "custom_tag:formal-logic", "custom_tag:reasoning", "custom_tag:lora", "custom_tag:model-merging", "custom_tag:wise-ft", "custom_tag:reinforcement-learning", "custom_tag:grpo", "custom_tag:smollm3", "custom_tag:twil-lm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 22261451381}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T11:40:35.004115+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5000089", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "JANGQ-AI/Osaurus-AppleScript-8B-JANG_6M", "modelProfile": {"architectures": ["ZayaForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7915599888, "estimatedRequiredGiB": 8.885, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "zaya", "modelscopeFileSize": 7950463197, "modelscopeLicense": "other", "modelscopeParams": 2274126328, "modelscopeTags": ["license:other", "model_type:zaya", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:applescript", "custom_tag:macos", "custom_tag:computer-use", "custom_tag:agent", "custom_tag:tool-calling", "custom_tag:function-calling", "custom_tag:mlx", "custom_tag:moe", "custom_tag:osaurus"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 7950463197}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T11:40:35.210780+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5000137", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-patch-tokenizer", "lastSyncTime": null, "modelId": "neuralmagic/Meta-Llama-3.1-8B-Instruct-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9084040952, "estimatedRequiredGiB": 10.163, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9093261938, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9093261938}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T11:42:21.093921+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5000138", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-patch-tokenizer", "lastSyncTime": null, "modelId": "RedHatAI/Llama-3.2-3B-Instruct-FP8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4395007696, "estimatedRequiredGiB": 4.922, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 4404161034, "modelscopeLicense": "llama3.2", "modelscopeParams": 3606752256, "modelscopeTags": ["license:llama3.2", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:llama", "custom_tag:llama-3", "custom_tag:neuralmagic", "custom_tag:llmcompressor"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4404161034}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-21T11:42:38.193150+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5000196", "taskType": "text-generation", "verifyResult": null}