state: generation 6873 (cycle)

This commit is contained in:
2026-09-13 20:16:49 +00:00
parent 6b4374750b
commit aa4984ea10
10 changed files with 2133 additions and 2112 deletions

View File

@@ -1473,7 +1473,7 @@
"taskType": "text-generation"
}
},
"generatedAt": "2026-09-13T20:13:36.133355+00:00",
"generatedAt": "2026-09-13T20:16:48.732216+00:00",
"summary": {
"activeBlockCount": 74,
"byGpuFramework": {

View File

@@ -19,7 +19,7 @@
"10": {
"complete": false,
"lastError": "ModelHubAPIError: 系统错误",
"listingErrors": 498,
"listingErrors": 499,
"nextPage": 1,
"recordsScanned": 0,
"uniqueRecords": 0
@@ -102,12 +102,12 @@
"cutoffAt": "2026-09-04T03:55:51.365685+00:00",
"failureLogsInspected": 0,
"mode": "incremental_decision_only",
"nextAccountIndex": 10,
"nextAccountIndex": 11,
"recordsScanned": 0,
"seenTaskIds": [],
"startedAt": "2026-09-04T03:55:51.365685+00:00",
"terminalRecords": 0,
"uniqueRecords": 0,
"updatedAt": "2026-09-13T20:13:36.106934+00:00",
"updatedAt": "2026-09-13T20:16:48.706845+00:00",
"version": 1
}

View File

@@ -416,7 +416,7 @@
}
},
"frameworkUpdatedAt": null,
"generatedAt": "2026-09-13T20:10:56.955871+00:00",
"generatedAt": "2026-09-13T20:14:42.920017+00:00",
"gpuStats": {
"Ascend_910-b3": {
"available": true,

File diff suppressed because it is too large Load Diff

View File

@@ -1,6 +1,6 @@
{
"generatedAt": "2026-09-13T19:32:14.274055+00:00",
"lastSyncTime": "2026-09-13T19:32:14.039457+00:00",
"generatedAt": "2026-09-13T20:14:37.132877+00:00",
"lastSyncTime": "2026-09-13T20:14:36.914736+00:00",
"recentLimit": 300,
"report": {
"architectureCompatibilityBlocks": {
@@ -1906,26 +1906,26 @@
"unresolvedFailureCount": 32
},
"Iluvatar_bi-150|vllm_0_17_0_corex_4_4_0|text-generation": {
"attributableFailureCount": 5,
"decisionFailureRate": 0.7143,
"decisionSuccessRate": 0.2857,
"decisionTotal": 7,
"attributableFailureCount": 6,
"decisionFailureRate": 0.75,
"decisionSuccessRate": 0.25,
"decisionTotal": 8,
"failureBreakdown": {
"ambiguous_runtime": 4,
"backend_operator": 3,
"framework_architecture_unsupported": 2
"framework_architecture_unsupported": 3
},
"failureCount": 9,
"failureRate": 0.8182,
"failureCount": 10,
"failureRate": 0.8333,
"framework": "vllm_0_17_0_corex_4_4_0",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 2,
"successRate": 0.1818,
"successRate": 0.1667,
"targetGpu": "Iluvatar_bi-150",
"taskType": "text-generation",
"total": 11,
"total": 12,
"unresolvedFailureCount": 4
},
"Iluvatar_bi-150|vllm|text-generation": {
@@ -2574,23 +2574,23 @@
"unresolvedFailureCount": 8
},
"vllm_0_17_0_corex_4_4_0": {
"attributableFailureCount": 5,
"decisionFailureRate": 0.7143,
"decisionSuccessRate": 0.2857,
"decisionTotal": 7,
"attributableFailureCount": 6,
"decisionFailureRate": 0.75,
"decisionSuccessRate": 0.25,
"decisionTotal": 8,
"failureBreakdown": {
"ambiguous_runtime": 4,
"backend_operator": 3,
"framework_architecture_unsupported": 2
"framework_architecture_unsupported": 3
},
"failureCount": 9,
"failureRate": 0.8182,
"failureCount": 10,
"failureRate": 0.8333,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 2,
"successRate": 0.1818,
"total": 11,
"successRate": 0.1667,
"total": 12,
"unresolvedFailureCount": 4
},
"vllm_fix_tokenizer": {
@@ -2636,7 +2636,7 @@
"unresolvedFailureCount": 1
}
},
"generatedAt": "2026-09-13T19:32:14.269368+00:00",
"generatedAt": "2026-09-13T20:14:37.128504+00:00",
"gpuSummaries": {
"Ascend_910-b3": {
"attributableFailureCount": 31,
@@ -2775,28 +2775,28 @@
"unresolvedFailureCount": 29
},
"Iluvatar_bi-150": {
"attributableFailureCount": 32,
"decisionFailureRate": 0.8,
"decisionSuccessRate": 0.2,
"decisionTotal": 40,
"attributableFailureCount": 33,
"decisionFailureRate": 0.8049,
"decisionSuccessRate": 0.1951,
"decisionTotal": 41,
"failureBreakdown": {
"ambiguous_runtime": 12,
"backend_operator": 6,
"framework_architecture_unsupported": 16,
"framework_architecture_unsupported": 17,
"model_load": 7,
"repository_structure": 1,
"runtime_memory": 2,
"参数/模板问题": 2,
"验证失败": 30
},
"failureCount": 76,
"failureRate": 0.9048,
"failureCount": 77,
"failureRate": 0.9059,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 8,
"successRate": 0.0952,
"total": 84,
"successRate": 0.0941,
"total": 85,
"unresolvedFailureCount": 44
},
"Iluvatar_mrv-100": {
@@ -3466,14 +3466,14 @@
"unresolvedFailureCount": 0
},
"Iluvatar_bi-150|vllm_0_17_0_corex_4_4_0|text-generation|rwkv7|none": {
"attributableFailureCount": 2,
"attributableFailureCount": 3,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 2,
"decisionTotal": 3,
"failureBreakdown": {
"framework_architecture_unsupported": 2
"framework_architecture_unsupported": 3
},
"failureCount": 2,
"failureCount": 3,
"failureRate": 1.0,
"framework": "vllm_0_17_0_corex_4_4_0",
"modelType": "rwkv7",
@@ -3485,7 +3485,7 @@
"successRate": 0.0,
"targetGpu": "Iluvatar_bi-150",
"taskType": "text-generation",
"total": 2,
"total": 3,
"unresolvedFailureCount": 0
},
"Iluvatar_bi-150|vllm_0_17_0_corex_4_4_0|text-generation|starcoder2|compressed-tensors": {
@@ -5896,6 +5896,30 @@
"total": 1,
"unresolvedFailureCount": 0
},
"Iluvatar_bi-150|vllm_0_17_0_corex_4_4_0|text-generation|rwkv7|none|34": {
"attributableFailureCount": 1,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"failureBreakdown": {
"framework_architecture_unsupported": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm_0_17_0_corex_4_4_0",
"loadSizeLog2Bucket": 34,
"modelType": "rwkv7",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "none",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Iluvatar_bi-150",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
},
"Iluvatar_bi-150|vllm_0_17_0_corex_4_4_0|text-generation|starcoder2|compressed-tensors|34": {
"attributableFailureCount": 0,
"decisionFailureRate": 0.0,
@@ -7455,17 +7479,17 @@
"unresolvedFailureCount": 0
}
},
"terminalRecords": 1778,
"totalRecords": 1865,
"terminalRecords": 1779,
"totalRecords": 1866,
"totals": {
"attributableFailureCount": 522,
"decisionFailureRate": 0.8985,
"decisionSuccessRate": 0.1015,
"decisionTotal": 581,
"attributableFailureCount": 523,
"decisionFailureRate": 0.8986,
"decisionSuccessRate": 0.1014,
"decisionTotal": 582,
"failureBreakdown": {
"ambiguous_runtime": 417,
"backend_operator": 43,
"framework_architecture_unsupported": 330,
"framework_architecture_unsupported": 331,
"memory_capacity": 11,
"model_load": 74,
"platform_infrastructure": 4,
@@ -7475,14 +7499,14 @@
"参数/模板问题": 103,
"验证失败": 673
},
"failureCount": 1719,
"failureCount": 1720,
"failureRate": 0.9668,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 4,
"successCount": 59,
"successRate": 0.0332,
"total": 1778,
"total": 1779,
"unresolvedFailureCount": 1193
},
"warnings": [
@@ -7520,6 +7544,6 @@
]
},
"storageMode": "decision_state_only",
"summarizedRecords": 1865,
"summarizedRecords": 1866,
"version": 1
}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -156,7 +156,6 @@
{"framework": "vllm_tokenizer_patch", "modelAddress": "https://modelscope.cn/models/cyankiwi/Apodex-1.1-mini-AWQ-INT4", "modelId": "cyankiwi/Apodex-1.1-mini-AWQ-INT4", "submitTime": "2026-09-06T06:30:19.979390+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4662535", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-tokenizer-patch-ascend-910-b4"}
{"framework": "vllm_0_17_0_corex_4_4_0", "modelAddress": "https://modelscope.cn/models/cyankiwi/Apodex-1.1-mini-AWQ-INT4", "modelId": "cyankiwi/Apodex-1.1-mini-AWQ-INT4", "submitTime": "2026-09-06T07:02:35.712857+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4662918", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-0-17-0-corex-4-4-0-iluvatar-bi-150"}
{"framework": "vllm-patch-tokenizer", "modelAddress": "https://modelscope.cn/models/cyankiwi/Apodex-1.1-mini-AWQ-INT4", "modelId": "cyankiwi/Apodex-1.1-mini-AWQ-INT4", "submitTime": "2026-09-06T07:17:44.185498+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4663094", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-patch-tokenizer-hygon-k100-ai"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/RWKV/RWKV7-13.3B-20260805", "modelId": "RWKV/RWKV7-13.3B-20260805", "submitTime": "2026-09-06T07:35:56.293000+00:00", "targetGpu": "MetaX_c-500", "taskId": "4663310", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-metax-c-500"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/inferencerlabs/DeepSeek-V4-Flash-MTP-DSpark-MLX", "modelId": "inferencerlabs/DeepSeek-V4-Flash-MTP-DSpark-MLX", "submitTime": "2026-09-06T07:56:28.496520+00:00", "targetGpu": "MetaX_c-500", "taskId": "4663539", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-metax-c-500"}
{"framework": "vllm_tokenizer_patch", "modelAddress": "https://modelscope.cn/models/empero-ai/Qwen3.8-4B-Distill", "modelId": "empero-ai/Qwen3.8-4B-Distill", "submitTime": "2026-09-06T08:12:14.777960+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4663715", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-tokenizer-patch-ascend-910-b4"}
{"framework": "vllm-mlu", "modelAddress": "https://modelscope.cn/models/empero-ai/Qwen3.8-4B-Distill", "modelId": "empero-ai/Qwen3.8-4B-Distill", "submitTime": "2026-09-06T08:34:09.456899+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4664143", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-mlu-cambricon-mlu-370-x4"}

View File

@@ -1,24 +1,24 @@
{
"agentVersion": "2026.09.04.4",
"checksums": {
".modelhub_state/architecture_compatibility_blacklist.json": "c69f9621e24108b0ae54bee6db3859701aa2f7af989a0910f4992ca380b734de",
".modelhub_state/architecture_history_backfill.json": "d52acdc4161ecf49a57b2446c00bd76378d1e51ccb1e2c61cdf8cff8f7468f76",
".modelhub_state/market_intelligence.json": "a5e515f11ceae115816e874563ebf0cd8d56f3efd00de7f5237103ab256d6e1f",
".modelhub_state/official_capabilities.json": "c1fa572629b1f8984d5a7ad92841f101cd03347201ddec11dfc69f44d204e9a3",
".modelhub_state/outcome_checkpoint.json": "adc7d90aed925044b26fa6b3f08c91d0adce5fecffa295603cffd06e3ed98f63",
".modelhub_state/architecture_compatibility_blacklist.json": "119ada491a4e5735ad71c72ad8c93c0396250c00627229d9bbe680cdf7415c0e",
".modelhub_state/architecture_history_backfill.json": "9e03fb970c13745a52d3ae7cfb182bf89b5333e1e362b554e5d8d7d536c8d4df",
".modelhub_state/market_intelligence.json": "cf72cd0ff4144552f39e5a478020a214ea5b16f876e44a5662720d7d180823f8",
".modelhub_state/official_capabilities.json": "9932355f5b78f74f537d9b191f1d50ed990461c3e41b9e3eb9ac84cc8c5ee79c",
".modelhub_state/outcome_checkpoint.json": "74c74711eeecb1c4d3864a7dc245863970ac690983d6861ca9ec6b62223d4b22",
".modelhub_state/queue_cleanup_latest.json": "f6b895b8233e19c5bd02b8861821ba25e5d8be5e7e5a8f29f659c01494c3199a",
".modelhub_state/recent_outcomes.jsonl": "62b659944f45c7254ddc38a7b6cc46a7faeab71e86fe611c2bf089c4a8bc96d0",
".modelhub_state/recovery_active_tasks.jsonl": "54541388b6995387e07f94a10cf1e9b0b9bb11e44af55403e64080b64255955a",
".modelhub_state/recovery_intents.jsonl": "7b9429ab3f9126dbfbdbce801edc7b01291823def0025907bc02d7df61f4c40e",
".modelhub_state/recovery_active_tasks.jsonl": "a52d68a2d3cd755c951f08e17a496882614530336b291020418703284d1f34f1",
".modelhub_state/recovery_intents.jsonl": "a4d77e0d789a804340d869fb99a8d28f6f599b7e19a764f792533e8ce1a61160",
".modelhub_state/routing_intelligence.json": "5a1ee27e192bc4bf70cd4d2daa949d5d751710cc5c0bbbd5862821ee6607cb9a",
".modelhub_state/submission_exclusions.jsonl": "75ddc8b4d313a8cecec2f373afc57298143d78e0eb907ca44f420d7bf9c55263",
".modelhub_state/worker_crashes.jsonl": "53505d335313446ff7094bcb58658b561de55799302fa7bfb49e418e414eebad",
"ledger/submissions.jsonl": "80af945498d223eb166c73c431271176748e3d71dc49860f65a33aa7bcf3838b",
"outcomes/submissions.jsonl": "fe8489af4d6ae86d2205104bcdc4b07026eb8b0c6496f5e1103e9e177adfabc7"
"ledger/submissions.jsonl": "33d100b2fe0a0d29850575dfa70c143ffed83fe29f84f55269b56b43c3757476",
"outcomes/submissions.jsonl": "990c40b70a88f527661fbfbb7d44ec57b4421669e8c96260c08f575467010411"
},
"generation": 6872,
"generation": 6873,
"phase": "cycle",
"schemaVersion": 1,
"updatedAt": "2026-09-13T20:13:36.251313+00:00",
"updatedAt": "2026-09-13T20:16:49.307534+00:00",
"writerId": "69701e73196b4ac2b3fad0f412335168"
}

View File

@@ -120,7 +120,6 @@
{"failReason": null, "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-05T21:24:35.912104+00:00", "modelId": "inferencerlabs/DeepSeek-V4-Flash-MTP-DSpark-MLX", "modelProfile": {"architectures": [], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 12994906286, "estimatedRequiredGiB": 14.53, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "deepseek_v4_dspark", "modelscopeFileSize": 13001289422, "modelscopeLicense": null, "modelscopeParams": 4276397927, "modelscopeTags": ["model_type:deepseek_v4_dspark", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 13001289422}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T13:15:06.887234+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4649370", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-05T21:42:08.215425+00:00", "modelId": "RWKV/RWKV7-7.2B-20260805", "modelProfile": {"architectures": ["Rwkv7ForCausalLM"], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 14399972864, "estimatedRequiredGiB": 16.095, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "rwkv7", "modelscopeFileSize": 14402000339, "modelscopeLicense": "apache-2.0", "modelscopeParams": 7199932416, "modelscopeTags": ["license:apache-2.0", "model_type:rwkv7", "library:safetensors", "task:text-generation", "custom_tag:rwkv", "custom_tag:rwkv7", "custom_tag:recurrent", "custom_tag:causal-lm", "custom_tag:conversational"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 14402000339}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T13:36:05.794989+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4649667", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "llamacpp", "lastSyncTime": "2026-09-05T21:42:08.215400+00:00", "modelId": "LiquidAI/LFM2.5-8B-A1B-DSpark-GGUF", "modelProfile": {"architectures": [], "configFingerprint": "49c09622b187326c7d52c77c501ea1ed17ae85611b418c974c6d1dd95d2ec84c", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 356491104, "estimatedRequiredGiB": 1.363, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": null, "modelscopeFileSize": 1219879026, "modelscopeLicense": "other", "modelscopeParams": 327707521, "modelscopeTags": ["license:other", "library:gguf", "library:pytorch", "task:text-generation", "custom_tag:speculative-decoding", "custom_tag:dspark", "custom_tag:lfm2", "custom_tag:draft-model", "custom_tag:gguf", "deploy:swingdeploy"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 1219879026}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T13:40:05.806797+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4649761", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-05T21:42:08.215443+00:00", "modelId": "RWKV/RWKV7-13.3B-20260805", "modelProfile": {"architectures": ["Rwkv7ForCausalLM"], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 26540803088, "estimatedRequiredGiB": 29.664, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "rwkv7", "modelscopeFileSize": 26542898184, "modelscopeLicense": "apache-2.0", "modelscopeParams": 13270298624, "modelscopeTags": ["license:apache-2.0", "model_type:rwkv7", "library:safetensors", "task:text-generation", "custom_tag:rwkv", "custom_tag:rwkv7", "custom_tag:recurrent", "custom_tag:causal-lm", "custom_tag:conversational"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 26542898184}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T13:40:05.816872+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4649762", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-05T21:50:41.400421+00:00", "modelId": "ornith-ai/Ornith-1.5-35B-A3B-MLX-6bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 28168623119, "estimatedRequiredGiB": 31.505, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 28190535646, "modelscopeLicense": null, "modelscopeParams": 7584230528, "modelscopeTags": ["model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 28190535646}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T13:43:45.755060+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4649829", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-05T22:00:13.693262+00:00", "modelId": "r0b0tlab/Qwen3.8-27B-NVFP4-MTP-sm121", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 21921675140, "estimatedRequiredGiB": 24.525, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 21944922993, "modelscopeLicense": "apache-2.0", "modelscopeParams": 18589348592, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:nvfp4", "custom_tag:vllm", "custom_tag:sm121", "custom_tag:gb10", "custom_tag:dgx-spark", "custom_tag:mtp", "custom_tag:speculative-decoding", "custom_tag:modelopt"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "modelopt", "repositoryOnDiskBytes": 21944922993}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T13:52:09.758631+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4650028", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-05T22:00:13.693287+00:00", "modelId": "FlagRelease/DeepSeek-R1-Distill-Qwen-1.5B-mthreads-FlagOS", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 3554214621, "estimatedRequiredGiB": 3.984, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 3564406686, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1777088000, "modelscopeTags": ["license:apache-2.0", "model_type:qwen2", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 3564406686}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T13:55:22.931577+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4650076", "taskType": "text-generation", "verifyResult": null}
@@ -635,7 +634,7 @@
{"failReason": null, "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-13T14:08:03.641274+00:00", "modelId": "XHToken/Spark-X2.5-4B-INT8", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4454282952, "estimatedRequiredGiB": 4.995, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 4469587176, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4469587176}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-13T06:03:08.407319+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4819935", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-13T17:57:25.416298+00:00", "modelId": "XHToken/Spark-X2.5-4B-INT8", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4454282952, "estimatedRequiredGiB": 4.995, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 4469587176, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4469587176}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-13T09:53:52.905331+00:00", "targetGpu": "MetaX_c-500", "taskId": "4823778", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-13T18:17:59.899586+00:00", "modelId": "XHToken/Spark-X2.5-4B-INT8", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4454282952, "estimatedRequiredGiB": 4.995, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 4469587176, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4469587176}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-13T10:16:13.410881+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4824251", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "XHToken/Spark-X2.5-4B-INT8", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "cbe5569cdb6c42553436b837dd5b8f0cfa03334642a56f4ff0137f952f8eb84b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4454282952, "estimatedRequiredGiB": 4.995, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 4469587176, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4469587176}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-13T12:09:15.680573+00:00", "targetGpu": "Vastai_va16", "taskId": "4827491", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-13T20:14:36.914736+00:00", "modelId": "XHToken/Spark-X2.5-4B-INT8", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "cbe5569cdb6c42553436b837dd5b8f0cfa03334642a56f4ff0137f952f8eb84b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4454282952, "estimatedRequiredGiB": 4.995, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 4469587176, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4469587176}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-13T12:09:15.680573+00:00", "targetGpu": "Vastai_va16", "taskId": "4827491", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": null, "modelId": "XHToken/Spark-X2.5-4B-INT8", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4454282952, "estimatedRequiredGiB": 4.995, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 4469587176, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4469587176}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-13T14:02:33.487789+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4829151", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "XHToken/Spark-X2.5-4B-INT8", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4454282952, "estimatedRequiredGiB": 4.995, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 4469587176, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4469587176}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-13T14:24:08.911334+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4829350", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "XHToken/Spark-X2.5-4B-INT8", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4454282952, "estimatedRequiredGiB": 4.995, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 4469587176, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4469587176}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-13T19:22:45.622511+00:00", "targetGpu": "Biren_166m", "taskId": "4834315", "taskType": "text-generation", "verifyResult": null}