state: generation 9338 (cycle)
This commit is contained in:
@@ -1743,7 +1743,7 @@
|
||||
"taskType": "text-generation"
|
||||
}
|
||||
},
|
||||
"generatedAt": "2026-09-18T15:47:55.479202+00:00",
|
||||
"generatedAt": "2026-09-18T15:51:05.837078+00:00",
|
||||
"summary": {
|
||||
"activeBlockCount": 84,
|
||||
"byGpuFramework": {
|
||||
|
||||
@@ -75,7 +75,7 @@
|
||||
"7": {
|
||||
"complete": false,
|
||||
"lastError": "ModelHubAPIError: 系统错误",
|
||||
"listingErrors": 680,
|
||||
"listingErrors": 681,
|
||||
"nextPage": 1,
|
||||
"recordsScanned": 0,
|
||||
"uniqueRecords": 0
|
||||
@@ -102,12 +102,12 @@
|
||||
"cutoffAt": "2026-09-04T03:55:51.365685+00:00",
|
||||
"failureLogsInspected": 0,
|
||||
"mode": "incremental_decision_only",
|
||||
"nextAccountIndex": 7,
|
||||
"nextAccountIndex": 8,
|
||||
"recordsScanned": 0,
|
||||
"seenTaskIds": [],
|
||||
"startedAt": "2026-09-04T03:55:51.365685+00:00",
|
||||
"terminalRecords": 0,
|
||||
"uniqueRecords": 0,
|
||||
"updatedAt": "2026-09-18T15:47:55.455797+00:00",
|
||||
"updatedAt": "2026-09-18T15:51:05.812556+00:00",
|
||||
"version": 1
|
||||
}
|
||||
|
||||
@@ -416,7 +416,7 @@
|
||||
}
|
||||
},
|
||||
"frameworkUpdatedAt": null,
|
||||
"generatedAt": "2026-09-18T15:46:17.476413+00:00",
|
||||
"generatedAt": "2026-09-18T15:49:03.066467+00:00",
|
||||
"gpuStats": {
|
||||
"Ascend_910-b3": {
|
||||
"available": true,
|
||||
|
||||
File diff suppressed because it is too large
Load Diff
@@ -1,6 +1,6 @@
|
||||
{
|
||||
"generatedAt": "2026-09-18T15:41:29.020363+00:00",
|
||||
"lastSyncTime": "2026-09-18T15:41:28.787881+00:00",
|
||||
"generatedAt": "2026-09-18T15:48:56.658923+00:00",
|
||||
"lastSyncTime": "2026-09-18T15:48:56.587431+00:00",
|
||||
"recentLimit": 300,
|
||||
"report": {
|
||||
"architectureCompatibilityBlocks": {
|
||||
@@ -2510,9 +2510,9 @@
|
||||
},
|
||||
"Mthreads_s4000|vllm|text-generation": {
|
||||
"attributableFailureCount": 52,
|
||||
"decisionFailureRate": 0.8667,
|
||||
"decisionSuccessRate": 0.1333,
|
||||
"decisionTotal": 60,
|
||||
"decisionFailureRate": 0.8525,
|
||||
"decisionSuccessRate": 0.1475,
|
||||
"decisionTotal": 61,
|
||||
"failureBreakdown": {
|
||||
"ambiguous_runtime": 45,
|
||||
"backend_operator": 6,
|
||||
@@ -2525,16 +2525,16 @@
|
||||
"参数/模板问题": 12
|
||||
},
|
||||
"failureCount": 109,
|
||||
"failureRate": 0.9316,
|
||||
"failureRate": 0.9237,
|
||||
"framework": "vllm",
|
||||
"pendingCount": 0,
|
||||
"pendingRate": 0.0,
|
||||
"platformFailureCount": 0,
|
||||
"successCount": 8,
|
||||
"successRate": 0.0684,
|
||||
"successCount": 9,
|
||||
"successRate": 0.0763,
|
||||
"targetGpu": "Mthreads_s4000",
|
||||
"taskType": "text-generation",
|
||||
"total": 117,
|
||||
"total": 118,
|
||||
"unresolvedFailureCount": 57
|
||||
},
|
||||
"Sunrise_pt-200-x1|unknown|text-generation": {
|
||||
@@ -2842,9 +2842,9 @@
|
||||
},
|
||||
"vllm": {
|
||||
"attributableFailureCount": 414,
|
||||
"decisionFailureRate": 0.9039,
|
||||
"decisionSuccessRate": 0.0961,
|
||||
"decisionTotal": 458,
|
||||
"decisionFailureRate": 0.902,
|
||||
"decisionSuccessRate": 0.098,
|
||||
"decisionTotal": 459,
|
||||
"failureBreakdown": {
|
||||
"ambiguous_runtime": 241,
|
||||
"backend_operator": 40,
|
||||
@@ -2858,13 +2858,13 @@
|
||||
"参数/模板问题": 40
|
||||
},
|
||||
"failureCount": 697,
|
||||
"failureRate": 0.9406,
|
||||
"failureRate": 0.9394,
|
||||
"pendingCount": 0,
|
||||
"pendingRate": 0.0,
|
||||
"platformFailureCount": 2,
|
||||
"successCount": 44,
|
||||
"successRate": 0.0594,
|
||||
"total": 741,
|
||||
"successCount": 45,
|
||||
"successRate": 0.0606,
|
||||
"total": 742,
|
||||
"unresolvedFailureCount": 281
|
||||
},
|
||||
"vllm-mlu": {
|
||||
@@ -2977,7 +2977,7 @@
|
||||
"unresolvedFailureCount": 18
|
||||
}
|
||||
},
|
||||
"generatedAt": "2026-09-18T15:41:29.014648+00:00",
|
||||
"generatedAt": "2026-09-18T15:48:56.653712+00:00",
|
||||
"gpuSummaries": {
|
||||
"Ascend_910-b3": {
|
||||
"attributableFailureCount": 58,
|
||||
@@ -3216,9 +3216,9 @@
|
||||
},
|
||||
"Mthreads_s4000": {
|
||||
"attributableFailureCount": 53,
|
||||
"decisionFailureRate": 0.8413,
|
||||
"decisionSuccessRate": 0.1587,
|
||||
"decisionTotal": 63,
|
||||
"decisionFailureRate": 0.8281,
|
||||
"decisionSuccessRate": 0.1719,
|
||||
"decisionTotal": 64,
|
||||
"failureBreakdown": {
|
||||
"ambiguous_runtime": 45,
|
||||
"backend_operator": 6,
|
||||
@@ -3232,13 +3232,13 @@
|
||||
"验证失败": 26
|
||||
},
|
||||
"failureCount": 144,
|
||||
"failureRate": 0.9351,
|
||||
"failureRate": 0.929,
|
||||
"pendingCount": 0,
|
||||
"pendingRate": 0.0,
|
||||
"platformFailureCount": 0,
|
||||
"successCount": 10,
|
||||
"successRate": 0.0649,
|
||||
"total": 154,
|
||||
"successCount": 11,
|
||||
"successRate": 0.071,
|
||||
"total": 155,
|
||||
"unresolvedFailureCount": 91
|
||||
},
|
||||
"Sunrise_pt-200-x1": {
|
||||
@@ -6774,7 +6774,7 @@
|
||||
"attributableFailureCount": 0,
|
||||
"decisionFailureRate": 0.0,
|
||||
"decisionSuccessRate": 1.0,
|
||||
"decisionTotal": 2,
|
||||
"decisionTotal": 3,
|
||||
"failureBreakdown": {},
|
||||
"failureCount": 0,
|
||||
"failureRate": 0.0,
|
||||
@@ -6784,11 +6784,11 @@
|
||||
"pendingRate": 0.0,
|
||||
"platformFailureCount": 0,
|
||||
"quantizationMethod": "none",
|
||||
"successCount": 2,
|
||||
"successCount": 3,
|
||||
"successRate": 1.0,
|
||||
"targetGpu": "Mthreads_s4000",
|
||||
"taskType": "text-generation",
|
||||
"total": 2,
|
||||
"total": 3,
|
||||
"unresolvedFailureCount": 0
|
||||
},
|
||||
"Mthreads_s4000|vllm|text-generation|spark2_5|fp8": {
|
||||
@@ -13548,7 +13548,7 @@
|
||||
"attributableFailureCount": 0,
|
||||
"decisionFailureRate": 0.0,
|
||||
"decisionSuccessRate": 1.0,
|
||||
"decisionTotal": 1,
|
||||
"decisionTotal": 2,
|
||||
"failureBreakdown": {},
|
||||
"failureCount": 0,
|
||||
"failureRate": 0.0,
|
||||
@@ -13559,11 +13559,11 @@
|
||||
"pendingRate": 0.0,
|
||||
"platformFailureCount": 0,
|
||||
"quantizationMethod": "none",
|
||||
"successCount": 1,
|
||||
"successCount": 2,
|
||||
"successRate": 1.0,
|
||||
"targetGpu": "Mthreads_s4000",
|
||||
"taskType": "text-generation",
|
||||
"total": 1,
|
||||
"total": 2,
|
||||
"unresolvedFailureCount": 0
|
||||
},
|
||||
"Mthreads_s4000|vllm|text-generation|qwen3|none|33": {
|
||||
@@ -14549,13 +14549,13 @@
|
||||
"unresolvedFailureCount": 0
|
||||
}
|
||||
},
|
||||
"terminalRecords": 2259,
|
||||
"totalRecords": 2362,
|
||||
"terminalRecords": 2260,
|
||||
"totalRecords": 2363,
|
||||
"totals": {
|
||||
"attributableFailureCount": 736,
|
||||
"decisionFailureRate": 0.8411,
|
||||
"decisionSuccessRate": 0.1589,
|
||||
"decisionTotal": 875,
|
||||
"decisionFailureRate": 0.8402,
|
||||
"decisionSuccessRate": 0.1598,
|
||||
"decisionTotal": 876,
|
||||
"failureBreakdown": {
|
||||
"ambiguous_runtime": 567,
|
||||
"backend_operator": 55,
|
||||
@@ -14570,13 +14570,13 @@
|
||||
"验证失败": 673
|
||||
},
|
||||
"failureCount": 2120,
|
||||
"failureRate": 0.9385,
|
||||
"failureRate": 0.9381,
|
||||
"pendingCount": 0,
|
||||
"pendingRate": 0.0,
|
||||
"platformFailureCount": 11,
|
||||
"successCount": 139,
|
||||
"successRate": 0.0615,
|
||||
"total": 2259,
|
||||
"successCount": 140,
|
||||
"successRate": 0.0619,
|
||||
"total": 2260,
|
||||
"unresolvedFailureCount": 1373
|
||||
},
|
||||
"warnings": [
|
||||
@@ -14616,6 +14616,6 @@
|
||||
]
|
||||
},
|
||||
"storageMode": "decision_state_only",
|
||||
"summarizedRecords": 2362,
|
||||
"summarizedRecords": 2363,
|
||||
"version": 1
|
||||
}
|
||||
|
||||
File diff suppressed because it is too large
Load Diff
File diff suppressed because it is too large
Load Diff
@@ -1,24 +1,24 @@
|
||||
{
|
||||
"agentVersion": "2026.09.04.4",
|
||||
"checksums": {
|
||||
".modelhub_state/architecture_compatibility_blacklist.json": "9c846a3af9848aa1601266b9d0b72332daef55ecf8ef65b9bbc206ab617eb287",
|
||||
".modelhub_state/architecture_history_backfill.json": "3fd9e35a3eca0cd34fe3fbcbff2670f637df5cafc7c35f5cd953c657c15b5966",
|
||||
".modelhub_state/market_intelligence.json": "c62fe15fc48a4c15d8678e04c855d163196030cdff07ba329e62e17b8cf1a292",
|
||||
".modelhub_state/official_capabilities.json": "663bd0960981ae49ba7f142740573f3feebf8587c4c7c0fcd8cf9c9e89203742",
|
||||
".modelhub_state/outcome_checkpoint.json": "207c01d06e253bec7628f56745b2bff92ecc3cac15abebdca7d5a18033f3497b",
|
||||
".modelhub_state/architecture_compatibility_blacklist.json": "9c1c2ff12d292d5fb2f8b41206415bed29819dba8acf2a12459438471acd186f",
|
||||
".modelhub_state/architecture_history_backfill.json": "e6c392a45fd359a86dc2056b535c9a4540858eac1f5fd9e46405e65e3739aa0a",
|
||||
".modelhub_state/market_intelligence.json": "7e9925aecf09c8e3a6cac6c05a8ddb58ba2f36d53dbba8a7ce4f2c6c28aa7a80",
|
||||
".modelhub_state/official_capabilities.json": "78b88857f059ff02d2a58eac956a535a15fdb4959f49ed94dd14bde58c178110",
|
||||
".modelhub_state/outcome_checkpoint.json": "7cd3911d7c24d4cc7b0e4172aee6dcccdb7ae0630ceab841c085dd2e3622e313",
|
||||
".modelhub_state/queue_cleanup_latest.json": "3c142558258883a3e45602d09e9392c46bfde3deae83aabc51d01f3b1c2d91d9",
|
||||
".modelhub_state/recent_outcomes.jsonl": "2d5bc67a36c72a2c3a6906f9d6fc23b5e73c0a4175033a1552d7b0978d7da2c4",
|
||||
".modelhub_state/recovery_active_tasks.jsonl": "925c8e4a1cd651cf1b5b6bda202f43bc9e7b6d27c0d02b84d52014ea0649ee5f",
|
||||
".modelhub_state/recovery_intents.jsonl": "d84b6cc1c323d747cfc3546467d92d5ea71148f440247c955e5cbeddc991e1e3",
|
||||
".modelhub_state/recovery_active_tasks.jsonl": "bd3192b92458651c3b88ac1f92c0fe5b3a605ce53d88c8cf2414a44d039888e1",
|
||||
".modelhub_state/recovery_intents.jsonl": "1d03262951693798136f7c86c2fb149865f20e6d19c198ef617bf987a0717829",
|
||||
".modelhub_state/routing_intelligence.json": "25da9799dda2a946dbe1ce38e329b5c92cc086d00b8d65f7373f59bc725883f9",
|
||||
".modelhub_state/submission_exclusions.jsonl": "cd362b9c480f30eb8106e264359b19b37b894120db54586e63b0a0d1d41a73b0",
|
||||
".modelhub_state/worker_crashes.jsonl": "a494412048eca6dce83e7284303a6b4b56a445c1274ac201ab8723c739a14f23",
|
||||
"ledger/submissions.jsonl": "3cc3885b0da2e656b60f8662f9b9fbbbaf01f43a076000f79e36ed84e59900fd",
|
||||
"outcomes/submissions.jsonl": "3056ad9670a6d91622ea3d63b9ad200aa0498a848e895c9ec9d1d80c6d86b447"
|
||||
"outcomes/submissions.jsonl": "5df9b6a829f24fb3113b888b04307e4025aba7c558521776d3330742668ee8a5"
|
||||
},
|
||||
"generation": 9337,
|
||||
"generation": 9338,
|
||||
"phase": "cycle",
|
||||
"schemaVersion": 1,
|
||||
"updatedAt": "2026-09-18T15:47:55.546093+00:00",
|
||||
"updatedAt": "2026-09-18T15:51:06.298738+00:00",
|
||||
"writerId": "217f1806b49c401894bed7ce18be9095"
|
||||
}
|
||||
|
||||
@@ -142,7 +142,6 @@
|
||||
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-09T08:15:14.695125+00:00", "modelId": "whq1111/M2RL-SFT", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044982008, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912361, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8060912361}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-09T00:13:45.012578+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4730585", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-09T08:15:14.695156+00:00", "modelId": "whq1111/M2RL-RL_Math", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044981872, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912225, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8060912225}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-09T00:13:44.995252+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4730580", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-09T08:15:14.695177+00:00", "modelId": "whq1111/M2RL-MT_OPD", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044982008, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912361, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8060912361}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-09T00:13:45.014363+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4730587", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-09T08:15:14.695114+00:00", "modelId": "whq1111/M2RL-RL_Agent", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044981872, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912225, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8060912225}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-09T00:13:45.003355+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4730583", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-09T08:15:14.695136+00:00", "modelId": "whq1111/M2RL-RL_Multi", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044981872, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912225, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8060912225}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-09T00:13:45.007232+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4730581", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-09T08:15:14.695108+00:00", "modelId": "whq1111/M2RL-RL_Coding", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044981872, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912225, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8060912225}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-09T00:13:45.047245+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4730590", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-09T08:15:14.695150+00:00", "modelId": "whq1111/M2RL-RL_IF", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044981832, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912185, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8060912185}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-09T00:13:45.027681+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4730589", "taskType": "text-generation", "verifyResult": null}
|
||||
@@ -525,7 +524,7 @@
|
||||
{"failReason": null, "framework": "vllm-customized", "lastSyncTime": "2026-09-18T08:13:18.585864+00:00", "modelId": "mlx-community/Ornith-1.5-35B-A3B-OptiQ-4bit-REAP-19B", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 13736538977, "estimatedRequiredGiB": 15.375, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 13756989526, "modelscopeLicense": "apache-2.0", "modelscopeParams": 3825799024, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:expert-pruning", "custom_tag:reap", "custom_tag:moe", "custom_tag:optiq", "custom_tag:apple-silicon", "custom_tag:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 13756989526}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-18T00:10:06.800446+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4925021", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-18T10:35:01.790461+00:00", "modelId": "mlx-community/Ornith-1.5-35B-A3B-OptiQ-4bit-REAP-19B", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 13736538977, "estimatedRequiredGiB": 15.375, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 13756989526, "modelscopeLicense": "apache-2.0", "modelscopeParams": 3825799024, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:expert-pruning", "custom_tag:reap", "custom_tag:moe", "custom_tag:optiq", "custom_tag:apple-silicon", "custom_tag:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 13756989526}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-18T02:29:42.495408+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4926623", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-18T15:32:08.587692+00:00", "modelId": "prism-ml/Ternary-Bonsai-2-27B-mlx-2bit", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8595477990, "estimatedRequiredGiB": 9.621, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "prism_hadamard_qwen35", "modelscopeFileSize": 8608734989, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2589078768, "modelscopeTags": ["license:apache-2.0", "model_type:prism_hadamard_qwen35", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:ternary", "custom_tag:2-bit", "custom_tag:mlx", "custom_tag:cuda", "custom_tag:metal", "custom_tag:on-device", "custom_tag:hybrid-attention", "custom_tag:prismml", "custom_tag:bonsai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8608734989}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-18T07:28:59.047241+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4930745", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "prism-ml/Ternary-Bonsai-2-27B-mlx-2bit", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8595477990, "estimatedRequiredGiB": 9.621, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "prism_hadamard_qwen35", "modelscopeFileSize": 8608734989, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2589078768, "modelscopeTags": ["license:apache-2.0", "model_type:prism_hadamard_qwen35", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:ternary", "custom_tag:2-bit", "custom_tag:mlx", "custom_tag:cuda", "custom_tag:metal", "custom_tag:on-device", "custom_tag:hybrid-attention", "custom_tag:prismml", "custom_tag:bonsai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8608734989}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-18T07:47:08.881305+00:00", "targetGpu": "MetaX_c-500", "taskId": "4931369", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-18T15:48:56.587408+00:00", "modelId": "prism-ml/Ternary-Bonsai-2-27B-mlx-2bit", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8595477990, "estimatedRequiredGiB": 9.621, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "prism_hadamard_qwen35", "modelscopeFileSize": 8608734989, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2589078768, "modelscopeTags": ["license:apache-2.0", "model_type:prism_hadamard_qwen35", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:ternary", "custom_tag:2-bit", "custom_tag:mlx", "custom_tag:cuda", "custom_tag:metal", "custom_tag:on-device", "custom_tag:hybrid-attention", "custom_tag:prismml", "custom_tag:bonsai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8608734989}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-18T07:47:08.881305+00:00", "targetGpu": "MetaX_c-500", "taskId": "4931369", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "prism-ml/Ternary-Bonsai-2-27B-mlx-2bit", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8595477990, "estimatedRequiredGiB": 9.621, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "prism_hadamard_qwen35", "modelscopeFileSize": 8608734989, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2589078768, "modelscopeTags": ["license:apache-2.0", "model_type:prism_hadamard_qwen35", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:ternary", "custom_tag:2-bit", "custom_tag:mlx", "custom_tag:cuda", "custom_tag:metal", "custom_tag:on-device", "custom_tag:hybrid-attention", "custom_tag:prismml", "custom_tag:bonsai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8608734989}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-18T08:04:28.268356+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4931543", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "prism-ml/Ternary-Bonsai-2-27B-mlx-2bit", "modelProfile": {"architectures": [], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8595477990, "estimatedRequiredGiB": 9.621, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "prism_hadamard_qwen35", "modelscopeFileSize": 8608734989, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2589078768, "modelscopeTags": ["license:apache-2.0", "model_type:prism_hadamard_qwen35", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:ternary", "custom_tag:2-bit", "custom_tag:mlx", "custom_tag:cuda", "custom_tag:metal", "custom_tag:on-device", "custom_tag:hybrid-attention", "custom_tag:prismml", "custom_tag:bonsai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8608734989}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-18T08:21:55.437762+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "4931755", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": null, "modelId": "prism-ml/Ternary-Bonsai-2-27B-mlx-2bit", "modelProfile": {"architectures": [], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8595477990, "estimatedRequiredGiB": 9.621, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "prism_hadamard_qwen35", "modelscopeFileSize": 8608734989, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2589078768, "modelscopeTags": ["license:apache-2.0", "model_type:prism_hadamard_qwen35", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:ternary", "custom_tag:2-bit", "custom_tag:mlx", "custom_tag:cuda", "custom_tag:metal", "custom_tag:on-device", "custom_tag:hybrid-attention", "custom_tag:prismml", "custom_tag:bonsai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8608734989}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-18T08:30:26.717917+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4931821", "taskType": "text-generation", "verifyResult": null}
|
||||
|
||||
Reference in New Issue
Block a user