state: generation 5075 (cycle)

This commit is contained in:
2026-09-10 08:30:11 +00:00
parent efa8c29eb9
commit d81fb93c58
10 changed files with 2384 additions and 2385 deletions

View File

@@ -1317,7 +1317,7 @@
"taskType": "text-generation"
}
},
"generatedAt": "2026-09-10T08:27:00.499217+00:00",
"generatedAt": "2026-09-10T08:30:11.352926+00:00",
"summary": {
"activeBlockCount": 66,
"byGpuFramework": {

View File

@@ -11,7 +11,7 @@
"1": {
"complete": false,
"lastError": "ModelHubAPIError: 系统错误",
"listingErrors": 360,
"listingErrors": 361,
"nextPage": 1,
"recordsScanned": 0,
"uniqueRecords": 0
@@ -102,12 +102,12 @@
"cutoffAt": "2026-09-04T03:55:51.365685+00:00",
"failureLogsInspected": 0,
"mode": "incremental_decision_only",
"nextAccountIndex": 1,
"nextAccountIndex": 2,
"recordsScanned": 0,
"seenTaskIds": [],
"startedAt": "2026-09-04T03:55:51.365685+00:00",
"terminalRecords": 0,
"uniqueRecords": 0,
"updatedAt": "2026-09-10T08:27:00.476612+00:00",
"updatedAt": "2026-09-10T08:30:11.330517+00:00",
"version": 1
}

View File

@@ -1,8 +1,8 @@
{
"communityAttemptedAt": "2026-09-10T08:11:06.664506+00:00",
"communityAttemptedAt": "2026-09-10T08:28:07.952113+00:00",
"communityError": null,
"communitySample": {},
"communityUpdatedAt": "2026-09-10T08:11:06.664506+00:00",
"communityUpdatedAt": "2026-09-10T08:28:07.952113+00:00",
"frameworkAttemptedAt": "2026-09-10T06:33:41.338309+00:00",
"frameworkError": null,
"frameworkStats": {
@@ -416,121 +416,121 @@
}
},
"frameworkUpdatedAt": null,
"generatedAt": "2026-09-10T08:25:29.894819+00:00",
"generatedAt": "2026-09-10T08:28:07.952113+00:00",
"gpuStats": {
"Ascend_910-b3": {
"available": true,
"backlogHours": 1033.7205882352941,
"backlogHours": 1004.4857142857144,
"canVerify": true,
"error": null,
"gpu": "Ascend_910-b3",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 1.1256251912462532,
"queueFactor": 0.9492094101404149,
"queueWeight": 0.9492094101404149,
"recentSuccess": 50,
"recentSuccessRate": 0.36764705882352944,
"recentTerminal": 136,
"recentWilsonLowerBound": 0.29128436979117783,
"qualityFactor": 1.1078352287478637,
"queueFactor": 0.9520447593534902,
"queueWeight": 0.9520447593534902,
"recentSuccess": 51,
"recentSuccessRate": 0.36428571428571427,
"recentTerminal": 140,
"recentWilsonLowerBound": 0.2891827265997497,
"running": 8,
"selectionWeight": 1.0684540238220477,
"selectionWeight": 1.0547087237565786,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 22.666666666666668,
"waiting": 23431
"throughputPerHour": 23.333333333333332,
"waiting": 23438
},
"Ascend_910-b4": {
"available": true,
"backlogHours": 941.9314285714286,
"backlogHours": 926.1573033707865,
"canVerify": true,
"error": null,
"gpu": "Ascend_910-b4",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 0.6312731187591929,
"queueFactor": 0.9625418403024633,
"queueWeight": 0.9625418403024633,
"qualityFactor": 0.6072877977984613,
"queueFactor": 0.9637096728804996,
"queueWeight": 0.9637096728804996,
"recentSuccess": 50,
"recentSuccessRate": 0.2857142857142857,
"recentTerminal": 175,
"recentWilsonLowerBound": 0.22394740858280318,
"recentSuccessRate": 0.2808988764044944,
"recentTerminal": 178,
"recentWilsonLowerBound": 0.22003883693517023,
"running": 8,
"selectionWeight": 0.607626789463949,
"selectionWeight": 0.5852491249606742,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 29.166666666666668,
"waiting": 27473
"throughputPerHour": 29.666666666666668,
"waiting": 27476
},
"Biren_166m": {
"available": true,
"backlogHours": 156.59302325581396,
"backlogHours": 152.3050847457627,
"canVerify": true,
"error": null,
"gpu": "Biren_166m",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 0.26181137815827804,
"queueFactor": 1.2598146333746134,
"queueWeight": 1.2598146333746134,
"qualityFactor": 0.24539862954709804,
"queueFactor": 1.2634026137954937,
"queueWeight": 1.2634026137954937,
"recentSuccess": 35,
"recentSuccessRate": 0.20348837209302326,
"recentTerminal": 172,
"recentWilsonLowerBound": 0.15010863889106016,
"recentSuccessRate": 0.1977401129943503,
"recentTerminal": 177,
"recentWilsonLowerBound": 0.14575568827498553,
"running": 8,
"selectionWeight": 0.3298338053877733,
"selectionWeight": 0.3100372699916357,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 28.666666666666668,
"waiting": 4489
"throughputPerHour": 29.5,
"waiting": 4493
},
"Cambricon_mlu-370-x4": {
"available": true,
"backlogHours": 1001.0823529411765,
"backlogHours": 1001.5058823529412,
"canVerify": true,
"error": null,
"gpu": "Cambricon_mlu-370-x4",
"healthFactor": 1.0,
"maxConcurrentTasks": 7,
"qualityFactor": 0.33385297314394097,
"queueFactor": 0.9537884062295313,
"queueWeight": 0.9537884062295313,
"recentSuccess": 21,
"recentSuccessRate": 0.24705882352941178,
"qualityFactor": 0.29221081457441955,
"queueFactor": 0.9524691231972989,
"queueWeight": 0.9524691231972989,
"recentSuccess": 20,
"recentSuccessRate": 0.23529411764705882,
"recentTerminal": 85,
"recentWilsonLowerBound": 0.16764498447307555,
"recentWilsonLowerBound": 0.1577942000874349,
"running": 7,
"selectionWeight": 0.31842509516995,
"selectionWeight": 0.2783217783464659,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 14.166666666666666,
"waiting": 14182
"waiting": 14188
},
"Cambricon_mlu-370-x8": {
"available": true,
"backlogHours": 541.7755102040817,
"backlogHours": 536.5454545454545,
"canVerify": true,
"error": null,
"gpu": "Cambricon_mlu-370-x8",
"healthFactor": 1.0,
"maxConcurrentTasks": 7,
"qualityFactor": 0.5235376476309527,
"queueFactor": 1.0458023284817508,
"queueWeight": 1.0458023284817508,
"qualityFactor": 0.5114738591496293,
"queueFactor": 1.0459428451392188,
"queueWeight": 1.0459428451392188,
"recentSuccess": 28,
"recentSuccessRate": 0.2857142857142857,
"recentTerminal": 98,
"recentWilsonLowerBound": 0.2056863230141654,
"recentSuccessRate": 0.2828282828282828,
"recentTerminal": 99,
"recentWilsonLowerBound": 0.20351825976230095,
"running": 7,
"selectionWeight": 0.5475168909403086,
"selectionWeight": 0.5349724234532993,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 16.333333333333332,
"waiting": 8849
"throughputPerHour": 16.5,
"waiting": 8853
},
"Iluvatar_bi-100": {
"available": true,
"backlogHours": 47.086092715231786,
"backlogHours": 46.70163934426229,
"canVerify": true,
"error": null,
"gpu": "Iluvatar_bi-100",
@@ -539,170 +539,170 @@
"qualityFactor": 0.05,
"queueFactor": 1.3,
"queueWeight": 1.3,
"recentSuccess": 30,
"recentSuccessRate": 0.09933774834437085,
"recentTerminal": 302,
"recentWilsonLowerBound": 0.07047147937251379,
"running": 3,
"recentSuccess": 29,
"recentSuccessRate": 0.09508196721311475,
"recentTerminal": 305,
"recentWilsonLowerBound": 0.06701857072541595,
"running": 1,
"selectionWeight": 0.065,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 50.333333333333336,
"waiting": 2370
"throughputPerHour": 50.833333333333336,
"waiting": 2374
},
"Iluvatar_bi-150": {
"available": true,
"backlogHours": 63.05753424657534,
"backlogHours": 62.20540540540541,
"canVerify": true,
"error": null,
"gpu": "Iluvatar_bi-150",
"healthFactor": 1.0,
"maxConcurrentTasks": 50,
"qualityFactor": 0.1984913824319533,
"qualityFactor": 0.192534950656926,
"queueFactor": 1.3,
"queueWeight": 1.3,
"recentSuccess": 61,
"recentSuccessRate": 0.16712328767123288,
"recentTerminal": 365,
"recentWilsonLowerBound": 0.13235733778099962,
"running": 2,
"selectionWeight": 0.2580387971615393,
"recentSuccessRate": 0.16486486486486487,
"recentTerminal": 370,
"recentWilsonLowerBound": 0.13053694426874998,
"running": 1,
"selectionWeight": 0.2502954358540038,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 60.833333333333336,
"throughputPerHour": 61.666666666666664,
"waiting": 3836
},
"Iluvatar_mrv-100": {
"available": true,
"backlogHours": 2507.189189189189,
"backlogHours": 2442.6315789473683,
"canVerify": true,
"error": null,
"gpu": "Iluvatar_mrv-100",
"healthFactor": 1.0,
"maxConcurrentTasks": 2,
"qualityFactor": 0.9025661601730541,
"queueFactor": 0.8310830863903741,
"queueWeight": 0.8310830863903741,
"qualityFactor": 0.8471182317361214,
"queueFactor": 0.8332402418923744,
"queueWeight": 0.8332402418923744,
"recentSuccess": 15,
"recentSuccessRate": 0.40540540540540543,
"recentTerminal": 37,
"recentWilsonLowerBound": 0.2634629583994014,
"recentSuccessRate": 0.39473684210526316,
"recentTerminal": 38,
"recentWilsonLowerBound": 0.2559785926361891,
"running": 2,
"selectionWeight": 0.7501074700681306,
"selectionWeight": 0.7058530003232464,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 6.166666666666667,
"waiting": 15461
"throughputPerHour": 6.333333333333333,
"waiting": 15470
},
"Kunlunxin_p-800": {
"available": true,
"backlogHours": 640.4117647058823,
"backlogHours": 666.4897959183673,
"canVerify": true,
"error": null,
"gpu": "Kunlunxin_p-800",
"healthFactor": 1.0,
"maxConcurrentTasks": 7,
"qualityFactor": 0.43342323193465304,
"queueFactor": 1.0198906602093378,
"queueWeight": 1.0198906602093378,
"recentSuccess": 27,
"recentSuccessRate": 0.2647058823529412,
"recentTerminal": 102,
"recentWilsonLowerBound": 0.188762815237447,
"qualityFactor": 0.5235376476309527,
"queueFactor": 1.0124647360146002,
"queueWeight": 1.0124647360146002,
"recentSuccess": 28,
"recentSuccessRate": 0.2857142857142857,
"recentTerminal": 98,
"recentWilsonLowerBound": 0.2056863230141654,
"running": 7,
"selectionWeight": 0.44204430616789825,
"selectionWeight": 0.5300634062023772,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 17.0,
"waiting": 10887
"throughputPerHour": 16.333333333333332,
"waiting": 10886
},
"MetaX_c-500": {
"available": true,
"backlogHours": 680.8514851485149,
"backlogHours": 631.1559633027523,
"canVerify": true,
"error": null,
"gpu": "MetaX_c-500",
"healthFactor": 1.0,
"maxConcurrentTasks": 4,
"qualityFactor": 0.4007251979062244,
"queueFactor": 1.0105659279352919,
"queueWeight": 1.0105659279352919,
"recentSuccess": 26,
"recentSuccessRate": 0.25742574257425743,
"recentTerminal": 101,
"recentWilsonLowerBound": 0.18215123164243846,
"qualityFactor": 0.3724114593022873,
"queueFactor": 1.0207712460193108,
"queueWeight": 1.0207712460193108,
"recentSuccess": 27,
"recentSuccessRate": 0.24770642201834864,
"recentTerminal": 109,
"recentWilsonLowerBound": 0.17618414860824205,
"running": 4,
"selectionWeight": 0.40495923146915713,
"selectionWeight": 0.3801469093438657,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 16.833333333333332,
"waiting": 11461
"throughputPerHour": 18.166666666666668,
"waiting": 11466
},
"Mthreads_s4000": {
"available": true,
"backlogHours": 1642.0,
"backlogHours": 1622.0506329113925,
"canVerify": true,
"error": null,
"gpu": "Mthreads_s4000",
"healthFactor": 1.0,
"maxConcurrentTasks": 4,
"qualityFactor": 0.9754898656430583,
"queueFactor": 0.8855570339768039,
"queueWeight": 0.8855570339768039,
"qualityFactor": 0.9469219811987993,
"queueFactor": 0.8860113196032761,
"queueWeight": 0.8860113196032761,
"recentSuccess": 29,
"recentSuccessRate": 0.3717948717948718,
"recentTerminal": 78,
"recentWilsonLowerBound": 0.2729339852422717,
"running": 5,
"selectionWeight": 0.8638519120932976,
"recentSuccessRate": 0.3670886075949367,
"recentTerminal": 79,
"recentWilsonLowerBound": 0.26927131273817784,
"running": 4,
"selectionWeight": 0.8389835941232967,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 13.0,
"waiting": 21346
"throughputPerHour": 13.166666666666666,
"waiting": 21357
},
"Sunrise_pt-200-x1": {
"available": true,
"backlogHours": 7692.545454545455,
"backlogHours": 6513.6923076923085,
"canVerify": true,
"error": null,
"gpu": "Sunrise_pt-200-x1",
"healthFactor": 1.0,
"maxConcurrentTasks": 2,
"qualityFactor": 1.7264520627394835,
"queueFactor": 0.7024444722439245,
"queueWeight": 0.7024444722439245,
"recentSuccess": 7,
"recentSuccessRate": 0.6363636363636364,
"recentTerminal": 11,
"recentWilsonLowerBound": 0.35379677689163724,
"qualityFactor": 1.7418198840927275,
"queueFactor": 0.719241677872962,
"queueWeight": 0.719241677872962,
"recentSuccess": 8,
"recentSuccessRate": 0.6153846153846154,
"recentTerminal": 13,
"recentWilsonLowerBound": 0.3552248097226855,
"running": 2,
"selectionWeight": 1.2127367080654712,
"selectionWeight": 1.2527894559873416,
"stale": false,
"submissionEligible": false,
"throughputPerHour": 1.8333333333333333,
"waiting": 14103
"throughputPerHour": 2.1666666666666665,
"waiting": 14113
},
"Vastai_va16": {
"available": true,
"backlogHours": 779.6883116883116,
"backlogHours": 781.2467532467532,
"canVerify": true,
"error": null,
"gpu": "Vastai_va16",
"healthFactor": 1.0,
"maxConcurrentTasks": 16,
"qualityFactor": 0.4755612192158145,
"queueFactor": 0.9902260709152735,
"queueWeight": 0.9902260709152735,
"queueFactor": 0.9886229718973073,
"queueWeight": 0.9886229718973073,
"recentSuccess": 22,
"recentSuccessRate": 0.2857142857142857,
"recentTerminal": 77,
"recentWilsonLowerBound": 0.1968937869371719,
"running": 16,
"selectionWeight": 0.47091311758375304,
"selectionWeight": 0.4701507458602454,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 12.833333333333334,
"waiting": 10006
"waiting": 10026
},
"hygon_k100-ai": {
"available": true,
@@ -713,23 +713,23 @@
"healthFactor": 1.0,
"maxConcurrentTasks": 6,
"qualityFactor": 2.5,
"queueFactor": 1.0535133813058994,
"queueWeight": 1.0535133813058994,
"queueFactor": 1.0521229106289807,
"queueWeight": 1.0521229106289807,
"recentSuccess": 52,
"recentSuccessRate": 0.5148514851485149,
"recentTerminal": 101,
"recentWilsonLowerBound": 0.41863755309601286,
"running": 6,
"selectionWeight": 2.6337834532647486,
"selectionWeight": 2.630307276572452,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 16.833333333333332,
"waiting": 8684
}
},
"queueAttemptedAt": "2026-09-10T08:16:49.850897+00:00",
"queueAttemptedAt": "2026-09-10T08:28:07.952113+00:00",
"queueError": null,
"queueUpdatedAt": "2026-09-10T08:16:49.850897+00:00",
"queueUpdatedAt": "2026-09-10T08:28:07.952113+00:00",
"supportedGpus": [
"Vastai_va16",
"Iluvatar_mrv-100",

File diff suppressed because it is too large Load Diff

View File

@@ -1,6 +1,6 @@
{
"generatedAt": "2026-09-10T08:19:33.977040+00:00",
"lastSyncTime": "2026-09-10T08:19:33.742658+00:00",
"generatedAt": "2026-09-10T08:28:01.488214+00:00",
"lastSyncTime": "2026-09-10T08:28:01.218249+00:00",
"recentLimit": 300,
"report": {
"architectureCompatibilityBlocks": {
@@ -1911,29 +1911,29 @@
"unresolvedFailureCount": 56
},
"MetaX_c-500|vllm|text-generation": {
"attributableFailureCount": 40,
"decisionFailureRate": 0.9756,
"decisionSuccessRate": 0.0244,
"decisionTotal": 41,
"attributableFailureCount": 41,
"decisionFailureRate": 0.9762,
"decisionSuccessRate": 0.0238,
"decisionTotal": 42,
"failureBreakdown": {
"ambiguous_runtime": 7,
"backend_operator": 21,
"backend_operator": 22,
"framework_architecture_unsupported": 14,
"memory_capacity": 1,
"model_load": 4,
"参数/模板问题": 9
},
"failureCount": 56,
"failureRate": 0.9825,
"failureCount": 57,
"failureRate": 0.9828,
"framework": "vllm",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 1,
"successRate": 0.0175,
"successRate": 0.0172,
"targetGpu": "MetaX_c-500",
"taskType": "text-generation",
"total": 57,
"total": 58,
"unresolvedFailureCount": 16
},
"Mthreads_s4000|llamacpp|text-generation": {
@@ -2006,7 +2006,7 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 30,
"failureBreakdown": {
"ambiguous_runtime": 23,
"ambiguous_runtime": 24,
"backend_operator": 2,
"framework_architecture_unsupported": 22,
"memory_capacity": 1,
@@ -2014,7 +2014,7 @@
"repository_structure": 1,
"runtime_memory": 2
},
"failureCount": 53,
"failureCount": 54,
"failureRate": 1.0,
"framework": "vllm",
"pendingCount": 0,
@@ -2024,8 +2024,8 @@
"successRate": 0.0,
"targetGpu": "Mthreads_s4000",
"taskType": "text-generation",
"total": 53,
"unresolvedFailureCount": 23
"total": 54,
"unresolvedFailureCount": 24
},
"Sunrise_pt-200-x1|unknown|text-generation": {
"attributableFailureCount": 0,
@@ -2320,13 +2320,13 @@
"unresolvedFailureCount": 842
},
"vllm": {
"attributableFailureCount": 231,
"attributableFailureCount": 232,
"decisionFailureRate": 0.9957,
"decisionSuccessRate": 0.0043,
"decisionTotal": 232,
"decisionTotal": 233,
"failureBreakdown": {
"ambiguous_runtime": 150,
"backend_operator": 25,
"ambiguous_runtime": 151,
"backend_operator": 26,
"framework_architecture_unsupported": 169,
"memory_capacity": 6,
"model_load": 18,
@@ -2336,15 +2336,15 @@
"tokenizer_compatibility": 3,
"参数/模板问题": 21
},
"failureCount": 403,
"failureCount": 405,
"failureRate": 0.9975,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 1,
"successCount": 1,
"successRate": 0.0025,
"total": 404,
"unresolvedFailureCount": 171
"total": 406,
"unresolvedFailureCount": 172
},
"vllm-mlu": {
"attributableFailureCount": 7,
@@ -2447,7 +2447,7 @@
"unresolvedFailureCount": 1
}
},
"generatedAt": "2026-09-10T08:19:33.972825+00:00",
"generatedAt": "2026-09-10T08:28:01.484104+00:00",
"gpuSummaries": {
"Ascend_910-b3": {
"attributableFailureCount": 26,
@@ -2654,27 +2654,27 @@
"unresolvedFailureCount": 83
},
"MetaX_c-500": {
"attributableFailureCount": 40,
"decisionFailureRate": 0.8,
"decisionSuccessRate": 0.2,
"decisionTotal": 50,
"attributableFailureCount": 41,
"decisionFailureRate": 0.8039,
"decisionSuccessRate": 0.1961,
"decisionTotal": 51,
"failureBreakdown": {
"ambiguous_runtime": 7,
"backend_operator": 21,
"backend_operator": 22,
"framework_architecture_unsupported": 14,
"memory_capacity": 1,
"model_load": 4,
"参数/模板问题": 17,
"验证失败": 48
},
"failureCount": 112,
"failureRate": 0.918,
"failureCount": 113,
"failureRate": 0.9187,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 10,
"successRate": 0.082,
"total": 122,
"successRate": 0.0813,
"total": 123,
"unresolvedFailureCount": 72
},
"Mthreads_s4000": {
@@ -2683,7 +2683,7 @@
"decisionSuccessRate": 0.0606,
"decisionTotal": 33,
"failureBreakdown": {
"ambiguous_runtime": 23,
"ambiguous_runtime": 24,
"backend_operator": 2,
"framework_architecture_unsupported": 22,
"memory_capacity": 1,
@@ -2693,15 +2693,15 @@
"参数/模板问题": 7,
"验证失败": 26
},
"failureCount": 87,
"failureRate": 0.9775,
"failureCount": 88,
"failureRate": 0.9778,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 2,
"successRate": 0.0225,
"total": 89,
"unresolvedFailureCount": 56
"successRate": 0.0222,
"total": 90,
"unresolvedFailureCount": 57
},
"Sunrise_pt-200-x1": {
"attributableFailureCount": 30,
@@ -3525,15 +3525,15 @@
"unresolvedFailureCount": 0
},
"MetaX_c-500|vllm|text-generation|llama|compressed-tensors": {
"attributableFailureCount": 11,
"decisionFailureRate": 0.9167,
"decisionSuccessRate": 0.0833,
"decisionTotal": 12,
"attributableFailureCount": 12,
"decisionFailureRate": 0.9231,
"decisionSuccessRate": 0.0769,
"decisionTotal": 13,
"failureBreakdown": {
"backend_operator": 11
"backend_operator": 12
},
"failureCount": 11,
"failureRate": 0.9167,
"failureCount": 12,
"failureRate": 0.9231,
"framework": "vllm",
"modelType": "llama",
"pendingCount": 0,
@@ -3541,10 +3541,10 @@
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 1,
"successRate": 0.0833,
"successRate": 0.0769,
"targetGpu": "MetaX_c-500",
"taskType": "text-generation",
"total": 12,
"total": 13,
"unresolvedFailureCount": 0
},
"MetaX_c-500|vllm|text-generation|phi3small|compressed-tensors": {
@@ -4436,17 +4436,17 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 4,
"failureBreakdown": {
"ambiguous_runtime": 4,
"ambiguous_runtime": 5,
"backend_operator": 1,
"framework_architecture_unsupported": 1,
"model_load": 1,
"runtime_memory": 1
},
"failureCount": 8,
"failureCount": 9,
"failureRate": 1.0,
"framework": "vllm",
"lastPlatformFailureAt": null,
"lastTerminalAt": "2026-09-10T04:09:13.117076+00:00",
"lastTerminalAt": "2026-09-10T08:28:01.218218+00:00",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
@@ -4454,8 +4454,8 @@
"successRate": 0.0,
"targetGpu": "Mthreads_s4000",
"taskType": "text-generation",
"total": 8,
"unresolvedFailureCount": 4
"total": 9,
"unresolvedFailureCount": 5
},
"Sunrise_pt-200-x1|unknown|text-generation": {
"attributableFailureCount": 0,
@@ -4541,10 +4541,10 @@
"decisionSuccessRate": 1.0,
"decisionTotal": 1,
"failureBreakdown": {
"参数/模板问题": 2
"参数/模板问题": 1
},
"failureCount": 2,
"failureRate": 0.6667,
"failureCount": 1,
"failureRate": 0.5,
"framework": "unknown",
"lastPlatformFailureAt": null,
"lastTerminalAt": "2026-09-07T22:32:11.428244+00:00",
@@ -4552,11 +4552,11 @@
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 1,
"successRate": 0.3333,
"successRate": 0.5,
"targetGpu": "Vastai_va16",
"taskType": "text-generation",
"total": 3,
"unresolvedFailureCount": 2
"total": 2,
"unresolvedFailureCount": 1
},
"Vastai_va16|vllm_fix_tokenizer|text-generation": {
"attributableFailureCount": 1,
@@ -6410,14 +6410,14 @@
"unresolvedFailureCount": 0
},
"MetaX_c-500|vllm|text-generation|llama|compressed-tensors|33": {
"attributableFailureCount": 5,
"attributableFailureCount": 6,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 5,
"decisionTotal": 6,
"failureBreakdown": {
"backend_operator": 5
"backend_operator": 6
},
"failureCount": 5,
"failureCount": 6,
"failureRate": 1.0,
"framework": "vllm",
"loadSizeLog2Bucket": 33,
@@ -6430,7 +6430,7 @@
"successRate": 0.0,
"targetGpu": "MetaX_c-500",
"taskType": "text-generation",
"total": 5,
"total": 6,
"unresolvedFailureCount": 0
},
"MetaX_c-500|vllm|text-generation|phi3small|compressed-tensors|33": {
@@ -6986,16 +6986,16 @@
"unresolvedFailureCount": 0
}
},
"terminalRecords": 1539,
"totalRecords": 1626,
"terminalRecords": 1541,
"totalRecords": 1628,
"totals": {
"attributableFailureCount": 401,
"decisionFailureRate": 0.8872,
"decisionSuccessRate": 0.1128,
"decisionTotal": 452,
"attributableFailureCount": 402,
"decisionFailureRate": 0.8874,
"decisionSuccessRate": 0.1126,
"decisionTotal": 453,
"failureBreakdown": {
"ambiguous_runtime": 317,
"backend_operator": 30,
"ambiguous_runtime": 318,
"backend_operator": 31,
"framework_architecture_unsupported": 271,
"memory_capacity": 11,
"model_load": 46,
@@ -7006,21 +7006,21 @@
"参数/模板问题": 95,
"验证失败": 673
},
"failureCount": 1488,
"failureCount": 1490,
"failureRate": 0.9669,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 2,
"successCount": 51,
"successRate": 0.0331,
"total": 1539,
"unresolvedFailureCount": 1085
"total": 1541,
"unresolvedFailureCount": 1086
},
"warnings": [
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_mrv-100 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高≥50%),建议重点关注。",
@@ -7028,7 +7028,7 @@
"GPU hygon_k100-ai 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。",
"组合 Iluvatar_mrv-100|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Biren_166m|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -7049,6 +7049,6 @@
]
},
"storageMode": "decision_state_only",
"summarizedRecords": 1626,
"summarizedRecords": 1628,
"version": 1
}

View File

@@ -1,3 +1,4 @@
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "driver_error", "failureCode": "DRIVER_ERROR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-10T08:28:01.218218+00:00", "modelId": "neuralmagic/gemma-2-9b-it-quantized.w8a16", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-10T08:27:21+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4493670", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "", "lastSyncTime": "2026-09-10T08:19:33.742658+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-W8A8-FP8-Channelwise-compressed-tensors", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-10T08:17:21+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4481727", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "", "lastSyncTime": "2026-09-10T07:53:10.699377+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-FP8-K-V", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-10T07:51:21+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4481723", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "", "lastSyncTime": "2026-09-10T07:53:10.699435+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-W4A16-ACTORDER-compressed-tensors-test", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-10T07:51:21+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4481716", "taskType": "text-generation", "verifyResult": -1}
@@ -297,4 +298,3 @@
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5_moe"], "framework": "", "lastSyncTime": "2026-09-07T16:24:49.011479+00:00", "modelId": "apodex/Apodex-1.1-mini-GPTQ-Int4", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-07T16:17:21+00:00", "targetGpu": "Biren_166m", "taskId": "4610377", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5_mtp"], "framework": "", "lastSyncTime": "2026-09-07T16:06:52.110332+00:00", "modelId": "mlx-community/Qwen3.8-27B-MTP-mxfp8", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-07T15:55:22+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "4218110", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-07T16:06:52.110340+00:00", "modelId": "fla-hub/rwkv7-1.5B-world", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-07T15:55:22+00:00", "targetGpu": "Vastai_va16", "taskId": "4079301", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "", "lastSyncTime": "2026-09-07T16:06:52.110299+00:00", "modelId": "LLM-Research/Phi-3-medium-128k-instruct", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-07T15:51:46+00:00", "targetGpu": "Vastai_va16", "taskId": "4079303", "taskType": "text-generation", "verifyResult": null}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -1,24 +1,24 @@
{
"agentVersion": "2026.09.04.4",
"checksums": {
".modelhub_state/architecture_compatibility_blacklist.json": "3ec91db2974023013f73c44d45223a39a02b313a73325f884cdf8fae128a2fe3",
".modelhub_state/architecture_history_backfill.json": "882d6b32571d24960fc6ad20a88bb26f2d151b0344c7057226c69b138bf26fe8",
".modelhub_state/market_intelligence.json": "cf89047e0bea5988ed772d12b2fc64eb11d5d0825aaeda947054ed8bb0f7e039",
".modelhub_state/official_capabilities.json": "aff5f23a904f7fc7121e40396fc44803e24ad18b983dc152a94a21b79a53c046",
".modelhub_state/outcome_checkpoint.json": "77db3eedc806b204c33ebe93e28b50ea900ab8da7801fb7c14d2c52890c9ea7a",
".modelhub_state/architecture_compatibility_blacklist.json": "aa8147848901950ab8b854c85d1b16297e006cd85798a013f2f4e7ad5da5c3a4",
".modelhub_state/architecture_history_backfill.json": "809e3faf8b5243ef32ab2ff668dccf0672449cfe2c4e47b136b133dbb77ab918",
".modelhub_state/market_intelligence.json": "c4948d8f2afca53a93c4e0447d4987490060261432e517a61e89a1238dc4ab91",
".modelhub_state/official_capabilities.json": "71047fdbf2e61927b8cf03f29c6d5c811f33e0d350a60946cbef26eb4856c5f4",
".modelhub_state/outcome_checkpoint.json": "e5e880d23eb9f9868a80d58da522c964b1bb9e02389315c15995a02a85fc15fb",
".modelhub_state/queue_cleanup_latest.json": "b9038630dc67feced29c6931cb43d6d94c28bb175e6dcf80fac9c625a52887d5",
".modelhub_state/recent_outcomes.jsonl": "24ef354d9d5d517fad28d9f087cb220ff5953914f3c52395966bb1a0cd326308",
".modelhub_state/recovery_active_tasks.jsonl": "af261837173a737a5cdb0967941a1e87e64694f7c3a3ee351ac13f334b9ef7d8",
".modelhub_state/recovery_intents.jsonl": "adbccedbc924491fde19b36d12f472bd4eacd50455cb3c7335dba9f3bf90331a",
".modelhub_state/recent_outcomes.jsonl": "40270babf92ee8377a530c97154faab97e931f17ad1fc7d49caf77434bbc0738",
".modelhub_state/recovery_active_tasks.jsonl": "c79957faa6f11aa24610c634153ef65e789531b9c4c4b0adad3fc92453712dad",
".modelhub_state/recovery_intents.jsonl": "7d6d8b311722d816f966d6d570c0a8c8de6294ba1bad9de3e3d3e4e6b768e1e0",
".modelhub_state/routing_intelligence.json": "8a52419d4402861a79d360da797632830eb2c915c1cd189832eea085096de774",
".modelhub_state/submission_exclusions.jsonl": "b2de1125bf1f3e0597cd50cc30b563a5bfee39459e843767163eb72101cebc03",
".modelhub_state/worker_crashes.jsonl": "d1c3f447ce0377ed5e820c2b5ff730d29f84a96af4fd14332b138f78c0ddde76",
"ledger/submissions.jsonl": "ae2d6630dc3b5048885517330e9530c50fe5e0c1ea4c5a17488ad884d16de042",
"outcomes/submissions.jsonl": "5a82453f005565f7286d902bfb64edba3ca67fe5ac81fae87ae3bd2c7fc5de81"
"outcomes/submissions.jsonl": "b361c286a5b8847421cd7eab42702cfcd22c3717c358684626b8ea23acc643c6"
},
"generation": 5074,
"generation": 5075,
"phase": "cycle",
"schemaVersion": 1,
"updatedAt": "2026-09-10T08:27:00.622744+00:00",
"updatedAt": "2026-09-10T08:30:11.851861+00:00",
"writerId": "58ff5dc2a2d64b119ad1e4560700f977"
}

View File

@@ -116,7 +116,6 @@
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T14:51:17.315123+00:00", "modelId": "solidrust/Llama-3-13B-Instruct-v0.1-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8447876488, "estimatedRequiredGiB": 9.452, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 8457284244, "modelscopeLicense": "other", "modelscopeParams": 13264949248, "modelscopeTags": ["license:other", "model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible", "custom_tag:mergekit", "custom_tag:merge", "custom_tag:facebook", "custom_tag:meta", "custom_tag:pytorch", "custom_tag:llama", "custom_tag:llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 8457284244}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T06:48:32.410291+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4643049", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "llamacpp", "lastSyncTime": "2026-09-05T17:06:08.800571+00:00", "modelId": "LiquidAI/LFM2.5-230M-GGUF", "modelProfile": {"architectures": [], "configFingerprint": "c331f3d8906467b7947cec00daebfec4ccad1f351223a1eced4dea452a1012df", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 149080928, "estimatedRequiredGiB": 2.218, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": null, "modelscopeFileSize": 1984559598, "modelscopeLicense": "other", "modelscopeParams": 229693184, "modelscopeTags": ["license:other", "library:gguf", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:gguf", "custom_tag:llama.cpp", "deploy:swingdeploy"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 1984559598}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T09:04:21.884770+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4645136", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T17:46:46.041785+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-Non-Uniform-compressed-tensors", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 20041566112, "estimatedRequiredGiB": 22.408, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 20050750527, "modelscopeLicense": null, "modelscopeParams": 8030261248, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"backend_operator": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm", "lastTerminalAt": "2026-09-05T03:28:46.602358+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "MetaX_c-500", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 20050750527}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T09:38:43.506267+00:00", "targetGpu": "MetaX_c-500", "taskId": "4645748", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T17:46:46.041804+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-FP8-K-V", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9081293776, "estimatedRequiredGiB": 10.159, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9090504091, "modelscopeLicense": "llama3", "modelscopeParams": 8030261312, "modelscopeTags": ["license:llama3", "model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"backend_operator": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm", "lastTerminalAt": "2026-09-05T03:28:46.602358+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "MetaX_c-500", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 9090504091}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T09:38:43.485599+00:00", "targetGpu": "MetaX_c-500", "taskId": "4645738", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-05T17:46:46.041763+00:00", "modelId": "Jackrong/DeepSeek-V4-Pro-Qwen3.5-9B", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306310880, "estimatedRequiredGiB": 21.599, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 19326449341, "modelscopeLicense": "apache-2.0", "modelscopeParams": 9653104368, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:transformers", "custom_tag:unsloth", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:distillation", "custom_tag:deepseek", "custom_tag:sft", "custom_tag:rl", "custom_tag:gspo", "custom_tag:math", "custom_tag:stem", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:mtp"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19326449341}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T09:43:33.758884+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4645816", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T18:34:58.235126+00:00", "modelId": "zstack/qwen3-4b-fake", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 25165824, "estimatedRequiredGiB": 0.028, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 25169485, "modelscopeLicense": null, "modelscopeParams": 25165435, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 25169485}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T10:33:51.484756+00:00", "targetGpu": "MetaX_c-500", "taskId": "4646505", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T19:13:04.549009+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-W4A16-ACTORDER-compressed-tensors-test", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5705684944, "estimatedRequiredGiB": 6.387, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5714910031, "modelscopeLicense": null, "modelscopeParams": 8031506432, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"backend_operator": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm", "lastTerminalAt": "2026-09-05T03:28:46.602358+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "MetaX_c-500", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 5714910031}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-05T11:12:23.284350+00:00", "targetGpu": "MetaX_c-500", "taskId": "4647279", "taskType": "text-generation", "verifyResult": null}
@@ -513,13 +512,13 @@
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-10T05:11:27.395920+00:00", "modelId": "ornith-ai/Ornith-1.5-35B-A3B-MLX-6bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 28168623119, "estimatedRequiredGiB": 31.505, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 28190535646, "modelscopeLicense": null, "modelscopeParams": 7584230528, "modelscopeTags": ["model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 2}, "failureCount": 2, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-09T14:00:25.508497+00:00", "modelType": "qwen3_5_moe", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 2, "unresolvedFailureCount": 2}, "repositoryOnDiskBytes": 28190535646}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-09T21:08:32.684861+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4746455", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-10T05:11:27.395914+00:00", "modelId": "JANGQ-AI/MiniMax-M2.7-JANGTQ_K", "modelProfile": {"architectures": ["MiniMaxM2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 79395122602, "estimatedRequiredGiB": 88.75, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "minimax_m2", "modelscopeFileSize": 79412319434, "modelscopeLicense": "other", "modelscopeParams": 19984155322, "modelscopeTags": ["license:other", "model_type:minimax_m2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:jang", "custom_tag:jangtq", "custom_tag:jangtq-prestack", "custom_tag:jangtq-k", "custom_tag:mixed-precision", "custom_tag:minimax", "custom_tag:minimax-m2", "custom_tag:moe", "custom_tag:apple-silicon", "custom_tag:text-generation", "custom_tag:conversational", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:quantization", "custom_tag:230b"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 79412319434}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-09T21:08:32.618999+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4746456", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-10T05:11:27.395892+00:00", "modelId": "FlagRelease/DeepSeek-R1-Distill-Qwen-1.5B-mthreads-FlagOS", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 3554214621, "estimatedRequiredGiB": 3.984, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 3564406686, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1777088000, "modelscopeTags": ["license:apache-2.0", "model_type:qwen2", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 3564406686}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-09T21:08:32.656390+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4746454", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "ddalcu/Muse-Glimmer-30B-MLX-Serve-8bit", "modelProfile": {"architectures": ["MuseGlimmerForConditionalGeneration"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 35620174949, "estimatedRequiredGiB": 39.84, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "muse_glimmer", "modelscopeFileSize": 35648665467, "modelscopeLicense": "apache-2.0", "modelscopeParams": 9345525760, "modelscopeTags": ["license:apache-2.0", "model_type:muse_glimmer", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:mlx-serve", "custom_tag:muse_glimmer"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 35648665467}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-10T00:22:02.859936+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749146", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "OpenBMB/MiniCPM5-2B-GPTQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2099615880, "estimatedRequiredGiB": 2.358, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 2109838972, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 2109838972}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-10T00:22:02.850913+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749148", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "OpenBMB/MiniCPM5-2B-Base", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557128, "estimatedRequiredGiB": 5.637, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5043778320, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5043778320}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-10T00:22:02.864784+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749147", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "OpenBMB/MiniCPM5-2B-SFT", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557128, "estimatedRequiredGiB": 5.637, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5043778298, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5043778298}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-10T00:22:02.853008+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749145", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "OpenBMB/MiniCPM5-2B-Midtrain", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557128, "estimatedRequiredGiB": 5.637, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5043778298, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5043778298}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-10T00:22:02.857970+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749149", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "ddalcu/Muse-Glimmer-30B-MLX-Serve-4bit", "modelProfile": {"architectures": ["MuseGlimmerForConditionalGeneration"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 21407235494, "estimatedRequiredGiB": 23.956, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "muse_glimmer", "modelscopeFileSize": 21435726263, "modelscopeLicense": "apache-2.0", "modelscopeParams": 5792290816, "modelscopeTags": ["license:apache-2.0", "model_type:muse_glimmer", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:mlx-serve", "custom_tag:muse_glimmer"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 21435726263}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-10T00:22:02.862038+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749144", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "laion/swesmith-nl2bash-stack-bugsseq", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8593, "estimatedRequiredGiB": 18.327, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 16398873171, "modelscopeLicense": "apache-2.0", "modelscopeParams": 8190735360, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:llama-factory", "custom_tag:full", "custom_tag:generated_from_trainer"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 16398873171}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-10T00:22:02.847614+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749143", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-10T08:28:01.218174+00:00", "modelId": "ddalcu/Muse-Glimmer-30B-MLX-Serve-8bit", "modelProfile": {"architectures": ["MuseGlimmerForConditionalGeneration"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 35620174949, "estimatedRequiredGiB": 39.84, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "muse_glimmer", "modelscopeFileSize": 35648665467, "modelscopeLicense": "apache-2.0", "modelscopeParams": 9345525760, "modelscopeTags": ["license:apache-2.0", "model_type:muse_glimmer", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:mlx-serve", "custom_tag:muse_glimmer"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 35648665467}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-10T00:22:02.859936+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749146", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-10T08:28:01.218150+00:00", "modelId": "OpenBMB/MiniCPM5-2B-GPTQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2099615880, "estimatedRequiredGiB": 2.358, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 2109838972, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 2109838972}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-10T00:22:02.850913+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749148", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-10T08:28:01.218196+00:00", "modelId": "OpenBMB/MiniCPM5-2B-Base", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557128, "estimatedRequiredGiB": 5.637, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5043778320, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5043778320}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-10T00:22:02.864784+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749147", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-10T08:28:01.218234+00:00", "modelId": "OpenBMB/MiniCPM5-2B-SFT", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557128, "estimatedRequiredGiB": 5.637, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5043778298, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5043778298}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-10T00:22:02.853008+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749145", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-10T08:28:01.218190+00:00", "modelId": "OpenBMB/MiniCPM5-2B-Midtrain", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557128, "estimatedRequiredGiB": 5.637, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5043778298, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5043778298}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-10T00:22:02.857970+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749149", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-10T08:28:01.218240+00:00", "modelId": "ddalcu/Muse-Glimmer-30B-MLX-Serve-4bit", "modelProfile": {"architectures": ["MuseGlimmerForConditionalGeneration"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 21407235494, "estimatedRequiredGiB": 23.956, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "muse_glimmer", "modelscopeFileSize": 21435726263, "modelscopeLicense": "apache-2.0", "modelscopeParams": 5792290816, "modelscopeTags": ["license:apache-2.0", "model_type:muse_glimmer", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:mlx-serve", "custom_tag:muse_glimmer"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 21435726263}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-10T00:22:02.862038+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749144", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-10T08:28:01.218183+00:00", "modelId": "laion/swesmith-nl2bash-stack-bugsseq", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8593, "estimatedRequiredGiB": 18.327, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 16398873171, "modelscopeLicense": "apache-2.0", "modelscopeParams": 8190735360, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:llama-factory", "custom_tag:full", "custom_tag:generated_from_trainer"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 16398873171}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-10T00:22:02.847614+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4749143", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "OpenBMB/MiniCPM5-2B", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557096, "estimatedRequiredGiB": 5.637, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5043809570, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5043809570}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-10T00:42:56.091512+00:00", "targetGpu": "MetaX_c-500", "taskId": "4749457", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "whq1111/M2RL-SFT", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044982008, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912361, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8060912361}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-10T00:42:56.051663+00:00", "targetGpu": "MetaX_c-500", "taskId": "4749456", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "whq1111/M2RL-RL_Math", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8044981872, "estimatedRequiredGiB": 9.009, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 8060912225, "modelscopeLicense": null, "modelscopeParams": 4022468096, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8060912225}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-10T00:42:56.093785+00:00", "targetGpu": "MetaX_c-500", "taskId": "4749466", "taskType": "text-generation", "verifyResult": null}