state: generation 22024 (cycle)

This commit is contained in:
2026-10-08 01:52:11 +00:00
parent 1056e5855e
commit 55062e73ce
9 changed files with 2895 additions and 3173 deletions

View File

@@ -399,7 +399,7 @@
"ascend_910-b4|vllm_tokenizer_patch|text-generation|model_type:mini_k3": {
"architectureSignature": "model_type:mini_k3",
"architectures": [],
"evidenceCount": 2,
"evidenceCount": 4,
"expiresAt": "2026-10-21T19:05:50.437924+00:00",
"framework": "vllm_tokenizer_patch",
"latestFailureAt": "2026-09-21T19:05:50.437924+00:00",
@@ -408,11 +408,15 @@
"modelType": "mini_k3",
"sourceModelIds": [
"nkkbr/Mini-K3-1H-decay-g16-v2_B",
"nkkbr/Mini-K3-1H-attnres-block6-v1_C"
"nkkbr/Mini-K3-1H-attnres-block6-v1_C",
"nkkbr/Mini-K3-1H-attnres-standard-v1_B",
"nkkbr/Mini-K3-1H-decay-g1-v2_B"
],
"sourceTaskIds": [
"5006050",
"5006054"
"5006054",
"5006051",
"5005585"
],
"targetGpu": "Ascend_910-b4",
"taskType": "text-generation"
@@ -2890,7 +2894,7 @@
"taskType": "text-generation"
}
},
"generatedAt": "2026-10-08T01:25:54.925981+00:00",
"generatedAt": "2026-10-08T01:44:45.052677+00:00",
"summary": {
"activeBlockCount": 145,
"byGpuFramework": {

View File

@@ -1,8 +1,8 @@
{
"communityAttemptedAt": "2026-10-08T01:27:27.079335+00:00",
"communityAttemptedAt": "2026-10-08T01:46:32.554265+00:00",
"communityError": null,
"communitySample": {},
"communityUpdatedAt": "2026-10-08T01:27:27.079335+00:00",
"communityUpdatedAt": "2026-10-08T01:46:32.554265+00:00",
"frameworkAttemptedAt": "2026-10-07T20:58:42.772583+00:00",
"frameworkError": null,
"frameworkStats": {
@@ -434,121 +434,121 @@
}
},
"frameworkUpdatedAt": null,
"generatedAt": "2026-10-08T01:40:57.276451+00:00",
"generatedAt": "2026-10-08T01:46:32.554265+00:00",
"gpuStats": {
"Ascend_910-b3": {
"available": true,
"backlogHours": 942.0344827586207,
"backlogHours": 953.0581395348837,
"canVerify": true,
"error": null,
"gpu": "Ascend_910-b3",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 1.0330988363353264,
"queueFactor": 1.0061884220086608,
"queueWeight": 1.0061884220086608,
"recentSuccess": 48,
"recentSuccessRate": 0.27586206896551724,
"recentTerminal": 174,
"recentWilsonLowerBound": 0.21483602929568732,
"running": 8,
"selectionWeight": 1.0394920879112257,
"qualityFactor": 1.0198161556666079,
"queueFactor": 1.0008205445314489,
"queueWeight": 1.0008205445314489,
"recentSuccess": 49,
"recentSuccessRate": 0.28488372093023256,
"recentTerminal": 172,
"recentWilsonLowerBound": 0.22270396035150342,
"running": 6,
"selectionWeight": 1.0206529602362233,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 29.0,
"waiting": 27319
"throughputPerHour": 28.666666666666668,
"waiting": 27321
},
"Ascend_910-b4": {
"available": true,
"backlogHours": 1035.329479768786,
"backlogHours": 1047.3684210526317,
"canVerify": true,
"error": null,
"gpu": "Ascend_910-b4",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 1.1620120099160778,
"queueFactor": 0.9920362652861231,
"queueWeight": 0.9920362652861231,
"recentSuccess": 50,
"recentSuccessRate": 0.28901734104046245,
"recentTerminal": 173,
"recentWilsonLowerBound": 0.2266314526680985,
"qualityFactor": 0.9803126805505986,
"queueFactor": 0.9867546910933408,
"queueWeight": 0.9867546910933408,
"recentSuccess": 48,
"recentSuccessRate": 0.2807017543859649,
"recentTerminal": 171,
"recentWilsonLowerBound": 0.21874049084032365,
"running": 8,
"selectionWeight": 1.1527580545347673,
"selectionWeight": 0.9673281362715909,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 28.833333333333332,
"waiting": 29852
"throughputPerHour": 28.5,
"waiting": 29850
},
"Biren_166m": {
"available": true,
"backlogHours": 160.95652173913044,
"backlogHours": 167.10967741935485,
"canVerify": true,
"error": null,
"gpu": "Biren_166m",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 0.3331647238362046,
"queueFactor": 1.3,
"queueWeight": 1.3,
"qualityFactor": 0.3310539784481304,
"queueFactor": 1.2994928099999101,
"queueWeight": 1.2994928099999101,
"recentSuccess": 29,
"recentSuccessRate": 0.18012422360248448,
"recentTerminal": 161,
"recentWilsonLowerBound": 0.12844163237023534,
"running": 8,
"selectionWeight": 0.433114140987066,
"recentSuccessRate": 0.1870967741935484,
"recentTerminal": 155,
"recentWilsonLowerBound": 0.13354466465333883,
"running": 9,
"selectionWeight": 0.43020226471521067,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 26.833333333333332,
"waiting": 4319
"throughputPerHour": 25.833333333333332,
"waiting": 4317
},
"Cambricon_mlu-370-x4": {
"available": true,
"backlogHours": 1173.7241379310344,
"backlogHours": 1160.3181818181818,
"canVerify": true,
"error": null,
"gpu": "Cambricon_mlu-370-x4",
"healthFactor": 1.0,
"maxConcurrentTasks": 7,
"qualityFactor": 0.31790178342745007,
"queueFactor": 0.973541412611454,
"queueWeight": 0.973541412611454,
"recentSuccess": 17,
"recentSuccessRate": 0.19540229885057472,
"recentTerminal": 87,
"recentWilsonLowerBound": 0.12573278124165052,
"qualityFactor": 0.3307351999236407,
"queueFactor": 0.9717119785396618,
"queueWeight": 0.9717119785396618,
"recentSuccess": 18,
"recentSuccessRate": 0.20454545454545456,
"recentTerminal": 88,
"recentWilsonLowerBound": 0.13348619800482903,
"running": 7,
"selectionWeight": 0.30949055130966024,
"selectionWeight": 0.3213793554905115,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 14.5,
"waiting": 17019
"throughputPerHour": 14.666666666666666,
"waiting": 17018
},
"Cambricon_mlu-370-x8": {
"available": true,
"backlogHours": 373.93288590604027,
"backlogHours": 394.8936170212766,
"canVerify": true,
"error": null,
"gpu": "Cambricon_mlu-370-x8",
"healthFactor": 1.0,
"maxConcurrentTasks": 7,
"qualityFactor": 0.3968477612465222,
"queueFactor": 1.1557669904176398,
"queueWeight": 1.1557669904176398,
"recentSuccess": 29,
"recentSuccessRate": 0.19463087248322147,
"recentTerminal": 149,
"recentWilsonLowerBound": 0.13907059958540524,
"running": 7,
"selectionWeight": 0.458663542669871,
"qualityFactor": 0.33943698223482,
"queueFactor": 1.14222616401631,
"queueWeight": 1.14222616401631,
"recentSuccess": 27,
"recentSuccessRate": 0.19148936170212766,
"recentTerminal": 141,
"recentWilsonLowerBound": 0.1350712947551214,
"running": 6,
"selectionWeight": 0.3877138021433508,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 24.833333333333332,
"waiting": 9286
"throughputPerHour": 23.5,
"waiting": 9280
},
"Iluvatar_bi-100": {
"available": true,
"backlogHours": 71.27547169811321,
"backlogHours": 69.88888888888889,
"canVerify": true,
"error": null,
"gpu": "Iluvatar_bi-100",
@@ -558,196 +558,196 @@
"queueFactor": 1.3,
"queueWeight": 1.3,
"recentSuccess": 7,
"recentSuccessRate": 0.026415094339622643,
"recentTerminal": 265,
"recentWilsonLowerBound": 0.012853009402853693,
"running": 5,
"recentSuccessRate": 0.025925925925925925,
"recentTerminal": 270,
"recentWilsonLowerBound": 0.01261393565316339,
"running": 8,
"selectionWeight": 0.065,
"stale": false,
"submissionEligible": false,
"throughputPerHour": 44.166666666666664,
"waiting": 3148
"throughputPerHour": 45.0,
"waiting": 3145
},
"Iluvatar_bi-150": {
"available": true,
"backlogHours": 189.60591133004925,
"backlogHours": 183.8,
"canVerify": true,
"error": null,
"gpu": "Iluvatar_bi-150",
"healthFactor": 1.0,
"maxConcurrentTasks": 50,
"qualityFactor": 0.2772764436272968,
"queueFactor": 1.2797099737430289,
"queueWeight": 1.2797099737430289,
"recentSuccess": 33,
"recentSuccessRate": 0.1625615763546798,
"recentTerminal": 203,
"recentWilsonLowerBound": 0.11815650006559465,
"running": 2,
"selectionWeight": 0.3548334303938484,
"qualityFactor": 0.31527768607505446,
"queueFactor": 1.2810683303156873,
"queueWeight": 1.2810683303156873,
"recentSuccess": 37,
"recentSuccessRate": 0.1761904761904762,
"recentTerminal": 210,
"recentWilsonLowerBound": 0.13061337248865776,
"running": 4,
"selectionWeight": 0.4038922588859635,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 33.833333333333336,
"waiting": 6415
"throughputPerHour": 35.0,
"waiting": 6433
},
"Iluvatar_mrv-100": {
"available": true,
"backlogHours": 2021.6086956521738,
"backlogHours": 2021.7391304347825,
"canVerify": true,
"error": null,
"gpu": "Iluvatar_mrv-100",
"healthFactor": 1.0,
"maxConcurrentTasks": 2,
"qualityFactor": 0.7957234284557874,
"queueFactor": 0.8972940153812214,
"queueWeight": 0.8972940153812214,
"recentSuccess": 14,
"recentSuccessRate": 0.30434782608695654,
"qualityFactor": 0.5868791703116154,
"queueFactor": 0.8940572999305172,
"queueWeight": 0.8940572999305172,
"recentSuccess": 13,
"recentSuccessRate": 0.2826086956521739,
"recentTerminal": 46,
"recentWilsonLowerBound": 0.190796708074489,
"recentWilsonLowerBound": 0.1732404154491407,
"running": 2,
"selectionWeight": 0.7139978702520056,
"selectionWeight": 0.524703606394265,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 7.666666666666667,
"waiting": 15499
"waiting": 15500
},
"Kunlunxin_p-800": {
"available": true,
"backlogHours": 405.2205882352941,
"backlogHours": 405.0441176470588,
"canVerify": true,
"error": null,
"gpu": "Kunlunxin_p-800",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 0.32908900725629964,
"queueFactor": 1.1419198183411587,
"queueWeight": 1.1419198183411587,
"recentSuccess": 25,
"recentSuccessRate": 0.18382352941176472,
"qualityFactor": 0.3683257930701287,
"queueFactor": 1.1378860459498426,
"queueWeight": 1.1378860459498426,
"recentSuccess": 27,
"recentSuccessRate": 0.19852941176470587,
"recentTerminal": 136,
"recentWilsonLowerBound": 0.127725020783369,
"recentWilsonLowerBound": 0.14018035078929256,
"running": 8,
"selectionWeight": 0.37579325938418595,
"selectionWeight": 0.41911278029790866,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 22.666666666666668,
"waiting": 9185
"waiting": 9181
},
"MetaX_c-500": {
"available": true,
"backlogHours": 543.2,
"backlogHours": 529.7560975609756,
"canVerify": true,
"error": null,
"gpu": "MetaX_c-500",
"healthFactor": 1.0,
"maxConcurrentTasks": 4,
"qualityFactor": 0.309997976263944,
"queueFactor": 1.092811789254245,
"queueWeight": 1.092811789254245,
"recentSuccess": 22,
"recentSuccessRate": 0.18333333333333332,
"recentTerminal": 120,
"recentWilsonLowerBound": 0.12430210244218538,
"qualityFactor": 0.3377898282742256,
"queueFactor": 1.0929812869842173,
"queueWeight": 1.0929812869842173,
"recentSuccess": 24,
"recentSuccessRate": 0.1951219512195122,
"recentTerminal": 123,
"recentWilsonLowerBound": 0.1347729686621224,
"running": 4,
"selectionWeight": 0.3387694431061956,
"selectionWeight": 0.36919796123734083,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 20.0,
"waiting": 10864
"throughputPerHour": 20.5,
"waiting": 10860
},
"Mthreads_s4000": {
"available": true,
"backlogHours": 1948.2985074626868,
"backlogHours": 1948.8358208955226,
"canVerify": true,
"error": null,
"gpu": "Mthreads_s4000",
"healthFactor": 1.0,
"maxConcurrentTasks": 4,
"qualityFactor": 2.5,
"queueFactor": 0.9022793355405623,
"queueWeight": 0.9022793355405623,
"recentSuccess": 29,
"recentSuccessRate": 0.43283582089552236,
"queueFactor": 0.898996152400354,
"queueWeight": 0.898996152400354,
"recentSuccess": 30,
"recentSuccessRate": 0.44776119402985076,
"recentTerminal": 67,
"recentWilsonLowerBound": 0.32104123341736546,
"recentWilsonLowerBound": 0.33476201784797566,
"running": 4,
"selectionWeight": 2.255698338851406,
"selectionWeight": 2.247490381000885,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 11.166666666666666,
"waiting": 21756
"waiting": 21762
},
"Sunrise_pt-200-x1": {
"available": true,
"backlogHours": 3020.470588235294,
"backlogHours": 3111.6363636363635,
"canVerify": true,
"error": null,
"gpu": "Sunrise_pt-200-x1",
"healthFactor": 1.0,
"maxConcurrentTasks": 2,
"qualityFactor": 0.07318814858603309,
"queueFactor": 0.8448471513252497,
"queueWeight": 0.8448471513252497,
"qualityFactor": 0.07141339080132725,
"queueFactor": 0.8380613174927585,
"queueWeight": 0.8380613174927585,
"recentSuccess": 5,
"recentSuccessRate": 0.14705882352941177,
"recentTerminal": 34,
"recentWilsonLowerBound": 0.06449346382626417,
"recentSuccessRate": 0.15151515151515152,
"recentTerminal": 33,
"recentWilsonLowerBound": 0.06650359257960956,
"running": 2,
"selectionWeight": 0.061832798843679156,
"selectionWeight": 0.059848800381585555,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 5.666666666666667,
"waiting": 17116
"throughputPerHour": 5.5,
"waiting": 17114
},
"Vastai_va16": {
"available": true,
"backlogHours": 1021.1399999999999,
"backlogHours": 963.5094339622641,
"canVerify": true,
"error": null,
"gpu": "Vastai_va16",
"healthFactor": 1.0,
"maxConcurrentTasks": 16,
"qualityFactor": 0.05,
"queueFactor": 0.9940919167161827,
"queueWeight": 0.9940919167161827,
"recentSuccess": 2,
"recentSuccessRate": 0.02,
"recentTerminal": 100,
"recentWilsonLowerBound": 0.005501852234968184,
"queueFactor": 0.9991845851250161,
"queueWeight": 0.9991845851250161,
"recentSuccess": 3,
"recentSuccessRate": 0.02830188679245283,
"recentTerminal": 106,
"recentWilsonLowerBound": 0.00967110864461902,
"running": 16,
"selectionWeight": 0.049704595835809134,
"selectionWeight": 0.049959229256250806,
"stale": false,
"submissionEligible": false,
"throughputPerHour": 16.666666666666668,
"waiting": 17019
"throughputPerHour": 17.666666666666668,
"waiting": 17022
},
"hygon_k100-ai": {
"available": true,
"backlogHours": 1249.5882352941176,
"backlogHours": 1261.7227722772277,
"canVerify": true,
"error": null,
"gpu": "hygon_k100-ai",
"healthFactor": 1.0,
"maxConcurrentTasks": 6,
"qualityFactor": 1.2214419979697482,
"queueFactor": 0.9644379618123488,
"queueWeight": 0.9644379618123488,
"recentSuccess": 32,
"recentSuccessRate": 0.3137254901960784,
"recentTerminal": 102,
"recentWilsonLowerBound": 0.23182840733684665,
"running": 6,
"selectionWeight": 1.178005030993947,
"qualityFactor": 1.0475316176996587,
"queueFactor": 0.9595763370689031,
"queueWeight": 0.9595763370689031,
"recentSuccess": 31,
"recentSuccessRate": 0.3069306930693069,
"recentTerminal": 101,
"recentWilsonLowerBound": 0.22543494459305355,
"running": 5,
"selectionWeight": 1.005186552676101,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 17.0,
"waiting": 21243
"throughputPerHour": 16.833333333333332,
"waiting": 21239
}
},
"queueAttemptedAt": "2026-10-08T01:35:55.089274+00:00",
"queueAttemptedAt": "2026-10-08T01:46:32.554265+00:00",
"queueError": null,
"queueUpdatedAt": "2026-10-08T01:35:55.089274+00:00",
"queueUpdatedAt": "2026-10-08T01:46:32.554265+00:00",
"supportedGpus": [
"Vastai_va16",
"Cambricon_mlu-370-x4",

File diff suppressed because it is too large Load Diff

View File

@@ -1,6 +1,6 @@
{
"generatedAt": "2026-10-08T01:25:54.828105+00:00",
"lastSyncTime": "2026-10-08T01:25:54.566312+00:00",
"generatedAt": "2026-10-08T01:44:44.903864+00:00",
"lastSyncTime": "2026-10-08T01:44:44.644735+00:00",
"recentLimit": 300,
"report": {
"architectureCompatibilityBlocks": {
@@ -403,7 +403,7 @@
"ascend_910-b4|vllm_tokenizer_patch|text-generation|model_type:mini_k3": {
"architectureSignature": "model_type:mini_k3",
"architectures": [],
"evidenceCount": 2,
"evidenceCount": 4,
"expiresAt": "2026-10-21T19:05:50.437924+00:00",
"framework": "vllm_tokenizer_patch",
"latestFailureAt": "2026-09-21T19:05:50.437924+00:00",
@@ -412,11 +412,15 @@
"modelType": "mini_k3",
"sourceModelIds": [
"nkkbr/Mini-K3-1H-decay-g16-v2_B",
"nkkbr/Mini-K3-1H-attnres-block6-v1_C"
"nkkbr/Mini-K3-1H-attnres-block6-v1_C",
"nkkbr/Mini-K3-1H-attnres-standard-v1_B",
"nkkbr/Mini-K3-1H-decay-g1-v2_B"
],
"sourceTaskIds": [
"5006050",
"5006054"
"5006054",
"5006051",
"5005585"
],
"targetGpu": "Ascend_910-b4",
"taskType": "text-generation"
@@ -3200,18 +3204,18 @@
"unresolvedFailureCount": 17
},
"Ascend_910-b4|vllm_tokenizer_patch|text-generation": {
"attributableFailureCount": 34,
"attributableFailureCount": 36,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 34,
"decisionTotal": 36,
"failureBreakdown": {
"ambiguous_runtime": 101,
"framework_architecture_unsupported": 33,
"framework_architecture_unsupported": 35,
"platform_infrastructure": 1,
"repository_structure": 1,
"参数/模板问题": 6
},
"failureCount": 142,
"failureCount": 144,
"failureRate": 1.0,
"framework": "vllm_tokenizer_patch",
"pendingCount": 0,
@@ -3221,7 +3225,7 @@
"successRate": 0.0,
"targetGpu": "Ascend_910-b4",
"taskType": "text-generation",
"total": 142,
"total": 144,
"unresolvedFailureCount": 107
},
"Ascend_910-b4|vllm|text-generation": {
@@ -5767,15 +5771,15 @@
"unresolvedFailureCount": 395
},
"vllm_tokenizer_patch": {
"attributableFailureCount": 159,
"decisionFailureRate": 0.9408,
"decisionSuccessRate": 0.0592,
"decisionTotal": 169,
"attributableFailureCount": 161,
"decisionFailureRate": 0.9415,
"decisionSuccessRate": 0.0585,
"decisionTotal": 171,
"failureBreakdown": {
"ambiguous_runtime": 208,
"backend_operator": 15,
"context_length": 9,
"framework_architecture_unsupported": 101,
"framework_architecture_unsupported": 103,
"memory_capacity": 2,
"model_load": 24,
"platform_infrastructure": 3,
@@ -5784,18 +5788,18 @@
"tokenizer_compatibility": 2,
"参数/模板问题": 49
},
"failureCount": 419,
"failureRate": 0.9767,
"failureCount": 421,
"failureRate": 0.9768,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 3,
"successCount": 10,
"successRate": 0.0233,
"total": 429,
"successRate": 0.0232,
"total": 431,
"unresolvedFailureCount": 257
}
},
"generatedAt": "2026-10-08T01:25:54.813489+00:00",
"generatedAt": "2026-10-08T01:44:44.889651+00:00",
"gpuSummaries": {
"Ascend_910-b3": {
"attributableFailureCount": 121,
@@ -5825,14 +5829,14 @@
"unresolvedFailureCount": 232
},
"Ascend_910-b4": {
"attributableFailureCount": 333,
"decisionFailureRate": 0.8388,
"decisionSuccessRate": 0.1612,
"decisionTotal": 397,
"attributableFailureCount": 335,
"decisionFailureRate": 0.8396,
"decisionSuccessRate": 0.1604,
"decisionTotal": 399,
"failureBreakdown": {
"ambiguous_runtime": 251,
"context_length": 1,
"framework_architecture_unsupported": 189,
"framework_architecture_unsupported": 191,
"memory_capacity": 19,
"model_load": 85,
"platform_infrastructure": 3,
@@ -5842,14 +5846,14 @@
"日志缺失": 14,
"验证失败": 175
},
"failureCount": 1045,
"failureRate": 0.9423,
"failureCount": 1047,
"failureRate": 0.9424,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 3,
"successCount": 64,
"successRate": 0.0577,
"total": 1109,
"successRate": 0.0576,
"total": 1111,
"unresolvedFailureCount": 709
},
"Biren_166m": {
@@ -8052,14 +8056,14 @@
"unresolvedFailureCount": 6
},
"Ascend_910-b4|vllm_tokenizer_patch|text-generation|mini_k3|none": {
"attributableFailureCount": 2,
"attributableFailureCount": 4,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 2,
"decisionTotal": 4,
"failureBreakdown": {
"framework_architecture_unsupported": 2
"framework_architecture_unsupported": 4
},
"failureCount": 2,
"failureCount": 4,
"failureRate": 1.0,
"framework": "vllm_tokenizer_patch",
"modelType": "mini_k3",
@@ -8071,7 +8075,7 @@
"successRate": 0.0,
"targetGpu": "Ascend_910-b4",
"taskType": "text-generation",
"total": 2,
"total": 4,
"unresolvedFailureCount": 0
},
"Ascend_910-b4|vllm_tokenizer_patch|text-generation|mistral3|none": {
@@ -25531,9 +25535,9 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"参数/模板问题": 2
"参数/模板问题": 1
},
"failureCount": 2,
"failureCount": 1,
"failureRate": 1.0,
"framework": "unknown",
"lastPlatformFailureAt": null,
@@ -25545,8 +25549,8 @@
"successRate": 0.0,
"targetGpu": "Ascend_910-b3",
"taskType": "text-generation",
"total": 2,
"unresolvedFailureCount": 2
"total": 1,
"unresolvedFailureCount": 1
},
"Ascend_910-b3|vllm_tokenizer_patch|text-generation": {
"attributableFailureCount": 7,
@@ -25602,17 +25606,17 @@
"unresolvedFailureCount": 2
},
"Ascend_910-b4|vllm_tokenizer_patch|text-generation": {
"attributableFailureCount": 2,
"consecutiveFailures": 2,
"attributableFailureCount": 4,
"consecutiveFailures": 4,
"consecutivePlatformFailures": 0,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 2,
"decisionTotal": 4,
"failureBreakdown": {
"ambiguous_runtime": 11,
"framework_architecture_unsupported": 2
"framework_architecture_unsupported": 4
},
"failureCount": 13,
"failureCount": 15,
"failureRate": 1.0,
"framework": "vllm_tokenizer_patch",
"lastPlatformFailureAt": null,
@@ -25624,7 +25628,7 @@
"successRate": 0.0,
"targetGpu": "Ascend_910-b4",
"taskType": "text-generation",
"total": 13,
"total": 15,
"unresolvedFailureCount": 11
},
"Ascend_910-b4|vllm|text-generation": {
@@ -25737,10 +25741,10 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 6,
"ambiguous_runtime": 5,
"参数/模板问题": 1
},
"failureCount": 7,
"failureCount": 6,
"failureRate": 1.0,
"framework": "vllm-mlu",
"lastPlatformFailureAt": null,
@@ -25752,8 +25756,8 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x4",
"taskType": "text-generation",
"total": 7,
"unresolvedFailureCount": 7
"total": 6,
"unresolvedFailureCount": 6
},
"Cambricon_mlu-370-x4|vllm|text-generation": {
"attributableFailureCount": 2,
@@ -26686,15 +26690,15 @@
"unresolvedFailureCount": 10
},
"Ascend_910-b4|vllm_tokenizer_patch|text-generation|mini_k3|none": {
"attributableFailureCount": 2,
"consecutiveFailures": 2,
"attributableFailureCount": 4,
"consecutiveFailures": 4,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 2,
"decisionTotal": 4,
"failureBreakdown": {
"framework_architecture_unsupported": 2
"framework_architecture_unsupported": 4
},
"failureCount": 2,
"failureCount": 4,
"failureRate": 1.0,
"framework": "vllm_tokenizer_patch",
"lastTerminalAt": "2026-10-07T17:46:09.953381+00:00",
@@ -26707,7 +26711,7 @@
"successRate": 0.0,
"targetGpu": "Ascend_910-b4",
"taskType": "text-generation",
"total": 2,
"total": 4,
"unresolvedFailureCount": 0
},
"Ascend_910-b4|vllm|text-generation|llama|compressed-tensors": {
@@ -27060,31 +27064,6 @@
"total": 1,
"unresolvedFailureCount": 1
},
"Cambricon_mlu-370-x4|vllm-mlu|text-generation|starcoder2|compressed-tensors": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm-mlu",
"lastTerminalAt": "2026-09-26T01:14:46.157729+00:00",
"modelType": "starcoder2",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x4",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
},
"Cambricon_mlu-370-x4|vllm|text-generation|lfm2|none": {
"attributableFailureCount": 1,
"consecutiveFailures": 1,
@@ -32649,14 +32628,14 @@
"unresolvedFailureCount": 5
},
"Ascend_910-b4|vllm_tokenizer_patch|text-generation|mini_k3|none|30": {
"attributableFailureCount": 2,
"attributableFailureCount": 4,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 2,
"decisionTotal": 4,
"failureBreakdown": {
"framework_architecture_unsupported": 2
"framework_architecture_unsupported": 4
},
"failureCount": 2,
"failureCount": 4,
"failureRate": 1.0,
"framework": "vllm_tokenizer_patch",
"loadSizeLog2Bucket": 30,
@@ -32669,7 +32648,7 @@
"successRate": 0.0,
"targetGpu": "Ascend_910-b4",
"taskType": "text-generation",
"total": 2,
"total": 4,
"unresolvedFailureCount": 0
},
"Ascend_910-b4|vllm_tokenizer_patch|text-generation|mistral3|none|34": {
@@ -58981,20 +58960,20 @@
"unresolvedFailureCount": 0
}
},
"terminalRecords": 17443,
"totalRecords": 17825,
"terminalRecords": 17445,
"totalRecords": 17827,
"totals": {
"attributableFailureCount": 6267,
"attributableFailureCount": 6269,
"decisionFailureRate": 0.8649,
"decisionSuccessRate": 0.1351,
"decisionTotal": 7246,
"decisionTotal": 7248,
"failureBreakdown": {
"ambiguous_runtime": 4581,
"architecture_compatibility": 212,
"attention_backend": 3,
"backend_operator": 130,
"context_length": 327,
"framework_architecture_unsupported": 2285,
"framework_architecture_unsupported": 2287,
"memory_capacity": 1206,
"model_load": 571,
"platform_infrastructure": 955,
@@ -59005,14 +58984,14 @@
"日志缺失": 719,
"验证失败": 676
},
"failureCount": 16464,
"failureCount": 16466,
"failureRate": 0.9439,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 955,
"successCount": 979,
"successRate": 0.0561,
"total": 17443,
"total": 17445,
"unresolvedFailureCount": 9242
},
"warnings": [
@@ -59022,14 +59001,14 @@
"GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Kunlunxin_p-800 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_bi-100 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。",
"组合 Vastai_va16|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Ascend_910-b3|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Iluvatar_mrv-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -59075,6 +59054,6 @@
]
},
"storageMode": "decision_state_only",
"summarizedRecords": 17825,
"summarizedRecords": 17827,
"version": 1
}

View File

@@ -130,8 +130,10 @@
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T14:24:51.661617+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19329296879}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:05:50.745520+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006056", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-07T17:46:09.953381+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:05:50.437924+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006050", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-07T17:46:09.953349+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:05:50.435859+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006054", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T01:44:44.644712+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:05:50.391206+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006051", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-23T23:59:25.752461+00:00", "modelId": "nm-testing/Qwen2-1.5B-Instruct-FP8W8", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2245332464, "estimatedRequiredGiB": 2.522, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 2256814377, "modelscopeLicense": null, "modelscopeParams": 1777088000, "modelscopeTags": ["model_type:qwen2", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2256814377}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:50:52.437033+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005783", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-23T19:08:31.650327+00:00", "modelId": "nm-testing/tinyllama-one-shot-w4a16-group-packed", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "d8df464812ff2fd3c46dc89b0fc6a96370e694fab8e52179f1ada2cdd0ea92b9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1047023664, "estimatedRequiredGiB": 1.172, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 1048871402, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 1048871402}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:50:52.306184+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005756", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T01:44:44.644735+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030685704, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039047610}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:38:19.113576+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5005585", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "missing_structured_error_code", "failureCode": null, "failureDetectedFramework": "transformers", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "transformers", "lastSyncTime": "2026-09-22T04:16:12.463726+00:00", "modelId": "RedHatAI/starcoder2-15b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 17785269848, "estimatedRequiredGiB": 19.88, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 17788663591, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 15957889024, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 17788663591}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:32:49.780633+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5005549", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-24T10:56:20.956238+00:00", "modelId": "aisingapore/SEA-LION-v1-7B-IT-GPTQ", "modelProfile": {"architectures": ["MPTForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5469228368, "estimatedRequiredGiB": 6.118, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mpt", "modelscopeFileSize": 5473985594, "modelscopeLicense": "mit", "modelscopeParams": 1922048000, "modelscopeTags": ["license:mit", "model_type:mpt", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5473985594}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:24:26.638177+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005440", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "backend_operator", "failureAction": "prefer_other_proven_framework_or_gpu", "failureCategory": "backend_operator", "failureClassificationReason": "backend_version_dependent", "failureCode": "MISSING_OPERATOR", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-23T10:53:27.671921+00:00", "modelId": "RedHatAI/Meta-Llama-3.1-8B-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9084040952, "estimatedRequiredGiB": 10.163, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9093251763, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9093251763}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:24:26.526740+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005439", "taskType": "text-generation", "verifyResult": -1}
@@ -296,5 +298,3 @@
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5_moe"], "framework": "vllm", "lastSyncTime": "2026-09-21T10:33:30.477632+00:00", "modelId": "ornith-ai/Ornith-1.5-35B-A3B-MLX-8bit", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T10:23:21+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4609105", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-24T10:35:03.454820+00:00", "modelId": "aisingapore/SEA-LION-v1-7B-IT-Research", "modelProfile": {"architectures": ["MPTForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 15003361968, "estimatedRequiredGiB": 16.773, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mpt", "modelscopeFileSize": 15008118474, "modelscopeLicense": "cc-by-nc-sa-4.0", "modelscopeParams": 7501651968, "modelscopeTags": ["license:cc-by-nc-sa-4.0", "model_type:mpt", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 15008118474}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T10:17:52.663711+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4999054", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5"], "framework": "vllm", "lastSyncTime": "2026-09-21T10:33:30.477558+00:00", "modelId": "Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality-FP16", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T10:15:21+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4582656", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-mlu", "lastSyncTime": "2026-09-26T01:14:46.157729+00:00", "modelId": "neuralmagic/starcoder2-3b-quantized.w8a8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4093158536, "estimatedRequiredGiB": 4.578, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 4096457730, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 3181366272, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4096457730}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T10:13:37.540416+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4998917", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "", "lastSyncTime": "2026-09-21T09:54:21.980346+00:00", "modelId": "mlx-community/gemma-4-e4b-it-OptiQ-4bit", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T09:52:44+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4969634", "taskType": "text-generation", "verifyResult": null}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -2,24 +2,24 @@
"agentVersion": "2026.09.04.4",
"checksums": {
".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1",
".modelhub_state/architecture_compatibility_blacklist.json": "3e50d32b88c6a9b047422b5fb3071b3fabbdb1db72590d4534b89470bf79414d",
".modelhub_state/architecture_compatibility_blacklist.json": "f2be3392740358d2e4f9e803dff58b05fb8ba1f9fa56abee6e93bdb2cc3d0331",
".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab",
".modelhub_state/market_intelligence.json": "e0b330c8487cefb1c55a4c69f2b29bff715a1dfd0d05befb5d9a1054498d19ca",
".modelhub_state/official_capabilities.json": "3a23eba3e53af7786815b1edc35ee7ebe74641adcb61c06e79bb07f720a422ca",
".modelhub_state/outcome_checkpoint.json": "1d4fe686a2da044bb5e3b909aa631d46bc14c80a77bdb9fde22ca466517e3d03",
".modelhub_state/market_intelligence.json": "048c761cd649c80274686ba8d83de0b7207c76e28b72eafd246a34cb46eaee6c",
".modelhub_state/official_capabilities.json": "e25b38075256d619aaf8cb9250a5aabecab56f9a356eda082ad8ad368be69d10",
".modelhub_state/outcome_checkpoint.json": "93a12fbd061eb8ef577c2b725fa7229707f3da881b4d8a6bb92876be1143e0bb",
".modelhub_state/queue_cleanup_latest.json": "568ae8813ea4bc8c494aef8be02f77b1c9756ab49dd7d307b81483e6cca30468",
".modelhub_state/recent_outcomes.jsonl": "6b4944e4f9fbaef27d7d2eabd252e63d224d60f4287780d362c7975343d09400",
".modelhub_state/recovery_active_tasks.jsonl": "f7cff8ef89d827ac32ea9ef24392441b968749a879425d2a42671aaa3d63fbd5",
".modelhub_state/recovery_intents.jsonl": "93ddadc05937531e330927d97727f93b13befe4349f116c9ea0ee6f5d2fee5c3",
".modelhub_state/recent_outcomes.jsonl": "151c1fd7f523d7a52581e8e5fb14cdf2dadb2ad7973dad8c5f71163af2c087ce",
".modelhub_state/recovery_active_tasks.jsonl": "89885173bb07291f815dacd1f8a07f3bdd6a83f06067c829ca29aa4401d65075",
".modelhub_state/recovery_intents.jsonl": "82fb97b0069639d80a0aba63758a2f5beae633e715a14d6ed59635910095bc4c",
".modelhub_state/routing_intelligence.json": "a312187abffa011156b64da1fed551d1816329b725ab3f38c5221900b7cc793e",
".modelhub_state/submission_exclusions.jsonl": "dca7091e8b1da8bf9b3ecb95fe573b2a41666601edf86cea13ce9ce738b9eb7b",
".modelhub_state/worker_crashes.jsonl": "b321ea3648ae6b322601ed30ef8c3b1da0f13612af1bde3a64b0d41dc18a7b9f",
"ledger/submissions.jsonl": "e454fe4d597b7036bd9ad1d21a044f660b72bf85d1370813a7264341281b7126",
"outcomes/submissions.jsonl": "054014c5c6da461a4bd668a1f4715404c4edfcc8cb647b3910080ddefcf0b348"
"outcomes/submissions.jsonl": "3944341e674b30c5c6446b902183cbd39746f49ea28afa4549e7cf314c149166"
},
"generation": 22023,
"generation": 22024,
"phase": "cycle",
"schemaVersion": 1,
"updatedAt": "2026-10-08T01:43:39.934448+00:00",
"updatedAt": "2026-10-08T01:52:11.606252+00:00",
"writerId": "33ed03361c5848e88b8ce6204fb4f7d2"
}

View File

@@ -208,8 +208,6 @@
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T02:22:55.559751+00:00", "modelId": "nm-testing/tinyllama-oneshot-w8-channel-a8-tensor", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1232059012, "estimatedRequiredGiB": 1.379, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 1233907698, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_tokenizer_patch", "lastTerminalAt": "2026-09-21T15:02:24.876390+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Ascend_910-b4", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 1233907698}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T18:22:48.751608+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5005404", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T02:22:55.559801+00:00", "modelId": "nm-testing/llama7b-one-shot-2_4-w4a16-marlin24-t", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 3054596816, "estimatedRequiredGiB": 3.416, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 3056444703, "modelscopeLicense": null, "modelscopeParams": 1122504704, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 3056444703}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T18:22:48.756508+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005406", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T02:26:33.565841+00:00", "modelId": "nm-testing/tinyllama-oneshot-w4a16-channel-v2", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "d8df464812ff2fd3c46dc89b0fc6a96370e694fab8e52179f1ada2cdd0ea92b9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 747618112, "estimatedRequiredGiB": 0.838, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 749466433, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 749466433}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T18:22:48.845075+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005433", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T02:38:53.182724+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030685704, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039047610}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T18:38:19.113576+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5005585", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T03:05:58.563167+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:05:50.391206+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006051", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T03:05:58.563219+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block2-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042625829}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:05:50.446409+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006046", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T03:05:58.563160+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030685704, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039047610}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:05:50.457742+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006045", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T03:05:58.563242+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031556216, "estimatedRequiredGiB": 2.28, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039918195}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:05:50.449911+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006044", "taskType": "text-generation", "verifyResult": null}
@@ -926,8 +924,8 @@
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-07T22:01:50.158755+00:00", "modelId": "raincandy-u/MacroStories", "modelProfile": {"architectures": ["OuroForCausalLM"], "configFingerprint": "e4f10af7e21b1a730b2dfa32856745ab0e7a14867778026d61065fda3de90727", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 81364, "estimatedRequiredGiB": 0.0, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "ouro", "modelscopeFileSize": 154520, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:ouro", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:custom-code", "custom_tag:storytelling", "custom_tag:small-language-model", "custom_tag:recurrent-depth", "custom_tag:synthetic-data"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 154520}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T13:56:51.658258+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5355357", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T01:09:06.056731+00:00", "modelId": "OsaurusAI/Raptor-0.6.1-preview-4B-JANG_6M", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 3662928280, "estimatedRequiredGiB": 4.11, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 3677830216, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:jang", "custom_tag:quantized", "custom_tag:apple-silicon", "custom_tag:reasoning", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:spark2_5", "custom_tag:imatrix", "custom_tag:awq", "custom_tag:gptq", "custom_tag:preview"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 3677830216}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:00:35.063304+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358099", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T01:09:06.056772+00:00", "modelId": "cyankiwi/K2-Horizon-7B-AWQ-FP8", "modelProfile": {"architectures": ["K2HorizonForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11055458328, "estimatedRequiredGiB": 12.381, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "k2_horizon", "modelscopeFileSize": 11077974096, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:k2_horizon", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:k2-horizon", "custom_tag:7b", "custom_tag:dense", "custom_tag:open-weights", "custom_tag:ifm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 11077974096}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:00:35.065401+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358129", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "mlx-community/gpt-oss-20b-OptiQ-4bit", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11623702006, "estimatedRequiredGiB": 13.022, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 11651702017, "modelscopeLicense": "apache-2.0", "modelscopeParams": 3982569024, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:openai", "custom_tag:gpt-oss", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:4bit", "custom_tag:mixed-precision", "custom_tag:optiq", "custom_tag:moe", "custom_tag:apple-silicon", "custom_tag:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11651702017}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:15:34.052921+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358545", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "cyankiwi/K2-Horizon-3.7B-AWQ-INT4", "modelProfile": {"architectures": ["K2HorizonForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4749242120, "estimatedRequiredGiB": 5.332, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "k2_horizon", "modelscopeFileSize": 4771310100, "modelscopeLicense": "apache-2.0", "modelscopeParams": 641597440, "modelscopeTags": ["license:apache-2.0", "model_type:k2_horizon", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:k2-horizon", "custom_tag:3.7b", "custom_tag:dense", "custom_tag:open-weights", "custom_tag:ifm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4771310100}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:17:03.658299+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358570", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T01:44:44.644726+00:00", "modelId": "mlx-community/gpt-oss-20b-OptiQ-4bit", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11623702006, "estimatedRequiredGiB": 13.022, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 11651702017, "modelscopeLicense": "apache-2.0", "modelscopeParams": 3982569024, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:openai", "custom_tag:gpt-oss", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:4bit", "custom_tag:mixed-precision", "custom_tag:optiq", "custom_tag:moe", "custom_tag:apple-silicon", "custom_tag:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11651702017}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:15:34.052921+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358545", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T01:44:44.644687+00:00", "modelId": "cyankiwi/K2-Horizon-3.7B-AWQ-INT4", "modelProfile": {"architectures": ["K2HorizonForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4749242120, "estimatedRequiredGiB": 5.332, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "k2_horizon", "modelscopeFileSize": 4771310100, "modelscopeLicense": "apache-2.0", "modelscopeParams": 641597440, "modelscopeTags": ["license:apache-2.0", "model_type:k2_horizon", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:k2-horizon", "custom_tag:3.7b", "custom_tag:dense", "custom_tag:open-weights", "custom_tag:ifm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4771310100}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:17:03.658299+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358570", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "mlx-community/LFM2.5-1.2B-Thinking-5bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 804816628, "estimatedRequiredGiB": 0.905, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 809580753, "modelscopeLicense": "other", "modelscopeParams": 219544320, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 809580753}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:44:29.668857+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5358695", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "mlx-community/LFM2.5-1.2B-Instruct-bf16", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2340697867, "estimatedRequiredGiB": 2.621, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 2345448728, "modelscopeLicense": "other", "modelscopeParams": 1170340608, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2345448728}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:44:30.068704+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5358693", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "raincandy-u/MacroStories", "modelProfile": {"architectures": ["OuroForCausalLM"], "configFingerprint": "785069d14d27b828ee50a34932a2fa1917fd842d075189f20fc7defd52ef2db4", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 81364, "estimatedRequiredGiB": 0.0, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "ouro", "modelscopeFileSize": 154520, "modelscopeLicense": null, "modelscopeParams": 19969, "modelscopeTags": ["model_type:ouro", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:custom-code", "custom_tag:storytelling", "custom_tag:small-language-model", "custom_tag:recurrent-depth", "custom_tag:synthetic-data"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 154520}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:44:29.660022+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5358694", "taskType": "text-generation", "verifyResult": null}