state: generation 22030 (cycle)

This commit is contained in:
2026-10-08 02:28:20 +00:00
parent 554efa79db
commit 370e1671e8
9 changed files with 3704 additions and 3331 deletions

View File

@@ -64,7 +64,7 @@
"ascend_910-b3|vllm_tokenizer_patch|text-generation|model_type:mini_k3": {
"architectureSignature": "model_type:mini_k3",
"architectures": [],
"evidenceCount": 2,
"evidenceCount": 3,
"expiresAt": "2026-10-21T19:37:12.459191+00:00",
"framework": "vllm_tokenizer_patch",
"latestFailureAt": "2026-09-21T19:37:12.459191+00:00",
@@ -73,11 +73,13 @@
"modelType": "mini_k3",
"sourceModelIds": [
"nkkbr/Mini-K3-1H-decay-g2-v2_C",
"nkkbr/Mini-K3-1H-attnres-block6-v1_C"
"nkkbr/Mini-K3-1H-attnres-block6-v1_C",
"nkkbr/Mini-K3-1H-attnres-standard-v1_B"
],
"sourceTaskIds": [
"5006360",
"5006364"
"5006364",
"5006357"
],
"targetGpu": "Ascend_910-b3",
"taskType": "text-generation"
@@ -945,7 +947,7 @@
"cambricon_mlu-370-x8|vllm-mlu|text-generation|model_type:mini_k3": {
"architectureSignature": "model_type:mini_k3",
"architectures": [],
"evidenceCount": 4,
"evidenceCount": 5,
"expiresAt": "2026-10-21T19:52:49.757664+00:00",
"framework": "vllm-mlu",
"latestFailureAt": "2026-09-21T19:52:49.757664+00:00",
@@ -956,12 +958,14 @@
"nkkbr/Mini-K3-1H-decay-g16-v2_B",
"nkkbr/Mini-K3-1H-attnres-block6-v1_C",
"nkkbr/Mini-K3-1H-decay-g2-v2_C",
"nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C",
"nkkbr/Mini-K3-1H-attnres-standard-v1_B"
],
"sourceTaskIds": [
"5006516",
"5006518",
"5006512",
"5006511",
"5006510"
],
"targetGpu": "Cambricon_mlu-370-x8",
@@ -2894,7 +2898,7 @@
"taskType": "text-generation"
}
},
"generatedAt": "2026-10-08T02:03:59.540279+00:00",
"generatedAt": "2026-10-08T02:21:34.139461+00:00",
"summary": {
"activeBlockCount": 145,
"byGpuFramework": {

View File

@@ -1,8 +1,8 @@
{
"communityAttemptedAt": "2026-10-08T02:05:29.965768+00:00",
"communityAttemptedAt": "2026-10-08T02:22:49.896587+00:00",
"communityError": null,
"communitySample": {},
"communityUpdatedAt": "2026-10-08T02:05:29.965768+00:00",
"communityUpdatedAt": "2026-10-08T02:22:49.896587+00:00",
"frameworkAttemptedAt": "2026-10-07T20:58:42.772583+00:00",
"frameworkError": null,
"frameworkStats": {
@@ -434,121 +434,121 @@
}
},
"frameworkUpdatedAt": null,
"generatedAt": "2026-10-08T02:17:39.261977+00:00",
"generatedAt": "2026-10-08T02:22:49.896587+00:00",
"gpuStats": {
"Ascend_910-b3": {
"available": true,
"backlogHours": 981.5928143712575,
"backlogHours": 910.5,
"canVerify": true,
"error": null,
"gpu": "Ascend_910-b3",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 1.0716622671529823,
"queueFactor": 0.9933969344079984,
"queueWeight": 0.9933969344079984,
"recentSuccess": 48,
"recentSuccessRate": 0.2874251497005988,
"recentTerminal": 167,
"recentWilsonLowerBound": 0.22417344442874804,
"qualityFactor": 1.0185212592223822,
"queueFactor": 0.9626399001538056,
"queueWeight": 0.9626399001538056,
"recentSuccess": 47,
"recentSuccessRate": 0.2611111111111111,
"recentTerminal": 180,
"recentWilsonLowerBound": 0.20241252105479327,
"running": 8,
"selectionWeight": 1.0645860109104979,
"selectionWeight": 0.9804692032823624,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 27.833333333333332,
"waiting": 27321
"throughputPerHour": 30.0,
"waiting": 27315
},
"Ascend_910-b4": {
"available": true,
"backlogHours": 923.4123711340205,
"backlogHours": 749.3723849372384,
"canVerify": true,
"error": null,
"gpu": "Ascend_910-b4",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 0.7621172004769737,
"queueFactor": 1.0025433664635357,
"queueWeight": 1.0025433664635357,
"qualityFactor": 0.5658794120476099,
"queueFactor": 0.9911769603702267,
"queueWeight": 0.9911769603702267,
"recentSuccess": 48,
"recentSuccessRate": 0.24742268041237114,
"recentTerminal": 194,
"recentWilsonLowerBound": 0.19199724360578466,
"running": 6,
"selectionWeight": 0.7640555438059505,
"recentSuccessRate": 0.200836820083682,
"recentTerminal": 239,
"recentWilsonLowerBound": 0.1549588454515307,
"running": 7,
"selectionWeight": 0.5608866355694411,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 32.333333333333336,
"waiting": 29857
"throughputPerHour": 39.833333333333336,
"waiting": 29850
},
"Biren_166m": {
"available": true,
"backlogHours": 169.2941176470588,
"backlogHours": 167.03225806451613,
"canVerify": true,
"error": null,
"gpu": "Biren_166m",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 0.32186647969356075,
"queueFactor": 1.2930527456305354,
"queueWeight": 1.2930527456305354,
"recentSuccess": 28,
"recentSuccessRate": 0.1830065359477124,
"recentTerminal": 153,
"recentWilsonLowerBound": 0.12975906724694125,
"running": 8,
"selectionWeight": 0.4161903352941937,
"qualityFactor": 0.4460527048651359,
"queueFactor": 1.241468767929756,
"queueWeight": 1.241468767929756,
"recentSuccess": 30,
"recentSuccessRate": 0.1935483870967742,
"recentTerminal": 155,
"recentWilsonLowerBound": 0.13907359549299317,
"running": 7,
"selectionWeight": 0.5537605019406553,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 25.5,
"waiting": 4317
"throughputPerHour": 25.833333333333332,
"waiting": 4315
},
"Cambricon_mlu-370-x4": {
"available": true,
"backlogHours": 1173.7241379310344,
"backlogHours": 872.8717948717949,
"canVerify": true,
"error": null,
"gpu": "Cambricon_mlu-370-x4",
"healthFactor": 1.0,
"maxConcurrentTasks": 7,
"qualityFactor": 0.3515767675650826,
"queueFactor": 0.967113878427609,
"queueWeight": 0.967113878427609,
"recentSuccess": 18,
"recentSuccessRate": 0.20689655172413793,
"recentTerminal": 87,
"recentWilsonLowerBound": 0.13507251809274734,
"qualityFactor": 0.24796599129561395,
"queueFactor": 0.968753494510883,
"queueWeight": 0.968753494510883,
"recentSuccess": 19,
"recentSuccessRate": 0.1623931623931624,
"recentTerminal": 117,
"recentWilsonLowerBound": 0.10649722549629985,
"running": 7,
"selectionWeight": 0.34001477124490903,
"selectionWeight": 0.2402179205874812,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 14.5,
"waiting": 17019
"throughputPerHour": 19.5,
"waiting": 17021
},
"Cambricon_mlu-370-x8": {
"available": true,
"backlogHours": 363.6470588235294,
"backlogHours": 309.1333333333333,
"canVerify": true,
"error": null,
"gpu": "Cambricon_mlu-370-x8",
"healthFactor": 1.0,
"maxConcurrentTasks": 7,
"qualityFactor": 0.3860640701823197,
"queueFactor": 1.1529500941689594,
"queueWeight": 1.1529500941689594,
"qualityFactor": 0.3183797201155025,
"queueFactor": 1.131967546056151,
"queueWeight": 1.131967546056151,
"recentSuccess": 30,
"recentSuccessRate": 0.19607843137254902,
"recentTerminal": 153,
"recentWilsonLowerBound": 0.14094165512787288,
"recentSuccessRate": 0.16666666666666666,
"recentTerminal": 180,
"recentWilsonLowerBound": 0.11931105652108458,
"running": 7,
"selectionWeight": 0.44511260607195724,
"selectionWeight": 0.36039551049318946,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 25.5,
"waiting": 9273
"throughputPerHour": 30.0,
"waiting": 9274
},
"Iluvatar_bi-100": {
"available": true,
"backlogHours": 67.06761565836298,
"backlogHours": 65.41666666666667,
"canVerify": true,
"error": null,
"gpu": "Iluvatar_bi-100",
@@ -557,197 +557,197 @@
"qualityFactor": 0.05,
"queueFactor": 1.3,
"queueWeight": 1.3,
"recentSuccess": 9,
"recentSuccessRate": 0.03202846975088968,
"recentTerminal": 281,
"recentWilsonLowerBound": 0.016939892932890558,
"running": 2,
"recentSuccess": 10,
"recentSuccessRate": 0.034722222222222224,
"recentTerminal": 288,
"recentWilsonLowerBound": 0.018967607724656183,
"running": 1,
"selectionWeight": 0.065,
"stale": false,
"submissionEligible": false,
"throughputPerHour": 46.833333333333336,
"waiting": 3141
"throughputPerHour": 48.0,
"waiting": 3140
},
"Iluvatar_bi-150": {
"available": true,
"backlogHours": 184.30622009569376,
"backlogHours": 180.7887323943662,
"canVerify": true,
"error": null,
"gpu": "Iluvatar_bi-150",
"healthFactor": 1.0,
"maxConcurrentTasks": 50,
"qualityFactor": 0.3781090855766414,
"queueFactor": 1.2766784338438268,
"queueWeight": 1.2766784338438268,
"recentSuccess": 39,
"recentSuccessRate": 0.18660287081339713,
"recentTerminal": 209,
"recentWilsonLowerBound": 0.1396140879839264,
"running": 11,
"selectionWeight": 0.48272371519610807,
"qualityFactor": 0.4601064237519589,
"queueFactor": 1.2268180221500542,
"queueWeight": 1.2268180221500542,
"recentSuccess": 40,
"recentSuccessRate": 0.18779342723004694,
"recentTerminal": 213,
"recentWilsonLowerBound": 0.1410484679695861,
"running": 5,
"selectionWeight": 0.564466852765913,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 34.833333333333336,
"waiting": 6420
"throughputPerHour": 35.5,
"waiting": 6418
},
"Iluvatar_mrv-100": {
"available": true,
"backlogHours": 1978.4680851063831,
"backlogHours": 1897.7142857142858,
"canVerify": true,
"error": null,
"gpu": "Iluvatar_mrv-100",
"healthFactor": 1.0,
"maxConcurrentTasks": 2,
"qualityFactor": 0.7150258723216495,
"queueFactor": 0.8942586787838174,
"queueWeight": 0.8942586787838174,
"recentSuccess": 14,
"recentSuccessRate": 0.2978723404255319,
"recentTerminal": 47,
"recentWilsonLowerBound": 0.18651084151016264,
"qualityFactor": 0.6249383600701626,
"queueFactor": 0.8622262233104306,
"queueWeight": 0.8622262233104306,
"recentSuccess": 13,
"recentSuccessRate": 0.2653061224489796,
"recentTerminal": 49,
"recentWilsonLowerBound": 0.1621113124514944,
"running": 2,
"selectionWeight": 0.6394180918786048,
"selectionWeight": 0.5388382420051103,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 7.833333333333333,
"throughputPerHour": 8.166666666666666,
"waiting": 15498
},
"Kunlunxin_p-800": {
"available": true,
"backlogHours": 385.21678321678326,
"backlogHours": 382.625,
"canVerify": true,
"error": null,
"gpu": "Kunlunxin_p-800",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 0.3405525387332613,
"queueFactor": 1.1430276626545544,
"queueWeight": 1.1430276626545544,
"recentSuccess": 27,
"recentSuccessRate": 0.1888111888111888,
"recentTerminal": 143,
"recentWilsonLowerBound": 0.13313059841931657,
"running": 8,
"selectionWeight": 0.38926097235935425,
"qualityFactor": 0.3608481685245635,
"queueFactor": 1.096326343324002,
"queueWeight": 1.096326343324002,
"recentSuccess": 26,
"recentSuccessRate": 0.18055555555555555,
"recentTerminal": 144,
"recentWilsonLowerBound": 0.1262985801362023,
"running": 7,
"selectionWeight": 0.39560735309369793,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 23.833333333333332,
"waiting": 9181
"throughputPerHour": 24.0,
"waiting": 9183
},
"MetaX_c-500": {
"available": true,
"backlogHours": 529.560975609756,
"backlogHours": 508.78125,
"canVerify": true,
"error": null,
"gpu": "MetaX_c-500",
"healthFactor": 1.0,
"maxConcurrentTasks": 4,
"qualityFactor": 0.5791326224596315,
"queueFactor": 1.0897456020417968,
"queueWeight": 1.0897456020417968,
"qualityFactor": 0.6293583094791467,
"queueFactor": 1.0504519375824717,
"queueWeight": 1.0504519375824717,
"recentSuccess": 29,
"recentSuccessRate": 0.23577235772357724,
"recentTerminal": 123,
"recentWilsonLowerBound": 0.169470182254119,
"recentSuccessRate": 0.2265625,
"recentTerminal": 128,
"recentWilsonLowerBound": 0.1626314704520524,
"running": 4,
"selectionWeight": 0.6311072283243158,
"selectionWeight": 0.6611106556259986,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 20.5,
"waiting": 10856
"throughputPerHour": 21.333333333333332,
"waiting": 10854
},
"Mthreads_s4000": {
"available": true,
"backlogHours": 1921.2352941176468,
"backlogHours": 1718.921052631579,
"canVerify": true,
"error": null,
"gpu": "Mthreads_s4000",
"healthFactor": 1.0,
"maxConcurrentTasks": 4,
"qualityFactor": 2.5,
"queueFactor": 0.8982049364656525,
"queueWeight": 0.8982049364656525,
"recentSuccess": 30,
"recentSuccessRate": 0.4411764705882353,
"recentTerminal": 68,
"recentWilsonLowerBound": 0.329460449863809,
"queueFactor": 0.8751197022607649,
"queueWeight": 0.8751197022607649,
"recentSuccess": 31,
"recentSuccessRate": 0.40789473684210525,
"recentTerminal": 76,
"recentWilsonLowerBound": 0.3044362924110896,
"running": 4,
"selectionWeight": 2.2455123411641313,
"selectionWeight": 2.187799255651912,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 11.333333333333334,
"waiting": 21774
"throughputPerHour": 12.666666666666666,
"waiting": 21773
},
"Sunrise_pt-200-x1": {
"available": true,
"backlogHours": 3025.0588235294117,
"backlogHours": 2638.923076923077,
"canVerify": true,
"error": null,
"gpu": "Sunrise_pt-200-x1",
"healthFactor": 1.0,
"maxConcurrentTasks": 2,
"qualityFactor": 0.19569773063498763,
"queueFactor": 0.83907821840434,
"queueWeight": 0.83907821840434,
"recentSuccess": 7,
"recentSuccessRate": 0.20588235294117646,
"recentTerminal": 34,
"recentWilsonLowerBound": 0.10349396022351322,
"qualityFactor": 0.2546670908081134,
"queueFactor": 0.8206195166845721,
"queueWeight": 0.8206195166845721,
"recentSuccess": 8,
"recentSuccessRate": 0.20512820512820512,
"recentTerminal": 39,
"recentWilsonLowerBound": 0.10779590197911117,
"running": 2,
"selectionWeight": 0.16420570316697786,
"selectionWeight": 0.20898478497442005,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 5.666666666666667,
"waiting": 17142
"throughputPerHour": 6.5,
"waiting": 17153
},
"Vastai_va16": {
"available": true,
"backlogHours": 954.9532710280374,
"backlogHours": 663.3896103896103,
"canVerify": true,
"error": null,
"gpu": "Vastai_va16",
"healthFactor": 1.0,
"maxConcurrentTasks": 16,
"qualityFactor": 0.05,
"queueFactor": 0.9975052794211626,
"queueWeight": 0.9975052794211626,
"queueFactor": 1.009463339406955,
"queueWeight": 1.009463339406955,
"recentSuccess": 3,
"recentSuccessRate": 0.028037383177570093,
"recentTerminal": 107,
"recentWilsonLowerBound": 0.009580293417619424,
"running": 15,
"selectionWeight": 0.04987526397105813,
"recentSuccessRate": 0.01948051948051948,
"recentTerminal": 154,
"recentWilsonLowerBound": 0.00664678005963353,
"running": 16,
"selectionWeight": 0.05047316697034775,
"stale": false,
"submissionEligible": false,
"throughputPerHour": 17.833333333333332,
"waiting": 17030
"throughputPerHour": 25.666666666666668,
"waiting": 17027
},
"hygon_k100-ai": {
"available": true,
"backlogHours": 1213.8285714285714,
"backlogHours": 1180.0555555555557,
"canVerify": true,
"error": null,
"gpu": "hygon_k100-ai",
"healthFactor": 1.0,
"maxConcurrentTasks": 6,
"qualityFactor": 1.4731201652464643,
"queueFactor": 0.9622522109735849,
"queueWeight": 0.9622522109735849,
"recentSuccess": 36,
"recentSuccessRate": 0.34285714285714286,
"recentTerminal": 105,
"recentWilsonLowerBound": 0.25905582525585225,
"qualityFactor": 1.8930968436603526,
"queueFactor": 0.9259136425242689,
"queueWeight": 0.9259136425242689,
"recentSuccess": 38,
"recentSuccessRate": 0.35185185185185186,
"recentTerminal": 108,
"recentWilsonLowerBound": 0.26828862070909015,
"running": 6,
"selectionWeight": 1.417513136038183,
"selectionWeight": 1.7528441941647535,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 17.5,
"waiting": 21242
"throughputPerHour": 18.0,
"waiting": 21241
}
},
"queueAttemptedAt": "2026-10-08T02:12:05.466087+00:00",
"queueAttemptedAt": "2026-10-08T02:22:49.896587+00:00",
"queueError": null,
"queueUpdatedAt": "2026-10-08T02:12:05.466087+00:00",
"queueUpdatedAt": "2026-10-08T02:22:49.896587+00:00",
"supportedGpus": [
"Vastai_va16",
"Cambricon_mlu-370-x4",

File diff suppressed because it is too large Load Diff

View File

@@ -1,6 +1,6 @@
{
"generatedAt": "2026-10-08T02:03:59.434771+00:00",
"lastSyncTime": "2026-10-08T02:03:59.168125+00:00",
"generatedAt": "2026-10-08T02:21:34.037397+00:00",
"lastSyncTime": "2026-10-08T02:21:33.753390+00:00",
"recentLimit": 300,
"report": {
"architectureCompatibilityBlocks": {
@@ -68,7 +68,7 @@
"ascend_910-b3|vllm_tokenizer_patch|text-generation|model_type:mini_k3": {
"architectureSignature": "model_type:mini_k3",
"architectures": [],
"evidenceCount": 2,
"evidenceCount": 3,
"expiresAt": "2026-10-21T19:37:12.459191+00:00",
"framework": "vllm_tokenizer_patch",
"latestFailureAt": "2026-09-21T19:37:12.459191+00:00",
@@ -77,11 +77,13 @@
"modelType": "mini_k3",
"sourceModelIds": [
"nkkbr/Mini-K3-1H-decay-g2-v2_C",
"nkkbr/Mini-K3-1H-attnres-block6-v1_C"
"nkkbr/Mini-K3-1H-attnres-block6-v1_C",
"nkkbr/Mini-K3-1H-attnres-standard-v1_B"
],
"sourceTaskIds": [
"5006360",
"5006364"
"5006364",
"5006357"
],
"targetGpu": "Ascend_910-b3",
"taskType": "text-generation"
@@ -949,7 +951,7 @@
"cambricon_mlu-370-x8|vllm-mlu|text-generation|model_type:mini_k3": {
"architectureSignature": "model_type:mini_k3",
"architectures": [],
"evidenceCount": 4,
"evidenceCount": 5,
"expiresAt": "2026-10-21T19:52:49.757664+00:00",
"framework": "vllm-mlu",
"latestFailureAt": "2026-09-21T19:52:49.757664+00:00",
@@ -960,12 +962,14 @@
"nkkbr/Mini-K3-1H-decay-g16-v2_B",
"nkkbr/Mini-K3-1H-attnres-block6-v1_C",
"nkkbr/Mini-K3-1H-decay-g2-v2_C",
"nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C",
"nkkbr/Mini-K3-1H-attnres-standard-v1_B"
],
"sourceTaskIds": [
"5006516",
"5006518",
"5006512",
"5006511",
"5006510"
],
"targetGpu": "Cambricon_mlu-370-x8",
@@ -3019,29 +3023,29 @@
"unresolvedFailureCount": 1
},
"Ascend_910-b3|vllm_tokenizer_patch|text-generation": {
"attributableFailureCount": 49,
"decisionFailureRate": 0.9245,
"decisionSuccessRate": 0.0755,
"decisionTotal": 53,
"attributableFailureCount": 50,
"decisionFailureRate": 0.9259,
"decisionSuccessRate": 0.0741,
"decisionTotal": 54,
"failureBreakdown": {
"ambiguous_runtime": 93,
"context_length": 9,
"framework_architecture_unsupported": 39,
"framework_architecture_unsupported": 40,
"memory_capacity": 1,
"platform_infrastructure": 1,
"参数/模板问题": 8
},
"failureCount": 151,
"failureRate": 0.9742,
"failureCount": 152,
"failureRate": 0.9744,
"framework": "vllm_tokenizer_patch",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 1,
"successCount": 4,
"successRate": 0.0258,
"successRate": 0.0256,
"targetGpu": "Ascend_910-b3",
"taskType": "text-generation",
"total": 155,
"total": 156,
"unresolvedFailureCount": 101
},
"Ascend_910-b3|vllm|text-generation": {
@@ -3601,29 +3605,29 @@
"unresolvedFailureCount": 47
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation": {
"attributableFailureCount": 23,
"decisionFailureRate": 0.6389,
"decisionSuccessRate": 0.3611,
"decisionTotal": 36,
"attributableFailureCount": 24,
"decisionFailureRate": 0.6486,
"decisionSuccessRate": 0.3514,
"decisionTotal": 37,
"failureBreakdown": {
"ambiguous_runtime": 54,
"framework_architecture_unsupported": 19,
"framework_architecture_unsupported": 20,
"model_load": 3,
"tokenizer_compatibility": 1,
"参数/模板问题": 3
"参数/模板问题": 10
},
"failureCount": 80,
"failureRate": 0.8602,
"failureCount": 88,
"failureRate": 0.8713,
"framework": "vllm-mlu",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 13,
"successRate": 0.1398,
"successRate": 0.1287,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 93,
"unresolvedFailureCount": 57
"total": 101,
"unresolvedFailureCount": 64
},
"Cambricon_mlu-370-x8|vllm|text-generation": {
"attributableFailureCount": 22,
@@ -5675,28 +5679,28 @@
"unresolvedFailureCount": 51
},
"vllm-mlu": {
"attributableFailureCount": 49,
"decisionFailureRate": 0.6901,
"decisionSuccessRate": 0.3099,
"decisionTotal": 71,
"attributableFailureCount": 50,
"decisionFailureRate": 0.6944,
"decisionSuccessRate": 0.3056,
"decisionTotal": 72,
"failureBreakdown": {
"ambiguous_runtime": 103,
"framework_architecture_unsupported": 41,
"framework_architecture_unsupported": 42,
"model_load": 7,
"platform_infrastructure": 1,
"tokenizer_compatibility": 1,
"参数/模板问题": 4,
"参数/模板问题": 11,
"验证失败": 3
},
"failureCount": 160,
"failureRate": 0.8791,
"failureCount": 168,
"failureRate": 0.8842,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 1,
"successCount": 22,
"successRate": 0.1209,
"total": 182,
"unresolvedFailureCount": 110
"successRate": 0.1158,
"total": 190,
"unresolvedFailureCount": 117
},
"vllm-patch-tokenizer": {
"attributableFailureCount": 67,
@@ -5771,15 +5775,15 @@
"unresolvedFailureCount": 396
},
"vllm_tokenizer_patch": {
"attributableFailureCount": 161,
"decisionFailureRate": 0.9415,
"decisionSuccessRate": 0.0585,
"decisionTotal": 171,
"attributableFailureCount": 162,
"decisionFailureRate": 0.9419,
"decisionSuccessRate": 0.0581,
"decisionTotal": 172,
"failureBreakdown": {
"ambiguous_runtime": 208,
"backend_operator": 15,
"context_length": 9,
"framework_architecture_unsupported": 103,
"framework_architecture_unsupported": 104,
"memory_capacity": 2,
"model_load": 24,
"platform_infrastructure": 3,
@@ -5788,28 +5792,28 @@
"tokenizer_compatibility": 2,
"参数/模板问题": 71
},
"failureCount": 443,
"failureRate": 0.9779,
"failureCount": 444,
"failureRate": 0.978,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 3,
"successCount": 10,
"successRate": 0.0221,
"total": 453,
"successRate": 0.022,
"total": 454,
"unresolvedFailureCount": 279
}
},
"generatedAt": "2026-10-08T02:03:59.420071+00:00",
"generatedAt": "2026-10-08T02:21:34.021514+00:00",
"gpuSummaries": {
"Ascend_910-b3": {
"attributableFailureCount": 121,
"decisionFailureRate": 0.8462,
"decisionSuccessRate": 0.1538,
"decisionTotal": 143,
"attributableFailureCount": 122,
"decisionFailureRate": 0.8472,
"decisionSuccessRate": 0.1528,
"decisionTotal": 144,
"failureBreakdown": {
"ambiguous_runtime": 162,
"context_length": 9,
"framework_architecture_unsupported": 106,
"framework_architecture_unsupported": 107,
"memory_capacity": 2,
"platform_infrastructure": 1,
"repository_structure": 1,
@@ -5818,14 +5822,14 @@
"日志缺失": 3,
"验证失败": 27
},
"failureCount": 354,
"failureRate": 0.9415,
"failureCount": 355,
"failureRate": 0.9416,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 1,
"successCount": 22,
"successRate": 0.0585,
"total": 376,
"successRate": 0.0584,
"total": 377,
"unresolvedFailureCount": 232
},
"Ascend_910-b4": {
@@ -5916,29 +5920,29 @@
"unresolvedFailureCount": 856
},
"Cambricon_mlu-370-x8": {
"attributableFailureCount": 69,
"decisionFailureRate": 0.8214,
"decisionSuccessRate": 0.1786,
"decisionTotal": 84,
"attributableFailureCount": 70,
"decisionFailureRate": 0.8235,
"decisionSuccessRate": 0.1765,
"decisionTotal": 85,
"failureBreakdown": {
"ambiguous_runtime": 158,
"framework_architecture_unsupported": 56,
"framework_architecture_unsupported": 57,
"memory_capacity": 4,
"model_load": 6,
"platform_infrastructure": 2,
"tokenizer_compatibility": 3,
"参数/模板问题": 41,
"参数/模板问题": 48,
"验证失败": 22
},
"failureCount": 292,
"failureRate": 0.9511,
"failureCount": 300,
"failureRate": 0.9524,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 2,
"successCount": 15,
"successRate": 0.0489,
"total": 307,
"unresolvedFailureCount": 221
"successRate": 0.0476,
"total": 315,
"unresolvedFailureCount": 228
},
"Iluvatar_bi-100": {
"attributableFailureCount": 194,
@@ -6632,14 +6636,14 @@
"unresolvedFailureCount": 2
},
"Ascend_910-b3|vllm_tokenizer_patch|text-generation|mini_k3|none": {
"attributableFailureCount": 2,
"attributableFailureCount": 3,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 2,
"decisionTotal": 3,
"failureBreakdown": {
"framework_architecture_unsupported": 2
"framework_architecture_unsupported": 3
},
"failureCount": 2,
"failureCount": 3,
"failureRate": 1.0,
"framework": "vllm_tokenizer_patch",
"modelType": "mini_k3",
@@ -6651,7 +6655,7 @@
"successRate": 0.0,
"targetGpu": "Ascend_910-b3",
"taskType": "text-generation",
"total": 2,
"total": 3,
"unresolvedFailureCount": 0
},
"Ascend_910-b3|vllm_tokenizer_patch|text-generation|mistral3|none": {
@@ -13443,14 +13447,14 @@
"unresolvedFailureCount": 1
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mini_k3|none": {
"attributableFailureCount": 4,
"attributableFailureCount": 5,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 4,
"decisionTotal": 5,
"failureBreakdown": {
"framework_architecture_unsupported": 4
"framework_architecture_unsupported": 5
},
"failureCount": 4,
"failureCount": 5,
"failureRate": 1.0,
"framework": "vllm-mlu",
"modelType": "mini_k3",
@@ -13462,7 +13466,7 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 4,
"total": 5,
"unresolvedFailureCount": 0
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mistral|compressed-tensors": {
@@ -25553,18 +25557,18 @@
"unresolvedFailureCount": 1
},
"Ascend_910-b3|vllm_tokenizer_patch|text-generation": {
"attributableFailureCount": 5,
"consecutiveFailures": 5,
"attributableFailureCount": 6,
"consecutiveFailures": 6,
"consecutivePlatformFailures": 0,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 5,
"decisionTotal": 6,
"failureBreakdown": {
"ambiguous_runtime": 6,
"context_length": 3,
"framework_architecture_unsupported": 2
"framework_architecture_unsupported": 3
},
"failureCount": 11,
"failureCount": 12,
"failureRate": 1.0,
"framework": "vllm_tokenizer_patch",
"lastPlatformFailureAt": null,
@@ -25576,7 +25580,7 @@
"successRate": 0.0,
"targetGpu": "Ascend_910-b3",
"taskType": "text-generation",
"total": 11,
"total": 12,
"unresolvedFailureCount": 6
},
"Ascend_910-b3|vllm|text-generation": {
@@ -25640,9 +25644,9 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 2
"ambiguous_runtime": 1
},
"failureCount": 2,
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm",
"lastPlatformFailureAt": null,
@@ -25654,8 +25658,8 @@
"successRate": 0.0,
"targetGpu": "Ascend_910-b4",
"taskType": "text-generation",
"total": 2,
"unresolvedFailureCount": 2
"total": 1,
"unresolvedFailureCount": 1
},
"Biren_166m|unknown|text-generation": {
"attributableFailureCount": 2,
@@ -25820,10 +25824,10 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 12,
"ambiguous_runtime": 5,
"参数/模板问题": 1
},
"failureCount": 13,
"failureCount": 6,
"failureRate": 1.0,
"framework": "vllm-customized",
"lastPlatformFailureAt": null,
@@ -25835,25 +25839,26 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 13,
"unresolvedFailureCount": 13
"total": 6,
"unresolvedFailureCount": 6
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation": {
"attributableFailureCount": 5,
"consecutiveFailures": 5,
"attributableFailureCount": 6,
"consecutiveFailures": 6,
"consecutivePlatformFailures": 0,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 5,
"decisionTotal": 6,
"failureBreakdown": {
"ambiguous_runtime": 1,
"framework_architecture_unsupported": 5
"framework_architecture_unsupported": 6,
"参数/模板问题": 7
},
"failureCount": 6,
"failureCount": 14,
"failureRate": 1.0,
"framework": "vllm-mlu",
"lastPlatformFailureAt": null,
"lastTerminalAt": "2026-10-07T18:18:51.743140+00:00",
"lastTerminalAt": "2026-10-08T02:21:33.753289+00:00",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
@@ -25861,8 +25866,8 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 6,
"unresolvedFailureCount": 1
"total": 14,
"unresolvedFailureCount": 8
},
"Iluvatar_bi-150|transformers|text-generation": {
"attributableFailureCount": 5,
@@ -26073,19 +26078,19 @@
"unresolvedFailureCount": 11
},
"Kunlunxin_p-800|vllm_tokenizer_patch|text-generation": {
"attributableFailureCount": 14,
"consecutiveFailures": 14,
"attributableFailureCount": 13,
"consecutiveFailures": 13,
"consecutivePlatformFailures": 0,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 14,
"decisionTotal": 13,
"failureBreakdown": {
"ambiguous_runtime": 3,
"backend_operator": 6,
"framework_architecture_unsupported": 1,
"model_load": 7
"model_load": 6
},
"failureCount": 17,
"failureCount": 16,
"failureRate": 1.0,
"framework": "vllm_tokenizer_patch",
"lastPlatformFailureAt": null,
@@ -26097,7 +26102,7 @@
"successRate": 0.0,
"targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation",
"total": 17,
"total": 16,
"unresolvedFailureCount": 3
},
"Kunlunxin_p-800|vllm|text-generation": {
@@ -26415,15 +26420,15 @@
"unresolvedFailureCount": 2
},
"Ascend_910-b3|vllm_tokenizer_patch|text-generation|mini_k3|none": {
"attributableFailureCount": 2,
"consecutiveFailures": 2,
"attributableFailureCount": 3,
"consecutiveFailures": 3,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 2,
"decisionTotal": 3,
"failureBreakdown": {
"framework_architecture_unsupported": 2
"framework_architecture_unsupported": 3
},
"failureCount": 2,
"failureCount": 3,
"failureRate": 1.0,
"framework": "vllm_tokenizer_patch",
"lastTerminalAt": "2026-10-07T23:00:29.672674+00:00",
@@ -26436,7 +26441,7 @@
"successRate": 0.0,
"targetGpu": "Ascend_910-b3",
"taskType": "text-generation",
"total": 2,
"total": 3,
"unresolvedFailureCount": 0
},
"Ascend_910-b3|vllm_tokenizer_patch|text-generation|mistral|compressed-tensors": {
@@ -26614,31 +26619,6 @@
"total": 4,
"unresolvedFailureCount": 0
},
"Ascend_910-b4|vllm|text-generation|llama|compressed-tensors": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm",
"lastTerminalAt": "2026-09-23T05:33:38.855687+00:00",
"modelType": "llama",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Ascend_910-b4",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
},
"Ascend_910-b4|vllm|text-generation|qwen3|compressed-tensors": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
@@ -27046,9 +27026,9 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 4
"ambiguous_runtime": 2
},
"failureCount": 4,
"failureCount": 2,
"failureRate": 1.0,
"framework": "vllm-customized",
"lastTerminalAt": "2026-09-22T18:27:54.061728+00:00",
@@ -27061,60 +27041,10 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 4,
"unresolvedFailureCount": 4
},
"Cambricon_mlu-370-x8|vllm-customized|text-generation|minicpm|none": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm-customized",
"lastTerminalAt": "2026-09-22T08:13:39.456382+00:00",
"modelType": "minicpm",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "none",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
"total": 2,
"unresolvedFailureCount": 2
},
"Cambricon_mlu-370-x8|vllm-customized|text-generation|phi3|compressed-tensors": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 2
},
"failureCount": 2,
"failureRate": 1.0,
"framework": "vllm-customized",
"lastTerminalAt": "2026-09-23T02:39:29.759268+00:00",
"modelType": "phi3",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 2,
"unresolvedFailureCount": 2
},
"Cambricon_mlu-370-x8|vllm-customized|text-generation|qwen2|compressed-tensors": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
"decisionFailureRate": 0.0,
@@ -27126,8 +27056,8 @@
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm-customized",
"lastTerminalAt": "2026-09-22T13:11:01.559205+00:00",
"modelType": "qwen2",
"lastTerminalAt": "2026-09-23T02:39:29.759268+00:00",
"modelType": "phi3",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
@@ -27164,41 +27094,16 @@
"total": 1,
"unresolvedFailureCount": 1
},
"Cambricon_mlu-370-x8|vllm-customized|text-generation|starcoder2|compressed-tensors": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 2
},
"failureCount": 2,
"failureRate": 1.0,
"framework": "vllm-customized",
"lastTerminalAt": "2026-09-22T18:31:46.771079+00:00",
"modelType": "starcoder2",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 2,
"unresolvedFailureCount": 2
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mini_k3|none": {
"attributableFailureCount": 4,
"consecutiveFailures": 4,
"attributableFailureCount": 5,
"consecutiveFailures": 5,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 4,
"decisionTotal": 5,
"failureBreakdown": {
"framework_architecture_unsupported": 4
"framework_architecture_unsupported": 5
},
"failureCount": 4,
"failureCount": 5,
"failureRate": 1.0,
"framework": "vllm-mlu",
"lastTerminalAt": "2026-10-07T20:46:38.448824+00:00",
@@ -27211,7 +27116,7 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 4,
"total": 5,
"unresolvedFailureCount": 0
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mistral|compressed-tensors": {
@@ -28316,15 +28221,15 @@
"unresolvedFailureCount": 0
},
"Kunlunxin_p-800|vllm_tokenizer_patch|text-generation|lfm2|none": {
"attributableFailureCount": 3,
"consecutiveFailures": 3,
"attributableFailureCount": 2,
"consecutiveFailures": 2,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 3,
"decisionTotal": 2,
"failureBreakdown": {
"model_load": 3
"model_load": 2
},
"failureCount": 3,
"failureCount": 2,
"failureRate": 1.0,
"framework": "vllm_tokenizer_patch",
"lastTerminalAt": "2026-09-23T23:25:29.854556+00:00",
@@ -28337,7 +28242,7 @@
"successRate": 0.0,
"targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation",
"total": 3,
"total": 2,
"unresolvedFailureCount": 0
},
"Kunlunxin_p-800|vllm_tokenizer_patch|text-generation|llama|compressed-tensors": {
@@ -29932,14 +29837,14 @@
"unresolvedFailureCount": 1
},
"Ascend_910-b3|vllm_tokenizer_patch|text-generation|mini_k3|none|30": {
"attributableFailureCount": 2,
"attributableFailureCount": 3,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 2,
"decisionTotal": 3,
"failureBreakdown": {
"framework_architecture_unsupported": 2
"framework_architecture_unsupported": 3
},
"failureCount": 2,
"failureCount": 3,
"failureRate": 1.0,
"framework": "vllm_tokenizer_patch",
"loadSizeLog2Bucket": 30,
@@ -29952,7 +29857,7 @@
"successRate": 0.0,
"targetGpu": "Ascend_910-b3",
"taskType": "text-generation",
"total": 2,
"total": 3,
"unresolvedFailureCount": 0
},
"Ascend_910-b3|vllm_tokenizer_patch|text-generation|mistral3|none|34": {
@@ -40618,14 +40523,14 @@
"unresolvedFailureCount": 0
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mini_k3|none|30": {
"attributableFailureCount": 4,
"attributableFailureCount": 5,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 4,
"decisionTotal": 5,
"failureBreakdown": {
"framework_architecture_unsupported": 4
"framework_architecture_unsupported": 5
},
"failureCount": 4,
"failureCount": 5,
"failureRate": 1.0,
"framework": "vllm-mlu",
"loadSizeLog2Bucket": 30,
@@ -40638,7 +40543,7 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 4,
"total": 5,
"unresolvedFailureCount": 0
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|mistral|compressed-tensors|33": {
@@ -58586,39 +58491,39 @@
"unresolvedFailureCount": 0
}
},
"terminalRecords": 17469,
"totalRecords": 17851,
"terminalRecords": 17478,
"totalRecords": 17860,
"totals": {
"attributableFailureCount": 6270,
"decisionFailureRate": 0.8649,
"decisionSuccessRate": 0.1351,
"decisionTotal": 7249,
"attributableFailureCount": 6272,
"decisionFailureRate": 0.865,
"decisionSuccessRate": 0.135,
"decisionTotal": 7251,
"failureBreakdown": {
"ambiguous_runtime": 4582,
"architecture_compatibility": 212,
"attention_backend": 3,
"backend_operator": 130,
"context_length": 327,
"framework_architecture_unsupported": 2288,
"framework_architecture_unsupported": 2290,
"memory_capacity": 1206,
"model_load": 571,
"platform_infrastructure": 955,
"repository_structure": 742,
"runtime_memory": 101,
"tokenizer_compatibility": 690,
"参数/模板问题": 3288,
"参数/模板问题": 3295,
"日志缺失": 719,
"验证失败": 676
},
"failureCount": 16490,
"failureCount": 16499,
"failureRate": 0.944,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 955,
"successCount": 979,
"successRate": 0.056,
"total": 17469,
"unresolvedFailureCount": 9265
"total": 17478,
"unresolvedFailureCount": 9272
},
"warnings": [
"GPU MetaX_c-500 本地统计失败率偏高(≥50%),建议重点关注。",
@@ -58627,14 +58532,14 @@
"GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Kunlunxin_p-800 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_bi-100 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。",
"组合 Vastai_va16|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Ascend_910-b3|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Iluvatar_mrv-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -58680,6 +58585,6 @@
]
},
"storageMode": "decision_state_only",
"summarizedRecords": 17851,
"summarizedRecords": 17860,
"version": 1
}

View File

@@ -1,7 +1,14 @@
{"failReason": "参数/模板问题", "framework": "vllm-mlu", "lastSyncTime": "2026-10-08T02:21:33.753289+00:00", "modelId": "Youssofal/Qwen3.6-27B-MTPLX-Optimized", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-07T06:35:26.381282+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5349734", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm-mlu", "lastSyncTime": "2026-10-08T02:21:33.753315+00:00", "modelId": "ukisai/Swift-1.5-3bit-MLX-TextOnly", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-07T06:35:26.357823+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5349733", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm-mlu", "lastSyncTime": "2026-10-08T02:21:33.753379+00:00", "modelId": "mlx-community/Ornith-1.5-9B-OptiQ-4bit", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-07T06:35:26.352295+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5349732", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-07T14:31:58.345448+00:00", "modelId": "mlx-community/Ornith-1.5-9B-OptiQ-4bit", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-07T03:47:04.956076+00:00", "targetGpu": "MetaX_c-500", "taskId": "5347242", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-10-07T11:42:31.164536+00:00", "modelId": "groxaxo/Hemmingway-1-oQ5-MLX", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T23:17:07.153265+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5343702", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-07T14:31:58.345546+00:00", "modelId": "groxaxo/Hemmingway-1-oQ5-MLX", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T22:44:43.576920+00:00", "targetGpu": "MetaX_c-500", "taskId": "5343307", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm-mlu", "lastSyncTime": "2026-10-08T02:21:33.753325+00:00", "modelId": "rapid-mlx/Qwen3.8-27B-4bit-MTP-fp16-MLX", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T09:57:50.947704+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5321243", "taskType": "text-generation", "verifyResult": null}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5"], "framework": "vllm-mlu", "lastSyncTime": "2026-10-07T18:18:51.743140+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19329296879}, "outcome": "failed", "status": "success", "submitTime": "2026-10-06T09:57:50.069956+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5321221", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "vllm-mlu", "lastSyncTime": "2026-10-08T02:21:33.753371+00:00", "modelId": "LessThanThreeAI/Qwen3.8-27B-Humanlike-Chat-2.0-GPTQ-Int4", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T09:57:49.944154+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5321215", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm-mlu", "lastSyncTime": "2026-10-08T02:21:33.753305+00:00", "modelId": "togethercomputer/Tev1-4B-experimental", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T09:57:49.857043+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5321213", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm-mlu", "lastSyncTime": "2026-10-08T02:21:33.753390+00:00", "modelId": "ukisai/Swift-1.5-5bit-MLX", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T09:56:23.934000+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5321202", "taskType": "text-generation", "verifyResult": null}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["gpt_oss"], "framework": "vllm", "lastSyncTime": "2026-10-07T06:48:39.066266+00:00", "modelId": "mlx-community/gpt-oss-20b-OptiQ-4bit", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11623702006, "estimatedRequiredGiB": 13.022, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 11651702017, "modelscopeLicense": "apache-2.0", "modelscopeParams": 3982569024, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:openai", "custom_tag:gpt-oss", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:4bit", "custom_tag:mixed-precision", "custom_tag:optiq", "custom_tag:moe", "custom_tag:apple-silicon", "custom_tag:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11651702017}, "outcome": "failed", "status": "success", "submitTime": "2026-10-06T09:47:42.556514+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5321077", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-10-07T11:42:31.164561+00:00", "modelId": "ukisai/Swift-1.5-3bit-MLX-TextOnly", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T09:35:46.359396+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5320892", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-10-07T11:42:31.164611+00:00", "modelId": "Youssofal/Qwen3.6-27B-MTPLX-Optimized", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T09:35:46.356016+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5320886", "taskType": "text-generation", "verifyResult": null}
@@ -128,11 +135,13 @@
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm-mlu", "lastSyncTime": "2026-10-07T20:46:38.448824+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:52:49.757664+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006516", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm-mlu", "lastSyncTime": "2026-10-07T23:36:57.259705+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:52:49.751148+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006518", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm-mlu", "lastSyncTime": "2026-10-07T20:46:38.448855+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g2-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030713792, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039076183}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:52:49.749531+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006512", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm-mlu", "lastSyncTime": "2026-10-08T02:21:33.753354+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2018871528, "estimatedRequiredGiB": 2.26, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2022478516}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:52:49.747539+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006511", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm-mlu", "lastSyncTime": "2026-10-08T02:03:59.167905+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:52:49.710413+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006510", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-25T01:41:30.953868+00:00", "modelId": "mlx-community/LFM2.5-1.2B-Thinking-6bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 951093016, "estimatedRequiredGiB": 1.068, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 955857175, "modelscopeLicense": "other", "modelscopeParams": 256113408, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"ambiguous_runtime": 4, "model_load": 1}, "failureCount": 5, "failureRate": 1.0, "framework": "vllm-customized", "lastTerminalAt": "2026-09-21T19:49:37.657075+00:00", "modelType": "lfm2", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Cambricon_mlu-370-x8", "taskType": "text-generation", "total": 5, "unresolvedFailureCount": 4}, "repositoryOnDiskBytes": 955857175}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:49:53.770533+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006460", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T11:42:31.164621+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 5}, "failureCount": 5, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-21T16:50:30.559192+00:00", "modelType": "qwen3_5", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Biren_166m", "taskType": "text-generation", "total": 5, "unresolvedFailureCount": 5}, "repositoryOnDiskBytes": 19329296879}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:37:12.653471+00:00", "targetGpu": "Biren_166m", "taskId": "5006368", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-07T23:00:29.672674+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g2-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030713792, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039076183}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:37:12.459191+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006360", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-07T19:02:02.168317+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:37:12.447446+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006364", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T02:21:33.753335+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:37:12.388268+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006357", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T09:53:21.160613+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 3, "consecutiveFailures": 3, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 3, "failureBreakdown": {"memory_capacity": 3}, "failureCount": 3, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-20T12:21:49.901832+00:00", "modelType": "qwen3_5", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Iluvatar_bi-150", "taskType": "text-generation", "total": 3, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 19329296879}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:21:51.849661+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5006201", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T13:06:44.750866+00:00", "modelId": "prithivMLmods/Qwen-Image-2.1-PE-T2I-MLX", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 35196531592, "estimatedRequiredGiB": 39.403, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "other", "modelscopeParams": 1411666624, "modelscopeTags": ["license:other", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:text-generation-inference", "custom_tag:qwen3_5", "custom_tag:mlx-vlm", "custom_tag:prompt-rewriter", "custom_tag:prompt enhancer", "custom_tag:apple-silicon", "custom_tag:4-bit", "custom_tag:8-bit"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 5}, "failureCount": 5, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-21T16:50:30.559192+00:00", "modelType": "qwen3_5", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Biren_166m", "taskType": "text-generation", "total": 5, "unresolvedFailureCount": 5}, "repositoryOnDiskBytes": 35256868927}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:21:51.848154+00:00", "targetGpu": "Biren_166m", "taskId": "5006202", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T22:01:50.158710+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:21:51.640501+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006192", "taskType": "text-generation", "verifyResult": -1}
@@ -289,12 +298,3 @@
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-23T15:52:40.863686+00:00", "modelId": "RedHatAI/Phi-3-medium-128k-instruct-quantized.w4a16", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7686303632, "estimatedRequiredGiB": 8.592, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 7688299781, "modelscopeLicense": "llama2", "modelscopeParams": 13960238080, "modelscopeTags": ["license:llama2", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7688299781}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T11:57:55.174530+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5000425", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "driver_error", "failureCode": "DRIVER_ERROR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-02T20:23:01.655879+00:00", "modelId": "RedHatAI/Phi-3-mini-128k-instruct-FP8", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4018332584, "estimatedRequiredGiB": 4.494, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 4020783717, "modelscopeLicense": "mit", "modelscopeParams": 3821079552, "modelscopeTags": ["license:mit", "model_type:phi3", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4020783717}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T11:57:55.153765+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5000419", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "backend_operator", "failureAction": "prefer_other_proven_framework_or_gpu", "failureCategory": "backend_operator", "failureClassificationReason": "backend_version_dependent", "failureCode": "MISSING_OPERATOR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "gpu_framework", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-23T10:40:05.458934+00:00", "modelId": "aisingapore/Gemma-SEA-LION-v4-27B-IT-FP8-Dynamic", "modelProfile": {"architectures": ["Gemma3ForConditionalGeneration"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 29274355224, "estimatedRequiredGiB": 32.761, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma3", "modelscopeFileSize": 29314389092, "modelscopeLicense": "gemma", "modelscopeParams": 27432406640, "modelscopeTags": ["license:gemma", "model_type:gemma3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 29314389092}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T11:57:55.143712+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5000420", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T20:46:09.364327+00:00", "modelId": "mlx-community/LFM2.5-1.2B-Instruct-4bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 658540250, "estimatedRequiredGiB": 0.741, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 663396475, "modelscopeLicense": "other", "modelscopeParams": 182975232, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 663396475}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T11:54:31.274098+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5000347", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "driver_error", "failureCode": "DRIVER_ERROR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-23T05:33:38.855687+00:00", "modelId": "neuralmagic/Llama-3.2-3B-Instruct-FP8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4395007696, "estimatedRequiredGiB": 4.922, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 4404161088, "modelscopeLicense": "llama3.2", "modelscopeParams": 3606752256, "modelscopeTags": ["license:llama3.2", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:llama", "custom_tag:llama-3", "custom_tag:neuralmagic", "custom_tag:llmcompressor"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4404161088}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T11:50:46.187626+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5000279", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-22T18:31:46.771079+00:00", "modelId": "RedHatAI/starcoder2-7b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7857298896, "estimatedRequiredGiB": 8.785, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 7860673720, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 7400416256, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7860673720}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T11:48:23.283753+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5000251", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-22T23:47:28.194157+00:00", "modelId": "RedHatAI/starcoder2-3b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4093180600, "estimatedRequiredGiB": 4.578, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 4096479058, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 3181366272, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4096479058}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T11:46:34.674727+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5000249", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-22T13:11:01.559205+00:00", "modelId": "RedHatAI/Qwen2-0.5B-Instruct-quantized.w8a8", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 903168128, "estimatedRequiredGiB": 1.022, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 914658256, "modelscopeLicense": "apache-2.0", "modelscopeParams": 630167424, "modelscopeTags": ["license:apache-2.0", "model_type:qwen2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 914658256}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T11:46:27.357049+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5000226", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-22T13:13:03.464336+00:00", "modelId": "RedHatAI/Phi-3-medium-128k-instruct-quantized.w4a16", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7686303632, "estimatedRequiredGiB": 8.592, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 7688299781, "modelscopeLicense": "llama2", "modelscopeParams": 13960238080, "modelscopeTags": ["license:llama2", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7688299781}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T11:46:27.192316+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5000225", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-22T08:13:39.456359+00:00", "modelId": "RedHatAI/Llama-3.2-1B-Instruct-quantized.w8a8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2024670536, "estimatedRequiredGiB": 2.273, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 2033824831, "modelscopeLicense": "llama3.2", "modelscopeParams": 1498482688, "modelscopeTags": ["license:llama3.2", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:llama", "custom_tag:llama-3", "custom_tag:neuralmagic", "custom_tag:llmcompressor"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 2}, "failureCount": 2, "failureRate": 1.0, "framework": "vllm-customized", "lastTerminalAt": "2026-09-21T11:15:42.052853+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Cambricon_mlu-370-x8", "taskType": "text-generation", "total": 2, "unresolvedFailureCount": 2}, "repositoryOnDiskBytes": 2033824831}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T11:46:27.062138+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5000224", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-24T11:22:18.162695+00:00", "modelId": "neuralmagic/Llama-3.2-1B-Instruct-quantized.w8a8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2024670536, "estimatedRequiredGiB": 2.273, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 2033824885, "modelscopeLicense": "llama3.2", "modelscopeParams": 1498482688, "modelscopeTags": ["license:llama3.2", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:llama", "custom_tag:llama-3", "custom_tag:neuralmagic", "custom_tag:llmcompressor"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 2}, "failureCount": 2, "failureRate": 1.0, "framework": "vllm-customized", "lastTerminalAt": "2026-09-21T11:15:42.052853+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Cambricon_mlu-370-x8", "taskType": "text-generation", "total": 2, "unresolvedFailureCount": 2}, "repositoryOnDiskBytes": 2033824885}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T11:44:40.201702+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5000223", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-22T08:13:39.456382+00:00", "modelId": "OpenBMB/BitCPM-CANN-8B", "modelProfile": {"architectures": ["MiniCPMForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 16370604914, "estimatedRequiredGiB": 18.305, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "minicpm", "modelscopeFileSize": 16378634956, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:minicpm", "library:pytorch", "library:transformer", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 16378634956}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T11:44:25.650478+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5000197", "taskType": "text-generation", "verifyResult": -1}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -2,24 +2,24 @@
"agentVersion": "2026.09.04.4",
"checksums": {
".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1",
".modelhub_state/architecture_compatibility_blacklist.json": "5262c902b7118b30be9dce34bf3c9b2f3c17154999f8b9e1403c33739ecd0ad0",
".modelhub_state/architecture_compatibility_blacklist.json": "1e04f1052250e6a08604a640dbdf20d198431720eb06311593ba3646408ae145",
".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab",
".modelhub_state/market_intelligence.json": "da72d0e3d87f60751c78bac24786bf9a7ee2ff9a24086ce9d74a4c68e486a55f",
".modelhub_state/official_capabilities.json": "1cdd246be6fd92f462a1e9a6772b0a269e592d57e8851eff4f805a84111bc103",
".modelhub_state/outcome_checkpoint.json": "09b6e6ea03d502873f3d3f89ada2607126c542375cb27b0a1ec28f0be0b8675b",
".modelhub_state/market_intelligence.json": "0d1fd05292b87ace8bb2fda28f2f3793878153fff27ba56b8608642088059d62",
".modelhub_state/official_capabilities.json": "e83981210238b1f9be01fe49fe85a3bca4fd6729745c170c325a03ca4c48bf22",
".modelhub_state/outcome_checkpoint.json": "ef5fdd33d30d547a897ac8d7e115d0da7f8d8e0ad2ee8f9aeece3606425abdd5",
".modelhub_state/queue_cleanup_latest.json": "568ae8813ea4bc8c494aef8be02f77b1c9756ab49dd7d307b81483e6cca30468",
".modelhub_state/recent_outcomes.jsonl": "b068736c627060c6b0013a19d7d5df1ff397edc4169d2399892b6519e3008497",
".modelhub_state/recovery_active_tasks.jsonl": "dbf0cb19a78524ffdf86298d967c9ee59cd833f0bf17ef07e93557a116ba756e",
".modelhub_state/recovery_intents.jsonl": "b31eca914086726f31cd60973e8133ea3a336d151b35a8d8e6b07409886237e3",
".modelhub_state/recent_outcomes.jsonl": "d65fd97495519e70116dc481a956a965e8e98212502ab239d857b2baa30ac7b4",
".modelhub_state/recovery_active_tasks.jsonl": "371cf0e279e00958201f0f1fd20e0f3931cdb3a0bc271da79e0bbeeed42cb254",
".modelhub_state/recovery_intents.jsonl": "7721e42bd36e20e3976e30a779fb42f725dd9f552dfc80714db1fcdea67607ab",
".modelhub_state/routing_intelligence.json": "a312187abffa011156b64da1fed551d1816329b725ab3f38c5221900b7cc793e",
".modelhub_state/submission_exclusions.jsonl": "dca7091e8b1da8bf9b3ecb95fe573b2a41666601edf86cea13ce9ce738b9eb7b",
".modelhub_state/worker_crashes.jsonl": "b321ea3648ae6b322601ed30ef8c3b1da0f13612af1bde3a64b0d41dc18a7b9f",
"ledger/submissions.jsonl": "e454fe4d597b7036bd9ad1d21a044f660b72bf85d1370813a7264341281b7126",
"outcomes/submissions.jsonl": "397f42d1a9f50088a12379ffeb2534f57a4f90077c0378d4a6785b4d34d3424f"
"outcomes/submissions.jsonl": "aa178b315c9976767a31cf9f308cc349f0b02988053df4993f434281166d6fd6"
},
"generation": 22029,
"generation": 22030,
"phase": "cycle",
"schemaVersion": 1,
"updatedAt": "2026-10-08T02:20:31.983683+00:00",
"updatedAt": "2026-10-08T02:28:20.009463+00:00",
"writerId": "33ed03361c5848e88b8ce6204fb4f7d2"
}

View File

@@ -219,10 +219,8 @@
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T03:05:58.563180+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g8-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030882272, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": 1015108684, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039244968}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:05:50.750203+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006047", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T03:22:42.057389+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2037838088, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2041445091}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:21:51.641656+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006191", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T03:22:42.057480+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2018871528, "estimatedRequiredGiB": 2.26, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2022478516}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:21:51.638009+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006194", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T03:37:52.600714+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:37:12.388268+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006357", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T03:37:52.600703+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:37:12.384898+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006356", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T03:37:52.600649+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2037838088, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2041445091}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:37:12.449585+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006359", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-22T03:53:42.966096+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2018871528, "estimatedRequiredGiB": 2.26, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2022478516}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:52:49.747539+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006511", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T03:53:42.966069+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19329296879}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:52:49.754157+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5006513", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T03:53:42.966089+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block2-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042625829}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:52:49.745051+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5006517", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T03:53:42.966032+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030685704, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039047610}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:52:49.746330+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5006515", "taskType": "text-generation", "verifyResult": null}
@@ -941,10 +939,10 @@
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T02:03:59.167927+00:00", "modelId": "cyankiwi/Spark-X2.5-4B-AWQ-INT4", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2856860040, "estimatedRequiredGiB": 3.21, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 2872281308, "modelscopeLicense": "apache-2.0", "modelscopeParams": 4112079360, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:llm", "custom_tag:sparkx2_5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2872281308}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:55:56.580334+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358864", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T02:03:59.168027+00:00", "modelId": "cyankiwi/K2-Horizon-3.7B-AWQ-FP8", "modelProfile": {"architectures": ["K2HorizonForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 6343991648, "estimatedRequiredGiB": 7.115, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "k2_horizon", "modelscopeFileSize": 6366013051, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1716764160, "modelscopeTags": ["license:apache-2.0", "model_type:k2_horizon", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:k2-horizon", "custom_tag:3.7b", "custom_tag:dense", "custom_tag:open-weights", "custom_tag:ifm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 6366013051}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:57:57.450138+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358870", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T02:03:59.168079+00:00", "modelId": "peculiar-ragdoll/Sharp-MiniCPM5-2B-MLX-oQ6e", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2092366914, "estimatedRequiredGiB": 2.351, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 2103475788, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:omlx", "custom_tag:apple-silicon", "custom_tag:oq", "custom_tag:llama", "custom_tag:minicpm", "custom_tag:imatrix", "custom_tag:long-context", "custom_tag:coding", "custom_tag:sharp-template", "custom_tag:6-bit"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2103475788}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:57:57.356235+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358868", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "ProCreations/BetterWright-K2-Horizon-7B-Uno", "modelProfile": {"architectures": ["K2HorizonForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19395158128, "estimatedRequiredGiB": 21.699, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "k2_horizon", "modelscopeFileSize": 19416072650, "modelscopeLicense": "apache-2.0", "modelscopeParams": 4022513664, "modelscopeTags": ["license:apache-2.0", "model_type:k2_horizon", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:betterwright", "custom_tag:browser-agent", "custom_tag:web-agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:diffusion-language-model", "custom_tag:uno", "custom_tag:k2-horizon", "custom_tag:full-finetune"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19416072650}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:57:57.561355+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358949", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "nkkbr/Mini-K3-1H-llama-mha-standard-v1", "modelProfile": {"architectures": [], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1960168568, "estimatedRequiredGiB": 2.344, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": 2097293495, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:llama-style-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2097293495}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:57:57.565552+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358968", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T02:21:33.753253+00:00", "modelId": "ProCreations/BetterWright-K2-Horizon-7B-Uno", "modelProfile": {"architectures": ["K2HorizonForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19395158128, "estimatedRequiredGiB": 21.699, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "k2_horizon", "modelscopeFileSize": 19416072650, "modelscopeLicense": "apache-2.0", "modelscopeParams": 4022513664, "modelscopeTags": ["license:apache-2.0", "model_type:k2_horizon", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:betterwright", "custom_tag:browser-agent", "custom_tag:web-agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:diffusion-language-model", "custom_tag:uno", "custom_tag:k2-horizon", "custom_tag:full-finetune"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19416072650}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:57:57.561355+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358949", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T02:21:33.753347+00:00", "modelId": "nkkbr/Mini-K3-1H-llama-mha-standard-v1", "modelProfile": {"architectures": [], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1960168568, "estimatedRequiredGiB": 2.344, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": 2097293495, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:llama-style-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2097293495}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:57:57.565552+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358968", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T02:03:59.167918+00:00", "modelId": "Akahsizrr/Cyber-Prime-1.1-2.6B", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5394427432, "estimatedRequiredGiB": 6.049, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 5412809492, "modelscopeLicense": "other", "modelscopeParams": 209741824, "modelscopeTags": ["license:other", "model_type:lfm2", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:cybersecurity", "custom_tag:cyberbench", "custom_tag:threat-intelligence", "custom_tag:named-entity-recognition", "custom_tag:phishing-detection", "custom_tag:http-anomaly-detection", "custom_tag:lfm2", "custom_tag:2.6b"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5412809492}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:57:57.453481+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358869", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "mlx-community/LFM2.5-1.2B-Thinking-5bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 804816628, "estimatedRequiredGiB": 0.905, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 809580753, "modelscopeLicense": "other", "modelscopeParams": 219544320, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 809580753}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T18:14:21.857761+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5359099", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T02:21:33.753364+00:00", "modelId": "mlx-community/LFM2.5-1.2B-Thinking-5bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 804816628, "estimatedRequiredGiB": 0.905, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 809580753, "modelscopeLicense": "other", "modelscopeParams": 219544320, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 809580753}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T18:14:21.857761+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5359099", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "bench-labs/tinctura-v1", "modelProfile": {"architectures": ["CagliostroForCausalLM"], "configFingerprint": "58bd440e460cf3e4d9271b3c32c451e80254e59faf47ce55dcda11588cf4117e", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 384820248, "estimatedRequiredGiB": 1.739, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "cagliostro", "modelscopeFileSize": 1556071699, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:cagliostro", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:causal-lm", "custom_tag:language-model", "custom_tag:base-model", "custom_tag:pretrained-from-scratch", "custom_tag:small-language-model"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 1556071699}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T18:27:23.565694+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5359388", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "cyankiwi/K2-Horizon-7B-AWQ-INT4", "modelProfile": {"architectures": ["K2HorizonForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8122473440, "estimatedRequiredGiB": 9.103, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "k2_horizon", "modelscopeFileSize": 8145035684, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1605333250, "modelscopeTags": ["license:apache-2.0", "model_type:k2_horizon", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:k2-horizon", "custom_tag:7b", "custom_tag:dense", "custom_tag:open-weights", "custom_tag:ifm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 8145035684}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T18:27:23.567977+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5359384", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "GnLOLot/MiniCPM5-2B-Claude-Fable5-1-Thinking-Agentic", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557128, "estimatedRequiredGiB": 5.638, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:thinking", "custom_tag:fable5", "custom_tag:tool-calling", "custom_tag:function-calling", "custom_tag:agentic", "custom_tag:coding", "custom_tag:instruction-following", "custom_tag:conversational"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5045067151}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T18:27:23.580122+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5359386", "taskType": "text-generation", "verifyResult": null}