state: generation 6332 (cycle)

This commit is contained in:
2026-09-12 19:03:59 +00:00
parent 94854846a5
commit cd6fe88754
11 changed files with 2297 additions and 2210 deletions

View File

@@ -1,5 +1,26 @@
{ {
"blocks": { "blocks": {
"ascend_910-b3|vllm|text-generation|architectures:spark2_5forcausallm": {
"architectureSignature": "architectures:spark2_5forcausallm",
"architectures": [
"spark2_5forcausallm"
],
"evidenceCount": 1,
"expiresAt": "2026-10-12T18:53:21+00:00",
"framework": "vllm",
"latestFailureAt": "2026-09-12T18:53:21+00:00",
"latestSuccessfulAt": null,
"matchType": "architectures",
"modelType": null,
"sourceModelIds": [
"XHToken/Spark-X2.5-4B"
],
"sourceTaskIds": [
"4549470"
],
"targetGpu": "Ascend_910-b3",
"taskType": "text-generation"
},
"ascend_910-b3|vllm|text-generation|model_type:glm_ocr": { "ascend_910-b3|vllm|text-generation|model_type:glm_ocr": {
"architectureSignature": "model_type:glm_ocr", "architectureSignature": "model_type:glm_ocr",
"architectures": [], "architectures": [],
@@ -1406,11 +1427,11 @@
"taskType": "text-generation" "taskType": "text-generation"
} }
}, },
"generatedAt": "2026-09-12T18:58:52.603012+00:00", "generatedAt": "2026-09-12T19:03:58.780515+00:00",
"summary": { "summary": {
"activeBlockCount": 71, "activeBlockCount": 72,
"byGpuFramework": { "byGpuFramework": {
"Ascend_910-b3|vllm": 8, "Ascend_910-b3|vllm": 9,
"Ascend_910-b4|vllm": 10, "Ascend_910-b4|vllm": 10,
"Cambricon_mlu-370-x8|vllm": 2, "Cambricon_mlu-370-x8|vllm": 2,
"Cambricon_mlu-370-x8|vllm-mlu": 5, "Cambricon_mlu-370-x8|vllm-mlu": 5,

View File

@@ -83,7 +83,7 @@
"8": { "8": {
"complete": false, "complete": false,
"lastError": "ModelHubAPIError: 系统错误", "lastError": "ModelHubAPIError: 系统错误",
"listingErrors": 456, "listingErrors": 457,
"nextPage": 1, "nextPage": 1,
"recordsScanned": 0, "recordsScanned": 0,
"uniqueRecords": 0 "uniqueRecords": 0
@@ -102,12 +102,12 @@
"cutoffAt": "2026-09-04T03:55:51.365685+00:00", "cutoffAt": "2026-09-04T03:55:51.365685+00:00",
"failureLogsInspected": 0, "failureLogsInspected": 0,
"mode": "incremental_decision_only", "mode": "incremental_decision_only",
"nextAccountIndex": 8, "nextAccountIndex": 9,
"recordsScanned": 0, "recordsScanned": 0,
"seenTaskIds": [], "seenTaskIds": [],
"startedAt": "2026-09-04T03:55:51.365685+00:00", "startedAt": "2026-09-04T03:55:51.365685+00:00",
"terminalRecords": 0, "terminalRecords": 0,
"uniqueRecords": 0, "uniqueRecords": 0,
"updatedAt": "2026-09-12T18:58:52.577560+00:00", "updatedAt": "2026-09-12T19:03:58.757431+00:00",
"version": 1 "version": 1
} }

View File

@@ -416,121 +416,121 @@
} }
}, },
"frameworkUpdatedAt": null, "frameworkUpdatedAt": null,
"generatedAt": "2026-09-12T18:56:58.171939+00:00", "generatedAt": "2026-09-12T19:00:09.474827+00:00",
"gpuStats": { "gpuStats": {
"Ascend_910-b3": { "Ascend_910-b3": {
"available": true, "available": true,
"backlogHours": 979.0069930069931, "backlogHours": 985.9436619718309,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Ascend_910-b3", "gpu": "Ascend_910-b3",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 8, "maxConcurrentTasks": 8,
"qualityFactor": 1.589316590938255, "qualityFactor": 1.3384521015978177,
"queueFactor": 0.9994759482328872, "queueFactor": 1.0017193315981783,
"queueWeight": 0.9994759482328872, "queueWeight": 1.0017193315981783,
"recentSuccess": 53, "recentSuccess": 50,
"recentSuccessRate": 0.3706293706293706, "recentSuccessRate": 0.352112676056338,
"recentTerminal": 143, "recentTerminal": 142,
"recentWilsonLowerBound": 0.29582198022284456, "recentWilsonLowerBound": 0.2783917433242715,
"running": 8, "running": 8,
"selectionWeight": 1.5884837067702722, "selectionWeight": 1.340753344588743,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 23.833333333333332, "throughputPerHour": 23.666666666666668,
"waiting": 23333 "waiting": 23334
}, },
"Ascend_910-b4": { "Ascend_910-b4": {
"available": true, "available": true,
"backlogHours": 1244.9545454545455, "backlogHours": 1217.111111111111,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Ascend_910-b4", "gpu": "Ascend_910-b4",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 8, "maxConcurrentTasks": 8,
"qualityFactor": 2.1043827297592523, "qualityFactor": 1.833814650107088,
"queueFactor": 0.9640891435482026, "queueFactor": 0.9705643517794991,
"queueWeight": 0.9640891435482026, "queueWeight": 0.9705643517794991,
"recentSuccess": 55, "recentSuccess": 54,
"recentSuccessRate": 0.4166666666666667, "recentSuccessRate": 0.4,
"recentTerminal": 132, "recentTerminal": 135,
"recentWilsonLowerBound": 0.33608260611446034, "recentWilsonLowerBound": 0.3212303901255117,
"running": 8, "running": 8,
"selectionWeight": 2.0288125436312265, "selectionWeight": 1.7798351271649349,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 22.0, "throughputPerHour": 22.5,
"waiting": 27389 "waiting": 27385
}, },
"Biren_166m": { "Biren_166m": {
"available": true, "available": true,
"backlogHours": 176.24516129032259, "backlogHours": 180.87417218543047,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Biren_166m", "gpu": "Biren_166m",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 8, "maxConcurrentTasks": 8,
"qualityFactor": 0.3878258503169784, "qualityFactor": 0.3960762895781608,
"queueFactor": 1.2926252533900822, "queueFactor": 1.2918657564147493,
"queueWeight": 1.2926252533900822, "queueWeight": 1.2918657564147493,
"recentSuccess": 33, "recentSuccess": 33,
"recentSuccessRate": 0.2129032258064516, "recentSuccessRate": 0.2185430463576159,
"recentTerminal": 155, "recentTerminal": 151,
"recentWilsonLowerBound": 0.15580732288767635, "recentWilsonLowerBound": 0.16005963055460068,
"running": 8, "running": 8,
"selectionWeight": 0.5013134880372083, "selectionWeight": 0.5116773954338381,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 25.833333333333332, "throughputPerHour": 25.166666666666668,
"waiting": 4553 "waiting": 4552
}, },
"Cambricon_mlu-370-x4": { "Cambricon_mlu-370-x4": {
"available": true, "available": true,
"backlogHours": 1548.2142857142856, "backlogHours": 1520.421052631579,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Cambricon_mlu-370-x4", "gpu": "Cambricon_mlu-370-x4",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 7, "maxConcurrentTasks": 7,
"qualityFactor": 0.467218718031627, "qualityFactor": 0.43173782245051917,
"queueFactor": 0.9330728571075463, "queueFactor": 0.9387053408068077,
"queueWeight": 0.9330728571075463, "queueWeight": 0.9387053408068077,
"recentSuccess": 15, "recentSuccess": 15,
"recentSuccessRate": 0.26785714285714285, "recentSuccessRate": 0.2631578947368421,
"recentTerminal": 56, "recentTerminal": 57,
"recentWilsonLowerBound": 0.16957158661894964, "recentWilsonLowerBound": 0.16645642421847712,
"running": 7, "running": 7,
"selectionWeight": 0.4359491041278953, "selectionWeight": 0.4052745997626036,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 9.333333333333334, "throughputPerHour": 9.5,
"waiting": 14450 "waiting": 14444
}, },
"Cambricon_mlu-370-x8": { "Cambricon_mlu-370-x8": {
"available": true, "available": true,
"backlogHours": 452.15384615384613, "backlogHours": 456.05172413793105,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Cambricon_mlu-370-x8", "gpu": "Cambricon_mlu-370-x8",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 7, "maxConcurrentTasks": 7,
"qualityFactor": 0.5229152376678179, "qualityFactor": 0.5132750794765675,
"queueFactor": 1.1222698152825517, "queueFactor": 1.124531835149806,
"queueWeight": 1.1222698152825517, "queueWeight": 1.124531835149806,
"recentSuccess": 29, "recentSuccess": 29,
"recentSuccessRate": 0.24786324786324787, "recentSuccessRate": 0.25,
"recentTerminal": 117, "recentTerminal": 116,
"recentWilsonLowerBound": 0.1784782855379003, "recentWilsonLowerBound": 0.18007382859915586,
"running": 7, "running": 7,
"selectionWeight": 0.5868519871858936, "selectionWeight": 0.5771941670604469,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 19.5, "throughputPerHour": 19.333333333333332,
"waiting": 8817 "waiting": 8817
}, },
"Iluvatar_bi-100": { "Iluvatar_bi-100": {
"available": true, "available": true,
"backlogHours": 45.93037974683544, "backlogHours": 44.64,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Iluvatar_bi-100", "gpu": "Iluvatar_bi-100",
@@ -539,38 +539,38 @@
"qualityFactor": 0.05, "qualityFactor": 0.05,
"queueFactor": 1.3, "queueFactor": 1.3,
"queueWeight": 1.3, "queueWeight": 1.3,
"recentSuccess": 16, "recentSuccess": 15,
"recentSuccessRate": 0.05063291139240506, "recentSuccessRate": 0.046153846153846156,
"recentTerminal": 316, "recentTerminal": 325,
"recentWilsonLowerBound": 0.03140326041443045, "recentWilsonLowerBound": 0.028166194172197002,
"running": 24, "running": 24,
"selectionWeight": 0.065, "selectionWeight": 0.065,
"stale": false, "stale": false,
"submissionEligible": false, "submissionEligible": false,
"throughputPerHour": 52.666666666666664, "throughputPerHour": 54.166666666666664,
"waiting": 2419 "waiting": 2418
}, },
"Iluvatar_bi-150": { "Iluvatar_bi-150": {
"available": true, "available": true,
"backlogHours": 99.925, "backlogHours": 104.24347826086957,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Iluvatar_bi-150", "gpu": "Iluvatar_bi-150",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 50, "maxConcurrentTasks": 50,
"qualityFactor": 0.08577782236415071, "qualityFactor": 0.09080190076644462,
"queueFactor": 1.3, "queueFactor": 1.3,
"queueWeight": 1.3, "queueWeight": 1.3,
"recentSuccess": 27, "recentSuccess": 27,
"recentSuccessRate": 0.1125, "recentSuccessRate": 0.11739130434782609,
"recentTerminal": 240, "recentTerminal": 230,
"recentWilsonLowerBound": 0.0784768606712071, "recentWilsonLowerBound": 0.08194385641129474,
"running": 9, "running": 10,
"selectionWeight": 0.11151116907339594, "selectionWeight": 0.118042470996378,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 40.0, "throughputPerHour": 38.333333333333336,
"waiting": 3997 "waiting": 3996
}, },
"Iluvatar_mrv-100": { "Iluvatar_mrv-100": {
"available": true, "available": true,
@@ -580,15 +580,15 @@
"gpu": "Iluvatar_mrv-100", "gpu": "Iluvatar_mrv-100",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 2, "maxConcurrentTasks": 2,
"qualityFactor": 1.009123249669564, "qualityFactor": 0.9713139487253274,
"queueFactor": 0.8673801645167987, "queueFactor": 0.8702482120697435,
"queueWeight": 0.8673801645167987, "queueWeight": 0.8702482120697435,
"recentSuccess": 14, "recentSuccess": 14,
"recentSuccessRate": 0.3783783783783784, "recentSuccessRate": 0.3783783783783784,
"recentTerminal": 37, "recentTerminal": 37,
"recentWilsonLowerBound": 0.2406378746389103, "recentWilsonLowerBound": 0.2406378746389103,
"running": 2, "running": 2,
"selectionWeight": 0.8752934903161128, "selectionWeight": 0.8452842272366187,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 6.166666666666667, "throughputPerHour": 6.166666666666667,
@@ -596,140 +596,140 @@
}, },
"Kunlunxin_p-800": { "Kunlunxin_p-800": {
"available": true, "available": true,
"backlogHours": 972.1764705882352, "backlogHours": 1083.737704918033,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Kunlunxin_p-800", "gpu": "Kunlunxin_p-800",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 7, "maxConcurrentTasks": 7,
"qualityFactor": 0.424552625925815, "qualityFactor": 0.5246945727440794,
"queueFactor": 1.0005261657610238, "queueFactor": 0.9876094627734362,
"queueWeight": 1.0005261657610238, "queueWeight": 0.9876094627734362,
"recentSuccess": 17, "recentSuccess": 17,
"recentSuccessRate": 0.25, "recentSuccessRate": 0.2786885245901639,
"recentTerminal": 68, "recentTerminal": 61,
"recentWilsonLowerBound": 0.16234881695499528, "recentWilsonLowerBound": 0.18188396512091543,
"running": 7, "running": 7,
"selectionWeight": 0.42477601098132994, "selectionWeight": 0.5181933251079178,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 11.333333333333334, "throughputPerHour": 10.166666666666666,
"waiting": 11018 "waiting": 11018
}, },
"MetaX_c-500": { "MetaX_c-500": {
"available": true, "available": true,
"backlogHours": 863.1645569620254, "backlogHours": 863.0886075949368,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "MetaX_c-500", "gpu": "MetaX_c-500",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 4, "maxConcurrentTasks": 4,
"qualityFactor": 0.47150754870635736, "qualityFactor": 0.45384135103193507,
"queueFactor": 1.0185355147518735, "queueFactor": 1.0219168552501956,
"queueWeight": 1.0185355147518735, "queueWeight": 1.0219168552501956,
"recentSuccess": 20, "recentSuccess": 20,
"recentSuccessRate": 0.25316455696202533, "recentSuccessRate": 0.25316455696202533,
"recentTerminal": 79, "recentTerminal": 79,
"recentWilsonLowerBound": 0.1702773604894678, "recentWilsonLowerBound": 0.1702773604894678,
"running": 4, "running": 4,
"selectionWeight": 0.48024718383102377, "selectionWeight": 0.4637881262290552,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 13.166666666666666, "throughputPerHour": 13.166666666666666,
"waiting": 11365 "waiting": 11364
}, },
"Mthreads_s4000": { "Mthreads_s4000": {
"available": true, "available": true,
"backlogHours": 2181.050847457627, "backlogHours": 2144.7,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Mthreads_s4000", "gpu": "Mthreads_s4000",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 4, "maxConcurrentTasks": 4,
"qualityFactor": 2.339473495395263, "qualityFactor": 2.381515750914992,
"queueFactor": 0.886319589193588, "queueFactor": 0.8914949496257885,
"queueWeight": 0.886319589193588, "queueWeight": 0.8914949496257885,
"recentSuccess": 28, "recentSuccess": 29,
"recentSuccessRate": 0.4745762711864407, "recentSuccessRate": 0.48333333333333334,
"recentTerminal": 59, "recentTerminal": 60,
"recentWilsonLowerBound": 0.35265669027401325, "recentWilsonLowerBound": 0.3617484128577001,
"running": 4, "running": 4,
"selectionWeight": 2.073521187368017, "selectionWeight": 2.1231092643949823,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 9.833333333333334, "throughputPerHour": 10.0,
"waiting": 21447 "waiting": 21447
}, },
"Sunrise_pt-200-x1": { "Sunrise_pt-200-x1": {
"available": true, "available": true,
"backlogHours": 3207.1111111111113, "backlogHours": 3206.8888888888887,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Sunrise_pt-200-x1", "gpu": "Sunrise_pt-200-x1",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 2, "maxConcurrentTasks": 2,
"qualityFactor": 0.5755472703687623, "qualityFactor": 0.5539829669398878,
"queueFactor": 0.8365138110831766, "queueFactor": 0.8392885205406453,
"queueWeight": 0.8365138110831766, "queueWeight": 0.8392885205406453,
"recentSuccess": 9, "recentSuccess": 9,
"recentSuccessRate": 0.3333333333333333, "recentSuccessRate": 0.3333333333333333,
"recentTerminal": 27, "recentTerminal": 27,
"recentWilsonLowerBound": 0.1864305444359335, "recentWilsonLowerBound": 0.1864305444359335,
"running": 2, "running": 2,
"selectionWeight": 0.4814532405946928, "selectionWeight": 0.4649515447276956,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 4.5, "throughputPerHour": 4.5,
"waiting": 14432 "waiting": 14431
}, },
"Vastai_va16": { "Vastai_va16": {
"available": true, "available": true,
"backlogHours": 1058.2622950819673, "backlogHours": 1008.65625,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Vastai_va16", "gpu": "Vastai_va16",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 16, "maxConcurrentTasks": 16,
"qualityFactor": 0.545118798125299, "qualityFactor": 0.46973457725961537,
"queueFactor": 0.9878732331938088, "queueFactor": 0.9983030371942057,
"queueWeight": 0.9878732331938088, "queueWeight": 0.9983030371942057,
"recentSuccess": 17, "recentSuccess": 17,
"recentSuccessRate": 0.2786885245901639, "recentSuccessRate": 0.265625,
"recentTerminal": 61, "recentTerminal": 64,
"recentWilsonLowerBound": 0.18188396512091543, "recentWilsonLowerBound": 0.1729623856953776,
"running": 16, "running": 16,
"selectionWeight": 0.5385082695787623, "selectionWeight": 0.4689374551534103,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 10.166666666666666, "throughputPerHour": 10.666666666666666,
"waiting": 10759 "waiting": 10759
}, },
"hygon_k100-ai": { "hygon_k100-ai": {
"available": true, "available": true,
"backlogHours": 652.2558139534883, "backlogHours": 644.7586206896551,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "hygon_k100-ai", "gpu": "hygon_k100-ai",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 6, "maxConcurrentTasks": 6,
"qualityFactor": 2.5, "qualityFactor": 2.5,
"queueFactor": 1.0622519152750023, "queueFactor": 1.067614088839958,
"queueWeight": 1.0622519152750023, "queueWeight": 1.067614088839958,
"recentSuccess": 40, "recentSuccess": 41,
"recentSuccessRate": 0.46511627906976744, "recentSuccessRate": 0.47126436781609193,
"recentTerminal": 86, "recentTerminal": 87,
"recentWilsonLowerBound": 0.3634569531171396, "recentWilsonLowerBound": 0.3698208820020664,
"running": 6, "running": 6,
"selectionWeight": 2.6556297881875057, "selectionWeight": 2.669035222099895,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 14.333333333333334, "throughputPerHour": 14.5,
"waiting": 9349 "waiting": 9349
} }
}, },
"queueAttemptedAt": "2026-09-12T18:49:40.383113+00:00", "queueAttemptedAt": "2026-09-12T19:00:09.474827+00:00",
"queueError": null, "queueError": null,
"queueUpdatedAt": "2026-09-12T18:49:40.383113+00:00", "queueUpdatedAt": "2026-09-12T19:00:09.474827+00:00",
"supportedGpus": [ "supportedGpus": [
"Vastai_va16", "Vastai_va16",
"Iluvatar_mrv-100", "Iluvatar_mrv-100",

File diff suppressed because it is too large Load Diff

View File

@@ -1,9 +1,30 @@
{ {
"generatedAt": "2026-09-12T18:04:41.740562+00:00", "generatedAt": "2026-09-12T18:59:53.566932+00:00",
"lastSyncTime": "2026-09-12T18:04:41.532609+00:00", "lastSyncTime": "2026-09-12T18:59:53.316571+00:00",
"recentLimit": 300, "recentLimit": 300,
"report": { "report": {
"architectureCompatibilityBlocks": { "architectureCompatibilityBlocks": {
"ascend_910-b3|vllm|text-generation|architectures:spark2_5forcausallm": {
"architectureSignature": "architectures:spark2_5forcausallm",
"architectures": [
"spark2_5forcausallm"
],
"evidenceCount": 1,
"expiresAt": "2026-10-12T18:53:21+00:00",
"framework": "vllm",
"latestFailureAt": "2026-09-12T18:53:21+00:00",
"latestSuccessfulAt": null,
"matchType": "architectures",
"modelType": null,
"sourceModelIds": [
"XHToken/Spark-X2.5-4B"
],
"sourceTaskIds": [
"4549470"
],
"targetGpu": "Ascend_910-b3",
"taskType": "text-generation"
},
"ascend_910-b3|vllm|text-generation|model_type:glm_ocr": { "ascend_910-b3|vllm|text-generation|model_type:glm_ocr": {
"architectureSignature": "model_type:glm_ocr", "architectureSignature": "model_type:glm_ocr",
"architectures": [], "architectures": [],
@@ -1411,9 +1432,9 @@
} }
}, },
"architectureCompatibilitySummary": { "architectureCompatibilitySummary": {
"activeBlockCount": 71, "activeBlockCount": 72,
"byGpuFramework": { "byGpuFramework": {
"Ascend_910-b3|vllm": 8, "Ascend_910-b3|vllm": 9,
"Ascend_910-b4|vllm": 10, "Ascend_910-b4|vllm": 10,
"Cambricon_mlu-370-x8|vllm": 2, "Cambricon_mlu-370-x8|vllm": 2,
"Cambricon_mlu-370-x8|vllm-mlu": 5, "Cambricon_mlu-370-x8|vllm-mlu": 5,
@@ -1474,17 +1495,17 @@
"unresolvedFailureCount": 1 "unresolvedFailureCount": 1
}, },
"Ascend_910-b3|vllm|text-generation": { "Ascend_910-b3|vllm|text-generation": {
"attributableFailureCount": 28, "attributableFailureCount": 29,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 28, "decisionTotal": 29,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 28, "ambiguous_runtime": 28,
"framework_architecture_unsupported": 26, "framework_architecture_unsupported": 27,
"memory_capacity": 1, "memory_capacity": 1,
"tokenizer_compatibility": 1 "tokenizer_compatibility": 1
}, },
"failureCount": 56, "failureCount": 57,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm", "framework": "vllm",
"pendingCount": 0, "pendingCount": 0,
@@ -1494,7 +1515,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Ascend_910-b3", "targetGpu": "Ascend_910-b3",
"taskType": "text-generation", "taskType": "text-generation",
"total": 56, "total": 57,
"unresolvedFailureCount": 28 "unresolvedFailureCount": 28
}, },
"Ascend_910-b4|llamacpp|text-generation": { "Ascend_910-b4|llamacpp|text-generation": {
@@ -2327,15 +2348,15 @@
"unresolvedFailureCount": 28 "unresolvedFailureCount": 28
}, },
"hygon_k100-ai|vllm-patch-tokenizer|text-generation": { "hygon_k100-ai|vllm-patch-tokenizer|text-generation": {
"attributableFailureCount": 3, "attributableFailureCount": 4,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 3, "decisionTotal": 4,
"failureBreakdown": { "failureBreakdown": {
"framework_architecture_unsupported": 3, "framework_architecture_unsupported": 4,
"参数/模板问题": 8 "参数/模板问题": 8
}, },
"failureCount": 11, "failureCount": 12,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm-patch-tokenizer", "framework": "vllm-patch-tokenizer",
"pendingCount": 0, "pendingCount": 0,
@@ -2345,7 +2366,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "hygon_k100-ai", "targetGpu": "hygon_k100-ai",
"taskType": "text-generation", "taskType": "text-generation",
"total": 11, "total": 12,
"unresolvedFailureCount": 8 "unresolvedFailureCount": 8
}, },
"hygon_k100-ai|vllm|text-generation": { "hygon_k100-ai|vllm|text-generation": {
@@ -2440,14 +2461,14 @@
"unresolvedFailureCount": 866 "unresolvedFailureCount": 866
}, },
"vllm": { "vllm": {
"attributableFailureCount": 280, "attributableFailureCount": 281,
"decisionFailureRate": 0.9894, "decisionFailureRate": 0.9894,
"decisionSuccessRate": 0.0106, "decisionSuccessRate": 0.0106,
"decisionTotal": 283, "decisionTotal": 284,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 200, "ambiguous_runtime": 200,
"backend_operator": 34, "backend_operator": 34,
"framework_architecture_unsupported": 194, "framework_architecture_unsupported": 195,
"memory_capacity": 6, "memory_capacity": 6,
"model_load": 26, "model_load": 26,
"platform_infrastructure": 1, "platform_infrastructure": 1,
@@ -2456,14 +2477,14 @@
"tokenizer_compatibility": 6, "tokenizer_compatibility": 6,
"参数/模板问题": 24 "参数/模板问题": 24
}, },
"failureCount": 505, "failureCount": 506,
"failureRate": 0.9941, "failureRate": 0.9941,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 1, "platformFailureCount": 1,
"successCount": 3, "successCount": 3,
"successRate": 0.0059, "successRate": 0.0059,
"total": 508, "total": 509,
"unresolvedFailureCount": 224 "unresolvedFailureCount": 224
}, },
"vllm-mlu": { "vllm-mlu": {
@@ -2487,22 +2508,22 @@
"unresolvedFailureCount": 22 "unresolvedFailureCount": 22
}, },
"vllm-patch-tokenizer": { "vllm-patch-tokenizer": {
"attributableFailureCount": 3, "attributableFailureCount": 4,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 3, "decisionTotal": 4,
"failureBreakdown": { "failureBreakdown": {
"framework_architecture_unsupported": 3, "framework_architecture_unsupported": 4,
"参数/模板问题": 8 "参数/模板问题": 8
}, },
"failureCount": 11, "failureCount": 12,
"failureRate": 1.0, "failureRate": 1.0,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 0, "platformFailureCount": 0,
"successCount": 0, "successCount": 0,
"successRate": 0.0, "successRate": 0.0,
"total": 11, "total": 12,
"unresolvedFailureCount": 8 "unresolvedFailureCount": 8
}, },
"vllm_0_17_0_corex_4_4_0": { "vllm_0_17_0_corex_4_4_0": {
@@ -2568,29 +2589,29 @@
"unresolvedFailureCount": 1 "unresolvedFailureCount": 1
} }
}, },
"generatedAt": "2026-09-12T18:04:41.736777+00:00", "generatedAt": "2026-09-12T18:59:53.563039+00:00",
"gpuSummaries": { "gpuSummaries": {
"Ascend_910-b3": { "Ascend_910-b3": {
"attributableFailureCount": 28, "attributableFailureCount": 29,
"decisionFailureRate": 0.9655, "decisionFailureRate": 0.9667,
"decisionSuccessRate": 0.0345, "decisionSuccessRate": 0.0333,
"decisionTotal": 29, "decisionTotal": 30,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 28, "ambiguous_runtime": 28,
"framework_architecture_unsupported": 26, "framework_architecture_unsupported": 27,
"memory_capacity": 1, "memory_capacity": 1,
"tokenizer_compatibility": 1, "tokenizer_compatibility": 1,
"参数/模板问题": 8, "参数/模板问题": 8,
"验证失败": 27 "验证失败": 27
}, },
"failureCount": 91, "failureCount": 92,
"failureRate": 0.9891, "failureRate": 0.9892,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 0, "platformFailureCount": 0,
"successCount": 1, "successCount": 1,
"successRate": 0.0109, "successRate": 0.0108,
"total": 92, "total": 93,
"unresolvedFailureCount": 63 "unresolvedFailureCount": 63
}, },
"Ascend_910-b4": { "Ascend_910-b4": {
@@ -2875,13 +2896,13 @@
"unresolvedFailureCount": 206 "unresolvedFailureCount": 206
}, },
"hygon_k100-ai": { "hygon_k100-ai": {
"attributableFailureCount": 45, "attributableFailureCount": 46,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 45, "decisionTotal": 46,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 20, "ambiguous_runtime": 20,
"framework_architecture_unsupported": 34, "framework_architecture_unsupported": 35,
"memory_capacity": 1, "memory_capacity": 1,
"model_load": 4, "model_load": 4,
"repository_structure": 4, "repository_structure": 4,
@@ -2889,14 +2910,14 @@
"参数/模板问题": 9, "参数/模板问题": 9,
"验证失败": 27 "验证失败": 27
}, },
"failureCount": 101, "failureCount": 102,
"failureRate": 1.0, "failureRate": 1.0,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 0, "platformFailureCount": 0,
"successCount": 0, "successCount": 0,
"successRate": 0.0, "successRate": 0.0,
"total": 101, "total": 102,
"unresolvedFailureCount": 56 "unresolvedFailureCount": 56
} }
}, },
@@ -4294,6 +4315,29 @@
"total": 2, "total": 2,
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"hygon_k100-ai|vllm-patch-tokenizer|text-generation|rwkv7|none": {
"attributableFailureCount": 1,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"failureBreakdown": {
"framework_architecture_unsupported": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm-patch-tokenizer",
"modelType": "rwkv7",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "none",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "hygon_k100-ai",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
},
"hygon_k100-ai|vllm-patch-tokenizer|text-generation|zaya|none": { "hygon_k100-ai|vllm-patch-tokenizer|text-generation|zaya|none": {
"attributableFailureCount": 1, "attributableFailureCount": 1,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
@@ -4320,21 +4364,21 @@
}, },
"recentCombinationStats": { "recentCombinationStats": {
"Ascend_910-b3|vllm|text-generation": { "Ascend_910-b3|vllm|text-generation": {
"attributableFailureCount": 2, "attributableFailureCount": 3,
"consecutiveFailures": 2, "consecutiveFailures": 3,
"consecutivePlatformFailures": 0, "consecutivePlatformFailures": 0,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 2, "decisionTotal": 3,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 18, "ambiguous_runtime": 17,
"framework_architecture_unsupported": 2 "framework_architecture_unsupported": 3
}, },
"failureCount": 20, "failureCount": 20,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm", "framework": "vllm",
"lastPlatformFailureAt": null, "lastPlatformFailureAt": null,
"lastTerminalAt": "2026-09-12T14:41:33.434355+00:00", "lastTerminalAt": "2026-09-12T18:59:53.316516+00:00",
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 0, "platformFailureCount": 0,
@@ -4343,7 +4387,7 @@
"targetGpu": "Ascend_910-b3", "targetGpu": "Ascend_910-b3",
"taskType": "text-generation", "taskType": "text-generation",
"total": 20, "total": 20,
"unresolvedFailureCount": 18 "unresolvedFailureCount": 17
}, },
"Ascend_910-b4|unknown|text-generation": { "Ascend_910-b4|unknown|text-generation": {
"attributableFailureCount": 0, "attributableFailureCount": 0,
@@ -4614,9 +4658,9 @@
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 0, "decisionTotal": 0,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 12 "ambiguous_runtime": 11
}, },
"failureCount": 12, "failureCount": 11,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm_fix_tokenizer", "framework": "vllm_fix_tokenizer",
"lastPlatformFailureAt": null, "lastPlatformFailureAt": null,
@@ -4628,8 +4672,8 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Kunlunxin_p-800", "targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation", "taskType": "text-generation",
"total": 12, "total": 11,
"unresolvedFailureCount": 12 "unresolvedFailureCount": 11
}, },
"MetaX_c-500|vllm|text-generation": { "MetaX_c-500|vllm|text-generation": {
"attributableFailureCount": 6, "attributableFailureCount": 6,
@@ -4952,9 +4996,9 @@
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 0, "decisionTotal": 0,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 3 "ambiguous_runtime": 2
}, },
"failureCount": 3, "failureCount": 2,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm_fix_tokenizer", "framework": "vllm_fix_tokenizer",
"lastTerminalAt": "2026-09-10T02:58:51.546388+00:00", "lastTerminalAt": "2026-09-10T02:58:51.546388+00:00",
@@ -4967,8 +5011,8 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Kunlunxin_p-800", "targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation", "taskType": "text-generation",
"total": 3, "total": 2,
"unresolvedFailureCount": 3 "unresolvedFailureCount": 2
}, },
"Kunlunxin_p-800|vllm_fix_tokenizer|text-generation|qwen3_5_mtp|none": { "Kunlunxin_p-800|vllm_fix_tokenizer|text-generation|qwen3_5_mtp|none": {
"attributableFailureCount": 0, "attributableFailureCount": 0,
@@ -7276,6 +7320,30 @@
"total": 1, "total": 1,
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"hygon_k100-ai|vllm-patch-tokenizer|text-generation|rwkv7|none|32": {
"attributableFailureCount": 1,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"failureBreakdown": {
"framework_architecture_unsupported": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm-patch-tokenizer",
"loadSizeLog2Bucket": 32,
"modelType": "rwkv7",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "none",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "hygon_k100-ai",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
},
"hygon_k100-ai|vllm-patch-tokenizer|text-generation|zaya|none|32": { "hygon_k100-ai|vllm-patch-tokenizer|text-generation|zaya|none|32": {
"attributableFailureCount": 1, "attributableFailureCount": 1,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
@@ -7301,17 +7369,17 @@
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
} }
}, },
"terminalRecords": 1732, "terminalRecords": 1734,
"totalRecords": 1819, "totalRecords": 1821,
"totals": { "totals": {
"attributableFailureCount": 492, "attributableFailureCount": 494,
"decisionFailureRate": 0.8962, "decisionFailureRate": 0.8966,
"decisionSuccessRate": 0.1038, "decisionSuccessRate": 0.1034,
"decisionTotal": 549, "decisionTotal": 551,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 405, "ambiguous_runtime": 405,
"backend_operator": 42, "backend_operator": 42,
"framework_architecture_unsupported": 305, "framework_architecture_unsupported": 307,
"memory_capacity": 11, "memory_capacity": 11,
"model_load": 72, "model_load": 72,
"platform_infrastructure": 4, "platform_infrastructure": 4,
@@ -7321,20 +7389,21 @@
"参数/模板问题": 101, "参数/模板问题": 101,
"验证失败": 673 "验证失败": 673
}, },
"failureCount": 1675, "failureCount": 1677,
"failureRate": 0.9671, "failureRate": 0.9671,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 4, "platformFailureCount": 4,
"successCount": 57, "successCount": 57,
"successRate": 0.0329, "successRate": 0.0329,
"total": 1732, "total": 1734,
"unresolvedFailureCount": 1179 "unresolvedFailureCount": 1179
}, },
"warnings": [ "warnings": [
"GPU Ascend_910-b3 本地统计失败率偏高≥50%),建议重点关注。", "GPU Ascend_910-b3 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高≥50%),建议重点关注。", "GPU Ascend_910-b4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高≥50%),建议重点关注。", "GPU Mthreads_s4000 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高≥50%),建议重点关注。",
"GPU hygon_k100-ai 本地统计失败率偏高≥50%),建议重点关注。", "GPU hygon_k100-ai 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高≥50%),建议重点关注。", "GPU Cambricon_mlu-370-x4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_mrv-100 本地统计失败率偏高≥50%),建议重点关注。", "GPU Iluvatar_mrv-100 本地统计失败率偏高≥50%),建议重点关注。",
@@ -7343,7 +7412,6 @@
"GPU MetaX_c-500 本地统计失败率偏高≥50%),建议重点关注。", "GPU MetaX_c-500 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Biren_166m 本地统计失败率偏高≥50%),建议重点关注。", "GPU Biren_166m 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。", "GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高≥50%),建议重点关注。",
"组合 hygon_k100-ai|vllm-patch-tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 hygon_k100-ai|vllm-patch-tokenizer|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 hygon_k100-ai|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 hygon_k100-ai|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Ascend_910-b4|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Ascend_910-b4|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -7366,6 +7434,6 @@
] ]
}, },
"storageMode": "decision_state_only", "storageMode": "decision_state_only",
"summarizedRecords": 1819, "summarizedRecords": 1821,
"version": 1 "version": 1
} }

View File

@@ -14,13 +14,13 @@
100 100
], ],
"accounts": 12, "accounts": 12,
"activeScanned": 1032, "activeScanned": 1026,
"ageCleanupMode": "admission_only", "ageCleanupMode": "admission_only",
"agePolicySkipped": { "agePolicySkipped": {
"cleanupDisabled": true, "cleanupDisabled": true,
"reason": "admission_only" "reason": "admission_only"
}, },
"architectureBlockCount": 71, "architectureBlockCount": 72,
"architectureFrameworkCatalog": { "architectureFrameworkCatalog": {
"ascend_910-b3|text-generation": [ "ascend_910-b3|text-generation": [
"llamacpp", "llamacpp",
@@ -88,14 +88,14 @@
"unsloth/LFM2-2.6B-Exp-GGUF": "HttpJsonError: HTTP request failed for https://modelscope.cn/models/unsloth/LFM2-2.6B-Exp-GGUF/resolve/master/config.json (status=404)", "unsloth/LFM2-2.6B-Exp-GGUF": "HttpJsonError: HTTP request failed for https://modelscope.cn/models/unsloth/LFM2-2.6B-Exp-GGUF/resolve/master/config.json (status=404)",
"z-lab/Qwen3.8-27B-DFlash2-GGUF": "HttpJsonError: HTTP request failed for https://modelscope.cn/models/z-lab/Qwen3.8-27B-DFlash2-GGUF/resolve/master/config.json (status=404)" "z-lab/Qwen3.8-27B-DFlash2-GGUF": "HttpJsonError: HTTP request failed for https://modelscope.cn/models/z-lab/Qwen3.8-27B-DFlash2-GGUF/resolve/master/config.json (status=404)"
}, },
"architectureModelConfigsComplete": 104, "architectureModelConfigsComplete": 103,
"architectureOnly": true, "architectureOnly": true,
"architecturePolicySkipped": { "architecturePolicySkipped": {
"frameworkCatalogUnknown": 79, "frameworkCatalogUnknown": 78,
"frameworkContextUnknown": 306, "frameworkContextUnknown": 298,
"modelArchitectureUnknown": 147, "modelArchitectureUnknown": 151,
"noMatchingBlock": 713, "noMatchingBlock": 707,
"partiallyBlockedFrameworkSet": 93, "partiallyBlockedFrameworkSet": 90,
"runningMatchedProtected": 0, "runningMatchedProtected": 0,
"submissionContextMismatch": 0, "submissionContextMismatch": 0,
"submissionContextUnknown": 0 "submissionContextUnknown": 0

View File

@@ -1,3 +1,4 @@
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedArchitectures": ["Spark2_5ForCausalLM"], "framework": "vllm", "lastSyncTime": "2026-09-12T18:59:53.316516+00:00", "modelId": "XHToken/Spark-X2.5-4B", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-12T18:53:21+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4549470", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["nemotron_h"], "framework": "vllm", "lastSyncTime": "2026-09-12T17:16:49.913530+00:00", "modelId": "primitive-ai/Nemotron-3.5-Lightning-30B-A3B-mixed-INT4-INT8", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-12T17:15:21+00:00", "targetGpu": "Vastai_va16", "taskId": "4543650", "taskType": "text-generation", "verifyResult": -1} {"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["nemotron_h"], "framework": "vllm", "lastSyncTime": "2026-09-12T17:16:49.913530+00:00", "modelId": "primitive-ai/Nemotron-3.5-Lightning-30B-A3B-mixed-INT4-INT8", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-12T17:15:21+00:00", "targetGpu": "Vastai_va16", "taskId": "4543650", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-12T17:06:34.916681+00:00", "modelId": "amd/Qwen2-7B-onnx-ryzenai-npu", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-12T16:57:21+00:00", "targetGpu": "MetaX_c-500", "taskId": "4079249", "taskType": "text-generation", "verifyResult": -1} {"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-12T17:06:34.916681+00:00", "modelId": "amd/Qwen2-7B-onnx-ryzenai-npu", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-12T16:57:21+00:00", "targetGpu": "MetaX_c-500", "taskId": "4079249", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5"], "framework": "vllm", "lastSyncTime": "2026-09-12T16:46:42.939263+00:00", "modelId": "primitive-ai/Qwen3.8-27B-mixed-NVFP4-FP8", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-12T16:43:21+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4610337", "taskType": "text-generation", "verifyResult": -1} {"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5"], "framework": "vllm", "lastSyncTime": "2026-09-12T16:46:42.939263+00:00", "modelId": "primitive-ai/Qwen3.8-27B-mixed-NVFP4-FP8", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-12T16:43:21+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4610337", "taskType": "text-generation", "verifyResult": -1}
@@ -297,4 +298,3 @@
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-10T02:58:51.546388+00:00", "modelId": "RedHatAI/Phi-3-medium-128k-instruct-quantized.w8a16", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 14293356304, "estimatedRequiredGiB": 15.977, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 14295851911, "modelscopeLicense": "mit", "modelscopeParams": 13960238080, "modelscopeTags": ["license:mit", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 14295851911}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T23:02:51.847566+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729520", "taskType": "text-generation", "verifyResult": -1} {"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-10T02:58:51.546388+00:00", "modelId": "RedHatAI/Phi-3-medium-128k-instruct-quantized.w8a16", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 14293356304, "estimatedRequiredGiB": 15.977, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 14295851911, "modelscopeLicense": "mit", "modelscopeParams": 13960238080, "modelscopeTags": ["license:mit", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 14295851911}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T23:02:51.847566+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729520", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-09T14:21:21.949411+00:00", "modelId": "RedHatAI/Phi-3-mini-128k-instruct-quantized.w8a16", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4020365960, "estimatedRequiredGiB": 4.496, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 4022810352, "modelscopeLicense": "mit", "modelscopeParams": 3821079552, "modelscopeTags": ["license:mit", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4022810352}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T23:02:51.843439+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729517", "taskType": "text-generation", "verifyResult": -1} {"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-09T14:21:21.949411+00:00", "modelId": "RedHatAI/Phi-3-mini-128k-instruct-quantized.w8a16", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4020365960, "estimatedRequiredGiB": 4.496, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 4022810352, "modelscopeLicense": "mit", "modelscopeParams": 3821079552, "modelscopeTags": ["license:mit", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4022810352}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T23:02:51.843439+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729517", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-09T14:24:47.907622+00:00", "modelId": "RedHatAI/starcoder2-7b-FP8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7855165704, "estimatedRequiredGiB": 8.783, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 7858540940, "modelscopeLicense": "other", "modelscopeParams": 7400416256, "modelscopeTags": ["license:other", "model_type:starcoder2", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-07T06:07:37.712079+00:00", "modelType": "starcoder2", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 7858540940}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T23:02:51.841387+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729516", "taskType": "text-generation", "verifyResult": -1} {"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-09T14:24:47.907622+00:00", "modelId": "RedHatAI/starcoder2-7b-FP8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7855165704, "estimatedRequiredGiB": 8.783, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 7858540940, "modelscopeLicense": "other", "modelscopeParams": 7400416256, "modelscopeTags": ["license:other", "model_type:starcoder2", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-07T06:07:37.712079+00:00", "modelType": "starcoder2", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 7858540940}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T23:02:51.841387+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729516", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-10T15:19:40.009011+00:00", "modelId": "RedHatAI/Phi-3-medium-128k-instruct-quantized.w8a8", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 14293335560, "estimatedRequiredGiB": 15.977, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 14295942065, "modelscopeLicense": "mit", "modelscopeParams": 13960238080, "modelscopeTags": ["license:mit", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 14295942065}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T23:02:51.830682+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4729514", "taskType": "text-generation", "verifyResult": -1}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -1,24 +1,24 @@
{ {
"agentVersion": "2026.09.04.4", "agentVersion": "2026.09.04.4",
"checksums": { "checksums": {
".modelhub_state/architecture_compatibility_blacklist.json": "8bb54ac11c9811cac497783c977fb913dbc4b3a5021b03c644f85bf7c9e512bc", ".modelhub_state/architecture_compatibility_blacklist.json": "0922327db8a76d778919a8b07274579f351d75928596bf85d9f0b8f0d32c3842",
".modelhub_state/architecture_history_backfill.json": "585583c672473259c31e61e89b5ac39dbab1a0a8105b5d413f0fa6c4e8519f07", ".modelhub_state/architecture_history_backfill.json": "9dec7e61957d2a33223d7adacbd7373c0c652383ba26465c4a8aa2982f5db0be",
".modelhub_state/market_intelligence.json": "a8e11f891c860d26beb8464ebb41d11fe5df353519580758e7789f7fda6951f9", ".modelhub_state/market_intelligence.json": "c2db202e07aa4859cb253226823cf282fc6a12553ac5b5bb1f3e6a5c64a68bda",
".modelhub_state/official_capabilities.json": "8c7d02a4610c71424ecb800fb3dba2ccd145e550ded1256c464d823cce3a5c2a", ".modelhub_state/official_capabilities.json": "72a77802c295fd2c3c8258a4aa346b48819e1f5d6cbd766ecbb0a0ef3357d375",
".modelhub_state/outcome_checkpoint.json": "e547a713bc00489e0b22ce7e24a2e53985ab8d5a85689084dfcf58344f108692", ".modelhub_state/outcome_checkpoint.json": "844817e021a11d003b1c6bf2075a968bffdea02bbf91d2ba43ea8e0ec897380e",
".modelhub_state/queue_cleanup_latest.json": "ccebc58971e155e7d5987315af83d23359f4ad65134945945f168235fb97bc19", ".modelhub_state/queue_cleanup_latest.json": "6e13d9db1daf048f4029a2d84ef15f8fcc26ad0dfa4a2deea5f40c92de0af1f3",
".modelhub_state/recent_outcomes.jsonl": "f0143b6f492637a597d7027271b2d3cfa24058051c2bd6a684fca345a8b23463", ".modelhub_state/recent_outcomes.jsonl": "8700b4b73aac2619ea8092ab07f4561a8675c7e73466883ba9f929d6a6acd71c",
".modelhub_state/recovery_active_tasks.jsonl": "42ae7143add591b23250d2132368e31b2b244a56bd5beb4a84b465ed5797b8ca", ".modelhub_state/recovery_active_tasks.jsonl": "755b4430108b306898913a0fa3818e6757df365f5b86ccecdb6b4ea85cb46c1b",
".modelhub_state/recovery_intents.jsonl": "4d2849f762599a746cbef8b11b359ce4e660231b9e49368976184eef195bc82e", ".modelhub_state/recovery_intents.jsonl": "80e971a7cce5f935b58bb171954e5e9cc9db993fc6c4ded836da03191563bb2c",
".modelhub_state/routing_intelligence.json": "cdd3341d66484775862c4a1f5c766a7fc0200b1a3a204a76975162502e1d3457", ".modelhub_state/routing_intelligence.json": "cdd3341d66484775862c4a1f5c766a7fc0200b1a3a204a76975162502e1d3457",
".modelhub_state/submission_exclusions.jsonl": "14480c58228be6b76e21e98008960b815d20d16132dcab7a11e5b449c5e2d220", ".modelhub_state/submission_exclusions.jsonl": "14480c58228be6b76e21e98008960b815d20d16132dcab7a11e5b449c5e2d220",
".modelhub_state/worker_crashes.jsonl": "9693a31a13cc18a3136ff5373f9569dc2fecaa274aaf91d3b1c8a67f31fe0162", ".modelhub_state/worker_crashes.jsonl": "9693a31a13cc18a3136ff5373f9569dc2fecaa274aaf91d3b1c8a67f31fe0162",
"ledger/submissions.jsonl": "828c7254d2bda84e29c1ccc3489b033f26de0fa8f8ae7cf4e571de42b1210714", "ledger/submissions.jsonl": "828c7254d2bda84e29c1ccc3489b033f26de0fa8f8ae7cf4e571de42b1210714",
"outcomes/submissions.jsonl": "f2c15b1eceed1adfa384c4f3f5aadc118c8e5815bb7998e1aa8d52abcf2043b2" "outcomes/submissions.jsonl": "330f4925bfdc6851862a37bcf16ba89cafeb5e0ec5028e9aac675e630a66f055"
}, },
"generation": 6331, "generation": 6332,
"phase": "cycle", "phase": "cycle",
"schemaVersion": 1, "schemaVersion": 1,
"updatedAt": "2026-09-12T18:58:52.681109+00:00", "updatedAt": "2026-09-12T19:03:59.379970+00:00",
"writerId": "e5dd59a4c84a4f21926bad61448789e2" "writerId": "e5dd59a4c84a4f21926bad61448789e2"
} }

View File

@@ -62,7 +62,6 @@
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T00:58:33.712526+00:00", "modelId": "nm-testing/tinyllama-marlin24-w4a16-group128", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "382ef635ba042d77a729681df1994f5ac5e7beaf5980ac5d2e7045645d11c732", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 640856992, "estimatedRequiredGiB": 0.718, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 642705637, "modelscopeLicense": null, "modelscopeParams": 259844096, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 642705637}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T16:55:10.211615+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4630908", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T00:58:33.712526+00:00", "modelId": "nm-testing/tinyllama-marlin24-w4a16-group128", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "382ef635ba042d77a729681df1994f5ac5e7beaf5980ac5d2e7045645d11c732", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 640856992, "estimatedRequiredGiB": 0.718, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 642705637, "modelscopeLicense": null, "modelscopeParams": 259844096, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 642705637}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T16:55:10.211615+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4630908", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T01:29:42.410346+00:00", "modelId": "pfnet/plamo-3-nict-8b-base", "modelProfile": {"architectures": ["Plamo3ForCausalLM"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 16182734928, "estimatedRequiredGiB": 18.09, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "manufacturer_spec", "sourceUrl": "https://www.birentech.com/news/id6rz98v3obczy77cmxzfgk3/"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "plamo3", "modelscopeFileSize": 16186391993, "modelscopeLicense": "other", "modelscopeParams": 8091348992, "modelscopeTags": ["license:other", "model_type:plamo3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 16186391993}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T17:27:00.623821+00:00", "targetGpu": "Biren_166m", "taskId": "4631345", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T01:29:42.410346+00:00", "modelId": "pfnet/plamo-3-nict-8b-base", "modelProfile": {"architectures": ["Plamo3ForCausalLM"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 16182734928, "estimatedRequiredGiB": 18.09, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "manufacturer_spec", "sourceUrl": "https://www.birentech.com/news/id6rz98v3obczy77cmxzfgk3/"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "plamo3", "modelscopeFileSize": 16186391993, "modelscopeLicense": "other", "modelscopeParams": 8091348992, "modelscopeTags": ["license:other", "model_type:plamo3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 16186391993}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T17:27:00.623821+00:00", "targetGpu": "Biren_166m", "taskId": "4631345", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T02:08:42.512158+00:00", "modelId": "ornith-ai/Ornith-1.5-35B-A3B-MLX-6bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 28168623119, "estimatedRequiredGiB": 31.505, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "manufacturer_spec", "sourceUrl": "https://www.birentech.com/news/id6rz98v3obczy77cmxzfgk3/"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 28190535646, "modelscopeLicense": null, "modelscopeParams": 7584230528, "modelscopeTags": ["model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 28190535646}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T18:06:53.125751+00:00", "targetGpu": "Biren_166m", "taskId": "4631858", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-05T02:08:42.512158+00:00", "modelId": "ornith-ai/Ornith-1.5-35B-A3B-MLX-6bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 28168623119, "estimatedRequiredGiB": 31.505, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "manufacturer_spec", "sourceUrl": "https://www.birentech.com/news/id6rz98v3obczy77cmxzfgk3/"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 28190535646, "modelscopeLicense": null, "modelscopeParams": 7584230528, "modelscopeTags": ["model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 28190535646}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T18:06:53.125751+00:00", "targetGpu": "Biren_166m", "taskId": "4631858", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-05T02:08:42.512181+00:00", "modelId": "RWKV/RWKV7-2.9B-20260805", "modelProfile": {"architectures": ["Rwkv7ForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5896238160, "estimatedRequiredGiB": 6.592, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:15"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "rwkv7", "modelscopeFileSize": 5898265436, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2948065280, "modelscopeTags": ["license:apache-2.0", "model_type:rwkv7", "library:safetensors", "task:text-generation", "custom_tag:rwkv", "custom_tag:rwkv7", "custom_tag:recurrent", "custom_tag:causal-lm", "custom_tag:conversational"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5898265436}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T18:07:32.312944+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4631859", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T02:32:00.692516+00:00", "modelId": "neuralmagic/gemma-2-9b-it-quantized.w8a16", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11998647728, "estimatedRequiredGiB": 13.434, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 12020564058, "modelscopeLicense": "gemma", "modelscopeParams": 10159209984, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 12020564058}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T18:26:10.985611+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4632116", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T02:32:00.692516+00:00", "modelId": "neuralmagic/gemma-2-9b-it-quantized.w8a16", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11998647728, "estimatedRequiredGiB": 13.434, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 12020564058, "modelscopeLicense": "gemma", "modelscopeParams": 10159209984, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 12020564058}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T18:26:10.985611+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4632116", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T02:32:00.692571+00:00", "modelId": "ornith-ai/Ornith-1.5-35B-A3B-NVFP4", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 23420419700, "estimatedRequiredGiB": 26.214, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 23455515266, "modelscopeLicense": "mit", "modelscopeParams": 19528501104, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "modelopt", "repositoryOnDiskBytes": 23455515266}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T18:26:16.665549+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4632117", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T02:32:00.692571+00:00", "modelId": "ornith-ai/Ornith-1.5-35B-A3B-NVFP4", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 23420419700, "estimatedRequiredGiB": 26.214, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 23455515266, "modelscopeLicense": "mit", "modelscopeParams": 19528501104, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "modelopt", "repositoryOnDiskBytes": 23455515266}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T18:26:16.665549+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4632117", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T03:05:43.096396+00:00", "modelId": "neuralmagic/gemma-2-9b-it-quantized.w8a8", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11998609696, "estimatedRequiredGiB": 13.434, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 12020499228, "modelscopeLicense": "gemma", "modelscopeParams": 10159209984, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 12020499228}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T19:03:47.678567+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4632579", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-05T03:05:43.096396+00:00", "modelId": "neuralmagic/gemma-2-9b-it-quantized.w8a8", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11998609696, "estimatedRequiredGiB": 13.434, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 12020499228, "modelscopeLicense": "gemma", "modelscopeParams": 10159209984, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 12020499228}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T19:03:47.678567+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4632579", "taskType": "text-generation", "verifyResult": null}
@@ -623,8 +622,8 @@
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-12T14:23:18.821537+00:00", "modelId": "mlx-community/Ornith-1.5-35B-A3B-8bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 37721402856, "estimatedRequiredGiB": 42.187, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 37748367893, "modelscopeLicense": "mit", "modelscopeParams": 10195701616, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 37748367893}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-12T06:19:56.330927+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4795478", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-12T14:23:18.821537+00:00", "modelId": "mlx-community/Ornith-1.5-35B-A3B-8bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 37721402856, "estimatedRequiredGiB": 42.187, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 37748367893, "modelscopeLicense": "mit", "modelscopeParams": 10195701616, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 37748367893}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-12T06:19:56.330927+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4795478", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-12T14:41:33.434314+00:00", "modelId": "mlx-community/Ornith-1.5-35B-A3B-8bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 37721402856, "estimatedRequiredGiB": 42.187, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 37748367893, "modelscopeLicense": "mit", "modelscopeParams": 10195701616, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 37748367893}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-12T06:36:56.396629+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4795634", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-12T14:41:33.434314+00:00", "modelId": "mlx-community/Ornith-1.5-35B-A3B-8bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 37721402856, "estimatedRequiredGiB": 42.187, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 37748367893, "modelscopeLicense": "mit", "modelscopeParams": 10195701616, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 37748367893}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-12T06:36:56.396629+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4795634", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-12T14:59:07.400101+00:00", "modelId": "mlx-community/Ornith-1.5-35B-A3B-8bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 37721402856, "estimatedRequiredGiB": 42.187, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 37748367893, "modelscopeLicense": "mit", "modelscopeParams": 10195701616, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 37748367893}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-12T06:53:56.898337+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4795839", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-12T14:59:07.400101+00:00", "modelId": "mlx-community/Ornith-1.5-35B-A3B-8bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 37721402856, "estimatedRequiredGiB": 42.187, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 37748367893, "modelscopeLicense": "mit", "modelscopeParams": 10195701616, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 37748367893}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-12T06:53:56.898337+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4795839", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "mlx-community/Ornith-1.5-35B-A3B-8bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 37721402856, "estimatedRequiredGiB": 42.187, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 37748367893, "modelscopeLicense": "mit", "modelscopeParams": 10195701616, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 2}, "failureCount": 2, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-09T14:00:25.508497+00:00", "modelType": "qwen3_5_moe", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 2, "unresolvedFailureCount": 2}, "repositoryOnDiskBytes": 37748367893}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-12T10:58:56.807180+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4800525", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-12T18:59:53.316548+00:00", "modelId": "mlx-community/Ornith-1.5-35B-A3B-8bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 37721402856, "estimatedRequiredGiB": 42.187, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 37748367893, "modelscopeLicense": "mit", "modelscopeParams": 10195701616, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 2}, "failureCount": 2, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-09T14:00:25.508497+00:00", "modelType": "qwen3_5_moe", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 2, "unresolvedFailureCount": 2}, "repositoryOnDiskBytes": 37748367893}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-12T10:58:56.807180+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4800525", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "unsloth/NVIDIA-Nemotron-3.5-Lightning-30B-A3B", "modelProfile": {"architectures": ["NemotronHForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 65827374264, "estimatedRequiredGiB": 73.588, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "nemotron_h", "modelscopeFileSize": 65845719365, "modelscopeLicense": "other", "modelscopeParams": 32913266240, "modelscopeTags": ["license:other", "model_type:nemotron_h", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:nvidia", "custom_tag:pytorch", "custom_tag:nemotron-3.5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 65845719365}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-12T10:58:56.798553+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4800526", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-12T18:59:53.316560+00:00", "modelId": "unsloth/NVIDIA-Nemotron-3.5-Lightning-30B-A3B", "modelProfile": {"architectures": ["NemotronHForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 65827374264, "estimatedRequiredGiB": 73.588, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "nemotron_h", "modelscopeFileSize": 65845719365, "modelscopeLicense": "other", "modelscopeParams": 32913266240, "modelscopeTags": ["license:other", "model_type:nemotron_h", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:nvidia", "custom_tag:pytorch", "custom_tag:nemotron-3.5"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 65845719365}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-12T10:58:56.798553+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4800526", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "mlx-community/Ornith-1.5-35B-A3B-8bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 37721402856, "estimatedRequiredGiB": 42.187, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 37748367893, "modelscopeLicense": "mit", "modelscopeParams": 10195701616, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 37748367893}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-12T14:09:52.635448+00:00", "targetGpu": "Biren_166m", "taskId": "4803464", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "mlx-community/Ornith-1.5-35B-A3B-8bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 37721402856, "estimatedRequiredGiB": 42.187, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 37748367893, "modelscopeLicense": "mit", "modelscopeParams": 10195701616, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 37748367893}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-12T14:09:52.635448+00:00", "targetGpu": "Biren_166m", "taskId": "4803464", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "mlx-community/Ornith-1.5-35B-A3B-8bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 37721402856, "estimatedRequiredGiB": 42.187, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 37748367893, "modelscopeLicense": "mit", "modelscopeParams": 10195701616, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 37748367893}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-12T16:07:22.080195+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4804755", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "mlx-community/Ornith-1.5-35B-A3B-8bit", "modelProfile": {"architectures": ["Qwen3_5MoeForConditionalGeneration"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 37721402856, "estimatedRequiredGiB": 42.187, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_moe", "modelscopeFileSize": 37748367893, "modelscopeLicense": "mit", "modelscopeParams": 10195701616, "modelscopeTags": ["license:mit", "model_type:qwen3_5_moe", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 37748367893}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-12T16:07:22.080195+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4804755", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "llamacpp", "lastSyncTime": null, "modelId": "cloudlnk/Spark-X2.5-4B-GGUF", "modelProfile": {"architectures": [], "configFingerprint": "c21a8c5b2598ee6aec1301e1dba618e3f68c70a7ab35b6b215134aa6e6b9a3eb", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2405581632, "estimatedRequiredGiB": 17.589, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": null, "modelscopeFileSize": 15737975890, "modelscopeLicense": "apache-2.0", "modelscopeParams": 4112079360, "modelscopeTags": ["license:apache-2.0", "library:gguf", "task:text-generation", "custom_tag:gguf", "custom_tag:llama.cpp", "custom_tag:spark-x2.5", "custom_tag:long-context", "custom_tag:1m-context", "deploy:swingdeploy"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 15737975890}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-12T16:59:17.247535+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4805292", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "llamacpp", "lastSyncTime": null, "modelId": "cloudlnk/Spark-X2.5-4B-GGUF", "modelProfile": {"architectures": [], "configFingerprint": "c21a8c5b2598ee6aec1301e1dba618e3f68c70a7ab35b6b215134aa6e6b9a3eb", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2405581632, "estimatedRequiredGiB": 17.589, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": null, "modelscopeFileSize": 15737975890, "modelscopeLicense": "apache-2.0", "modelscopeParams": 4112079360, "modelscopeTags": ["license:apache-2.0", "library:gguf", "task:text-generation", "custom_tag:gguf", "custom_tag:llama.cpp", "custom_tag:spark-x2.5", "custom_tag:long-context", "custom_tag:1m-context", "deploy:swingdeploy"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 15737975890}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-12T16:59:17.247535+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4805292", "taskType": "text-generation", "verifyResult": null}