state: generation 22024 (cycle)

This commit is contained in:
2026-10-08 01:52:11 +00:00
parent 1056e5855e
commit 55062e73ce
9 changed files with 2895 additions and 3173 deletions

View File

@@ -399,7 +399,7 @@
"ascend_910-b4|vllm_tokenizer_patch|text-generation|model_type:mini_k3": { "ascend_910-b4|vllm_tokenizer_patch|text-generation|model_type:mini_k3": {
"architectureSignature": "model_type:mini_k3", "architectureSignature": "model_type:mini_k3",
"architectures": [], "architectures": [],
"evidenceCount": 2, "evidenceCount": 4,
"expiresAt": "2026-10-21T19:05:50.437924+00:00", "expiresAt": "2026-10-21T19:05:50.437924+00:00",
"framework": "vllm_tokenizer_patch", "framework": "vllm_tokenizer_patch",
"latestFailureAt": "2026-09-21T19:05:50.437924+00:00", "latestFailureAt": "2026-09-21T19:05:50.437924+00:00",
@@ -408,11 +408,15 @@
"modelType": "mini_k3", "modelType": "mini_k3",
"sourceModelIds": [ "sourceModelIds": [
"nkkbr/Mini-K3-1H-decay-g16-v2_B", "nkkbr/Mini-K3-1H-decay-g16-v2_B",
"nkkbr/Mini-K3-1H-attnres-block6-v1_C" "nkkbr/Mini-K3-1H-attnres-block6-v1_C",
"nkkbr/Mini-K3-1H-attnres-standard-v1_B",
"nkkbr/Mini-K3-1H-decay-g1-v2_B"
], ],
"sourceTaskIds": [ "sourceTaskIds": [
"5006050", "5006050",
"5006054" "5006054",
"5006051",
"5005585"
], ],
"targetGpu": "Ascend_910-b4", "targetGpu": "Ascend_910-b4",
"taskType": "text-generation" "taskType": "text-generation"
@@ -2890,7 +2894,7 @@
"taskType": "text-generation" "taskType": "text-generation"
} }
}, },
"generatedAt": "2026-10-08T01:25:54.925981+00:00", "generatedAt": "2026-10-08T01:44:45.052677+00:00",
"summary": { "summary": {
"activeBlockCount": 145, "activeBlockCount": 145,
"byGpuFramework": { "byGpuFramework": {

View File

@@ -1,8 +1,8 @@
{ {
"communityAttemptedAt": "2026-10-08T01:27:27.079335+00:00", "communityAttemptedAt": "2026-10-08T01:46:32.554265+00:00",
"communityError": null, "communityError": null,
"communitySample": {}, "communitySample": {},
"communityUpdatedAt": "2026-10-08T01:27:27.079335+00:00", "communityUpdatedAt": "2026-10-08T01:46:32.554265+00:00",
"frameworkAttemptedAt": "2026-10-07T20:58:42.772583+00:00", "frameworkAttemptedAt": "2026-10-07T20:58:42.772583+00:00",
"frameworkError": null, "frameworkError": null,
"frameworkStats": { "frameworkStats": {
@@ -434,121 +434,121 @@
} }
}, },
"frameworkUpdatedAt": null, "frameworkUpdatedAt": null,
"generatedAt": "2026-10-08T01:40:57.276451+00:00", "generatedAt": "2026-10-08T01:46:32.554265+00:00",
"gpuStats": { "gpuStats": {
"Ascend_910-b3": { "Ascend_910-b3": {
"available": true, "available": true,
"backlogHours": 942.0344827586207, "backlogHours": 953.0581395348837,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Ascend_910-b3", "gpu": "Ascend_910-b3",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 8, "maxConcurrentTasks": 8,
"qualityFactor": 1.0330988363353264, "qualityFactor": 1.0198161556666079,
"queueFactor": 1.0061884220086608, "queueFactor": 1.0008205445314489,
"queueWeight": 1.0061884220086608, "queueWeight": 1.0008205445314489,
"recentSuccess": 48, "recentSuccess": 49,
"recentSuccessRate": 0.27586206896551724, "recentSuccessRate": 0.28488372093023256,
"recentTerminal": 174, "recentTerminal": 172,
"recentWilsonLowerBound": 0.21483602929568732, "recentWilsonLowerBound": 0.22270396035150342,
"running": 8, "running": 6,
"selectionWeight": 1.0394920879112257, "selectionWeight": 1.0206529602362233,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 29.0, "throughputPerHour": 28.666666666666668,
"waiting": 27319 "waiting": 27321
}, },
"Ascend_910-b4": { "Ascend_910-b4": {
"available": true, "available": true,
"backlogHours": 1035.329479768786, "backlogHours": 1047.3684210526317,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Ascend_910-b4", "gpu": "Ascend_910-b4",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 8, "maxConcurrentTasks": 8,
"qualityFactor": 1.1620120099160778, "qualityFactor": 0.9803126805505986,
"queueFactor": 0.9920362652861231, "queueFactor": 0.9867546910933408,
"queueWeight": 0.9920362652861231, "queueWeight": 0.9867546910933408,
"recentSuccess": 50, "recentSuccess": 48,
"recentSuccessRate": 0.28901734104046245, "recentSuccessRate": 0.2807017543859649,
"recentTerminal": 173, "recentTerminal": 171,
"recentWilsonLowerBound": 0.2266314526680985, "recentWilsonLowerBound": 0.21874049084032365,
"running": 8, "running": 8,
"selectionWeight": 1.1527580545347673, "selectionWeight": 0.9673281362715909,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 28.833333333333332, "throughputPerHour": 28.5,
"waiting": 29852 "waiting": 29850
}, },
"Biren_166m": { "Biren_166m": {
"available": true, "available": true,
"backlogHours": 160.95652173913044, "backlogHours": 167.10967741935485,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Biren_166m", "gpu": "Biren_166m",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 8, "maxConcurrentTasks": 8,
"qualityFactor": 0.3331647238362046, "qualityFactor": 0.3310539784481304,
"queueFactor": 1.3, "queueFactor": 1.2994928099999101,
"queueWeight": 1.3, "queueWeight": 1.2994928099999101,
"recentSuccess": 29, "recentSuccess": 29,
"recentSuccessRate": 0.18012422360248448, "recentSuccessRate": 0.1870967741935484,
"recentTerminal": 161, "recentTerminal": 155,
"recentWilsonLowerBound": 0.12844163237023534, "recentWilsonLowerBound": 0.13354466465333883,
"running": 8, "running": 9,
"selectionWeight": 0.433114140987066, "selectionWeight": 0.43020226471521067,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 26.833333333333332, "throughputPerHour": 25.833333333333332,
"waiting": 4319 "waiting": 4317
}, },
"Cambricon_mlu-370-x4": { "Cambricon_mlu-370-x4": {
"available": true, "available": true,
"backlogHours": 1173.7241379310344, "backlogHours": 1160.3181818181818,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Cambricon_mlu-370-x4", "gpu": "Cambricon_mlu-370-x4",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 7, "maxConcurrentTasks": 7,
"qualityFactor": 0.31790178342745007, "qualityFactor": 0.3307351999236407,
"queueFactor": 0.973541412611454, "queueFactor": 0.9717119785396618,
"queueWeight": 0.973541412611454, "queueWeight": 0.9717119785396618,
"recentSuccess": 17, "recentSuccess": 18,
"recentSuccessRate": 0.19540229885057472, "recentSuccessRate": 0.20454545454545456,
"recentTerminal": 87, "recentTerminal": 88,
"recentWilsonLowerBound": 0.12573278124165052, "recentWilsonLowerBound": 0.13348619800482903,
"running": 7, "running": 7,
"selectionWeight": 0.30949055130966024, "selectionWeight": 0.3213793554905115,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 14.5, "throughputPerHour": 14.666666666666666,
"waiting": 17019 "waiting": 17018
}, },
"Cambricon_mlu-370-x8": { "Cambricon_mlu-370-x8": {
"available": true, "available": true,
"backlogHours": 373.93288590604027, "backlogHours": 394.8936170212766,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Cambricon_mlu-370-x8", "gpu": "Cambricon_mlu-370-x8",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 7, "maxConcurrentTasks": 7,
"qualityFactor": 0.3968477612465222, "qualityFactor": 0.33943698223482,
"queueFactor": 1.1557669904176398, "queueFactor": 1.14222616401631,
"queueWeight": 1.1557669904176398, "queueWeight": 1.14222616401631,
"recentSuccess": 29, "recentSuccess": 27,
"recentSuccessRate": 0.19463087248322147, "recentSuccessRate": 0.19148936170212766,
"recentTerminal": 149, "recentTerminal": 141,
"recentWilsonLowerBound": 0.13907059958540524, "recentWilsonLowerBound": 0.1350712947551214,
"running": 7, "running": 6,
"selectionWeight": 0.458663542669871, "selectionWeight": 0.3877138021433508,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 24.833333333333332, "throughputPerHour": 23.5,
"waiting": 9286 "waiting": 9280
}, },
"Iluvatar_bi-100": { "Iluvatar_bi-100": {
"available": true, "available": true,
"backlogHours": 71.27547169811321, "backlogHours": 69.88888888888889,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Iluvatar_bi-100", "gpu": "Iluvatar_bi-100",
@@ -558,196 +558,196 @@
"queueFactor": 1.3, "queueFactor": 1.3,
"queueWeight": 1.3, "queueWeight": 1.3,
"recentSuccess": 7, "recentSuccess": 7,
"recentSuccessRate": 0.026415094339622643, "recentSuccessRate": 0.025925925925925925,
"recentTerminal": 265, "recentTerminal": 270,
"recentWilsonLowerBound": 0.012853009402853693, "recentWilsonLowerBound": 0.01261393565316339,
"running": 5, "running": 8,
"selectionWeight": 0.065, "selectionWeight": 0.065,
"stale": false, "stale": false,
"submissionEligible": false, "submissionEligible": false,
"throughputPerHour": 44.166666666666664, "throughputPerHour": 45.0,
"waiting": 3148 "waiting": 3145
}, },
"Iluvatar_bi-150": { "Iluvatar_bi-150": {
"available": true, "available": true,
"backlogHours": 189.60591133004925, "backlogHours": 183.8,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Iluvatar_bi-150", "gpu": "Iluvatar_bi-150",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 50, "maxConcurrentTasks": 50,
"qualityFactor": 0.2772764436272968, "qualityFactor": 0.31527768607505446,
"queueFactor": 1.2797099737430289, "queueFactor": 1.2810683303156873,
"queueWeight": 1.2797099737430289, "queueWeight": 1.2810683303156873,
"recentSuccess": 33, "recentSuccess": 37,
"recentSuccessRate": 0.1625615763546798, "recentSuccessRate": 0.1761904761904762,
"recentTerminal": 203, "recentTerminal": 210,
"recentWilsonLowerBound": 0.11815650006559465, "recentWilsonLowerBound": 0.13061337248865776,
"running": 2, "running": 4,
"selectionWeight": 0.3548334303938484, "selectionWeight": 0.4038922588859635,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 33.833333333333336, "throughputPerHour": 35.0,
"waiting": 6415 "waiting": 6433
}, },
"Iluvatar_mrv-100": { "Iluvatar_mrv-100": {
"available": true, "available": true,
"backlogHours": 2021.6086956521738, "backlogHours": 2021.7391304347825,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Iluvatar_mrv-100", "gpu": "Iluvatar_mrv-100",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 2, "maxConcurrentTasks": 2,
"qualityFactor": 0.7957234284557874, "qualityFactor": 0.5868791703116154,
"queueFactor": 0.8972940153812214, "queueFactor": 0.8940572999305172,
"queueWeight": 0.8972940153812214, "queueWeight": 0.8940572999305172,
"recentSuccess": 14, "recentSuccess": 13,
"recentSuccessRate": 0.30434782608695654, "recentSuccessRate": 0.2826086956521739,
"recentTerminal": 46, "recentTerminal": 46,
"recentWilsonLowerBound": 0.190796708074489, "recentWilsonLowerBound": 0.1732404154491407,
"running": 2, "running": 2,
"selectionWeight": 0.7139978702520056, "selectionWeight": 0.524703606394265,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 7.666666666666667, "throughputPerHour": 7.666666666666667,
"waiting": 15499 "waiting": 15500
}, },
"Kunlunxin_p-800": { "Kunlunxin_p-800": {
"available": true, "available": true,
"backlogHours": 405.2205882352941, "backlogHours": 405.0441176470588,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Kunlunxin_p-800", "gpu": "Kunlunxin_p-800",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 8, "maxConcurrentTasks": 8,
"qualityFactor": 0.32908900725629964, "qualityFactor": 0.3683257930701287,
"queueFactor": 1.1419198183411587, "queueFactor": 1.1378860459498426,
"queueWeight": 1.1419198183411587, "queueWeight": 1.1378860459498426,
"recentSuccess": 25, "recentSuccess": 27,
"recentSuccessRate": 0.18382352941176472, "recentSuccessRate": 0.19852941176470587,
"recentTerminal": 136, "recentTerminal": 136,
"recentWilsonLowerBound": 0.127725020783369, "recentWilsonLowerBound": 0.14018035078929256,
"running": 8, "running": 8,
"selectionWeight": 0.37579325938418595, "selectionWeight": 0.41911278029790866,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 22.666666666666668, "throughputPerHour": 22.666666666666668,
"waiting": 9185 "waiting": 9181
}, },
"MetaX_c-500": { "MetaX_c-500": {
"available": true, "available": true,
"backlogHours": 543.2, "backlogHours": 529.7560975609756,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "MetaX_c-500", "gpu": "MetaX_c-500",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 4, "maxConcurrentTasks": 4,
"qualityFactor": 0.309997976263944, "qualityFactor": 0.3377898282742256,
"queueFactor": 1.092811789254245, "queueFactor": 1.0929812869842173,
"queueWeight": 1.092811789254245, "queueWeight": 1.0929812869842173,
"recentSuccess": 22, "recentSuccess": 24,
"recentSuccessRate": 0.18333333333333332, "recentSuccessRate": 0.1951219512195122,
"recentTerminal": 120, "recentTerminal": 123,
"recentWilsonLowerBound": 0.12430210244218538, "recentWilsonLowerBound": 0.1347729686621224,
"running": 4, "running": 4,
"selectionWeight": 0.3387694431061956, "selectionWeight": 0.36919796123734083,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 20.0, "throughputPerHour": 20.5,
"waiting": 10864 "waiting": 10860
}, },
"Mthreads_s4000": { "Mthreads_s4000": {
"available": true, "available": true,
"backlogHours": 1948.2985074626868, "backlogHours": 1948.8358208955226,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Mthreads_s4000", "gpu": "Mthreads_s4000",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 4, "maxConcurrentTasks": 4,
"qualityFactor": 2.5, "qualityFactor": 2.5,
"queueFactor": 0.9022793355405623, "queueFactor": 0.898996152400354,
"queueWeight": 0.9022793355405623, "queueWeight": 0.898996152400354,
"recentSuccess": 29, "recentSuccess": 30,
"recentSuccessRate": 0.43283582089552236, "recentSuccessRate": 0.44776119402985076,
"recentTerminal": 67, "recentTerminal": 67,
"recentWilsonLowerBound": 0.32104123341736546, "recentWilsonLowerBound": 0.33476201784797566,
"running": 4, "running": 4,
"selectionWeight": 2.255698338851406, "selectionWeight": 2.247490381000885,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 11.166666666666666, "throughputPerHour": 11.166666666666666,
"waiting": 21756 "waiting": 21762
}, },
"Sunrise_pt-200-x1": { "Sunrise_pt-200-x1": {
"available": true, "available": true,
"backlogHours": 3020.470588235294, "backlogHours": 3111.6363636363635,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Sunrise_pt-200-x1", "gpu": "Sunrise_pt-200-x1",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 2, "maxConcurrentTasks": 2,
"qualityFactor": 0.07318814858603309, "qualityFactor": 0.07141339080132725,
"queueFactor": 0.8448471513252497, "queueFactor": 0.8380613174927585,
"queueWeight": 0.8448471513252497, "queueWeight": 0.8380613174927585,
"recentSuccess": 5, "recentSuccess": 5,
"recentSuccessRate": 0.14705882352941177, "recentSuccessRate": 0.15151515151515152,
"recentTerminal": 34, "recentTerminal": 33,
"recentWilsonLowerBound": 0.06449346382626417, "recentWilsonLowerBound": 0.06650359257960956,
"running": 2, "running": 2,
"selectionWeight": 0.061832798843679156, "selectionWeight": 0.059848800381585555,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 5.666666666666667, "throughputPerHour": 5.5,
"waiting": 17116 "waiting": 17114
}, },
"Vastai_va16": { "Vastai_va16": {
"available": true, "available": true,
"backlogHours": 1021.1399999999999, "backlogHours": 963.5094339622641,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Vastai_va16", "gpu": "Vastai_va16",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 16, "maxConcurrentTasks": 16,
"qualityFactor": 0.05, "qualityFactor": 0.05,
"queueFactor": 0.9940919167161827, "queueFactor": 0.9991845851250161,
"queueWeight": 0.9940919167161827, "queueWeight": 0.9991845851250161,
"recentSuccess": 2, "recentSuccess": 3,
"recentSuccessRate": 0.02, "recentSuccessRate": 0.02830188679245283,
"recentTerminal": 100, "recentTerminal": 106,
"recentWilsonLowerBound": 0.005501852234968184, "recentWilsonLowerBound": 0.00967110864461902,
"running": 16, "running": 16,
"selectionWeight": 0.049704595835809134, "selectionWeight": 0.049959229256250806,
"stale": false, "stale": false,
"submissionEligible": false, "submissionEligible": false,
"throughputPerHour": 16.666666666666668, "throughputPerHour": 17.666666666666668,
"waiting": 17019 "waiting": 17022
}, },
"hygon_k100-ai": { "hygon_k100-ai": {
"available": true, "available": true,
"backlogHours": 1249.5882352941176, "backlogHours": 1261.7227722772277,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "hygon_k100-ai", "gpu": "hygon_k100-ai",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 6, "maxConcurrentTasks": 6,
"qualityFactor": 1.2214419979697482, "qualityFactor": 1.0475316176996587,
"queueFactor": 0.9644379618123488, "queueFactor": 0.9595763370689031,
"queueWeight": 0.9644379618123488, "queueWeight": 0.9595763370689031,
"recentSuccess": 32, "recentSuccess": 31,
"recentSuccessRate": 0.3137254901960784, "recentSuccessRate": 0.3069306930693069,
"recentTerminal": 102, "recentTerminal": 101,
"recentWilsonLowerBound": 0.23182840733684665, "recentWilsonLowerBound": 0.22543494459305355,
"running": 6, "running": 5,
"selectionWeight": 1.178005030993947, "selectionWeight": 1.005186552676101,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 17.0, "throughputPerHour": 16.833333333333332,
"waiting": 21243 "waiting": 21239
} }
}, },
"queueAttemptedAt": "2026-10-08T01:35:55.089274+00:00", "queueAttemptedAt": "2026-10-08T01:46:32.554265+00:00",
"queueError": null, "queueError": null,
"queueUpdatedAt": "2026-10-08T01:35:55.089274+00:00", "queueUpdatedAt": "2026-10-08T01:46:32.554265+00:00",
"supportedGpus": [ "supportedGpus": [
"Vastai_va16", "Vastai_va16",
"Cambricon_mlu-370-x4", "Cambricon_mlu-370-x4",

File diff suppressed because it is too large Load Diff

View File

@@ -1,6 +1,6 @@
{ {
"generatedAt": "2026-10-08T01:25:54.828105+00:00", "generatedAt": "2026-10-08T01:44:44.903864+00:00",
"lastSyncTime": "2026-10-08T01:25:54.566312+00:00", "lastSyncTime": "2026-10-08T01:44:44.644735+00:00",
"recentLimit": 300, "recentLimit": 300,
"report": { "report": {
"architectureCompatibilityBlocks": { "architectureCompatibilityBlocks": {
@@ -403,7 +403,7 @@
"ascend_910-b4|vllm_tokenizer_patch|text-generation|model_type:mini_k3": { "ascend_910-b4|vllm_tokenizer_patch|text-generation|model_type:mini_k3": {
"architectureSignature": "model_type:mini_k3", "architectureSignature": "model_type:mini_k3",
"architectures": [], "architectures": [],
"evidenceCount": 2, "evidenceCount": 4,
"expiresAt": "2026-10-21T19:05:50.437924+00:00", "expiresAt": "2026-10-21T19:05:50.437924+00:00",
"framework": "vllm_tokenizer_patch", "framework": "vllm_tokenizer_patch",
"latestFailureAt": "2026-09-21T19:05:50.437924+00:00", "latestFailureAt": "2026-09-21T19:05:50.437924+00:00",
@@ -412,11 +412,15 @@
"modelType": "mini_k3", "modelType": "mini_k3",
"sourceModelIds": [ "sourceModelIds": [
"nkkbr/Mini-K3-1H-decay-g16-v2_B", "nkkbr/Mini-K3-1H-decay-g16-v2_B",
"nkkbr/Mini-K3-1H-attnres-block6-v1_C" "nkkbr/Mini-K3-1H-attnres-block6-v1_C",
"nkkbr/Mini-K3-1H-attnres-standard-v1_B",
"nkkbr/Mini-K3-1H-decay-g1-v2_B"
], ],
"sourceTaskIds": [ "sourceTaskIds": [
"5006050", "5006050",
"5006054" "5006054",
"5006051",
"5005585"
], ],
"targetGpu": "Ascend_910-b4", "targetGpu": "Ascend_910-b4",
"taskType": "text-generation" "taskType": "text-generation"
@@ -3200,18 +3204,18 @@
"unresolvedFailureCount": 17 "unresolvedFailureCount": 17
}, },
"Ascend_910-b4|vllm_tokenizer_patch|text-generation": { "Ascend_910-b4|vllm_tokenizer_patch|text-generation": {
"attributableFailureCount": 34, "attributableFailureCount": 36,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 34, "decisionTotal": 36,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 101, "ambiguous_runtime": 101,
"framework_architecture_unsupported": 33, "framework_architecture_unsupported": 35,
"platform_infrastructure": 1, "platform_infrastructure": 1,
"repository_structure": 1, "repository_structure": 1,
"参数/模板问题": 6 "参数/模板问题": 6
}, },
"failureCount": 142, "failureCount": 144,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm_tokenizer_patch", "framework": "vllm_tokenizer_patch",
"pendingCount": 0, "pendingCount": 0,
@@ -3221,7 +3225,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Ascend_910-b4", "targetGpu": "Ascend_910-b4",
"taskType": "text-generation", "taskType": "text-generation",
"total": 142, "total": 144,
"unresolvedFailureCount": 107 "unresolvedFailureCount": 107
}, },
"Ascend_910-b4|vllm|text-generation": { "Ascend_910-b4|vllm|text-generation": {
@@ -5767,15 +5771,15 @@
"unresolvedFailureCount": 395 "unresolvedFailureCount": 395
}, },
"vllm_tokenizer_patch": { "vllm_tokenizer_patch": {
"attributableFailureCount": 159, "attributableFailureCount": 161,
"decisionFailureRate": 0.9408, "decisionFailureRate": 0.9415,
"decisionSuccessRate": 0.0592, "decisionSuccessRate": 0.0585,
"decisionTotal": 169, "decisionTotal": 171,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 208, "ambiguous_runtime": 208,
"backend_operator": 15, "backend_operator": 15,
"context_length": 9, "context_length": 9,
"framework_architecture_unsupported": 101, "framework_architecture_unsupported": 103,
"memory_capacity": 2, "memory_capacity": 2,
"model_load": 24, "model_load": 24,
"platform_infrastructure": 3, "platform_infrastructure": 3,
@@ -5784,18 +5788,18 @@
"tokenizer_compatibility": 2, "tokenizer_compatibility": 2,
"参数/模板问题": 49 "参数/模板问题": 49
}, },
"failureCount": 419, "failureCount": 421,
"failureRate": 0.9767, "failureRate": 0.9768,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 3, "platformFailureCount": 3,
"successCount": 10, "successCount": 10,
"successRate": 0.0233, "successRate": 0.0232,
"total": 429, "total": 431,
"unresolvedFailureCount": 257 "unresolvedFailureCount": 257
} }
}, },
"generatedAt": "2026-10-08T01:25:54.813489+00:00", "generatedAt": "2026-10-08T01:44:44.889651+00:00",
"gpuSummaries": { "gpuSummaries": {
"Ascend_910-b3": { "Ascend_910-b3": {
"attributableFailureCount": 121, "attributableFailureCount": 121,
@@ -5825,14 +5829,14 @@
"unresolvedFailureCount": 232 "unresolvedFailureCount": 232
}, },
"Ascend_910-b4": { "Ascend_910-b4": {
"attributableFailureCount": 333, "attributableFailureCount": 335,
"decisionFailureRate": 0.8388, "decisionFailureRate": 0.8396,
"decisionSuccessRate": 0.1612, "decisionSuccessRate": 0.1604,
"decisionTotal": 397, "decisionTotal": 399,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 251, "ambiguous_runtime": 251,
"context_length": 1, "context_length": 1,
"framework_architecture_unsupported": 189, "framework_architecture_unsupported": 191,
"memory_capacity": 19, "memory_capacity": 19,
"model_load": 85, "model_load": 85,
"platform_infrastructure": 3, "platform_infrastructure": 3,
@@ -5842,14 +5846,14 @@
"日志缺失": 14, "日志缺失": 14,
"验证失败": 175 "验证失败": 175
}, },
"failureCount": 1045, "failureCount": 1047,
"failureRate": 0.9423, "failureRate": 0.9424,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 3, "platformFailureCount": 3,
"successCount": 64, "successCount": 64,
"successRate": 0.0577, "successRate": 0.0576,
"total": 1109, "total": 1111,
"unresolvedFailureCount": 709 "unresolvedFailureCount": 709
}, },
"Biren_166m": { "Biren_166m": {
@@ -8052,14 +8056,14 @@
"unresolvedFailureCount": 6 "unresolvedFailureCount": 6
}, },
"Ascend_910-b4|vllm_tokenizer_patch|text-generation|mini_k3|none": { "Ascend_910-b4|vllm_tokenizer_patch|text-generation|mini_k3|none": {
"attributableFailureCount": 2, "attributableFailureCount": 4,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 2, "decisionTotal": 4,
"failureBreakdown": { "failureBreakdown": {
"framework_architecture_unsupported": 2 "framework_architecture_unsupported": 4
}, },
"failureCount": 2, "failureCount": 4,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm_tokenizer_patch", "framework": "vllm_tokenizer_patch",
"modelType": "mini_k3", "modelType": "mini_k3",
@@ -8071,7 +8075,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Ascend_910-b4", "targetGpu": "Ascend_910-b4",
"taskType": "text-generation", "taskType": "text-generation",
"total": 2, "total": 4,
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"Ascend_910-b4|vllm_tokenizer_patch|text-generation|mistral3|none": { "Ascend_910-b4|vllm_tokenizer_patch|text-generation|mistral3|none": {
@@ -25531,9 +25535,9 @@
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 0, "decisionTotal": 0,
"failureBreakdown": { "failureBreakdown": {
"参数/模板问题": 2 "参数/模板问题": 1
}, },
"failureCount": 2, "failureCount": 1,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "unknown", "framework": "unknown",
"lastPlatformFailureAt": null, "lastPlatformFailureAt": null,
@@ -25545,8 +25549,8 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Ascend_910-b3", "targetGpu": "Ascend_910-b3",
"taskType": "text-generation", "taskType": "text-generation",
"total": 2, "total": 1,
"unresolvedFailureCount": 2 "unresolvedFailureCount": 1
}, },
"Ascend_910-b3|vllm_tokenizer_patch|text-generation": { "Ascend_910-b3|vllm_tokenizer_patch|text-generation": {
"attributableFailureCount": 7, "attributableFailureCount": 7,
@@ -25602,17 +25606,17 @@
"unresolvedFailureCount": 2 "unresolvedFailureCount": 2
}, },
"Ascend_910-b4|vllm_tokenizer_patch|text-generation": { "Ascend_910-b4|vllm_tokenizer_patch|text-generation": {
"attributableFailureCount": 2, "attributableFailureCount": 4,
"consecutiveFailures": 2, "consecutiveFailures": 4,
"consecutivePlatformFailures": 0, "consecutivePlatformFailures": 0,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 2, "decisionTotal": 4,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 11, "ambiguous_runtime": 11,
"framework_architecture_unsupported": 2 "framework_architecture_unsupported": 4
}, },
"failureCount": 13, "failureCount": 15,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm_tokenizer_patch", "framework": "vllm_tokenizer_patch",
"lastPlatformFailureAt": null, "lastPlatformFailureAt": null,
@@ -25624,7 +25628,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Ascend_910-b4", "targetGpu": "Ascend_910-b4",
"taskType": "text-generation", "taskType": "text-generation",
"total": 13, "total": 15,
"unresolvedFailureCount": 11 "unresolvedFailureCount": 11
}, },
"Ascend_910-b4|vllm|text-generation": { "Ascend_910-b4|vllm|text-generation": {
@@ -25737,10 +25741,10 @@
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 0, "decisionTotal": 0,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 6, "ambiguous_runtime": 5,
"参数/模板问题": 1 "参数/模板问题": 1
}, },
"failureCount": 7, "failureCount": 6,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm-mlu", "framework": "vllm-mlu",
"lastPlatformFailureAt": null, "lastPlatformFailureAt": null,
@@ -25752,8 +25756,8 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x4", "targetGpu": "Cambricon_mlu-370-x4",
"taskType": "text-generation", "taskType": "text-generation",
"total": 7, "total": 6,
"unresolvedFailureCount": 7 "unresolvedFailureCount": 6
}, },
"Cambricon_mlu-370-x4|vllm|text-generation": { "Cambricon_mlu-370-x4|vllm|text-generation": {
"attributableFailureCount": 2, "attributableFailureCount": 2,
@@ -26686,15 +26690,15 @@
"unresolvedFailureCount": 10 "unresolvedFailureCount": 10
}, },
"Ascend_910-b4|vllm_tokenizer_patch|text-generation|mini_k3|none": { "Ascend_910-b4|vllm_tokenizer_patch|text-generation|mini_k3|none": {
"attributableFailureCount": 2, "attributableFailureCount": 4,
"consecutiveFailures": 2, "consecutiveFailures": 4,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 2, "decisionTotal": 4,
"failureBreakdown": { "failureBreakdown": {
"framework_architecture_unsupported": 2 "framework_architecture_unsupported": 4
}, },
"failureCount": 2, "failureCount": 4,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm_tokenizer_patch", "framework": "vllm_tokenizer_patch",
"lastTerminalAt": "2026-10-07T17:46:09.953381+00:00", "lastTerminalAt": "2026-10-07T17:46:09.953381+00:00",
@@ -26707,7 +26711,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Ascend_910-b4", "targetGpu": "Ascend_910-b4",
"taskType": "text-generation", "taskType": "text-generation",
"total": 2, "total": 4,
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"Ascend_910-b4|vllm|text-generation|llama|compressed-tensors": { "Ascend_910-b4|vllm|text-generation|llama|compressed-tensors": {
@@ -27060,31 +27064,6 @@
"total": 1, "total": 1,
"unresolvedFailureCount": 1 "unresolvedFailureCount": 1
}, },
"Cambricon_mlu-370-x4|vllm-mlu|text-generation|starcoder2|compressed-tensors": {
"attributableFailureCount": 0,
"consecutiveFailures": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm-mlu",
"lastTerminalAt": "2026-09-26T01:14:46.157729+00:00",
"modelType": "starcoder2",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x4",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
},
"Cambricon_mlu-370-x4|vllm|text-generation|lfm2|none": { "Cambricon_mlu-370-x4|vllm|text-generation|lfm2|none": {
"attributableFailureCount": 1, "attributableFailureCount": 1,
"consecutiveFailures": 1, "consecutiveFailures": 1,
@@ -32649,14 +32628,14 @@
"unresolvedFailureCount": 5 "unresolvedFailureCount": 5
}, },
"Ascend_910-b4|vllm_tokenizer_patch|text-generation|mini_k3|none|30": { "Ascend_910-b4|vllm_tokenizer_patch|text-generation|mini_k3|none|30": {
"attributableFailureCount": 2, "attributableFailureCount": 4,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 2, "decisionTotal": 4,
"failureBreakdown": { "failureBreakdown": {
"framework_architecture_unsupported": 2 "framework_architecture_unsupported": 4
}, },
"failureCount": 2, "failureCount": 4,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm_tokenizer_patch", "framework": "vllm_tokenizer_patch",
"loadSizeLog2Bucket": 30, "loadSizeLog2Bucket": 30,
@@ -32669,7 +32648,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Ascend_910-b4", "targetGpu": "Ascend_910-b4",
"taskType": "text-generation", "taskType": "text-generation",
"total": 2, "total": 4,
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"Ascend_910-b4|vllm_tokenizer_patch|text-generation|mistral3|none|34": { "Ascend_910-b4|vllm_tokenizer_patch|text-generation|mistral3|none|34": {
@@ -58981,20 +58960,20 @@
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
} }
}, },
"terminalRecords": 17443, "terminalRecords": 17445,
"totalRecords": 17825, "totalRecords": 17827,
"totals": { "totals": {
"attributableFailureCount": 6267, "attributableFailureCount": 6269,
"decisionFailureRate": 0.8649, "decisionFailureRate": 0.8649,
"decisionSuccessRate": 0.1351, "decisionSuccessRate": 0.1351,
"decisionTotal": 7246, "decisionTotal": 7248,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 4581, "ambiguous_runtime": 4581,
"architecture_compatibility": 212, "architecture_compatibility": 212,
"attention_backend": 3, "attention_backend": 3,
"backend_operator": 130, "backend_operator": 130,
"context_length": 327, "context_length": 327,
"framework_architecture_unsupported": 2285, "framework_architecture_unsupported": 2287,
"memory_capacity": 1206, "memory_capacity": 1206,
"model_load": 571, "model_load": 571,
"platform_infrastructure": 955, "platform_infrastructure": 955,
@@ -59005,14 +58984,14 @@
"日志缺失": 719, "日志缺失": 719,
"验证失败": 676 "验证失败": 676
}, },
"failureCount": 16464, "failureCount": 16466,
"failureRate": 0.9439, "failureRate": 0.9439,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 955, "platformFailureCount": 955,
"successCount": 979, "successCount": 979,
"successRate": 0.0561, "successRate": 0.0561,
"total": 17443, "total": 17445,
"unresolvedFailureCount": 9242 "unresolvedFailureCount": 9242
}, },
"warnings": [ "warnings": [
@@ -59022,14 +59001,14 @@
"GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。", "GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Kunlunxin_p-800 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Kunlunxin_p-800 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_bi-100 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Iluvatar_bi-100 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。",
"组合 Vastai_va16|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Vastai_va16|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Ascend_910-b3|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Ascend_910-b3|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Iluvatar_mrv-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Iluvatar_mrv-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -59075,6 +59054,6 @@
] ]
}, },
"storageMode": "decision_state_only", "storageMode": "decision_state_only",
"summarizedRecords": 17825, "summarizedRecords": 17827,
"version": 1 "version": 1
} }

View File

@@ -130,8 +130,10 @@
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T14:24:51.661617+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19329296879}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:05:50.745520+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006056", "taskType": "text-generation", "verifyResult": -1} {"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T14:24:51.661617+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19329296879}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:05:50.745520+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006056", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-07T17:46:09.953381+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:05:50.437924+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006050", "taskType": "text-generation", "verifyResult": -1} {"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-07T17:46:09.953381+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:05:50.437924+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006050", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-07T17:46:09.953349+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:05:50.435859+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006054", "taskType": "text-generation", "verifyResult": -1} {"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-07T17:46:09.953349+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:05:50.435859+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006054", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T01:44:44.644712+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:05:50.391206+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006051", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-23T23:59:25.752461+00:00", "modelId": "nm-testing/Qwen2-1.5B-Instruct-FP8W8", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2245332464, "estimatedRequiredGiB": 2.522, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 2256814377, "modelscopeLicense": null, "modelscopeParams": 1777088000, "modelscopeTags": ["model_type:qwen2", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2256814377}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:50:52.437033+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005783", "taskType": "text-generation", "verifyResult": -1} {"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-23T23:59:25.752461+00:00", "modelId": "nm-testing/Qwen2-1.5B-Instruct-FP8W8", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2245332464, "estimatedRequiredGiB": 2.522, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 2256814377, "modelscopeLicense": null, "modelscopeParams": 1777088000, "modelscopeTags": ["model_type:qwen2", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2256814377}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:50:52.437033+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005783", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-23T19:08:31.650327+00:00", "modelId": "nm-testing/tinyllama-one-shot-w4a16-group-packed", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "d8df464812ff2fd3c46dc89b0fc6a96370e694fab8e52179f1ada2cdd0ea92b9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1047023664, "estimatedRequiredGiB": 1.172, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 1048871402, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 1048871402}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:50:52.306184+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005756", "taskType": "text-generation", "verifyResult": -1} {"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-23T19:08:31.650327+00:00", "modelId": "nm-testing/tinyllama-one-shot-w4a16-group-packed", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "d8df464812ff2fd3c46dc89b0fc6a96370e694fab8e52179f1ada2cdd0ea92b9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1047023664, "estimatedRequiredGiB": 1.172, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 1048871402, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 1048871402}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:50:52.306184+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005756", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T01:44:44.644735+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030685704, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039047610}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:38:19.113576+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5005585", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "missing_structured_error_code", "failureCode": null, "failureDetectedFramework": "transformers", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "transformers", "lastSyncTime": "2026-09-22T04:16:12.463726+00:00", "modelId": "RedHatAI/starcoder2-15b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 17785269848, "estimatedRequiredGiB": 19.88, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 17788663591, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 15957889024, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 17788663591}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:32:49.780633+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5005549", "taskType": "text-generation", "verifyResult": -1} {"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "missing_structured_error_code", "failureCode": null, "failureDetectedFramework": "transformers", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "transformers", "lastSyncTime": "2026-09-22T04:16:12.463726+00:00", "modelId": "RedHatAI/starcoder2-15b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 17785269848, "estimatedRequiredGiB": 19.88, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 17788663591, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 15957889024, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 17788663591}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:32:49.780633+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5005549", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-24T10:56:20.956238+00:00", "modelId": "aisingapore/SEA-LION-v1-7B-IT-GPTQ", "modelProfile": {"architectures": ["MPTForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5469228368, "estimatedRequiredGiB": 6.118, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mpt", "modelscopeFileSize": 5473985594, "modelscopeLicense": "mit", "modelscopeParams": 1922048000, "modelscopeTags": ["license:mit", "model_type:mpt", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5473985594}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:24:26.638177+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005440", "taskType": "text-generation", "verifyResult": -1} {"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-24T10:56:20.956238+00:00", "modelId": "aisingapore/SEA-LION-v1-7B-IT-GPTQ", "modelProfile": {"architectures": ["MPTForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5469228368, "estimatedRequiredGiB": 6.118, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mpt", "modelscopeFileSize": 5473985594, "modelscopeLicense": "mit", "modelscopeParams": 1922048000, "modelscopeTags": ["license:mit", "model_type:mpt", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5473985594}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:24:26.638177+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005440", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "backend_operator", "failureAction": "prefer_other_proven_framework_or_gpu", "failureCategory": "backend_operator", "failureClassificationReason": "backend_version_dependent", "failureCode": "MISSING_OPERATOR", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-23T10:53:27.671921+00:00", "modelId": "RedHatAI/Meta-Llama-3.1-8B-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9084040952, "estimatedRequiredGiB": 10.163, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9093251763, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9093251763}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:24:26.526740+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005439", "taskType": "text-generation", "verifyResult": -1} {"failReason": "backend_operator", "failureAction": "prefer_other_proven_framework_or_gpu", "failureCategory": "backend_operator", "failureClassificationReason": "backend_version_dependent", "failureCode": "MISSING_OPERATOR", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-23T10:53:27.671921+00:00", "modelId": "RedHatAI/Meta-Llama-3.1-8B-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9084040952, "estimatedRequiredGiB": 10.163, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9093251763, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9093251763}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T18:24:26.526740+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005439", "taskType": "text-generation", "verifyResult": -1}
@@ -296,5 +298,3 @@
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5_moe"], "framework": "vllm", "lastSyncTime": "2026-09-21T10:33:30.477632+00:00", "modelId": "ornith-ai/Ornith-1.5-35B-A3B-MLX-8bit", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T10:23:21+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4609105", "taskType": "text-generation", "verifyResult": -1} {"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5_moe"], "framework": "vllm", "lastSyncTime": "2026-09-21T10:33:30.477632+00:00", "modelId": "ornith-ai/Ornith-1.5-35B-A3B-MLX-8bit", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T10:23:21+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4609105", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-24T10:35:03.454820+00:00", "modelId": "aisingapore/SEA-LION-v1-7B-IT-Research", "modelProfile": {"architectures": ["MPTForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 15003361968, "estimatedRequiredGiB": 16.773, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mpt", "modelscopeFileSize": 15008118474, "modelscopeLicense": "cc-by-nc-sa-4.0", "modelscopeParams": 7501651968, "modelscopeTags": ["license:cc-by-nc-sa-4.0", "model_type:mpt", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 15008118474}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T10:17:52.663711+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4999054", "taskType": "text-generation", "verifyResult": -1} {"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-24T10:35:03.454820+00:00", "modelId": "aisingapore/SEA-LION-v1-7B-IT-Research", "modelProfile": {"architectures": ["MPTForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 15003361968, "estimatedRequiredGiB": 16.773, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mpt", "modelscopeFileSize": 15008118474, "modelscopeLicense": "cc-by-nc-sa-4.0", "modelscopeParams": 7501651968, "modelscopeTags": ["license:cc-by-nc-sa-4.0", "model_type:mpt", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 15008118474}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T10:17:52.663711+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4999054", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5"], "framework": "vllm", "lastSyncTime": "2026-09-21T10:33:30.477558+00:00", "modelId": "Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality-FP16", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T10:15:21+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4582656", "taskType": "text-generation", "verifyResult": -1} {"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5"], "framework": "vllm", "lastSyncTime": "2026-09-21T10:33:30.477558+00:00", "modelId": "Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality-FP16", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T10:15:21+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4582656", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-mlu", "lastSyncTime": "2026-09-26T01:14:46.157729+00:00", "modelId": "neuralmagic/starcoder2-3b-quantized.w8a8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4093158536, "estimatedRequiredGiB": 4.578, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 4096457730, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 3181366272, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4096457730}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T10:13:37.540416+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4998917", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "", "lastSyncTime": "2026-09-21T09:54:21.980346+00:00", "modelId": "mlx-community/gemma-4-e4b-it-OptiQ-4bit", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T09:52:44+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4969634", "taskType": "text-generation", "verifyResult": null}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -2,24 +2,24 @@
"agentVersion": "2026.09.04.4", "agentVersion": "2026.09.04.4",
"checksums": { "checksums": {
".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1", ".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1",
".modelhub_state/architecture_compatibility_blacklist.json": "3e50d32b88c6a9b047422b5fb3071b3fabbdb1db72590d4534b89470bf79414d", ".modelhub_state/architecture_compatibility_blacklist.json": "f2be3392740358d2e4f9e803dff58b05fb8ba1f9fa56abee6e93bdb2cc3d0331",
".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab", ".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab",
".modelhub_state/market_intelligence.json": "e0b330c8487cefb1c55a4c69f2b29bff715a1dfd0d05befb5d9a1054498d19ca", ".modelhub_state/market_intelligence.json": "048c761cd649c80274686ba8d83de0b7207c76e28b72eafd246a34cb46eaee6c",
".modelhub_state/official_capabilities.json": "3a23eba3e53af7786815b1edc35ee7ebe74641adcb61c06e79bb07f720a422ca", ".modelhub_state/official_capabilities.json": "e25b38075256d619aaf8cb9250a5aabecab56f9a356eda082ad8ad368be69d10",
".modelhub_state/outcome_checkpoint.json": "1d4fe686a2da044bb5e3b909aa631d46bc14c80a77bdb9fde22ca466517e3d03", ".modelhub_state/outcome_checkpoint.json": "93a12fbd061eb8ef577c2b725fa7229707f3da881b4d8a6bb92876be1143e0bb",
".modelhub_state/queue_cleanup_latest.json": "568ae8813ea4bc8c494aef8be02f77b1c9756ab49dd7d307b81483e6cca30468", ".modelhub_state/queue_cleanup_latest.json": "568ae8813ea4bc8c494aef8be02f77b1c9756ab49dd7d307b81483e6cca30468",
".modelhub_state/recent_outcomes.jsonl": "6b4944e4f9fbaef27d7d2eabd252e63d224d60f4287780d362c7975343d09400", ".modelhub_state/recent_outcomes.jsonl": "151c1fd7f523d7a52581e8e5fb14cdf2dadb2ad7973dad8c5f71163af2c087ce",
".modelhub_state/recovery_active_tasks.jsonl": "f7cff8ef89d827ac32ea9ef24392441b968749a879425d2a42671aaa3d63fbd5", ".modelhub_state/recovery_active_tasks.jsonl": "89885173bb07291f815dacd1f8a07f3bdd6a83f06067c829ca29aa4401d65075",
".modelhub_state/recovery_intents.jsonl": "93ddadc05937531e330927d97727f93b13befe4349f116c9ea0ee6f5d2fee5c3", ".modelhub_state/recovery_intents.jsonl": "82fb97b0069639d80a0aba63758a2f5beae633e715a14d6ed59635910095bc4c",
".modelhub_state/routing_intelligence.json": "a312187abffa011156b64da1fed551d1816329b725ab3f38c5221900b7cc793e", ".modelhub_state/routing_intelligence.json": "a312187abffa011156b64da1fed551d1816329b725ab3f38c5221900b7cc793e",
".modelhub_state/submission_exclusions.jsonl": "dca7091e8b1da8bf9b3ecb95fe573b2a41666601edf86cea13ce9ce738b9eb7b", ".modelhub_state/submission_exclusions.jsonl": "dca7091e8b1da8bf9b3ecb95fe573b2a41666601edf86cea13ce9ce738b9eb7b",
".modelhub_state/worker_crashes.jsonl": "b321ea3648ae6b322601ed30ef8c3b1da0f13612af1bde3a64b0d41dc18a7b9f", ".modelhub_state/worker_crashes.jsonl": "b321ea3648ae6b322601ed30ef8c3b1da0f13612af1bde3a64b0d41dc18a7b9f",
"ledger/submissions.jsonl": "e454fe4d597b7036bd9ad1d21a044f660b72bf85d1370813a7264341281b7126", "ledger/submissions.jsonl": "e454fe4d597b7036bd9ad1d21a044f660b72bf85d1370813a7264341281b7126",
"outcomes/submissions.jsonl": "054014c5c6da461a4bd668a1f4715404c4edfcc8cb647b3910080ddefcf0b348" "outcomes/submissions.jsonl": "3944341e674b30c5c6446b902183cbd39746f49ea28afa4549e7cf314c149166"
}, },
"generation": 22023, "generation": 22024,
"phase": "cycle", "phase": "cycle",
"schemaVersion": 1, "schemaVersion": 1,
"updatedAt": "2026-10-08T01:43:39.934448+00:00", "updatedAt": "2026-10-08T01:52:11.606252+00:00",
"writerId": "33ed03361c5848e88b8ce6204fb4f7d2" "writerId": "33ed03361c5848e88b8ce6204fb4f7d2"
} }

View File

@@ -208,8 +208,6 @@
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T02:22:55.559751+00:00", "modelId": "nm-testing/tinyllama-oneshot-w8-channel-a8-tensor", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1232059012, "estimatedRequiredGiB": 1.379, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 1233907698, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_tokenizer_patch", "lastTerminalAt": "2026-09-21T15:02:24.876390+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Ascend_910-b4", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 1233907698}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T18:22:48.751608+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5005404", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T02:22:55.559751+00:00", "modelId": "nm-testing/tinyllama-oneshot-w8-channel-a8-tensor", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1232059012, "estimatedRequiredGiB": 1.379, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 1233907698, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_tokenizer_patch", "lastTerminalAt": "2026-09-21T15:02:24.876390+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Ascend_910-b4", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 1233907698}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T18:22:48.751608+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5005404", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T02:22:55.559801+00:00", "modelId": "nm-testing/llama7b-one-shot-2_4-w4a16-marlin24-t", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 3054596816, "estimatedRequiredGiB": 3.416, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 3056444703, "modelscopeLicense": null, "modelscopeParams": 1122504704, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 3056444703}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T18:22:48.756508+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005406", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T02:22:55.559801+00:00", "modelId": "nm-testing/llama7b-one-shot-2_4-w4a16-marlin24-t", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 3054596816, "estimatedRequiredGiB": 3.416, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 3056444703, "modelscopeLicense": null, "modelscopeParams": 1122504704, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 3056444703}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T18:22:48.756508+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005406", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T02:26:33.565841+00:00", "modelId": "nm-testing/tinyllama-oneshot-w4a16-channel-v2", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "d8df464812ff2fd3c46dc89b0fc6a96370e694fab8e52179f1ada2cdd0ea92b9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 747618112, "estimatedRequiredGiB": 0.838, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 749466433, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 749466433}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T18:22:48.845075+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005433", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T02:26:33.565841+00:00", "modelId": "nm-testing/tinyllama-oneshot-w4a16-channel-v2", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "d8df464812ff2fd3c46dc89b0fc6a96370e694fab8e52179f1ada2cdd0ea92b9", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 747618112, "estimatedRequiredGiB": 0.838, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 749466433, "modelscopeLicense": null, "modelscopeParams": 1100048384, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 749466433}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T18:22:48.845075+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5005433", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T02:38:53.182724+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030685704, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039047610}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T18:38:19.113576+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5005585", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T03:05:58.563167+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:05:50.391206+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5006051", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T03:05:58.563219+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block2-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042625829}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:05:50.446409+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006046", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T03:05:58.563219+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block2-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042625829}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:05:50.446409+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006046", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T03:05:58.563160+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030685704, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039047610}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:05:50.457742+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006045", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T03:05:58.563160+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030685704, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039047610}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:05:50.457742+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006045", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T03:05:58.563242+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031556216, "estimatedRequiredGiB": 2.28, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039918195}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:05:50.449911+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006044", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T03:05:58.563242+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031556216, "estimatedRequiredGiB": 2.28, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039918195}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T19:05:50.449911+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006044", "taskType": "text-generation", "verifyResult": null}
@@ -926,8 +924,8 @@
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-07T22:01:50.158755+00:00", "modelId": "raincandy-u/MacroStories", "modelProfile": {"architectures": ["OuroForCausalLM"], "configFingerprint": "e4f10af7e21b1a730b2dfa32856745ab0e7a14867778026d61065fda3de90727", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 81364, "estimatedRequiredGiB": 0.0, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "ouro", "modelscopeFileSize": 154520, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:ouro", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:custom-code", "custom_tag:storytelling", "custom_tag:small-language-model", "custom_tag:recurrent-depth", "custom_tag:synthetic-data"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 154520}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T13:56:51.658258+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5355357", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-07T22:01:50.158755+00:00", "modelId": "raincandy-u/MacroStories", "modelProfile": {"architectures": ["OuroForCausalLM"], "configFingerprint": "e4f10af7e21b1a730b2dfa32856745ab0e7a14867778026d61065fda3de90727", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 81364, "estimatedRequiredGiB": 0.0, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "ouro", "modelscopeFileSize": 154520, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:ouro", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:custom-code", "custom_tag:storytelling", "custom_tag:small-language-model", "custom_tag:recurrent-depth", "custom_tag:synthetic-data"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 154520}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T13:56:51.658258+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5355357", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T01:09:06.056731+00:00", "modelId": "OsaurusAI/Raptor-0.6.1-preview-4B-JANG_6M", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 3662928280, "estimatedRequiredGiB": 4.11, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 3677830216, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:jang", "custom_tag:quantized", "custom_tag:apple-silicon", "custom_tag:reasoning", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:spark2_5", "custom_tag:imatrix", "custom_tag:awq", "custom_tag:gptq", "custom_tag:preview"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 3677830216}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:00:35.063304+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358099", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T01:09:06.056731+00:00", "modelId": "OsaurusAI/Raptor-0.6.1-preview-4B-JANG_6M", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 3662928280, "estimatedRequiredGiB": 4.11, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": 3677830216, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:jang", "custom_tag:quantized", "custom_tag:apple-silicon", "custom_tag:reasoning", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:spark2_5", "custom_tag:imatrix", "custom_tag:awq", "custom_tag:gptq", "custom_tag:preview"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 3677830216}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:00:35.063304+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358099", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T01:09:06.056772+00:00", "modelId": "cyankiwi/K2-Horizon-7B-AWQ-FP8", "modelProfile": {"architectures": ["K2HorizonForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11055458328, "estimatedRequiredGiB": 12.381, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "k2_horizon", "modelscopeFileSize": 11077974096, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:k2_horizon", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:k2-horizon", "custom_tag:7b", "custom_tag:dense", "custom_tag:open-weights", "custom_tag:ifm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 11077974096}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:00:35.065401+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358129", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T01:09:06.056772+00:00", "modelId": "cyankiwi/K2-Horizon-7B-AWQ-FP8", "modelProfile": {"architectures": ["K2HorizonForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11055458328, "estimatedRequiredGiB": 12.381, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "k2_horizon", "modelscopeFileSize": 11077974096, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:k2_horizon", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:k2-horizon", "custom_tag:7b", "custom_tag:dense", "custom_tag:open-weights", "custom_tag:ifm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 11077974096}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:00:35.065401+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358129", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "mlx-community/gpt-oss-20b-OptiQ-4bit", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11623702006, "estimatedRequiredGiB": 13.022, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 11651702017, "modelscopeLicense": "apache-2.0", "modelscopeParams": 3982569024, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:openai", "custom_tag:gpt-oss", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:4bit", "custom_tag:mixed-precision", "custom_tag:optiq", "custom_tag:moe", "custom_tag:apple-silicon", "custom_tag:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11651702017}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:15:34.052921+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358545", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T01:44:44.644726+00:00", "modelId": "mlx-community/gpt-oss-20b-OptiQ-4bit", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11623702006, "estimatedRequiredGiB": 13.022, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 11651702017, "modelscopeLicense": "apache-2.0", "modelscopeParams": 3982569024, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:openai", "custom_tag:gpt-oss", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:4bit", "custom_tag:mixed-precision", "custom_tag:optiq", "custom_tag:moe", "custom_tag:apple-silicon", "custom_tag:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11651702017}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:15:34.052921+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358545", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "cyankiwi/K2-Horizon-3.7B-AWQ-INT4", "modelProfile": {"architectures": ["K2HorizonForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4749242120, "estimatedRequiredGiB": 5.332, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "k2_horizon", "modelscopeFileSize": 4771310100, "modelscopeLicense": "apache-2.0", "modelscopeParams": 641597440, "modelscopeTags": ["license:apache-2.0", "model_type:k2_horizon", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:k2-horizon", "custom_tag:3.7b", "custom_tag:dense", "custom_tag:open-weights", "custom_tag:ifm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4771310100}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:17:03.658299+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358570", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-10-08T01:44:44.644687+00:00", "modelId": "cyankiwi/K2-Horizon-3.7B-AWQ-INT4", "modelProfile": {"architectures": ["K2HorizonForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4749242120, "estimatedRequiredGiB": 5.332, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "k2_horizon", "modelscopeFileSize": 4771310100, "modelscopeLicense": "apache-2.0", "modelscopeParams": 641597440, "modelscopeTags": ["license:apache-2.0", "model_type:k2_horizon", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:k2-horizon", "custom_tag:3.7b", "custom_tag:dense", "custom_tag:open-weights", "custom_tag:ifm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4771310100}, "outcome": "pending", "status": "waiting", "submitTime": "2026-10-07T17:17:03.658299+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5358570", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "mlx-community/LFM2.5-1.2B-Thinking-5bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 804816628, "estimatedRequiredGiB": 0.905, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 809580753, "modelscopeLicense": "other", "modelscopeParams": 219544320, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 809580753}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:44:29.668857+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5358695", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "mlx-community/LFM2.5-1.2B-Thinking-5bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 804816628, "estimatedRequiredGiB": 0.905, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 809580753, "modelscopeLicense": "other", "modelscopeParams": 219544320, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 809580753}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:44:29.668857+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5358695", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "mlx-community/LFM2.5-1.2B-Instruct-bf16", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2340697867, "estimatedRequiredGiB": 2.621, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 2345448728, "modelscopeLicense": "other", "modelscopeParams": 1170340608, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2345448728}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:44:30.068704+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5358693", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "mlx-community/LFM2.5-1.2B-Instruct-bf16", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2340697867, "estimatedRequiredGiB": 2.621, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 2345448728, "modelscopeLicense": "other", "modelscopeParams": 1170340608, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2345448728}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:44:30.068704+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5358693", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "raincandy-u/MacroStories", "modelProfile": {"architectures": ["OuroForCausalLM"], "configFingerprint": "785069d14d27b828ee50a34932a2fa1917fd842d075189f20fc7defd52ef2db4", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 81364, "estimatedRequiredGiB": 0.0, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "ouro", "modelscopeFileSize": 154520, "modelscopeLicense": null, "modelscopeParams": 19969, "modelscopeTags": ["model_type:ouro", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:custom-code", "custom_tag:storytelling", "custom_tag:small-language-model", "custom_tag:recurrent-depth", "custom_tag:synthetic-data"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 154520}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:44:29.660022+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5358694", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "raincandy-u/MacroStories", "modelProfile": {"architectures": ["OuroForCausalLM"], "configFingerprint": "785069d14d27b828ee50a34932a2fa1917fd842d075189f20fc7defd52ef2db4", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 81364, "estimatedRequiredGiB": 0.0, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "ouro", "modelscopeFileSize": 154520, "modelscopeLicense": null, "modelscopeParams": 19969, "modelscopeTags": ["model_type:ouro", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:custom-code", "custom_tag:storytelling", "custom_tag:small-language-model", "custom_tag:recurrent-depth", "custom_tag:synthetic-data"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 154520}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-07T17:44:29.660022+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5358694", "taskType": "text-generation", "verifyResult": null}