state: generation 5063 (cycle)

This commit is contained in:
2026-09-10 07:55:17 +00:00
parent b2b7a36ab0
commit 0838dbfe5d
10 changed files with 2437 additions and 2417 deletions

View File

@@ -1317,7 +1317,7 @@
"taskType": "text-generation"
}
},
"generatedAt": "2026-09-10T07:52:10.001876+00:00",
"generatedAt": "2026-09-10T07:55:16.940972+00:00",
"summary": {
"activeBlockCount": 66,
"byGpuFramework": {

View File

@@ -11,7 +11,7 @@
"1": {
"complete": false,
"lastError": "ModelHubAPIError: 系统错误",
"listingErrors": 359,
"listingErrors": 360,
"nextPage": 1,
"recordsScanned": 0,
"uniqueRecords": 0
@@ -102,12 +102,12 @@
"cutoffAt": "2026-09-04T03:55:51.365685+00:00",
"failureLogsInspected": 0,
"mode": "incremental_decision_only",
"nextAccountIndex": 1,
"nextAccountIndex": 2,
"recordsScanned": 0,
"seenTaskIds": [],
"startedAt": "2026-09-04T03:55:51.365685+00:00",
"terminalRecords": 0,
"uniqueRecords": 0,
"updatedAt": "2026-09-10T07:52:09.978320+00:00",
"updatedAt": "2026-09-10T07:55:16.917478+00:00",
"version": 1
}

View File

@@ -1,8 +1,8 @@
{
"communityAttemptedAt": "2026-09-10T07:36:58.618611+00:00",
"communityAttemptedAt": "2026-09-10T07:53:17.152657+00:00",
"communityError": null,
"communitySample": {},
"communityUpdatedAt": "2026-09-10T07:36:58.618611+00:00",
"communityUpdatedAt": "2026-09-10T07:53:17.152657+00:00",
"frameworkAttemptedAt": "2026-09-10T06:33:41.338309+00:00",
"frameworkError": null,
"frameworkStats": {
@@ -416,121 +416,121 @@
}
},
"frameworkUpdatedAt": null,
"generatedAt": "2026-09-10T07:50:38.545442+00:00",
"generatedAt": "2026-09-10T07:53:17.152657+00:00",
"gpuStats": {
"Ascend_910-b3": {
"available": true,
"backlogHours": 1040.7555555555555,
"backlogHours": 1018.3478260869565,
"canVerify": true,
"error": null,
"gpu": "Ascend_910-b3",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 1.0632583209330457,
"queueFactor": 0.9563756960231999,
"queueWeight": 0.9563756960231999,
"recentSuccess": 48,
"recentSuccessRate": 0.35555555555555557,
"recentTerminal": 135,
"recentWilsonLowerBound": 0.2798281692310711,
"qualityFactor": 0.9898710586631865,
"queueFactor": 0.9599137523257513,
"queueWeight": 0.9599137523257513,
"recentSuccess": 49,
"recentSuccessRate": 0.35507246376811596,
"recentTerminal": 138,
"recentWilsonLowerBound": 0.2801466832622453,
"running": 8,
"selectionWeight": 1.0168744167348005,
"selectionWeight": 0.9501908422400431,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 22.5,
"waiting": 23417
"throughputPerHour": 23.0,
"waiting": 23422
},
"Ascend_910-b4": {
"available": true,
"backlogHours": 998.5090909090909,
"backlogHours": 974.9822485207101,
"canVerify": true,
"error": null,
"gpu": "Ascend_910-b4",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 0.7836857077697096,
"queueFactor": 0.9623388930722905,
"queueWeight": 0.9623388930722905,
"recentSuccess": 51,
"recentSuccessRate": 0.3090909090909091,
"recentTerminal": 165,
"recentWilsonLowerBound": 0.24359343748041754,
"qualityFactor": 0.7240453632082984,
"queueFactor": 0.9662002121303903,
"queueWeight": 0.9662002121303903,
"recentSuccess": 52,
"recentSuccessRate": 0.3076923076923077,
"recentTerminal": 169,
"recentWilsonLowerBound": 0.24302579439503535,
"running": 8,
"selectionWeight": 0.7541712365316768,
"selectionWeight": 0.6995727835238834,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 27.5,
"waiting": 27459
"throughputPerHour": 28.166666666666668,
"waiting": 27462
},
"Biren_166m": {
"available": true,
"backlogHours": 149.46368715083798,
"backlogHours": 148.07734806629833,
"canVerify": true,
"error": null,
"gpu": "Biren_166m",
"healthFactor": 1.0,
"maxConcurrentTasks": 8,
"qualityFactor": 0.21178476253994663,
"queueFactor": 1.2795300444658682,
"queueWeight": 1.2795300444658682,
"qualityFactor": 0.19180868807350088,
"queueFactor": 1.2818681017052975,
"queueWeight": 1.2818681017052975,
"recentSuccess": 33,
"recentSuccessRate": 0.18435754189944134,
"recentTerminal": 179,
"recentWilsonLowerBound": 0.13439137422180858,
"running": 8,
"selectionWeight": 0.27098496662993127,
"recentSuccessRate": 0.18232044198895028,
"recentTerminal": 181,
"recentWilsonLowerBound": 0.13286978560440893,
"running": 9,
"selectionWeight": 0.24587343887136212,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 29.833333333333332,
"waiting": 4459
"throughputPerHour": 30.166666666666668,
"waiting": 4467
},
"Cambricon_mlu-370-x4": {
"available": true,
"backlogHours": 999.529411764706,
"backlogHours": 976.6896551724138,
"canVerify": true,
"error": null,
"gpu": "Cambricon_mlu-370-x4",
"healthFactor": 1.0,
"maxConcurrentTasks": 7,
"qualityFactor": 0.3444584829271148,
"queueFactor": 0.9621914755948517,
"queueWeight": 0.9621914755948517,
"qualityFactor": 0.3033122279254653,
"queueFactor": 0.9659466632697774,
"queueWeight": 0.9659466632697774,
"recentSuccess": 21,
"recentSuccessRate": 0.24705882352941178,
"recentTerminal": 85,
"recentWilsonLowerBound": 0.16764498447307555,
"recentSuccessRate": 0.2413793103448276,
"recentTerminal": 87,
"recentWilsonLowerBound": 0.1636404322399915,
"running": 7,
"selectionWeight": 0.33143501596880465,
"selectionWeight": 0.29298343449352543,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 14.166666666666666,
"waiting": 14160
"throughputPerHour": 14.5,
"waiting": 14162
},
"Cambricon_mlu-370-x8": {
"available": true,
"backlogHours": 546.4329896907216,
"backlogHours": 524.970297029703,
"canVerify": true,
"error": null,
"gpu": "Cambricon_mlu-370-x8",
"healthFactor": 1.0,
"maxConcurrentTasks": 7,
"qualityFactor": 0.5530486141583089,
"queueFactor": 1.0534169571969512,
"queueWeight": 1.0534169571969512,
"recentSuccess": 28,
"recentSuccessRate": 0.28865979381443296,
"recentTerminal": 97,
"recentWilsonLowerBound": 0.20790125991766098,
"qualityFactor": 0.5139912305508227,
"queueFactor": 1.0602210559508034,
"queueWeight": 1.0602210559508034,
"recentSuccess": 29,
"recentSuccessRate": 0.2871287128712871,
"recentTerminal": 101,
"recentWilsonLowerBound": 0.20797514306988282,
"running": 7,
"selectionWeight": 0.5825907883086364,
"selectionWeight": 0.5449443252040461,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 16.166666666666668,
"waiting": 8834
"throughputPerHour": 16.833333333333332,
"waiting": 8837
},
"Iluvatar_bi-100": {
"available": true,
"backlogHours": 44.52037617554859,
"backlogHours": 44.3625,
"canVerify": true,
"error": null,
"gpu": "Iluvatar_bi-100",
@@ -540,196 +540,196 @@
"queueFactor": 1.3,
"queueWeight": 1.3,
"recentSuccess": 28,
"recentSuccessRate": 0.0877742946708464,
"recentTerminal": 319,
"recentWilsonLowerBound": 0.06142506018722531,
"recentSuccessRate": 0.0875,
"recentTerminal": 320,
"recentWilsonLowerBound": 0.06123086961941921,
"running": 3,
"selectionWeight": 0.065,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 53.166666666666664,
"waiting": 2367
"throughputPerHour": 53.333333333333336,
"waiting": 2366
},
"Iluvatar_bi-150": {
"available": true,
"backlogHours": 61.31550802139037,
"backlogHours": 61.447721179624665,
"canVerify": true,
"error": null,
"gpu": "Iluvatar_bi-150",
"healthFactor": 1.0,
"maxConcurrentTasks": 50,
"qualityFactor": 0.1565414620154959,
"qualityFactor": 0.1528845417740741,
"queueFactor": 1.3,
"queueWeight": 1.3,
"recentSuccess": 56,
"recentSuccessRate": 0.1497326203208556,
"recentTerminal": 374,
"recentWilsonLowerBound": 0.11714003194918979,
"running": 1,
"selectionWeight": 0.20350390062014467,
"recentSuccess": 57,
"recentSuccessRate": 0.15281501340482573,
"recentTerminal": 373,
"recentWilsonLowerBound": 0.11985367941455251,
"running": 2,
"selectionWeight": 0.19874990430629633,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 62.333333333333336,
"waiting": 3822
"throughputPerHour": 62.166666666666664,
"waiting": 3820
},
"Iluvatar_mrv-100": {
"available": true,
"backlogHours": 2258.19512195122,
"backlogHours": 2315.85,
"canVerify": true,
"error": null,
"gpu": "Iluvatar_mrv-100",
"healthFactor": 1.0,
"maxConcurrentTasks": 2,
"qualityFactor": 1.04441755506855,
"queueFactor": 0.851464649558194,
"queueWeight": 0.851464649558194,
"recentSuccess": 17,
"recentSuccessRate": 0.4146341463414634,
"recentTerminal": 41,
"recentWilsonLowerBound": 0.2775633082533015,
"running": 2,
"selectionWeight": 0.8892846275188687,
"qualityFactor": 0.8649269136760944,
"queueFactor": 0.8486137627640006,
"queueWeight": 0.8486137627640006,
"recentSuccess": 16,
"recentSuccessRate": 0.4,
"recentTerminal": 40,
"recentWilsonLowerBound": 0.2634811061240136,
"running": 3,
"selectionWeight": 0.7339888827305244,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 6.833333333333333,
"waiting": 15431
"throughputPerHour": 6.666666666666667,
"waiting": 15439
},
"Kunlunxin_p-800": {
"available": true,
"backlogHours": 701.4193548387096,
"backlogHours": 679.6875,
"canVerify": true,
"error": null,
"gpu": "Kunlunxin_p-800",
"healthFactor": 1.0,
"maxConcurrentTasks": 7,
"qualityFactor": 0.5527644271330466,
"queueFactor": 1.0146918680916857,
"queueWeight": 1.0146918680916857,
"qualityFactor": 0.4772083138840772,
"queueFactor": 1.0199297090849742,
"queueWeight": 1.0199297090849742,
"recentSuccess": 27,
"recentSuccessRate": 0.2903225806451613,
"recentTerminal": 93,
"recentWilsonLowerBound": 0.20785269347957885,
"recentSuccessRate": 0.28125,
"recentTerminal": 96,
"recentWilsonLowerBound": 0.20107282637501533,
"running": 7,
"selectionWeight": 0.5608855691822615,
"selectionWeight": 0.4867189367527179,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 15.5,
"waiting": 10872
"throughputPerHour": 16.0,
"waiting": 10875
},
"MetaX_c-500": {
"available": true,
"backlogHours": 730.9148936170213,
"backlogHours": 722.8421052631579,
"canVerify": true,
"error": null,
"gpu": "MetaX_c-500",
"healthFactor": 1.0,
"maxConcurrentTasks": 4,
"qualityFactor": 0.48741292444398343,
"queueFactor": 1.0084417560546803,
"queueWeight": 1.0084417560546803,
"qualityFactor": 0.441778598123695,
"queueFactor": 1.0105553799021938,
"queueWeight": 1.0105553799021938,
"recentSuccess": 26,
"recentSuccessRate": 0.2765957446808511,
"recentTerminal": 94,
"recentWilsonLowerBound": 0.19629891934748106,
"running": 4,
"selectionWeight": 0.49152754545003785,
"recentSuccessRate": 0.2736842105263158,
"recentTerminal": 95,
"recentWilsonLowerBound": 0.19414427878715157,
"running": 7,
"selectionWeight": 0.4464417390595492,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 15.666666666666666,
"waiting": 11451
"throughputPerHour": 15.833333333333334,
"waiting": 11445
},
"Mthreads_s4000": {
"available": true,
"backlogHours": 1800.169014084507,
"backlogHours": 1751.8356164383563,
"canVerify": true,
"error": null,
"gpu": "Mthreads_s4000",
"healthFactor": 1.0,
"maxConcurrentTasks": 4,
"qualityFactor": 1.2545774194276704,
"queueFactor": 0.8809146841911522,
"queueWeight": 0.8809146841911522,
"recentSuccess": 29,
"recentSuccessRate": 0.4084507042253521,
"recentTerminal": 71,
"recentWilsonLowerBound": 0.3016855200237845,
"running": 4,
"selectionWeight": 1.1051756712284768,
"qualityFactor": 0.992653848799105,
"queueFactor": 0.8848968151595895,
"queueWeight": 0.8848968151595895,
"recentSuccess": 28,
"recentSuccessRate": 0.3835616438356164,
"recentTerminal": 73,
"recentWilsonLowerBound": 0.28050439402671845,
"running": 5,
"selectionWeight": 0.8783962293582367,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 11.833333333333334,
"waiting": 21302
"throughputPerHour": 12.166666666666666,
"waiting": 21314
},
"Sunrise_pt-200-x1": {
"available": true,
"backlogHours": 6030.428571428571,
"backlogHours": 6033.857142857142,
"canVerify": true,
"error": null,
"gpu": "Sunrise_pt-200-x1",
"healthFactor": 1.0,
"maxConcurrentTasks": 2,
"qualityFactor": 2.1778132905642726,
"queueFactor": 0.7348160184741153,
"queueWeight": 0.7348160184741153,
"qualityFactor": 2.0224302929721603,
"queueFactor": 0.7350677704735842,
"queueWeight": 0.7350677704735842,
"recentSuccess": 9,
"recentSuccessRate": 0.6428571428571429,
"recentTerminal": 14,
"recentWilsonLowerBound": 0.3876400468214041,
"running": 2,
"selectionWeight": 1.6002920911524503,
"selectionWeight": 1.4866233263932835,
"stale": false,
"submissionEligible": false,
"throughputPerHour": 2.3333333333333335,
"waiting": 14071
"waiting": 14079
},
"Vastai_va16": {
"available": true,
"backlogHours": 815.1780821917808,
"backlogHours": 827.6666666666666,
"canVerify": true,
"error": null,
"gpu": "Vastai_va16",
"healthFactor": 1.0,
"maxConcurrentTasks": 16,
"qualityFactor": 0.3711065411126375,
"queueFactor": 0.9920714864761494,
"queueWeight": 0.9920714864761494,
"qualityFactor": 0.35572401782569774,
"queueFactor": 0.9902350971184667,
"queueWeight": 0.9902350971184667,
"recentSuccess": 19,
"recentSuccessRate": 0.2602739726027397,
"recentTerminal": 73,
"recentWilsonLowerBound": 0.17342050231153916,
"recentSuccessRate": 0.2638888888888889,
"recentTerminal": 72,
"recentWilsonLowerBound": 0.17593641596552725,
"running": 16,
"selectionWeight": 0.36816421788263654,
"selectionWeight": 0.352250407339001,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 12.166666666666666,
"waiting": 9918
"throughputPerHour": 12.0,
"waiting": 9932
},
"hygon_k100-ai": {
"available": true,
"backlogHours": 531.6734693877552,
"backlogHours": 548.4,
"canVerify": true,
"error": null,
"gpu": "hygon_k100-ai",
"healthFactor": 1.0,
"maxConcurrentTasks": 6,
"qualityFactor": 2.5,
"queueFactor": 1.057752579965651,
"queueWeight": 1.057752579965651,
"queueFactor": 1.0532998391650896,
"queueWeight": 1.0532998391650896,
"recentSuccess": 50,
"recentSuccessRate": 0.5102040816326531,
"recentTerminal": 98,
"recentWilsonLowerBound": 0.41272874059974574,
"recentSuccessRate": 0.5263157894736842,
"recentTerminal": 95,
"recentWilsonLowerBound": 0.4268517068062815,
"running": 6,
"selectionWeight": 2.644381449914128,
"selectionWeight": 2.633249597912724,
"stale": false,
"submissionEligible": true,
"throughputPerHour": 16.333333333333332,
"waiting": 8684
"throughputPerHour": 15.833333333333334,
"waiting": 8683
}
},
"queueAttemptedAt": "2026-09-10T07:42:41.398195+00:00",
"queueAttemptedAt": "2026-09-10T07:53:17.152657+00:00",
"queueError": null,
"queueUpdatedAt": "2026-09-10T07:42:41.398195+00:00",
"queueUpdatedAt": "2026-09-10T07:53:17.152657+00:00",
"supportedGpus": [
"Vastai_va16",
"Iluvatar_mrv-100",

File diff suppressed because it is too large Load Diff

View File

@@ -1,6 +1,6 @@
{
"generatedAt": "2026-09-10T07:29:03.167497+00:00",
"lastSyncTime": "2026-09-10T07:29:02.941680+00:00",
"generatedAt": "2026-09-10T07:53:10.960863+00:00",
"lastSyncTime": "2026-09-10T07:53:10.699435+00:00",
"recentLimit": 300,
"report": {
"architectureCompatibilityBlocks": {
@@ -1576,25 +1576,25 @@
"decisionSuccessRate": 0.2222,
"decisionTotal": 9,
"failureBreakdown": {
"ambiguous_runtime": 15,
"ambiguous_runtime": 18,
"framework_architecture_unsupported": 5,
"memory_capacity": 1,
"tokenizer_compatibility": 1,
"参数/模板问题": 5,
"验证失败": 22
},
"failureCount": 49,
"failureRate": 0.9608,
"failureCount": 52,
"failureRate": 0.963,
"framework": "unknown",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 2,
"successRate": 0.0392,
"successRate": 0.037,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 51,
"unresolvedFailureCount": 42
"total": 54,
"unresolvedFailureCount": 45
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation": {
"attributableFailureCount": 7,
@@ -1602,11 +1602,11 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 7,
"failureBreakdown": {
"ambiguous_runtime": 13,
"ambiguous_runtime": 14,
"framework_architecture_unsupported": 7,
"参数/模板问题": 3
},
"failureCount": 23,
"failureCount": 24,
"failureRate": 1.0,
"framework": "vllm-mlu",
"pendingCount": 0,
@@ -1616,8 +1616,8 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 23,
"unresolvedFailureCount": 16
"total": 24,
"unresolvedFailureCount": 17
},
"Cambricon_mlu-370-x8|vllm|text-generation": {
"attributableFailureCount": 3,
@@ -1912,9 +1912,9 @@
},
"MetaX_c-500|vllm|text-generation": {
"attributableFailureCount": 39,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 39,
"decisionFailureRate": 0.975,
"decisionSuccessRate": 0.025,
"decisionTotal": 40,
"failureBreakdown": {
"ambiguous_runtime": 7,
"backend_operator": 20,
@@ -1924,16 +1924,16 @@
"参数/模板问题": 9
},
"failureCount": 55,
"failureRate": 1.0,
"failureRate": 0.9821,
"framework": "vllm",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 0,
"successRate": 0.0,
"successCount": 1,
"successRate": 0.0179,
"targetGpu": "MetaX_c-500",
"taskType": "text-generation",
"total": 55,
"total": 56,
"unresolvedFailureCount": 16
},
"Mthreads_s4000|llamacpp|text-generation": {
@@ -2300,7 +2300,7 @@
"decisionSuccessRate": 0.284,
"decisionTotal": 169,
"failureBreakdown": {
"ambiguous_runtime": 109,
"ambiguous_runtime": 112,
"backend_operator": 2,
"framework_architecture_unsupported": 87,
"memory_capacity": 5,
@@ -2309,21 +2309,21 @@
"参数/模板问题": 56,
"验证失败": 673
},
"failureCount": 959,
"failureRate": 0.9523,
"failureCount": 962,
"failureRate": 0.9525,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 48,
"successRate": 0.0477,
"total": 1007,
"unresolvedFailureCount": 838
"successRate": 0.0475,
"total": 1010,
"unresolvedFailureCount": 841
},
"vllm": {
"attributableFailureCount": 230,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 230,
"decisionFailureRate": 0.9957,
"decisionSuccessRate": 0.0043,
"decisionTotal": 231,
"failureBreakdown": {
"ambiguous_runtime": 150,
"backend_operator": 24,
@@ -2337,13 +2337,13 @@
"参数/模板问题": 21
},
"failureCount": 402,
"failureRate": 1.0,
"failureRate": 0.9975,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 1,
"successCount": 0,
"successRate": 0.0,
"total": 402,
"successCount": 1,
"successRate": 0.0025,
"total": 403,
"unresolvedFailureCount": 171
},
"vllm-mlu": {
@@ -2352,19 +2352,19 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 7,
"failureBreakdown": {
"ambiguous_runtime": 13,
"ambiguous_runtime": 14,
"framework_architecture_unsupported": 7,
"参数/模板问题": 3
},
"failureCount": 23,
"failureCount": 24,
"failureRate": 1.0,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 0,
"successRate": 0.0,
"total": 23,
"unresolvedFailureCount": 16
"total": 24,
"unresolvedFailureCount": 17
},
"vllm-patch-tokenizer": {
"attributableFailureCount": 3,
@@ -2447,7 +2447,7 @@
"unresolvedFailureCount": 1
}
},
"generatedAt": "2026-09-10T07:29:03.163136+00:00",
"generatedAt": "2026-09-10T07:53:10.956424+00:00",
"gpuSummaries": {
"Ascend_910-b3": {
"attributableFailureCount": 26,
@@ -2549,22 +2549,22 @@
"decisionSuccessRate": 0.1053,
"decisionTotal": 19,
"failureBreakdown": {
"ambiguous_runtime": 28,
"ambiguous_runtime": 32,
"framework_architecture_unsupported": 15,
"memory_capacity": 1,
"tokenizer_compatibility": 1,
"参数/模板问题": 18,
"验证失败": 22
},
"failureCount": 85,
"failureRate": 0.977,
"failureCount": 89,
"failureRate": 0.978,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 2,
"successRate": 0.023,
"total": 87,
"unresolvedFailureCount": 68
"successRate": 0.022,
"total": 91,
"unresolvedFailureCount": 72
},
"Iluvatar_bi-100": {
"attributableFailureCount": 0,
@@ -2655,9 +2655,9 @@
},
"MetaX_c-500": {
"attributableFailureCount": 39,
"decisionFailureRate": 0.8125,
"decisionSuccessRate": 0.1875,
"decisionTotal": 48,
"decisionFailureRate": 0.7959,
"decisionSuccessRate": 0.2041,
"decisionTotal": 49,
"failureBreakdown": {
"ambiguous_runtime": 7,
"backend_operator": 20,
@@ -2668,13 +2668,13 @@
"验证失败": 48
},
"failureCount": 111,
"failureRate": 0.925,
"failureRate": 0.9174,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 9,
"successRate": 0.075,
"total": 120,
"successCount": 10,
"successRate": 0.0826,
"total": 121,
"unresolvedFailureCount": 72
},
"Mthreads_s4000": {
@@ -2865,9 +2865,9 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 2
"ambiguous_runtime": 3
},
"failureCount": 2,
"failureCount": 3,
"failureRate": 1.0,
"framework": "vllm-mlu",
"modelType": "llama",
@@ -2879,8 +2879,8 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 2,
"unresolvedFailureCount": 2
"total": 3,
"unresolvedFailureCount": 3
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|nemotron_h|modelopt": {
"attributableFailureCount": 1,
@@ -3505,25 +3505,25 @@
},
"MetaX_c-500|vllm|text-generation|llama|compressed-tensors": {
"attributableFailureCount": 10,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 10,
"decisionFailureRate": 0.9091,
"decisionSuccessRate": 0.0909,
"decisionTotal": 11,
"failureBreakdown": {
"backend_operator": 10
},
"failureCount": 10,
"failureRate": 1.0,
"failureRate": 0.9091,
"framework": "vllm",
"modelType": "llama",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 0,
"successRate": 0.0,
"successCount": 1,
"successRate": 0.0909,
"targetGpu": "MetaX_c-500",
"taskType": "text-generation",
"total": 10,
"total": 11,
"unresolvedFailureCount": 0
},
"MetaX_c-500|vllm|text-generation|phi3small|compressed-tensors": {
@@ -4078,28 +4078,28 @@
"attributableFailureCount": 2,
"consecutiveFailures": 2,
"consecutivePlatformFailures": 0,
"decisionFailureRate": 0.6667,
"decisionSuccessRate": 0.3333,
"decisionTotal": 3,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 2,
"failureBreakdown": {
"ambiguous_runtime": 11,
"ambiguous_runtime": 14,
"framework_architecture_unsupported": 1,
"tokenizer_compatibility": 1
},
"failureCount": 13,
"failureRate": 0.9286,
"failureCount": 16,
"failureRate": 1.0,
"framework": "unknown",
"lastPlatformFailureAt": null,
"lastTerminalAt": "2026-09-10T05:27:18.447582+00:00",
"lastTerminalAt": "2026-09-10T07:53:10.699377+00:00",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"successCount": 1,
"successRate": 0.0714,
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 14,
"unresolvedFailureCount": 11
"total": 16,
"unresolvedFailureCount": 14
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation": {
"attributableFailureCount": 4,
@@ -4109,11 +4109,11 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 4,
"failureBreakdown": {
"ambiguous_runtime": 10,
"ambiguous_runtime": 11,
"framework_architecture_unsupported": 4,
"参数/模板问题": 1
},
"failureCount": 15,
"failureCount": 16,
"failureRate": 1.0,
"framework": "vllm-mlu",
"lastPlatformFailureAt": null,
@@ -4125,8 +4125,8 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 15,
"unresolvedFailureCount": 11
"total": 16,
"unresolvedFailureCount": 12
},
"Cambricon_mlu-370-x8|vllm|text-generation": {
"attributableFailureCount": 3,
@@ -4700,9 +4700,9 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
"ambiguous_runtime": 2
},
"failureCount": 1,
"failureCount": 2,
"failureRate": 1.0,
"framework": "vllm-mlu",
"lastTerminalAt": "2026-09-08T15:41:33.599000+00:00",
@@ -4715,8 +4715,8 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
"total": 2,
"unresolvedFailureCount": 2
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|nemotron_h|modelopt": {
"attributableFailureCount": 1,
@@ -5296,9 +5296,9 @@
"decisionSuccessRate": 0.0,
"decisionTotal": 0,
"failureBreakdown": {
"ambiguous_runtime": 1
"ambiguous_runtime": 2
},
"failureCount": 1,
"failureCount": 2,
"failureRate": 1.0,
"framework": "vllm-mlu",
"loadSizeLog2Bucket": 33,
@@ -5311,8 +5311,8 @@
"successRate": 0.0,
"targetGpu": "Cambricon_mlu-370-x8",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 1
"total": 2,
"unresolvedFailureCount": 2
},
"Cambricon_mlu-370-x8|vllm-mlu|text-generation|nemotron_h|modelopt|34": {
"attributableFailureCount": 1,
@@ -6248,6 +6248,28 @@
"total": 1,
"unresolvedFailureCount": 0
},
"MetaX_c-500|vllm|text-generation|llama|compressed-tensors|28": {
"attributableFailureCount": 0,
"decisionFailureRate": 0.0,
"decisionSuccessRate": 1.0,
"decisionTotal": 1,
"failureBreakdown": {},
"failureCount": 0,
"failureRate": 0.0,
"framework": "vllm",
"loadSizeLog2Bucket": 28,
"modelType": "llama",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "compressed-tensors",
"successCount": 1,
"successRate": 1.0,
"targetGpu": "MetaX_c-500",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
},
"MetaX_c-500|vllm|text-generation|llama|compressed-tensors|30": {
"attributableFailureCount": 3,
"decisionFailureRate": 1.0,
@@ -6897,15 +6919,15 @@
"unresolvedFailureCount": 0
}
},
"terminalRecords": 1528,
"totalRecords": 1615,
"terminalRecords": 1533,
"totalRecords": 1620,
"totals": {
"attributableFailureCount": 400,
"decisionFailureRate": 0.8909,
"decisionSuccessRate": 0.1091,
"decisionTotal": 449,
"decisionFailureRate": 0.8889,
"decisionSuccessRate": 0.1111,
"decisionTotal": 450,
"failureBreakdown": {
"ambiguous_runtime": 309,
"ambiguous_runtime": 313,
"backend_operator": 29,
"framework_architecture_unsupported": 271,
"memory_capacity": 11,
@@ -6917,21 +6939,21 @@
"参数/模板问题": 95,
"验证失败": 673
},
"failureCount": 1479,
"failureRate": 0.9679,
"failureCount": 1483,
"failureRate": 0.9674,
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 2,
"successCount": 49,
"successRate": 0.0321,
"total": 1528,
"unresolvedFailureCount": 1077
"successCount": 50,
"successRate": 0.0326,
"total": 1533,
"unresolvedFailureCount": 1081
},
"warnings": [
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_mrv-100 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高≥50%),建议重点关注。",
@@ -6939,7 +6961,7 @@
"GPU hygon_k100-ai 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高≥50%),建议重点关注。",
"组合 Iluvatar_mrv-100|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Biren_166m|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -6960,6 +6982,6 @@
]
},
"storageMode": "decision_state_only",
"summarizedRecords": 1615,
"summarizedRecords": 1620,
"version": 1
}

View File

@@ -1,3 +1,6 @@
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "", "lastSyncTime": "2026-09-10T07:53:10.699377+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-FP8-K-V", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-10T07:51:21+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4481723", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "", "lastSyncTime": "2026-09-10T07:53:10.699435+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-W4A16-ACTORDER-compressed-tensors-test", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-10T07:51:21+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4481716", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "", "lastSyncTime": "2026-09-10T07:53:10.699425+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-W4-Group128-A16-Test", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-10T07:47:21+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4481724", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "", "lastSyncTime": "2026-09-10T07:29:02.941680+00:00", "modelId": "neuralmagic/Llama-3.2-3B-Instruct-FP8", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-10T07:23:21+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4496943", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "", "lastSyncTime": "2026-09-10T07:21:04.730363+00:00", "modelId": "nm-testing/Meta-Llama-3-8B-Instruct-W4A16-compressed-tensors-test", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-10T07:19:23+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4497058", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-10T07:04:57.311815+00:00", "modelId": "nm-testing/nonuniform", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-10T07:03:21+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4493609", "taskType": "text-generation", "verifyResult": -1}
@@ -230,6 +233,7 @@
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-mlu", "lastSyncTime": "2026-09-08T18:40:55.416614+00:00", "modelId": "RedHatAI/Phi-3-small-128k-instruct-quantized.w8a16", "modelProfile": {"architectures": ["Phi3SmallForCausalLM"], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8630134648, "estimatedRequiredGiB": 9.647, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3small", "modelscopeFileSize": 8632060880, "modelscopeLicense": "mit", "modelscopeParams": 7803314176, "modelscopeTags": ["license:mit", "model_type:phi3small", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 8632060880}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T06:46:06.886454+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4712804", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-mlu", "lastSyncTime": "2026-09-08T20:58:55.412656+00:00", "modelId": "RedHatAI/Qwen2.5-1.5B-quantized.w4a16", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1611497856, "estimatedRequiredGiB": 1.819, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 1627385309, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1781159424, "modelscopeTags": ["license:apache-2.0", "model_type:qwen2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:chat", "custom_tag:neuralmagic", "custom_tag:llmcompressor"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 1627385309}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T06:46:06.804740+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4712806", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-mlu", "lastSyncTime": "2026-09-08T15:41:33.599000+00:00", "modelId": "neuralmagic/Llama-3.2-1B-Instruct-FP8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2023929984, "estimatedRequiredGiB": 2.272, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 2033083373, "modelscopeLicense": "llama3.2", "modelscopeParams": 1498482688, "modelscopeTags": ["license:llama3.2", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:llama", "custom_tag:llama-3", "custom_tag:neuralmagic", "custom_tag:llmcompressor"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2033083377}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T06:46:06.795745+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4712800", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-mlu", "lastSyncTime": "2026-09-10T07:53:10.699404+00:00", "modelId": "nm-testing/nonuniform", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9517467172, "estimatedRequiredGiB": 10.647, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9526650722, "modelscopeLicense": null, "modelscopeParams": 8030261248, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9526650722}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T06:46:06.780642+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4712802", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-08T06:39:56.007893+00:00", "modelId": "nv-community/Qwen3-30B-A3B-NVFP4", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T06:31:21+00:00", "targetGpu": "MetaX_c-500", "taskId": "4079272", "taskType": "text-generation", "verifyResult": -1}
{"failReason": null, "framework": "", "lastSyncTime": "2026-09-08T06:21:18.620967+00:00", "modelId": "ysqlian/YZH_Model", "modelProfile": {}, "outcome": "success", "status": "success", "submitTime": "2026-09-08T06:11:21+00:00", "targetGpu": "MetaX_c-500", "taskId": "4525689", "taskType": "text-generation", "verifyResult": 1}
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-08T06:03:35.611314+00:00", "modelId": "nightmedia/Qwen3-4B-Element8-Eva-Heretic-mxfp4-mlx", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-08T06:03:21+00:00", "targetGpu": "MetaX_c-500", "taskId": "4079395", "taskType": "text-generation", "verifyResult": -1}
@@ -294,7 +298,3 @@
{"failReason": "参数/模板问题", "framework": "", "lastSyncTime": "2026-09-07T16:06:52.110299+00:00", "modelId": "LLM-Research/Phi-3-medium-128k-instruct", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-07T15:51:46+00:00", "targetGpu": "Vastai_va16", "taskId": "4079303", "taskType": "text-generation", "verifyResult": null}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mellum"], "framework": "", "lastSyncTime": "2026-09-07T16:06:52.110321+00:00", "modelId": "JetBrains/Mellum2-12B-A2.5B-Thinking", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-07T15:51:21+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "4148307", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-07T14:48:12.111065+00:00", "modelId": "dickeyli/llmrec-onereason-8b-sh2-grpo4-step240", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-07T14:29:21+00:00", "targetGpu": "Vastai_va16", "taskId": "4458046", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-07T14:27:46.850382+00:00", "modelId": "Aratako/ELYZA-japanese-Llama-2-fast-MoE-2x7B-v0.1", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-07T14:27:21+00:00", "targetGpu": "Vastai_va16", "taskId": "4079298", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "kv_cache_error", "failureCode": "KV_CACHE_ERROR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-07T14:27:46.850392+00:00", "modelId": "kurakurai/Luth-LFM2-700M", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-07T14:25:21+00:00", "targetGpu": "Vastai_va16", "taskId": "4079284", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-07T14:27:46.850360+00:00", "modelId": "dickeyli/llmrec-onereason-8b-sh2-grpo4-step160", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-09-07T14:23:21+00:00", "targetGpu": "Vastai_va16", "taskId": "4458045", "taskType": "text-generation", "verifyResult": -1}
{"failReason": null, "framework": "", "lastSyncTime": "2026-09-07T14:07:33.009927+00:00", "modelId": "dickeyli/llmrec-onereason-8b-sh2-grpo4-step240", "modelProfile": {}, "outcome": "success", "status": "success", "submitTime": "2026-09-07T14:05:22+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4471039", "taskType": "text-generation", "verifyResult": 1}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -1,24 +1,24 @@
{
"agentVersion": "2026.09.04.4",
"checksums": {
".modelhub_state/architecture_compatibility_blacklist.json": "483bbad0e76774bb3eb7d8974c54319f97006042aa3419b020737cc78095ac80",
".modelhub_state/architecture_history_backfill.json": "9354b0edc9edaab943d9420a1793e242d49b2924c9b4bc1eff79690492317dbf",
".modelhub_state/market_intelligence.json": "43db0ad801588b32a42bdd4b4b019353fae9c65d3bd6ae3c4dd6a2e7d2a4d016",
".modelhub_state/official_capabilities.json": "29aa1b60e22a5d36fb0f03c64e8bf1e5b8c951eaba97cc49adfb71819af967f9",
".modelhub_state/outcome_checkpoint.json": "4cb86fc7d5e588c517479df71a814190ecb52b303d8141d838ed4e07c550d806",
".modelhub_state/architecture_compatibility_blacklist.json": "73d8388d70f289f791bf34650cd3c8de84b33a2cc4bc345260ebd594cd3fb39e",
".modelhub_state/architecture_history_backfill.json": "ab3ef891f7f55485562df4270bb645d89851494ec0ccf97d1925363abc4665c4",
".modelhub_state/market_intelligence.json": "284acd0eaa1fdfe7c5b016c84b5a3913e16d1fc3defee4a23fa77a08468823cd",
".modelhub_state/official_capabilities.json": "4f3b24e174498985b568c583eb19640d71064699a671a49b7dfd0607e476bc0b",
".modelhub_state/outcome_checkpoint.json": "f636aa59918cb4b23355a5a53047b6584b648709c0dbee0b0cfe054e95ae65a1",
".modelhub_state/queue_cleanup_latest.json": "b251e2ff52f1e826ed4fc9723e1765d93287b92341cb7f593f01eb5e88982f99",
".modelhub_state/recent_outcomes.jsonl": "bfcf9e9826809a4fdb908263410434c0b4285802199616dd05d656397eb47410",
".modelhub_state/recovery_active_tasks.jsonl": "60a0145ae7550bf364f7df4660cea0d155a61ebbf5f2650ce54d94fbddfab49d",
".modelhub_state/recovery_intents.jsonl": "e52fb15a192d4b2484a9f412b76f17f66edca6fe650525f35e3d4dcd376893e9",
".modelhub_state/recent_outcomes.jsonl": "06407523c3a9cc5b207be90fac5264d8893710a3dea96c00107c95c45ca4f396",
".modelhub_state/recovery_active_tasks.jsonl": "8ff27a5acdb59e0a9472aabeedb22f0956fe91830e01d5ef04464241a8668eca",
".modelhub_state/recovery_intents.jsonl": "55c9c307b906914ce23924ae9434bd6225e9aa6e6fc6849ae6d98d98c888c3f0",
".modelhub_state/routing_intelligence.json": "8a52419d4402861a79d360da797632830eb2c915c1cd189832eea085096de774",
".modelhub_state/submission_exclusions.jsonl": "b2de1125bf1f3e0597cd50cc30b563a5bfee39459e843767163eb72101cebc03",
".modelhub_state/worker_crashes.jsonl": "d1c3f447ce0377ed5e820c2b5ff730d29f84a96af4fd14332b138f78c0ddde76",
"ledger/submissions.jsonl": "ae2d6630dc3b5048885517330e9530c50fe5e0c1ea4c5a17488ad884d16de042",
"outcomes/submissions.jsonl": "7042c6e7d0bfe22a93357ccba386fd4c266703f2b418fce83a69a2fe04bb2b64"
"outcomes/submissions.jsonl": "cb24db13bdbf2c66aef5f7e91a82ecf791f7e4f2e71f312ddc3b8f04e8aac3ab"
},
"generation": 5062,
"generation": 5063,
"phase": "cycle",
"schemaVersion": 1,
"updatedAt": "2026-09-10T07:52:10.082804+00:00",
"updatedAt": "2026-09-10T07:55:17.587672+00:00",
"writerId": "58ff5dc2a2d64b119ad1e4560700f977"
}

View File

@@ -45,7 +45,6 @@
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-04T16:14:29.511220+00:00", "modelId": "Mia-AiLab/Qwen3.8-27B-EXL3-3.5bpw", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 15338408461, "estimatedRequiredGiB": 17.168, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "modelhub_preflight_oom:49"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 15362064483, "modelscopeLicense": "apache-2.0", "modelscopeParams": 7669052656, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:exl3", "custom_tag:exllamav3", "custom_tag:quantization", "custom_tag:long-context", "custom_tag:speculative-decoding"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "exl3", "repositoryOnDiskBytes": 15362064483}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T08:14:12.544960+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "4622655", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-04T16:33:41.731498+00:00", "modelId": "Mia-AiLab/Qwen3.8-27B-EXL3-3.5bpw", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 15338408461, "estimatedRequiredGiB": 17.168, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "manufacturer_spec", "sourceUrl": "https://www.birentech.com/news/id6rz98v3obczy77cmxzfgk3/"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 15362064483, "modelscopeLicense": "apache-2.0", "modelscopeParams": 7669052656, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:exl3", "custom_tag:exllamav3", "custom_tag:quantization", "custom_tag:long-context", "custom_tag:speculative-decoding"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "exl3", "repositoryOnDiskBytes": 15362064483}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T08:33:06.846794+00:00", "targetGpu": "Biren_166m", "taskId": "4623002", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-04T16:50:26.817445+00:00", "modelId": "Mia-AiLab/Qwen3.8-27B-EXL3-3.5bpw", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 15338408461, "estimatedRequiredGiB": 17.168, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 15362064483, "modelscopeLicense": "apache-2.0", "modelscopeParams": 7669052656, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:exl3", "custom_tag:exllamav3", "custom_tag:quantization", "custom_tag:long-context", "custom_tag:speculative-decoding"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "exl3", "repositoryOnDiskBytes": 15362064483}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T08:44:58.161709+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4623226", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-04T19:52:10.096489+00:00", "modelId": "neuralmagic/SmolLM-360M-Instruct-quantized.w8a8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "5dc29cb4673042e118df9721ee1fc20ce84e880992fba859071f1332bb52342f", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 504052632, "estimatedRequiredGiB": 0.567, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:29"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 507443106, "modelscopeLicense": "apache-2.0", "modelscopeParams": 409007040, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 507443106}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T11:51:30.613200+00:00", "targetGpu": "MetaX_c-500", "taskId": "4625822", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-04T20:39:27.718139+00:00", "modelId": "ornith-ai/Ornith-1.5-9B-NVFP4", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8818103892, "estimatedRequiredGiB": 9.883, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:8"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 8842796317, "modelscopeLicense": "mit", "modelscopeParams": 6728625904, "modelscopeTags": ["license:mit", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "modelopt", "repositoryOnDiskBytes": 8842796317}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T12:34:49.403585+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4626360", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-04T21:36:16.816860+00:00", "modelId": "siliconflow/gpt-oss-20b-FP8", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 22109595640, "estimatedRequiredGiB": 24.741, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:29"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 22137550529, "modelscopeLicense": "Apache License 2.0", "modelscopeParams": 20921584848, "modelscopeTags": ["license:Apache License 2.0", "model_type:gpt_oss", "library:safetensors", "library:other", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "mxfp4", "repositoryOnDiskBytes": 22137550529}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T13:34:49.450482+00:00", "targetGpu": "MetaX_c-500", "taskId": "4627250", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T21:46:36.195225+00:00", "modelId": "sapientinc/HRM-Text-1B", "modelProfile": {"architectures": ["HrmTextForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2365606568, "estimatedRequiredGiB": 2.651, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "hrm_text", "modelscopeFileSize": 2371660433, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1182795264, "modelscopeTags": ["license:apache-2.0", "model_type:hrm_text", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:hrm", "custom_tag:hierarchical-reasoning", "custom_tag:prefix-lm", "custom_tag:pre-alignment", "custom_tag:non-chat", "custom_tag:non-instruction-tuned"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2371660433}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T13:43:30.537609+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4627500", "taskType": "text-generation", "verifyResult": null}
@@ -255,7 +254,6 @@
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-08T12:11:42.795256+00:00", "modelId": "OpenBMB/MiniCPM5-2B", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557096, "estimatedRequiredGiB": 5.637, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5043805854, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5043805854}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T03:58:12.682940+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "4710401", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-08T12:42:19.103199+00:00", "modelId": "OpenBMB/MiniCPM5-2B", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557096, "estimatedRequiredGiB": 5.637, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5043805854, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5043805854}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T04:20:35.203447+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4710796", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-08T13:16:14.206207+00:00", "modelId": "OpenBMB/MiniCPM5-2B", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557096, "estimatedRequiredGiB": 5.637, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5043805854, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5043805854}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T05:08:32.946681+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4711416", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-08T14:58:38.614313+00:00", "modelId": "nm-testing/nonuniform", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9517467172, "estimatedRequiredGiB": 10.647, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9526650722, "modelscopeLicense": null, "modelscopeParams": 8030261248, "modelscopeTags": ["model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9526650722}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T06:46:06.780642+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4712802", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-08T14:58:38.614464+00:00", "modelId": "zstack/qwen3-4b-fake", "modelProfile": {"architectures": ["Qwen3ForCausalLM"], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 25165824, "estimatedRequiredGiB": 0.028, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3", "modelscopeFileSize": 25169485, "modelscopeLicense": null, "modelscopeParams": 25165435, "modelscopeTags": ["model_type:qwen3", "library:safetensors", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 25169485}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T06:46:06.785300+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4712808", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-08T14:58:38.614275+00:00", "modelId": "OpenBMB/MiniCPM5-2B", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5033557096, "estimatedRequiredGiB": 5.637, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5043805854, "modelscopeLicense": "apache-2.0", "modelscopeParams": 2516756480, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:minicpm", "custom_tag:minicpm5", "custom_tag:llama", "custom_tag:text-generation", "custom_tag:long-context", "custom_tag:tool-calling", "custom_tag:on-device", "custom_tag:edge-ai"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5043805854}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T06:46:06.799047+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4712803", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-08T14:58:38.614470+00:00", "modelId": "RedHatAI/starcoder2-3b-FP8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 3484485728, "estimatedRequiredGiB": 3.898, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 3487786133, "modelscopeLicense": "other", "modelscopeParams": 3181366272, "modelscopeTags": ["license:other", "model_type:starcoder2", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 3487786133}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-08T06:46:06.808048+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "4712807", "taskType": "text-generation", "verifyResult": null}