state: generation 16733 (cycle)

This commit is contained in:
2026-09-26 18:29:46 +00:00
parent 60d9d0410f
commit 706f46db09
8 changed files with 1603 additions and 1557 deletions

View File

@@ -3261,7 +3261,7 @@
"taskType": "text-generation" "taskType": "text-generation"
} }
}, },
"generatedAt": "2026-09-26T18:22:15.193152+00:00", "generatedAt": "2026-09-26T18:28:52.935474+00:00",
"summary": { "summary": {
"activeBlockCount": 164, "activeBlockCount": 164,
"byGpuFramework": { "byGpuFramework": {

View File

@@ -396,99 +396,99 @@
} }
}, },
"frameworkUpdatedAt": null, "frameworkUpdatedAt": null,
"generatedAt": "2026-09-26T18:26:50.770485+00:00", "generatedAt": "2026-09-26T18:29:41.464558+00:00",
"gpuStats": { "gpuStats": {
"Ascend_910-b4": { "Ascend_910-b4": {
"available": true, "available": true,
"backlogHours": 1363.142857142857, "backlogHours": 1362.952380952381,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Ascend_910-b4", "gpu": "Ascend_910-b4",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 8, "maxConcurrentTasks": 8,
"qualityFactor": 2.5, "qualityFactor": 2.2329519769482618,
"queueFactor": 0.9382357844802666, "queueFactor": 0.9417509283267936,
"queueWeight": 0.9382357844802666, "queueWeight": 0.9417509283267936,
"recentSuccess": 51, "recentSuccess": 51,
"recentSuccessRate": 0.40476190476190477, "recentSuccessRate": 0.40476190476190477,
"recentTerminal": 126, "recentTerminal": 126,
"recentWilsonLowerBound": 0.3231031696813985, "recentWilsonLowerBound": 0.3231031696813985,
"running": 8, "running": 8,
"selectionWeight": 2.3455894612006665, "selectionWeight": 2.1028845972001746,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 21.0, "throughputPerHour": 21.0,
"waiting": 28626 "waiting": 28622
}, },
"Biren_166m": { "Biren_166m": {
"available": true, "available": true,
"backlogHours": 130.23529411764704, "backlogHours": 128.2736842105263,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Biren_166m", "gpu": "Biren_166m",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 8, "maxConcurrentTasks": 8,
"qualityFactor": 0.41234472294603963, "qualityFactor": 0.3814497797750198,
"queueFactor": 1.3, "queueFactor": 1.3,
"queueWeight": 1.3, "queueWeight": 1.3,
"recentSuccess": 36, "recentSuccess": 37,
"recentSuccessRate": 0.1925133689839572, "recentSuccessRate": 0.19473684210526315,
"recentTerminal": 187, "recentTerminal": 190,
"recentWilsonLowerBound": 0.1424222290594821, "recentWilsonLowerBound": 0.14471179788888525,
"running": 8, "running": 8,
"selectionWeight": 0.5360481398298516, "selectionWeight": 0.4958847137075258,
"stale": false, "stale": false,
"submissionEligible": false, "submissionEligible": false,
"throughputPerHour": 31.166666666666668, "throughputPerHour": 31.666666666666668,
"waiting": 4059 "waiting": 4062
}, },
"Cambricon_mlu-370-x4": { "Cambricon_mlu-370-x4": {
"available": true, "available": true,
"backlogHours": 1194.7105263157896, "backlogHours": 1164.076923076923,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Cambricon_mlu-370-x4", "gpu": "Cambricon_mlu-370-x4",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 7, "maxConcurrentTasks": 7,
"qualityFactor": 0.42641247489466605, "qualityFactor": 0.4204197397982533,
"queueFactor": 0.9569820576202163, "queueFactor": 0.9642972037656222,
"queueWeight": 0.9569820576202163, "queueWeight": 0.9642972037656222,
"recentSuccess": 17, "recentSuccess": 18,
"recentSuccessRate": 0.2236842105263158, "recentSuccessRate": 0.23076923076923078,
"recentTerminal": 76, "recentTerminal": 78,
"recentWilsonLowerBound": 0.1446106442066905, "recentWilsonLowerBound": 0.15125388693827768,
"running": 7, "running": 7,
"selectionWeight": 0.40806908761962635, "selectionWeight": 0.40540957949532613,
"stale": false, "stale": false,
"submissionEligible": false, "submissionEligible": true,
"throughputPerHour": 12.666666666666666, "throughputPerHour": 13.0,
"waiting": 15133 "waiting": 15133
}, },
"Cambricon_mlu-370-x8": { "Cambricon_mlu-370-x8": {
"available": true, "available": true,
"backlogHours": 479.6181818181818, "backlogHours": 470.99999999999994,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Cambricon_mlu-370-x8", "gpu": "Cambricon_mlu-370-x8",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 7, "maxConcurrentTasks": 7,
"qualityFactor": 0.3722407437720538, "qualityFactor": 0.31916893181445916,
"queueFactor": 1.097384579230896, "queueFactor": 1.1044727959231118,
"queueWeight": 1.097384579230896, "queueWeight": 1.1044727959231118,
"recentSuccess": 22, "recentSuccess": 22,
"recentSuccessRate": 0.2, "recentSuccessRate": 0.19642857142857142,
"recentTerminal": 110, "recentTerminal": 112,
"recentWilsonLowerBound": 0.13595004455478174, "recentWilsonLowerBound": 0.13344874797915993,
"running": 7, "running": 7,
"selectionWeight": 0.40849125197689107, "selectionWeight": 0.35251340249290875,
"stale": false, "stale": false,
"submissionEligible": false, "submissionEligible": false,
"throughputPerHour": 18.333333333333332, "throughputPerHour": 18.666666666666668,
"waiting": 8793 "waiting": 8792
}, },
"Iluvatar_bi-100": { "Iluvatar_bi-100": {
"available": true, "available": true,
"backlogHours": 39.6198347107438, "backlogHours": 40.44507042253521,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Iluvatar_bi-100", "gpu": "Iluvatar_bi-100",
@@ -497,197 +497,197 @@
"qualityFactor": 0.05, "qualityFactor": 0.05,
"queueFactor": 1.3, "queueFactor": 1.3,
"queueWeight": 1.3, "queueWeight": 1.3,
"recentSuccess": 16, "recentSuccess": 15,
"recentSuccessRate": 0.0440771349862259, "recentSuccessRate": 0.04225352112676056,
"recentTerminal": 363, "recentTerminal": 355,
"recentWilsonLowerBound": 0.027310238666944146, "recentWilsonLowerBound": 0.02577058277604124,
"running": 24, "running": 25,
"selectionWeight": 0.065, "selectionWeight": 0.065,
"stale": false, "stale": false,
"submissionEligible": false, "submissionEligible": false,
"throughputPerHour": 60.5, "throughputPerHour": 59.166666666666664,
"waiting": 2397 "waiting": 2393
}, },
"Iluvatar_bi-150": { "Iluvatar_bi-150": {
"available": true, "available": true,
"backlogHours": 107.07011070110701, "backlogHours": 96.39867109634552,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Iluvatar_bi-150", "gpu": "Iluvatar_bi-150",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 50, "maxConcurrentTasks": 50,
"qualityFactor": 0.16664894395677188, "qualityFactor": 0.13585196359732205,
"queueFactor": 1.3, "queueFactor": 1.3,
"queueWeight": 1.3, "queueWeight": 1.3,
"recentSuccess": 35, "recentSuccess": 37,
"recentSuccessRate": 0.12915129151291513, "recentSuccessRate": 0.12292358803986711,
"recentTerminal": 271, "recentTerminal": 301,
"recentWilsonLowerBound": 0.09434812852595996, "recentWilsonLowerBound": 0.09051045234295892,
"running": 7, "running": 5,
"selectionWeight": 0.21664362714380345, "selectionWeight": 0.17660755267651868,
"stale": false, "stale": false,
"submissionEligible": false, "submissionEligible": false,
"throughputPerHour": 45.166666666666664, "throughputPerHour": 50.166666666666664,
"waiting": 4836 "waiting": 4836
}, },
"Iluvatar_mrv-100": { "Iluvatar_mrv-100": {
"available": true, "available": true,
"backlogHours": 2592.0, "backlogHours": 2523.789473684211,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Iluvatar_mrv-100", "gpu": "Iluvatar_mrv-100",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 2, "maxConcurrentTasks": 2,
"qualityFactor": 0.4895164342687316, "qualityFactor": 0.5438647283374198,
"queueFactor": 0.852016389999132, "queueFactor": 0.8586183992149651,
"queueWeight": 0.852016389999132, "queueWeight": 0.8586183992149651,
"recentSuccess": 10, "recentSuccess": 11,
"recentSuccessRate": 0.2702702702702703, "recentSuccessRate": 0.2894736842105263,
"recentTerminal": 37, "recentTerminal": 38,
"recentWilsonLowerBound": 0.15397298246990687, "recentWilsonLowerBound": 0.1700310626365613,
"running": 2, "running": 2,
"selectionWeight": 0.4170760251708921, "selectionWeight": 0.46697226243455725,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 6.166666666666667, "throughputPerHour": 6.333333333333333,
"waiting": 15984 "waiting": 15984
}, },
"Kunlunxin_p-800": { "Kunlunxin_p-800": {
"available": true, "available": true,
"backlogHours": 374.6103896103896, "backlogHours": 369.84615384615387,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Kunlunxin_p-800", "gpu": "Kunlunxin_p-800",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 8, "maxConcurrentTasks": 8,
"qualityFactor": 0.4328120594492218, "qualityFactor": 0.47816066334238155,
"queueFactor": 1.138822990581349, "queueFactor": 1.1452623754785163,
"queueWeight": 1.138822990581349, "queueWeight": 1.1452623754785163,
"recentSuccess": 31, "recentSuccess": 34,
"recentSuccessRate": 0.2012987012987013, "recentSuccessRate": 0.21794871794871795,
"recentTerminal": 154, "recentTerminal": 156,
"recentWilsonLowerBound": 0.1455931426663901, "recentWilsonLowerBound": 0.16036567945065483,
"running": 8, "running": 8,
"selectionWeight": 0.49289632390163535, "selectionWeight": 0.547619417159879,
"stale": false, "stale": false,
"submissionEligible": false, "submissionEligible": true,
"throughputPerHour": 25.666666666666668, "throughputPerHour": 26.0,
"waiting": 9615 "waiting": 9616
}, },
"MetaX_c-500": { "MetaX_c-500": {
"available": true, "available": true,
"backlogHours": 521.1147540983607, "backlogHours": 534.2521008403362,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "MetaX_c-500", "gpu": "MetaX_c-500",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 4, "maxConcurrentTasks": 4,
"qualityFactor": 0.7345930861339918, "qualityFactor": 0.5821494899319415,
"queueFactor": 1.0838100988827326, "queueFactor": 1.0837927053265886,
"queueWeight": 1.0838100988827326, "queueWeight": 1.0837927053265886,
"recentSuccess": 31, "recentSuccess": 29,
"recentSuccessRate": 0.2540983606557377, "recentSuccessRate": 0.24369747899159663,
"recentTerminal": 122, "recentTerminal": 119,
"recentWilsonLowerBound": 0.18517041283138747, "recentWilsonLowerBound": 0.17537076257934212,
"running": 4, "running": 4,
"selectionWeight": 0.7961594053214534, "selectionWeight": 0.6309293705978325,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 20.333333333333332, "throughputPerHour": 19.833333333333332,
"waiting": 10596 "waiting": 10596
}, },
"Mthreads_s4000": { "Mthreads_s4000": {
"available": true, "available": true,
"backlogHours": 2045.8064516129032, "backlogHours": 2079.2459016393445,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Mthreads_s4000", "gpu": "Mthreads_s4000",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 4, "maxConcurrentTasks": 4,
"qualityFactor": 2.4377982257323256, "qualityFactor": 2.5,
"queueFactor": 0.8828024245514094, "queueFactor": 0.8839389706160153,
"queueWeight": 0.8828024245514094, "queueWeight": 0.8839389706160153,
"recentSuccess": 27, "recentSuccess": 28,
"recentSuccessRate": 0.43548387096774194, "recentSuccessRate": 0.45901639344262296,
"recentTerminal": 62, "recentTerminal": 61,
"recentWilsonLowerBound": 0.3194239439101423, "recentWilsonLowerBound": 0.34012730888289117,
"running": 4, "running": 4,
"selectionWeight": 2.152094184243621, "selectionWeight": 2.2098474265400383,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 10.333333333333334, "throughputPerHour": 10.166666666666666,
"waiting": 21140 "waiting": 21139
}, },
"Sunrise_pt-200-x1": { "Sunrise_pt-200-x1": {
"available": true, "available": true,
"backlogHours": 3647.3333333333335, "backlogHours": 3517.0714285714284,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Sunrise_pt-200-x1", "gpu": "Sunrise_pt-200-x1",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 2, "maxConcurrentTasks": 2,
"qualityFactor": 0.3471308032405321, "qualityFactor": 0.28504593710927545,
"queueFactor": 0.8094627730375703, "queueFactor": 0.8169227320494267,
"queueWeight": 0.8094627730375703, "queueWeight": 0.8169227320494267,
"recentSuccess": 7, "recentSuccess": 7,
"recentSuccessRate": 0.25925925925925924, "recentSuccessRate": 0.25,
"recentTerminal": 27, "recentTerminal": 28,
"recentWilsonLowerBound": 0.13170208422866778, "recentWilsonLowerBound": 0.12676334942200781,
"running": 2, "running": 2,
"selectionWeight": 0.2809894625978403, "selectionWeight": 0.23286050570289835,
"stale": false, "stale": false,
"submissionEligible": false, "submissionEligible": false,
"throughputPerHour": 4.5, "throughputPerHour": 4.666666666666667,
"waiting": 16413 "waiting": 16413
}, },
"Vastai_va16": { "Vastai_va16": {
"available": true, "available": true,
"backlogHours": 891.1578947368421, "backlogHours": 940.6666666666666,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "Vastai_va16", "gpu": "Vastai_va16",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 16, "maxConcurrentTasks": 16,
"qualityFactor": 1.6670636387116757, "qualityFactor": 1.5596278172206257,
"queueFactor": 1.0, "queueFactor": 0.9956181294289365,
"queueWeight": 1.0, "queueWeight": 0.9956181294289365,
"recentSuccess": 34, "recentSuccess": 33,
"recentSuccessRate": 0.35789473684210527, "recentSuccessRate": 0.36666666666666664,
"recentTerminal": 95, "recentTerminal": 90,
"recentWilsonLowerBound": 0.2687489341134812, "recentWilsonLowerBound": 0.2744710138371422,
"running": 16, "running": 16,
"selectionWeight": 1.6670636387116757, "selectionWeight": 1.5527937299865346,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 15.833333333333334, "throughputPerHour": 15.0,
"waiting": 14110 "waiting": 14110
}, },
"hygon_k100-ai": { "hygon_k100-ai": {
"available": true, "available": true,
"backlogHours": 929.9999999999999, "backlogHours": 913.5263157894736,
"canVerify": true, "canVerify": true,
"error": null, "error": null,
"gpu": "hygon_k100-ai", "gpu": "hygon_k100-ai",
"healthFactor": 1.0, "healthFactor": 1.0,
"maxConcurrentTasks": 6, "maxConcurrentTasks": 6,
"qualityFactor": 1.2302537990317566, "qualityFactor": 1.055008951398408,
"queueFactor": 0.9936209882848406, "queueFactor": 1.0,
"queueWeight": 0.9936209882848406, "queueWeight": 1.0,
"recentSuccess": 35, "recentSuccess": 35,
"recentSuccessRate": 0.3125, "recentSuccessRate": 0.30701754385964913,
"recentTerminal": 112, "recentTerminal": 114,
"recentWilsonLowerBound": 0.23408095733633788, "recentWilsonLowerBound": 0.22978975154130196,
"running": 6, "running": 7,
"selectionWeight": 1.2224059956351137, "selectionWeight": 1.055008951398408,
"stale": false, "stale": false,
"submissionEligible": true, "submissionEligible": true,
"throughputPerHour": 18.666666666666668, "throughputPerHour": 19.0,
"waiting": 17360 "waiting": 17357
} }
}, },
"queueAttemptedAt": "2026-09-26T18:18:59.900979+00:00", "queueAttemptedAt": "2026-09-26T18:29:41.464558+00:00",
"queueError": null, "queueError": null,
"queueUpdatedAt": "2026-09-26T18:18:59.900979+00:00", "queueUpdatedAt": "2026-09-26T18:29:41.464558+00:00",
"supportedGpus": [ "supportedGpus": [
"Vastai_va16", "Vastai_va16",
"Cambricon_mlu-370-x4", "Cambricon_mlu-370-x4",

View File

@@ -1,5 +1,5 @@
{ {
"catalogUpdatedAt": "2026-09-26T18:26:50.770485+00:00", "catalogUpdatedAt": "2026-09-26T18:29:41.464558+00:00",
"configuredTaskTypes": [ "configuredTaskTypes": [
"text-generation" "text-generation"
], ],
@@ -56,7 +56,7 @@
"time-series-forecasting" "time-series-forecasting"
], ],
"errors": [], "errors": [],
"generatedAt": "2026-09-26T18:26:50.770485+00:00", "generatedAt": "2026-09-26T18:29:41.464558+00:00",
"gpuCatalog": { "gpuCatalog": {
"Ascend_910-b3": { "Ascend_910-b3": {
"canVerify": true, "canVerify": true,
@@ -6265,6 +6265,6 @@
"updateTime": "2025-12-22 08:59:53" "updateTime": "2025-12-22 08:59:53"
} }
], ],
"taskTreeUpdatedAt": "2026-09-26T18:26:50.770485+00:00", "taskTreeUpdatedAt": "2026-09-26T18:29:41.464558+00:00",
"version": 1 "version": 1
} }

View File

@@ -1,6 +1,6 @@
{ {
"generatedAt": "2026-09-26T18:22:15.111319+00:00", "generatedAt": "2026-09-26T18:28:52.859100+00:00",
"lastSyncTime": "2026-09-26T18:22:14.859595+00:00", "lastSyncTime": "2026-09-26T18:28:52.569178+00:00",
"recentLimit": 300, "recentLimit": 300,
"report": { "report": {
"architectureCompatibilityBlocks": { "architectureCompatibilityBlocks": {
@@ -5427,14 +5427,14 @@
"unresolvedFailureCount": 6 "unresolvedFailureCount": 6
}, },
"Sunrise_pt-200-x1|vllm|text-generation": { "Sunrise_pt-200-x1|vllm|text-generation": {
"attributableFailureCount": 614, "attributableFailureCount": 615,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 614, "decisionTotal": 615,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 109, "ambiguous_runtime": 109,
"architecture_compatibility": 43, "architecture_compatibility": 43,
"backend_operator": 27, "backend_operator": 28,
"context_length": 34, "context_length": 34,
"framework_architecture_unsupported": 142, "framework_architecture_unsupported": 142,
"memory_capacity": 113, "memory_capacity": 113,
@@ -5444,7 +5444,7 @@
"tokenizer_compatibility": 179, "tokenizer_compatibility": 179,
"参数/模板问题": 9 "参数/模板问题": 9
}, },
"failureCount": 938, "failureCount": 939,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm", "framework": "vllm",
"pendingCount": 0, "pendingCount": 0,
@@ -5454,7 +5454,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Sunrise_pt-200-x1", "targetGpu": "Sunrise_pt-200-x1",
"taskType": "text-generation", "taskType": "text-generation",
"total": 938, "total": 939,
"unresolvedFailureCount": 118 "unresolvedFailureCount": 118
}, },
"Sunrise_pt-200-x1|vllm|unknown": { "Sunrise_pt-200-x1|vllm|unknown": {
@@ -5956,15 +5956,15 @@
"unresolvedFailureCount": 6473 "unresolvedFailureCount": 6473
}, },
"vllm": { "vllm": {
"attributableFailureCount": 3622, "attributableFailureCount": 3623,
"decisionFailureRate": 0.9739, "decisionFailureRate": 0.9739,
"decisionSuccessRate": 0.0261, "decisionSuccessRate": 0.0261,
"decisionTotal": 3719, "decisionTotal": 3720,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 1574, "ambiguous_runtime": 1574,
"architecture_compatibility": 112, "architecture_compatibility": 112,
"attention_backend": 3, "attention_backend": 3,
"backend_operator": 92, "backend_operator": 93,
"context_length": 161, "context_length": 161,
"framework_architecture_unsupported": 1357, "framework_architecture_unsupported": 1357,
"memory_capacity": 725, "memory_capacity": 725,
@@ -5975,14 +5975,14 @@
"tokenizer_compatibility": 416, "tokenizer_compatibility": 416,
"参数/模板问题": 50 "参数/模板问题": 50
}, },
"failureCount": 6116, "failureCount": 6117,
"failureRate": 0.9844, "failureRate": 0.9844,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 870, "platformFailureCount": 870,
"successCount": 97, "successCount": 97,
"successRate": 0.0156, "successRate": 0.0156,
"total": 6213, "total": 6214,
"unresolvedFailureCount": 1624 "unresolvedFailureCount": 1624
}, },
"vllm-customized": { "vllm-customized": {
@@ -6133,7 +6133,7 @@
"unresolvedFailureCount": 196 "unresolvedFailureCount": 196
} }
}, },
"generatedAt": "2026-09-26T18:22:15.098384+00:00", "generatedAt": "2026-09-26T18:28:52.846993+00:00",
"gpuSummaries": { "gpuSummaries": {
"Ascend_910-b3": { "Ascend_910-b3": {
"attributableFailureCount": 102, "attributableFailureCount": 102,
@@ -6468,14 +6468,14 @@
"unresolvedFailureCount": 299 "unresolvedFailureCount": 299
}, },
"Sunrise_pt-200-x1": { "Sunrise_pt-200-x1": {
"attributableFailureCount": 745, "attributableFailureCount": 746,
"decisionFailureRate": 0.889, "decisionFailureRate": 0.8892,
"decisionSuccessRate": 0.111, "decisionSuccessRate": 0.1108,
"decisionTotal": 838, "decisionTotal": 839,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 162, "ambiguous_runtime": 162,
"architecture_compatibility": 44, "architecture_compatibility": 44,
"backend_operator": 36, "backend_operator": 37,
"context_length": 39, "context_length": 39,
"framework_architecture_unsupported": 158, "framework_architecture_unsupported": 158,
"memory_capacity": 113, "memory_capacity": 113,
@@ -6486,14 +6486,14 @@
"参数/模板问题": 228, "参数/模板问题": 228,
"验证失败": 32 "验证失败": 32
}, },
"failureCount": 1393, "failureCount": 1394,
"failureRate": 0.9374, "failureRate": 0.9375,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 226, "platformFailureCount": 226,
"successCount": 93, "successCount": 93,
"successRate": 0.0626, "successRate": 0.0625,
"total": 1486, "total": 1487,
"unresolvedFailureCount": 422 "unresolvedFailureCount": 422
}, },
"Vastai_va16": { "Vastai_va16": {
@@ -20659,6 +20659,29 @@
"total": 3, "total": 3,
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"Sunrise_pt-200-x1|vllm|text-generation|llama|awq": {
"attributableFailureCount": 1,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"failureBreakdown": {
"backend_operator": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm",
"modelType": "llama",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "awq",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Sunrise_pt-200-x1",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
},
"Sunrise_pt-200-x1|vllm|text-generation|llama|bitsandbytes": { "Sunrise_pt-200-x1|vllm|text-generation|llama|bitsandbytes": {
"attributableFailureCount": 1, "attributableFailureCount": 1,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
@@ -48021,6 +48044,30 @@
"total": 2, "total": 2,
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"Sunrise_pt-200-x1|vllm|text-generation|llama|awq|32": {
"attributableFailureCount": 1,
"decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0,
"decisionTotal": 1,
"failureBreakdown": {
"backend_operator": 1
},
"failureCount": 1,
"failureRate": 1.0,
"framework": "vllm",
"loadSizeLog2Bucket": 32,
"modelType": "llama",
"pendingCount": 0,
"pendingRate": 0.0,
"platformFailureCount": 0,
"quantizationMethod": "awq",
"successCount": 0,
"successRate": 0.0,
"targetGpu": "Sunrise_pt-200-x1",
"taskType": "text-generation",
"total": 1,
"unresolvedFailureCount": 0
},
"Sunrise_pt-200-x1|vllm|text-generation|llama|bitsandbytes|31": { "Sunrise_pt-200-x1|vllm|text-generation|llama|bitsandbytes|31": {
"attributableFailureCount": 1, "attributableFailureCount": 1,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
@@ -50908,18 +50955,18 @@
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
} }
}, },
"terminalRecords": 17044, "terminalRecords": 17045,
"totalRecords": 17265, "totalRecords": 17266,
"totals": { "totals": {
"attributableFailureCount": 6112, "attributableFailureCount": 6113,
"decisionFailureRate": 0.8635, "decisionFailureRate": 0.8635,
"decisionSuccessRate": 0.1365, "decisionSuccessRate": 0.1365,
"decisionTotal": 7078, "decisionTotal": 7079,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 4407, "ambiguous_runtime": 4407,
"architecture_compatibility": 212, "architecture_compatibility": 212,
"attention_backend": 3, "attention_backend": 3,
"backend_operator": 127, "backend_operator": 128,
"context_length": 322, "context_length": 322,
"framework_architecture_unsupported": 2171, "framework_architecture_unsupported": 2171,
"memory_capacity": 1206, "memory_capacity": 1206,
@@ -50932,30 +50979,30 @@
"日志缺失": 719, "日志缺失": 719,
"验证失败": 676 "验证失败": 676
}, },
"failureCount": 16078, "failureCount": 16079,
"failureRate": 0.9433, "failureRate": 0.9433,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 937, "platformFailureCount": 937,
"successCount": 966, "successCount": 966,
"successRate": 0.0567, "successRate": 0.0567,
"total": 17044, "total": 17045,
"unresolvedFailureCount": 9029 "unresolvedFailureCount": 9029
}, },
"warnings": [ "warnings": [
"GPU Biren_166m 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Biren_166m 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_bi-100 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Iluvatar_bi-100 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高(≥50%),建议重点关注。", "GPU MetaX_c-500 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Mthreads_s4000 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Kunlunxin_p-800 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Kunlunxin_p-800 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。", "GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Iluvatar_bi-150 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。",
"组合 Iluvatar_bi-150|llamacpp|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Iluvatar_bi-150|llamacpp|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Sunrise_pt-200-x1|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Sunrise_pt-200-x1|vllm|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -50968,7 +51015,6 @@
"组合 Iluvatar_bi-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Iluvatar_bi-100|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Ascend_910-b4|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Ascend_910-b4|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x4|vllm-mlu|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Cambricon_mlu-370-x4|vllm-mlu|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 hygon_k100-ai|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 hygon_k100-ai|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Ascend_910-b4|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Ascend_910-b4|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|vllm-customized|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Cambricon_mlu-370-x8|vllm-customized|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -50994,10 +51040,11 @@
"组合 Cambricon_mlu-370-x4|unknown|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Cambricon_mlu-370-x4|unknown|visual-multi-modal 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Ascend_910-b4|llamacpp|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Ascend_910-b4|llamacpp|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Cambricon_mlu-370-x8|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Cambricon_mlu-370-x8|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 MetaX_c-500|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。" "组合 MetaX_c-500|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。"
] ]
}, },
"storageMode": "decision_state_only", "storageMode": "decision_state_only",
"summarizedRecords": 17265, "summarizedRecords": 17266,
"version": 1 "version": 1
} }

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -2,24 +2,24 @@
"agentVersion": "2026.09.22.1", "agentVersion": "2026.09.22.1",
"checksums": { "checksums": {
".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1", ".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1",
".modelhub_state/architecture_compatibility_blacklist.json": "371eb5dea2d75f856a56e2646d32ea1892d264cac9a7bc4aba84718aa291df82", ".modelhub_state/architecture_compatibility_blacklist.json": "405d9f4bca1b9a9fc714bb77a24b5e2454d1b0ef4f37e7df3983bd4c92a49d19",
".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab", ".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab",
".modelhub_state/market_intelligence.json": "0e995c34a5d98ffe1554153c48fe6fdef1640b16957294480450159815c7d9a1", ".modelhub_state/market_intelligence.json": "e26e2562cb56a1a3d51dfd9a62e67038ad076297334354ef2eec92272a10282e",
".modelhub_state/official_capabilities.json": "832fd782bf74f170671af2453c6da484146c5395051c294c840d36ac5d80f588", ".modelhub_state/official_capabilities.json": "1ce5162cd99631341adcc514e7e439d17aa7d9baa9619c6e9bf7bf07a5faeef4",
".modelhub_state/outcome_checkpoint.json": "eb6acad1d0a916824c09f61ef7e725857a9878eaa34aaaf1ba429ccf4cf5167b", ".modelhub_state/outcome_checkpoint.json": "597154f92d3a1203751c99611f0a9f4064c53928837bff73586e96e085a438cd",
".modelhub_state/queue_cleanup_latest.json": "69b07b4c7f0e1a61310077a9b0cf5b45c959484d402ad60f0304381993afe5e7", ".modelhub_state/queue_cleanup_latest.json": "69b07b4c7f0e1a61310077a9b0cf5b45c959484d402ad60f0304381993afe5e7",
".modelhub_state/recent_outcomes.jsonl": "94cee511bdff3336099866fb3c6afdd345089bb56c8aa0e85ff9041c08254a57", ".modelhub_state/recent_outcomes.jsonl": "94cee511bdff3336099866fb3c6afdd345089bb56c8aa0e85ff9041c08254a57",
".modelhub_state/recovery_active_tasks.jsonl": "70e5c0b9a011beb81cb63d9745d53c827a998ab37192943794b5d4454a2e2627", ".modelhub_state/recovery_active_tasks.jsonl": "9bf43b393c3df09223cd418320656d6bcf17ab964c64adfba6437a4f13a7a146",
".modelhub_state/recovery_intents.jsonl": "a85fd076184a7e754331424ee55779241fb60a267d955c83e891d3ca1d00fc59", ".modelhub_state/recovery_intents.jsonl": "e784934834cb0d449a281ee09a85b6fd3d0c0bb19922bad308712ac0aa69d46e",
".modelhub_state/routing_intelligence.json": "519577e231ce3934d8378cbf1f13f1356f0576991f528675ded72ec2b8b3c804", ".modelhub_state/routing_intelligence.json": "519577e231ce3934d8378cbf1f13f1356f0576991f528675ded72ec2b8b3c804",
".modelhub_state/submission_exclusions.jsonl": "2cd0731cd4d31bc6d844f4f0a1e510e2fc839ca66f2ce07d2664110b33374799", ".modelhub_state/submission_exclusions.jsonl": "2cd0731cd4d31bc6d844f4f0a1e510e2fc839ca66f2ce07d2664110b33374799",
".modelhub_state/worker_crashes.jsonl": "ccd40ad86ab5068ea1c3520a48fa733cf2e4b357ae5abb95ff00728d5d1b5487", ".modelhub_state/worker_crashes.jsonl": "ccd40ad86ab5068ea1c3520a48fa733cf2e4b357ae5abb95ff00728d5d1b5487",
"ledger/submissions.jsonl": "6071510b13d7fa1186e155941f35e6810e50a687772bd3064a7286c5ba918d9c", "ledger/submissions.jsonl": "6071510b13d7fa1186e155941f35e6810e50a687772bd3064a7286c5ba918d9c",
"outcomes/submissions.jsonl": "2805905ddbacf503a2b99beb34b6d9f08a789895840d024a14e7c32ab12900c8" "outcomes/submissions.jsonl": "1e5fee3284e2d77065d1ad9bda053800d053056e3b2383e701fb7bdeaeaace73"
}, },
"generation": 16732, "generation": 16733,
"phase": "cycle", "phase": "cycle",
"schemaVersion": 1, "schemaVersion": 1,
"updatedAt": "2026-09-26T18:27:50.826995+00:00", "updatedAt": "2026-09-26T18:29:46.022538+00:00",
"writerId": "08206cb1993a433e83f1d3e297db2d2e" "writerId": "08206cb1993a433e83f1d3e297db2d2e"
} }

View File

@@ -386,7 +386,6 @@
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T23:08:35.573457+00:00", "modelId": "neuralmagic/Qwen2-1.5B-Instruct-quantized.w8a8", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2245331488, "estimatedRequiredGiB": 2.522, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 2256941144, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1777088000, "modelscopeTags": ["license:apache-2.0", "model_type:qwen2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2256941144}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:06:16.550878+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4980890", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T23:08:35.573457+00:00", "modelId": "neuralmagic/Qwen2-1.5B-Instruct-quantized.w8a8", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2245331488, "estimatedRequiredGiB": 2.522, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 2256941144, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1777088000, "modelscopeTags": ["license:apache-2.0", "model_type:qwen2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2256941144}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:06:16.550878+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4980890", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T00:08:58.191977+00:00", "modelId": "Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 20683241105, "estimatedRequiredGiB": 23.138, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 20703487237, "modelscopeLicense": "apache-2.0", "modelscopeParams": 6086364400, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:apple-silicon", "custom_tag:macos", "custom_tag:speculative-decoding", "custom_tag:multi-token-prediction", "custom_tag:qwen", "custom_tag:qwen3.8", "custom_tag:mtp", "custom_tag:mtplx", "custom_tag:local-ai", "custom_tag:coding", "custom_tag:qwen3-8", "custom_tag:qwen-3.8", "custom_tag:local-llm", "custom_tag:llm", "custom_tag:m5", "custom_tag:m5-max", "custom_tag:m4", "custom_tag:m3", "custom_tag:macbook-pro", "custom_tag:mac-studio", "custom_tag:opencode", "custom_tag:claude-code", "custom_tag:27b", "custom_tag:qwen3.8-27b", "custom_tag:qwen3-8-27b"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 20703487237}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:58:54.438915+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4981854", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T00:08:58.191977+00:00", "modelId": "Youssofal/Qwen3.8-27B-MTPLX-Optimized-Speed", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 20683241105, "estimatedRequiredGiB": 23.138, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 20703487237, "modelscopeLicense": "apache-2.0", "modelscopeParams": 6086364400, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:apple-silicon", "custom_tag:macos", "custom_tag:speculative-decoding", "custom_tag:multi-token-prediction", "custom_tag:qwen", "custom_tag:qwen3.8", "custom_tag:mtp", "custom_tag:mtplx", "custom_tag:local-ai", "custom_tag:coding", "custom_tag:qwen3-8", "custom_tag:qwen-3.8", "custom_tag:local-llm", "custom_tag:llm", "custom_tag:m5", "custom_tag:m5-max", "custom_tag:m4", "custom_tag:m3", "custom_tag:macbook-pro", "custom_tag:mac-studio", "custom_tag:opencode", "custom_tag:claude-code", "custom_tag:27b", "custom_tag:qwen3.8-27b", "custom_tag:qwen3-8-27b"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 20703487237}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:58:54.438915+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4981854", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T00:08:58.192009+00:00", "modelId": "Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 29952488643, "estimatedRequiredGiB": 33.497, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 29972714678, "modelscopeLicense": "apache-2.0", "modelscopeParams": 8027131120, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:apple-silicon", "custom_tag:macos", "custom_tag:speculative-decoding", "custom_tag:multi-token-prediction", "custom_tag:qwen", "custom_tag:qwen3.8", "custom_tag:mtp", "custom_tag:mtplx", "custom_tag:local-ai", "custom_tag:coding", "custom_tag:qwen3-8", "custom_tag:qwen-3.8", "custom_tag:local-llm", "custom_tag:llm", "custom_tag:m5", "custom_tag:m5-max", "custom_tag:m4", "custom_tag:m3", "custom_tag:macbook-pro", "custom_tag:mac-studio", "custom_tag:opencode", "custom_tag:claude-code", "custom_tag:27b", "custom_tag:qwen3.8-27b", "custom_tag:qwen3-8-27b"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 29972714678}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:58:54.420086+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4981850", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T00:08:58.192009+00:00", "modelId": "Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 29952488643, "estimatedRequiredGiB": 33.497, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 29972714678, "modelscopeLicense": "apache-2.0", "modelscopeParams": 8027131120, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:apple-silicon", "custom_tag:macos", "custom_tag:speculative-decoding", "custom_tag:multi-token-prediction", "custom_tag:qwen", "custom_tag:qwen3.8", "custom_tag:mtp", "custom_tag:mtplx", "custom_tag:local-ai", "custom_tag:coding", "custom_tag:qwen3-8", "custom_tag:qwen-3.8", "custom_tag:local-llm", "custom_tag:llm", "custom_tag:m5", "custom_tag:m5-max", "custom_tag:m4", "custom_tag:m3", "custom_tag:macbook-pro", "custom_tag:mac-studio", "custom_tag:opencode", "custom_tag:claude-code", "custom_tag:27b", "custom_tag:qwen3.8-27b", "custom_tag:qwen3-8-27b"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 29972714678}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:58:54.420086+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4981850", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T00:08:58.191989+00:00", "modelId": "solidrust/Llama-3-8B-Instruct-v0.4-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5727938576, "estimatedRequiredGiB": 6.412, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5737300809, "modelscopeLicense": "other", "modelscopeParams": 8030261248, "modelscopeTags": ["license:other", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible", "custom_tag:axolotl", "custom_tag:finetune", "custom_tag:facebook", "custom_tag:meta", "custom_tag:pytorch", "custom_tag:llama", "custom_tag:llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 5737300809}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:58:54.475251+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4981857", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T00:08:58.192042+00:00", "modelId": "solidrust/Llama-3-16B-Instruct-v0.1-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 10261168632, "estimatedRequiredGiB": 11.478, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 10270608122, "modelscopeLicense": "other", "modelscopeParams": 16754741248, "modelscopeTags": ["license:other", "model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible - mergekit - merge - facebook - meta - pytorch - llama - llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 10270608122}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:58:54.480303+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4981856", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T00:08:58.192042+00:00", "modelId": "solidrust/Llama-3-16B-Instruct-v0.1-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 10261168632, "estimatedRequiredGiB": 11.478, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 10270608122, "modelscopeLicense": "other", "modelscopeParams": 16754741248, "modelscopeTags": ["license:other", "model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible - mergekit - merge - facebook - meta - pytorch - llama - llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 10270608122}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:58:54.480303+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4981856", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T00:08:58.191942+00:00", "modelId": "solidrust/Llama-3-8B-Instruct-DPO-v0.1-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5727954960, "estimatedRequiredGiB": 6.412, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5737317601, "modelscopeLicense": "other", "modelscopeParams": 8030269440, "modelscopeTags": ["license:other", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible", "custom_tag:axolotl", "custom_tag:finetune", "custom_tag:facebook", "custom_tag:meta", "custom_tag:pytorch", "custom_tag:llama", "custom_tag:llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 5737317601}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:58:54.487823+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4981859", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T00:08:58.191942+00:00", "modelId": "solidrust/Llama-3-8B-Instruct-DPO-v0.1-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5727954960, "estimatedRequiredGiB": 6.412, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5737317601, "modelscopeLicense": "other", "modelscopeParams": 8030269440, "modelscopeTags": ["license:other", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible", "custom_tag:axolotl", "custom_tag:finetune", "custom_tag:facebook", "custom_tag:meta", "custom_tag:pytorch", "custom_tag:llama", "custom_tag:llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 5737317601}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:58:54.487823+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4981859", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T00:08:58.191900+00:00", "modelId": "solidrust/Llama-3-8B-Instruct-v0.5-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5727954960, "estimatedRequiredGiB": 6.412, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5737318602, "modelscopeLicense": "other", "modelscopeParams": 8030269440, "modelscopeTags": ["license:other", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible", "custom_tag:axolotl", "custom_tag:finetune", "custom_tag:facebook", "custom_tag:meta", "custom_tag:pytorch", "custom_tag:llama", "custom_tag:llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 5737318602}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:58:54.445927+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4981853", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-21T00:08:58.191900+00:00", "modelId": "solidrust/Llama-3-8B-Instruct-v0.5-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1557c77dfe4d3dc1a68ae6b8349e7d094da7eec7752d29442a9d6d27e5f13121", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5727954960, "estimatedRequiredGiB": 6.412, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5737318602, "modelscopeLicense": "other", "modelscopeParams": 8030269440, "modelscopeTags": ["license:other", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible", "custom_tag:axolotl", "custom_tag:finetune", "custom_tag:facebook", "custom_tag:meta", "custom_tag:pytorch", "custom_tag:llama", "custom_tag:llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 5737318602}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T15:58:54.445927+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4981853", "taskType": "text-generation", "verifyResult": null}