state: generation 8720 (intent)

This commit is contained in:
2026-09-17 12:03:46 +00:00
parent cd8deb245b
commit 20584d3d9d
7 changed files with 816 additions and 816 deletions

View File

@@ -1741,7 +1741,7 @@
"taskType": "text-generation" "taskType": "text-generation"
} }
}, },
"generatedAt": "2026-09-17T12:00:18.925488+00:00", "generatedAt": "2026-09-17T12:01:22.203095+00:00",
"summary": { "summary": {
"activeBlockCount": 84, "activeBlockCount": 84,
"byGpuFramework": { "byGpuFramework": {

View File

@@ -416,7 +416,7 @@
} }
}, },
"frameworkUpdatedAt": null, "frameworkUpdatedAt": null,
"generatedAt": "2026-09-17T11:58:26.873896+00:00", "generatedAt": "2026-09-17T12:01:35.289529+00:00",
"gpuStats": { "gpuStats": {
"Ascend_910-b3": { "Ascend_910-b3": {
"available": true, "available": true,

File diff suppressed because it is too large Load Diff

View File

@@ -1,6 +1,6 @@
{ {
"generatedAt": "2026-09-17T11:44:42.225028+00:00", "generatedAt": "2026-09-17T12:01:22.158675+00:00",
"lastSyncTime": "2026-09-17T11:44:39.929678+00:00", "lastSyncTime": "2026-09-17T12:01:19.615770+00:00",
"recentLimit": 300, "recentLimit": 300,
"report": { "report": {
"architectureCompatibilityBlocks": { "architectureCompatibilityBlocks": {
@@ -2557,18 +2557,18 @@
"unresolvedFailureCount": 35 "unresolvedFailureCount": 35
}, },
"Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation": { "Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation": {
"attributableFailureCount": 56, "attributableFailureCount": 57,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 56, "decisionTotal": 57,
"failureBreakdown": { "failureBreakdown": {
"backend_operator": 3, "backend_operator": 4,
"framework_architecture_unsupported": 7, "framework_architecture_unsupported": 7,
"platform_infrastructure": 7, "platform_infrastructure": 7,
"tokenizer_compatibility": 46, "tokenizer_compatibility": 46,
"参数/模板问题": 6 "参数/模板问题": 6
}, },
"failureCount": 69, "failureCount": 70,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm_fix_tokenizer", "framework": "vllm_fix_tokenizer",
"pendingCount": 0, "pendingCount": 0,
@@ -2578,7 +2578,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Sunrise_pt-200-x1", "targetGpu": "Sunrise_pt-200-x1",
"taskType": "text-generation", "taskType": "text-generation",
"total": 69, "total": 70,
"unresolvedFailureCount": 6 "unresolvedFailureCount": 6
}, },
"Sunrise_pt-200-x1|vllm|text-generation": { "Sunrise_pt-200-x1|vllm|text-generation": {
@@ -2929,27 +2929,27 @@
"unresolvedFailureCount": 13 "unresolvedFailureCount": 13
}, },
"vllm_fix_tokenizer": { "vllm_fix_tokenizer": {
"attributableFailureCount": 59, "attributableFailureCount": 60,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 59, "decisionTotal": 60,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 64, "ambiguous_runtime": 64,
"backend_operator": 3, "backend_operator": 4,
"framework_architecture_unsupported": 9, "framework_architecture_unsupported": 9,
"model_load": 1, "model_load": 1,
"platform_infrastructure": 7, "platform_infrastructure": 7,
"tokenizer_compatibility": 46, "tokenizer_compatibility": 46,
"参数/模板问题": 8 "参数/模板问题": 8
}, },
"failureCount": 138, "failureCount": 139,
"failureRate": 1.0, "failureRate": 1.0,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 7, "platformFailureCount": 7,
"successCount": 0, "successCount": 0,
"successRate": 0.0, "successRate": 0.0,
"total": 138, "total": 139,
"unresolvedFailureCount": 72 "unresolvedFailureCount": 72
}, },
"vllm_tokenizer_patch": { "vllm_tokenizer_patch": {
@@ -2972,7 +2972,7 @@
"unresolvedFailureCount": 8 "unresolvedFailureCount": 8
} }
}, },
"generatedAt": "2026-09-17T11:44:42.219868+00:00", "generatedAt": "2026-09-17T12:01:22.151198+00:00",
"gpuSummaries": { "gpuSummaries": {
"Ascend_910-b3": { "Ascend_910-b3": {
"attributableFailureCount": 56, "attributableFailureCount": 56,
@@ -3237,13 +3237,13 @@
"unresolvedFailureCount": 90 "unresolvedFailureCount": 90
}, },
"Sunrise_pt-200-x1": { "Sunrise_pt-200-x1": {
"attributableFailureCount": 68, "attributableFailureCount": 69,
"decisionFailureRate": 0.9855, "decisionFailureRate": 0.9857,
"decisionSuccessRate": 0.0145, "decisionSuccessRate": 0.0143,
"decisionTotal": 69, "decisionTotal": 70,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 1, "ambiguous_runtime": 1,
"backend_operator": 4, "backend_operator": 5,
"framework_architecture_unsupported": 12, "framework_architecture_unsupported": 12,
"memory_capacity": 1, "memory_capacity": 1,
"platform_infrastructure": 9, "platform_infrastructure": 9,
@@ -3251,14 +3251,14 @@
"参数/模板问题": 18, "参数/模板问题": 18,
"验证失败": 32 "验证失败": 32
}, },
"failureCount": 128, "failureCount": 129,
"failureRate": 0.9922, "failureRate": 0.9923,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 9, "platformFailureCount": 9,
"successCount": 1, "successCount": 1,
"successRate": 0.0078, "successRate": 0.0077,
"total": 129, "total": 130,
"unresolvedFailureCount": 51 "unresolvedFailureCount": 51
}, },
"Vastai_va16": { "Vastai_va16": {
@@ -6506,14 +6506,14 @@
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation|llama|awq": { "Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation|llama|awq": {
"attributableFailureCount": 2, "attributableFailureCount": 3,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 2, "decisionTotal": 3,
"failureBreakdown": { "failureBreakdown": {
"backend_operator": 2 "backend_operator": 3
}, },
"failureCount": 2, "failureCount": 3,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm_fix_tokenizer", "framework": "vllm_fix_tokenizer",
"modelType": "llama", "modelType": "llama",
@@ -6525,7 +6525,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Sunrise_pt-200-x1", "targetGpu": "Sunrise_pt-200-x1",
"taskType": "text-generation", "taskType": "text-generation",
"total": 2, "total": 3,
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation|llama|compressed-tensors": { "Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation|llama|compressed-tensors": {
@@ -12367,14 +12367,14 @@
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation|llama|awq|32": { "Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation|llama|awq|32": {
"attributableFailureCount": 1, "attributableFailureCount": 2,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 1, "decisionTotal": 2,
"failureBreakdown": { "failureBreakdown": {
"backend_operator": 1 "backend_operator": 2
}, },
"failureCount": 1, "failureCount": 2,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm_fix_tokenizer", "framework": "vllm_fix_tokenizer",
"loadSizeLog2Bucket": 32, "loadSizeLog2Bucket": 32,
@@ -12387,7 +12387,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Sunrise_pt-200-x1", "targetGpu": "Sunrise_pt-200-x1",
"taskType": "text-generation", "taskType": "text-generation",
"total": 1, "total": 2,
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation|llama|awq|33": { "Sunrise_pt-200-x1|vllm_fix_tokenizer|text-generation|llama|awq|33": {
@@ -12968,16 +12968,16 @@
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
} }
}, },
"terminalRecords": 2130, "terminalRecords": 2131,
"totalRecords": 2233, "totalRecords": 2234,
"totals": { "totals": {
"attributableFailureCount": 700, "attributableFailureCount": 701,
"decisionFailureRate": 0.8838, "decisionFailureRate": 0.884,
"decisionSuccessRate": 0.1162, "decisionSuccessRate": 0.116,
"decisionTotal": 792, "decisionTotal": 793,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 522, "ambiguous_runtime": 522,
"backend_operator": 49, "backend_operator": 50,
"framework_architecture_unsupported": 467, "framework_architecture_unsupported": 467,
"memory_capacity": 12, "memory_capacity": 12,
"model_load": 85, "model_load": 85,
@@ -12988,14 +12988,14 @@
"参数/模板问题": 133, "参数/模板问题": 133,
"验证失败": 673 "验证失败": 673
}, },
"failureCount": 2038, "failureCount": 2039,
"failureRate": 0.9568, "failureRate": 0.9568,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 10, "platformFailureCount": 10,
"successCount": 92, "successCount": 92,
"successRate": 0.0432, "successRate": 0.0432,
"total": 2130, "total": 2131,
"unresolvedFailureCount": 1328 "unresolvedFailureCount": 1328
}, },
"warnings": [ "warnings": [
@@ -13003,14 +13003,14 @@
"GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Iluvatar_mrv-100 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Sunrise_pt-200-x1 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Ascend_910-b4 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Biren_166m 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Biren_166m 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Iluvatar_bi-150 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Iluvatar_bi-150 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。", "GPU hygon_k100-ai 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Cambricon_mlu-370-x4 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Ascend_910-b3 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Cambricon_mlu-370-x8 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。", "GPU Vastai_va16 本地统计失败率偏高(≥50%),建议重点关注。",
"GPU MetaX_c-500 本地统计失败率偏高(≥50%),建议重点关注。",
"组合 Biren_166m|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Biren_166m|unknown|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Ascend_910-b4|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Ascend_910-b4|vllm_tokenizer_patch|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
"组合 Biren_166m|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。", "组合 Biren_166m|vllm|text-generation 近期失败集中,建议降低该 GPU+框架的提交优先级。",
@@ -13036,6 +13036,6 @@
] ]
}, },
"storageMode": "decision_state_only", "storageMode": "decision_state_only",
"summarizedRecords": 2233, "summarizedRecords": 2234,
"version": 1 "version": 1
} }

View File

@@ -860,6 +860,7 @@
{"batchId": "daeb14c26abd4648a4bb985321b158c8", "completedAt": "2026-09-17T11:10:25.999930+00:00", "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configSource": "modelhub_live", "createdAt": "2026-09-17T11:10:15.723589+00:00", "framework": "vllm_tokenizer_patch", "intentId": "e4100d6a521b4d6d9680f77771199959", "lastModified": "2026-09-17T10:58:53+00:00", "modelAddress": "https://modelscope.cn/models/SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "reason": null, "reconciledAt": "2026-09-17T11:54:39.287798+00:00", "repoId": "SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "Ascend_910-b3", "taskId": "4913855", "taskType": "text-generation"} {"batchId": "daeb14c26abd4648a4bb985321b158c8", "completedAt": "2026-09-17T11:10:25.999930+00:00", "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configSource": "modelhub_live", "createdAt": "2026-09-17T11:10:15.723589+00:00", "framework": "vllm_tokenizer_patch", "intentId": "e4100d6a521b4d6d9680f77771199959", "lastModified": "2026-09-17T10:58:53+00:00", "modelAddress": "https://modelscope.cn/models/SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "reason": null, "reconciledAt": "2026-09-17T11:54:39.287798+00:00", "repoId": "SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "Ascend_910-b3", "taskId": "4913855", "taskType": "text-generation"}
{"batchId": "3aed3a83a2c44d80b4f4dcd609349a5a", "completedAt": "2026-09-17T11:29:59.295458+00:00", "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configSource": "modelhub_live", "createdAt": "2026-09-17T11:29:51.205749+00:00", "framework": "vllm", "intentId": "70eeb0029c374496bc2bbc4a75d064eb", "lastModified": "2026-09-17T10:58:53+00:00", "modelAddress": "https://modelscope.cn/models/SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "reason": null, "reconciledAt": "2026-09-17T11:54:39.288480+00:00", "repoId": "SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "Iluvatar_mrv-100", "taskId": "4914037", "taskType": "text-generation"} {"batchId": "3aed3a83a2c44d80b4f4dcd609349a5a", "completedAt": "2026-09-17T11:29:59.295458+00:00", "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configSource": "modelhub_live", "createdAt": "2026-09-17T11:29:51.205749+00:00", "framework": "vllm", "intentId": "70eeb0029c374496bc2bbc4a75d064eb", "lastModified": "2026-09-17T10:58:53+00:00", "modelAddress": "https://modelscope.cn/models/SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "reason": null, "reconciledAt": "2026-09-17T11:54:39.288480+00:00", "repoId": "SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "Iluvatar_mrv-100", "taskId": "4914037", "taskType": "text-generation"}
{"batchId": "8945850c54474ace88a46646a7b4b159", "completedAt": "2026-09-17T11:46:33.749715+00:00", "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configSource": "modelhub_live", "createdAt": "2026-09-17T11:46:21.395742+00:00", "framework": "vllm-patch-tokenizer", "intentId": "9913cca63f0c4fe3856fa61ac838d07f", "lastModified": "2026-09-17T10:58:53+00:00", "modelAddress": "https://modelscope.cn/models/SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "reason": null, "reconciledAt": "2026-09-17T11:54:39.287796+00:00", "repoId": "SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "hygon_k100-ai", "taskId": "4914180", "taskType": "text-generation"} {"batchId": "8945850c54474ace88a46646a7b4b159", "completedAt": "2026-09-17T11:46:33.749715+00:00", "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configSource": "modelhub_live", "createdAt": "2026-09-17T11:46:21.395742+00:00", "framework": "vllm-patch-tokenizer", "intentId": "9913cca63f0c4fe3856fa61ac838d07f", "lastModified": "2026-09-17T10:58:53+00:00", "modelAddress": "https://modelscope.cn/models/SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "reason": null, "reconciledAt": "2026-09-17T11:54:39.287796+00:00", "repoId": "SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "hygon_k100-ai", "taskId": "4914180", "taskType": "text-generation"}
{"batchId": "e833fd41618d461fa526347a420e09ee", "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configSource": "modelhub_live", "createdAt": "2026-09-17T12:03:46.742535+00:00", "framework": "vllm", "intentId": "0c6db9d6378c4dc8aea34ad8009a9d17", "lastModified": "2026-09-17T10:58:53+00:00", "modelAddress": "https://modelscope.cn/models/SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "repoId": "SyonLi/Qwen3-4B-Instruct-2507-Segmenter", "safeConfigVector": {"dtype": "-", "gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Mthreads_s4000", "taskType": "text-generation"}
{"batchId": "dc557ed173284456b65de02d89689bdd", "completedAt": "2026-09-17T07:00:50.030789+00:00", "configFingerprint": "5ec090e92fba0f8471f90bb0af176a745ebf9604ae8d9957761f2bdcf7b7b894", "configSource": "modelhub_live", "createdAt": "2026-09-17T07:00:42.703320+00:00", "framework": "llamacpp", "intentId": "1e106c48321a4cdea39458e2629ff129", "repoId": "voconly/cohere-transcribe-03-2026-gguf", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "uniqueness_rejected", "targetGpu": "hygon_k100-ai", "taskId": null, "taskType": "text-generation"} {"batchId": "dc557ed173284456b65de02d89689bdd", "completedAt": "2026-09-17T07:00:50.030789+00:00", "configFingerprint": "5ec090e92fba0f8471f90bb0af176a745ebf9604ae8d9957761f2bdcf7b7b894", "configSource": "modelhub_live", "createdAt": "2026-09-17T07:00:42.703320+00:00", "framework": "llamacpp", "intentId": "1e106c48321a4cdea39458e2629ff129", "repoId": "voconly/cohere-transcribe-03-2026-gguf", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "uniqueness_rejected", "targetGpu": "hygon_k100-ai", "taskId": null, "taskType": "text-generation"}
{"batchId": "534b216536f14acab0831df3cca7c8b7", "completedAt": "2026-09-17T06:49:28.237705+00:00", "configFingerprint": "4ecf9a1a055b517fbf32a3498eaaf4a2d63b1c33abbcc170dd75fdec6cec9dc6", "configSource": "modelhub_live", "createdAt": "2026-09-17T06:49:18.457343+00:00", "framework": "llamacpp", "intentId": "b99b4231abe54ea698f0d5b126b52b6e", "repoId": "voconly/cohere-transcribe-03-2026-gguf", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 2048}, "status": "uniqueness_rejected", "targetGpu": "Mthreads_s4000", "taskId": null, "taskType": "text-generation"} {"batchId": "534b216536f14acab0831df3cca7c8b7", "completedAt": "2026-09-17T06:49:28.237705+00:00", "configFingerprint": "4ecf9a1a055b517fbf32a3498eaaf4a2d63b1c33abbcc170dd75fdec6cec9dc6", "configSource": "modelhub_live", "createdAt": "2026-09-17T06:49:18.457343+00:00", "framework": "llamacpp", "intentId": "b99b4231abe54ea698f0d5b126b52b6e", "repoId": "voconly/cohere-transcribe-03-2026-gguf", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 2048}, "status": "uniqueness_rejected", "targetGpu": "Mthreads_s4000", "taskId": null, "taskType": "text-generation"}
{"batchId": "88766ff730f64477804cc1605a44aaef", "completedAt": "2026-09-17T06:47:36.731565+00:00", "configFingerprint": "1ab708db1a2ba32a19914fb2b2a3e2674a900769ee64ff9790813f664f2605cb", "configSource": "modelhub_live", "createdAt": "2026-09-17T06:47:30.033650+00:00", "framework": "llamacpp", "intentId": "ab6c54fec18f414bae4f6b66156c2c6a", "repoId": "voconly/cohere-transcribe-03-2026-gguf", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "uniqueness_rejected", "targetGpu": "Ascend_910-b4", "taskId": null, "taskType": "text-generation"} {"batchId": "88766ff730f64477804cc1605a44aaef", "completedAt": "2026-09-17T06:47:36.731565+00:00", "configFingerprint": "1ab708db1a2ba32a19914fb2b2a3e2674a900769ee64ff9790813f664f2605cb", "configSource": "modelhub_live", "createdAt": "2026-09-17T06:47:30.033650+00:00", "framework": "llamacpp", "intentId": "ab6c54fec18f414bae4f6b66156c2c6a", "repoId": "voconly/cohere-transcribe-03-2026-gguf", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "uniqueness_rejected", "targetGpu": "Ascend_910-b4", "taskId": null, "taskType": "text-generation"}

View File

@@ -1,24 +1,24 @@
{ {
"agentVersion": "2026.09.04.4", "agentVersion": "2026.09.04.4",
"checksums": { "checksums": {
".modelhub_state/architecture_compatibility_blacklist.json": "9bfd3bec78db8c1e99831a7b1742f2cd78e6e86cac580d9faddf0fb0f1a08143", ".modelhub_state/architecture_compatibility_blacklist.json": "73cc1a6e92b4ee25bcd63fefdf43d649dd2ae1ad9af988453b9b7ed31f994557",
".modelhub_state/architecture_history_backfill.json": "37482139856f3a8c5d730ba9d523f8e01b0101d8fea9263d6c167ee41a58d4cc", ".modelhub_state/architecture_history_backfill.json": "37482139856f3a8c5d730ba9d523f8e01b0101d8fea9263d6c167ee41a58d4cc",
".modelhub_state/market_intelligence.json": "5b8bdd0f5da49476ee8b9a6007f1dc636a7e1946b4c306c62e290b3d930d696f", ".modelhub_state/market_intelligence.json": "5b251209fb7c6ae5e17c14f4e74f0786eb82e5bb79b614f37da1e019a61108cd",
".modelhub_state/official_capabilities.json": "9df415b7b53d650a9580f795abf31d90df9f6ee0018a356beda2e9a2da577822", ".modelhub_state/official_capabilities.json": "46c3ad12f17e26afbb5b3d60f2a3d2fba0565e94c142eb9c597ba968bbe8a5ad",
".modelhub_state/outcome_checkpoint.json": "be80d32f8ce103eea656ffb10693f9125cf0b28948df8d1b93eed9347be43d1e", ".modelhub_state/outcome_checkpoint.json": "234b947c1113da20705f50c9e694e856cce6644a9c77c4d7a64879ae692033d2",
".modelhub_state/queue_cleanup_latest.json": "4be02869ade05ead6def3f33db6297b95930841c24c0c7cab3372f7790acadd8", ".modelhub_state/queue_cleanup_latest.json": "4be02869ade05ead6def3f33db6297b95930841c24c0c7cab3372f7790acadd8",
".modelhub_state/recent_outcomes.jsonl": "a391daf68a87578021331c170ae71dca18bd55fe9c4e61e89058aa2daac29778", ".modelhub_state/recent_outcomes.jsonl": "a391daf68a87578021331c170ae71dca18bd55fe9c4e61e89058aa2daac29778",
".modelhub_state/recovery_active_tasks.jsonl": "c9b9de8d55f1c5456bf0d303a8a1e484d4c4f41a52d90839a2c0a9e66b3660c2", ".modelhub_state/recovery_active_tasks.jsonl": "c9b9de8d55f1c5456bf0d303a8a1e484d4c4f41a52d90839a2c0a9e66b3660c2",
".modelhub_state/recovery_intents.jsonl": "77f1b45a05a61490273676290d40b6e21a630f54c1f003145e76d7d6f7fc8c75", ".modelhub_state/recovery_intents.jsonl": "0f58f866578187f616af6a4b0c755f21f6591df34d995c702ddc4aca927830e8",
".modelhub_state/routing_intelligence.json": "7f7debff76296358f6434126c5969fae45a7a5f0bdeffa6bc30a36822f7e00f4", ".modelhub_state/routing_intelligence.json": "7f7debff76296358f6434126c5969fae45a7a5f0bdeffa6bc30a36822f7e00f4",
".modelhub_state/submission_exclusions.jsonl": "a0cb4e822e4b6d26c26c3bf22698cacbab31f2df5f3402ecf04fdfb3a3577ef7", ".modelhub_state/submission_exclusions.jsonl": "a0cb4e822e4b6d26c26c3bf22698cacbab31f2df5f3402ecf04fdfb3a3577ef7",
".modelhub_state/worker_crashes.jsonl": "b41d1dda7bab11bedd96de40fecd2d416e47396901b3283f48a56de5d6348983", ".modelhub_state/worker_crashes.jsonl": "b41d1dda7bab11bedd96de40fecd2d416e47396901b3283f48a56de5d6348983",
"ledger/submissions.jsonl": "51ae634e66ac73fae20bb785a84861282fe12e70f94d3626dbb8aa5e0573290c", "ledger/submissions.jsonl": "51ae634e66ac73fae20bb785a84861282fe12e70f94d3626dbb8aa5e0573290c",
"outcomes/submissions.jsonl": "ff8f059ce4de502aa87aa6789d99182ee1921404c12fba53cb23aba648123ccc" "outcomes/submissions.jsonl": "c7a28dd7adc04fc0040def5ee4c9d1a26259ce549e9b88d3bf135aa9f08fcd6a"
}, },
"generation": 8719, "generation": 8720,
"phase": "cycle", "phase": "intent",
"schemaVersion": 1, "schemaVersion": 1,
"updatedAt": "2026-09-17T12:00:19.012057+00:00", "updatedAt": "2026-09-17T12:03:46.884167+00:00",
"writerId": "eccb3e0018f640d19e578c271a207b5c" "writerId": "eccb3e0018f640d19e578c271a207b5c"
} }

View File

@@ -2,7 +2,6 @@
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T12:29:56.904005+00:00", "modelId": "bharatgenai/Param2-17B-A2.4B-Thinking", "modelProfile": {"architectures": ["Param2MoEForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 34302758832, "estimatedRequiredGiB": 38.353, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "param2moe", "modelscopeFileSize": 34317809830, "modelscopeLicense": null, "modelscopeParams": 17151125376, "modelscopeTags": ["model_type:param2moe", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:mixture-of-experts", "custom_tag:multilingual", "custom_tag:indian-languages"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 34317809830}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T04:29:16.672536+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4611191", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T12:29:56.904005+00:00", "modelId": "bharatgenai/Param2-17B-A2.4B-Thinking", "modelProfile": {"architectures": ["Param2MoEForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 34302758832, "estimatedRequiredGiB": 38.353, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "param2moe", "modelscopeFileSize": 34317809830, "modelscopeLicense": null, "modelscopeParams": 17151125376, "modelscopeTags": ["model_type:param2moe", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:mixture-of-experts", "custom_tag:multilingual", "custom_tag:indian-languages"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 34317809830}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T04:29:16.672536+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4611191", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T12:29:56.903997+00:00", "modelId": "solidrust/Llama-3-8B-Instruct-v0.4-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5727938576, "estimatedRequiredGiB": 6.412, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5737300809, "modelscopeLicense": "other", "modelscopeParams": 8030261248, "modelscopeTags": ["license:other", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible", "custom_tag:axolotl", "custom_tag:finetune", "custom_tag:facebook", "custom_tag:meta", "custom_tag:pytorch", "custom_tag:llama", "custom_tag:llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 5737300809}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T04:29:16.656478+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4611189", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T12:29:56.903997+00:00", "modelId": "solidrust/Llama-3-8B-Instruct-v0.4-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5727938576, "estimatedRequiredGiB": 6.412, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5737300809, "modelscopeLicense": "other", "modelscopeParams": 8030261248, "modelscopeTags": ["license:other", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible", "custom_tag:axolotl", "custom_tag:finetune", "custom_tag:facebook", "custom_tag:meta", "custom_tag:pytorch", "custom_tag:llama", "custom_tag:llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 5737300809}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T04:29:16.656478+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4611189", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T12:43:05.302336+00:00", "modelId": "solidrust/Llama-3-8B-Instruct-DPO-v0.1-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5727954960, "estimatedRequiredGiB": 6.412, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5737317601, "modelscopeLicense": "other", "modelscopeParams": 8030269440, "modelscopeTags": ["license:other", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible", "custom_tag:axolotl", "custom_tag:finetune", "custom_tag:facebook", "custom_tag:meta", "custom_tag:pytorch", "custom_tag:llama", "custom_tag:llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 5737317601}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T04:34:21.517356+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4611266", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T12:43:05.302336+00:00", "modelId": "solidrust/Llama-3-8B-Instruct-DPO-v0.1-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5727954960, "estimatedRequiredGiB": 6.412, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 5737317601, "modelscopeLicense": "other", "modelscopeParams": 8030269440, "modelscopeTags": ["license:other", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible", "custom_tag:axolotl", "custom_tag:finetune", "custom_tag:facebook", "custom_tag:meta", "custom_tag:pytorch", "custom_tag:llama", "custom_tag:llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 5737317601}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T04:34:21.517356+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4611266", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T12:43:05.302344+00:00", "modelId": "solidrust/Llama-3-11B-Instruct-v0.1-AWQ", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7541230432, "estimatedRequiredGiB": 8.438, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 7550622334, "modelscopeLicense": "other", "modelscopeParams": 11520053248, "modelscopeTags": ["license:other", "model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:4-bit", "custom_tag:AWQ", "custom_tag:text-generation", "custom_tag:autotrain_compatible", "custom_tag:endpoints_compatible", "custom_tag:mergekit", "custom_tag:merge", "custom_tag:facebook", "custom_tag:meta", "custom_tag:pytorch", "custom_tag:llama", "custom_tag:llama-3"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "awq", "repositoryOnDiskBytes": 7550622334}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T04:34:21.520300+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4611267", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "llamacpp", "lastSyncTime": "2026-09-04T12:43:05.302313+00:00", "modelId": "b77968543/Spark-X2.5-4B-Q8_0", "modelProfile": {"architectures": [], "configFingerprint": "054a7592edf89d789e18b12765c567c3c34b2ebb58661fdd49255aad03c66d40", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4375021152, "estimatedRequiredGiB": 4.889, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": null, "modelscopeFileSize": 4375025003, "modelscopeLicense": null, "modelscopeParams": 4112079360, "modelscopeTags": ["library:gguf", "library:", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 4375025003}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T04:40:16.372199+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4611339", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "llamacpp", "lastSyncTime": "2026-09-04T12:43:05.302313+00:00", "modelId": "b77968543/Spark-X2.5-4B-Q8_0", "modelProfile": {"architectures": [], "configFingerprint": "054a7592edf89d789e18b12765c567c3c34b2ebb58661fdd49255aad03c66d40", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4375021152, "estimatedRequiredGiB": 4.889, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "modelhub_preflight_oom:24"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": null, "modelscopeFileSize": 4375025003, "modelscopeLicense": null, "modelscopeParams": 4112079360, "modelscopeTags": ["library:gguf", "library:", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 4375025003}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T04:40:16.372199+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "4611339", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-04T15:14:29.722109+00:00", "modelId": "Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality-FP16", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 29952487299, "estimatedRequiredGiB": 33.498, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "manufacturer_spec", "sourceUrl": "https://www.birentech.com/news/id6rz98v3obczy77cmxzfgk3/"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 29973198172, "modelscopeLicense": "apache-2.0", "modelscopeParams": 8027131120, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:apple-silicon", "custom_tag:macos", "custom_tag:m1", "custom_tag:m2", "custom_tag:fp16", "custom_tag:speculative-decoding", "custom_tag:multi-token-prediction", "custom_tag:qwen", "custom_tag:qwen3.8", "custom_tag:mtp", "custom_tag:mtplx", "custom_tag:local-ai", "custom_tag:coding"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 29973198172}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T07:12:30.054811+00:00", "targetGpu": "Biren_166m", "taskId": "4621809", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-04T15:14:29.722109+00:00", "modelId": "Youssofal/Qwen3.8-27B-MTPLX-Optimized-Quality-FP16", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 29952487299, "estimatedRequiredGiB": 33.498, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "manufacturer_spec", "sourceUrl": "https://www.birentech.com/news/id6rz98v3obczy77cmxzfgk3/"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 29973198172, "modelscopeLicense": "apache-2.0", "modelscopeParams": 8027131120, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:apple-silicon", "custom_tag:macos", "custom_tag:m1", "custom_tag:m2", "custom_tag:fp16", "custom_tag:speculative-decoding", "custom_tag:multi-token-prediction", "custom_tag:qwen", "custom_tag:qwen3.8", "custom_tag:mtp", "custom_tag:mtplx", "custom_tag:local-ai", "custom_tag:coding"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 29973198172}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T07:12:30.054811+00:00", "targetGpu": "Biren_166m", "taskId": "4621809", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T22:53:17.234593+00:00", "modelId": "amd/gpt-oss-20b-BF16-w8a8-llmcompressor", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 44193251544, "estimatedRequiredGiB": 49.422, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 22125413673, "modelscopeLicense": "apache-2.0", "modelscopeParams": 20914757184, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:quantized", "custom_tag:int8", "custom_tag:w8a8", "custom_tag:dynamic-quantization", "custom_tag:8-bit", "custom_tag:llm-compressor", "custom_tag:compressed-tensors", "custom_tag:zendnn", "custom_tag:amd", "custom_tag:cpu-inference"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 44221632439}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T14:46:47.882785+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4628625", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-04T22:53:17.234593+00:00", "modelId": "amd/gpt-oss-20b-BF16-w8a8-llmcompressor", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 44193251544, "estimatedRequiredGiB": 49.422, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "modelhub_preflight_oom:36"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 22125413673, "modelscopeLicense": "apache-2.0", "modelscopeParams": 20914757184, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:quantized", "custom_tag:int8", "custom_tag:w8a8", "custom_tag:dynamic-quantization", "custom_tag:8-bit", "custom_tag:llm-compressor", "custom_tag:compressed-tensors", "custom_tag:zendnn", "custom_tag:amd", "custom_tag:cpu-inference"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 44221632439}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-04T14:46:47.882785+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4628625", "taskType": "text-generation", "verifyResult": null}