state: generation 10872 (intent)

This commit is contained in:
2026-09-20 20:13:09 +00:00
parent f6b7b2d926
commit 029441a391
6 changed files with 26 additions and 14 deletions

View File

@@ -2165,7 +2165,7 @@
"taskType": "text-generation" "taskType": "text-generation"
} }
}, },
"generatedAt": "2026-09-20T20:09:30.119223+00:00", "generatedAt": "2026-09-20T20:13:02.030852+00:00",
"summary": { "summary": {
"activeBlockCount": 106, "activeBlockCount": 106,
"byGpuFramework": { "byGpuFramework": {

View File

@@ -425,7 +425,7 @@
} }
}, },
"frameworkUpdatedAt": null, "frameworkUpdatedAt": null,
"generatedAt": "2026-09-20T20:11:59.656785+00:00", "generatedAt": "2026-09-20T20:13:09.032189+00:00",
"gpuStats": { "gpuStats": {
"Ascend_910-b3": { "Ascend_910-b3": {
"available": true, "available": true,

View File

@@ -1,5 +1,5 @@
{ {
"catalogUpdatedAt": "2026-09-20T20:11:59.656785+00:00", "catalogUpdatedAt": "2026-09-20T20:13:09.032189+00:00",
"configuredTaskTypes": [ "configuredTaskTypes": [
"text-generation" "text-generation"
], ],
@@ -56,7 +56,7 @@
"time-series-forecasting" "time-series-forecasting"
], ],
"errors": [], "errors": [],
"generatedAt": "2026-09-20T20:11:59.656785+00:00", "generatedAt": "2026-09-20T20:13:09.032189+00:00",
"gpuCatalog": { "gpuCatalog": {
"Ascend_910-b3": { "Ascend_910-b3": {
"canVerify": true, "canVerify": true,
@@ -6380,6 +6380,6 @@
"updateTime": "2025-12-22 08:59:53" "updateTime": "2025-12-22 08:59:53"
} }
], ],
"taskTreeUpdatedAt": "2026-09-20T20:11:59.656785+00:00", "taskTreeUpdatedAt": "2026-09-20T20:13:09.032189+00:00",
"version": 1 "version": 1
} }

View File

@@ -1806,6 +1806,18 @@
{"batchId": "cd7e8ec006ed4518b2c7bbea62e578e7", "completedAt": "2026-09-20T20:09:24.578625+00:00", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:09:22.950262+00:00", "framework": "transformers", "intentId": "cb8eab032eff4ad889e43272ab9b70c2", "lastModified": "2026-09-16T17:13:44+00:00", "modelAddress": "https://modelscope.cn/models/mlx-community/LFM2.5-1.2B-Instruct-4bit", "reason": null, "reconciledAt": "2026-09-20T20:09:44.929975+00:00", "repoId": "mlx-community/LFM2.5-1.2B-Instruct-4bit", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "Iluvatar_bi-100", "taskId": "4986872", "taskType": "text-generation"} {"batchId": "cd7e8ec006ed4518b2c7bbea62e578e7", "completedAt": "2026-09-20T20:09:24.578625+00:00", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:09:22.950262+00:00", "framework": "transformers", "intentId": "cb8eab032eff4ad889e43272ab9b70c2", "lastModified": "2026-09-16T17:13:44+00:00", "modelAddress": "https://modelscope.cn/models/mlx-community/LFM2.5-1.2B-Instruct-4bit", "reason": null, "reconciledAt": "2026-09-20T20:09:44.929975+00:00", "repoId": "mlx-community/LFM2.5-1.2B-Instruct-4bit", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "Iluvatar_bi-100", "taskId": "4986872", "taskType": "text-generation"}
{"batchId": "cd7e8ec006ed4518b2c7bbea62e578e7", "completedAt": "2026-09-20T20:09:24.578631+00:00", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:09:22.950385+00:00", "framework": "transformers", "intentId": "9b1e75d077514f818695965b3dcf3333", "lastModified": "2026-09-15T15:11:14+00:00", "modelAddress": "https://modelscope.cn/models/mlx-community/gemma-4-e2b-it-qat-OptiQ-4bit", "reason": null, "reconciledAt": "2026-09-20T20:09:44.929972+00:00", "repoId": "mlx-community/gemma-4-e2b-it-qat-OptiQ-4bit", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "Iluvatar_bi-100", "taskId": "4986873", "taskType": "text-generation"} {"batchId": "cd7e8ec006ed4518b2c7bbea62e578e7", "completedAt": "2026-09-20T20:09:24.578631+00:00", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:09:22.950385+00:00", "framework": "transformers", "intentId": "9b1e75d077514f818695965b3dcf3333", "lastModified": "2026-09-15T15:11:14+00:00", "modelAddress": "https://modelscope.cn/models/mlx-community/gemma-4-e2b-it-qat-OptiQ-4bit", "reason": null, "reconciledAt": "2026-09-20T20:09:44.929972+00:00", "repoId": "mlx-community/gemma-4-e2b-it-qat-OptiQ-4bit", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "Iluvatar_bi-100", "taskId": "4986873", "taskType": "text-generation"}
{"batchId": "cd7e8ec006ed4518b2c7bbea62e578e7", "completedAt": "2026-09-20T20:09:24.578639+00:00", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:09:22.950568+00:00", "framework": "transformers", "intentId": "91f04ef9a08944d2b0fb04599a84b5f5", "lastModified": "2026-09-16T17:28:41+00:00", "modelAddress": "https://modelscope.cn/models/mlx-community/LFM2.5-1.2B-Thinking-8bit", "reason": null, "reconciledAt": "2026-09-20T20:09:44.932277+00:00", "repoId": "mlx-community/LFM2.5-1.2B-Thinking-8bit", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "Iluvatar_bi-100", "taskId": "4986875", "taskType": "text-generation"} {"batchId": "cd7e8ec006ed4518b2c7bbea62e578e7", "completedAt": "2026-09-20T20:09:24.578639+00:00", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:09:22.950568+00:00", "framework": "transformers", "intentId": "91f04ef9a08944d2b0fb04599a84b5f5", "lastModified": "2026-09-16T17:28:41+00:00", "modelAddress": "https://modelscope.cn/models/mlx-community/LFM2.5-1.2B-Thinking-8bit", "reason": null, "reconciledAt": "2026-09-20T20:09:44.932277+00:00", "repoId": "mlx-community/LFM2.5-1.2B-Thinking-8bit", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "Iluvatar_bi-100", "taskId": "4986875", "taskType": "text-generation"}
{"batchId": "20edaee5f25d4ee0b9c7b8ab0636d504", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:13:09.278748+00:00", "framework": "transformers", "intentId": "5d013b609d934918bff6843a95aaab3f", "lastModified": "2026-09-18T05:43:55+00:00", "modelAddress": "https://modelscope.cn/models/prism-ml/Ternary-Bonsai-2-27B-mlx-2bit", "repoId": "prism-ml/Ternary-Bonsai-2-27B-mlx-2bit", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Iluvatar_bi-100", "taskType": "text-generation"}
{"batchId": "20edaee5f25d4ee0b9c7b8ab0636d504", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:13:09.278890+00:00", "framework": "transformers", "intentId": "4900a306e0ab4ddaa522355243d1c8d5", "lastModified": "2026-09-16T16:38:45+00:00", "modelAddress": "https://modelscope.cn/models/RedHatAI/gemma-4-12B-it-FP8-Dynamic", "repoId": "RedHatAI/gemma-4-12B-it-FP8-Dynamic", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Iluvatar_bi-100", "taskType": "text-generation"}
{"batchId": "20edaee5f25d4ee0b9c7b8ab0636d504", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:13:09.278958+00:00", "framework": "transformers", "intentId": "667f6b4f66f24ef0b3e58f204ff9f22e", "lastModified": "2026-09-17T08:53:56+00:00", "modelAddress": "https://modelscope.cn/models/Edge0/Edge0-35B-A3B-preview", "repoId": "Edge0/Edge0-35B-A3B-preview", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Iluvatar_bi-100", "taskType": "text-generation"}
{"batchId": "20edaee5f25d4ee0b9c7b8ab0636d504", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:13:09.279021+00:00", "framework": "transformers", "intentId": "ab8bbbefa7a14d98a1e595d10aabda9e", "lastModified": "2026-09-14T10:29:22+00:00", "modelAddress": "https://modelscope.cn/models/hcnote/SparkMuse-4B", "repoId": "hcnote/SparkMuse-4B", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Iluvatar_bi-100", "taskType": "text-generation"}
{"batchId": "20edaee5f25d4ee0b9c7b8ab0636d504", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:13:09.279083+00:00", "framework": "transformers", "intentId": "9a347d7c594540d4a1921ade1851dadf", "lastModified": "2026-09-17T08:55:16+00:00", "modelAddress": "https://modelscope.cn/models/Edge0/Edge0-8B-A1B-preview", "repoId": "Edge0/Edge0-8B-A1B-preview", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Iluvatar_bi-100", "taskType": "text-generation"}
{"batchId": "20edaee5f25d4ee0b9c7b8ab0636d504", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:13:09.279146+00:00", "framework": "transformers", "intentId": "a110bc4f75a54c83ae5f41e76b2bf82f", "lastModified": "2026-09-14T09:13:00+00:00", "modelAddress": "https://modelscope.cn/models/hcnote/SparkMuse-4B-INT8", "repoId": "hcnote/SparkMuse-4B-INT8", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Iluvatar_bi-100", "taskType": "text-generation"}
{"batchId": "20edaee5f25d4ee0b9c7b8ab0636d504", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:13:09.279209+00:00", "framework": "transformers", "intentId": "d46bf6fc9dcb46c1b0377ab31b191530", "lastModified": "2026-09-14T13:41:18+00:00", "modelAddress": "https://modelscope.cn/models/yujianboisme/qwen2.5-1.5b-darkhorse-code-fine-tuning", "repoId": "yujianboisme/qwen2.5-1.5b-darkhorse-code-fine-tuning", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Iluvatar_bi-100", "taskType": "text-generation"}
{"batchId": "20edaee5f25d4ee0b9c7b8ab0636d504", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:13:09.279271+00:00", "framework": "transformers", "intentId": "71215f33aa2f4613b17da7d39302a3ad", "lastModified": "2026-09-15T15:20:58+00:00", "modelAddress": "https://modelscope.cn/models/mlx-community/Agents-A1-OptiQ-4bit-REAP-19B", "repoId": "mlx-community/Agents-A1-OptiQ-4bit-REAP-19B", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Iluvatar_bi-100", "taskType": "text-generation"}
{"batchId": "20edaee5f25d4ee0b9c7b8ab0636d504", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:13:09.279334+00:00", "framework": "transformers", "intentId": "1d062a1c0e9d4460995ee5f1b877f8da", "lastModified": "2026-09-15T15:16:38+00:00", "modelAddress": "https://modelscope.cn/models/mlx-community/Ornith-1.5-35B-A3B-OptiQ-4bit-REAP-19B", "repoId": "mlx-community/Ornith-1.5-35B-A3B-OptiQ-4bit-REAP-19B", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Iluvatar_bi-100", "taskType": "text-generation"}
{"batchId": "20edaee5f25d4ee0b9c7b8ab0636d504", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:13:09.279395+00:00", "framework": "transformers", "intentId": "3b27e49af5e74628a9a5264fd828d835", "lastModified": "2026-09-15T15:22:00+00:00", "modelAddress": "https://modelscope.cn/models/mlx-community/XYZ-Aquila-mini-OptiQ-4bit-REAP-18B", "repoId": "mlx-community/XYZ-Aquila-mini-OptiQ-4bit-REAP-18B", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Iluvatar_bi-100", "taskType": "text-generation"}
{"batchId": "20edaee5f25d4ee0b9c7b8ab0636d504", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:13:09.279457+00:00", "framework": "transformers", "intentId": "95428949f20e40a0a737444bef612454", "lastModified": "2026-09-15T15:24:01+00:00", "modelAddress": "https://modelscope.cn/models/mlx-community/Ornith-1.0-35B-OptiQ-4bit-REAP-19B", "repoId": "mlx-community/Ornith-1.0-35B-OptiQ-4bit-REAP-19B", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Iluvatar_bi-100", "taskType": "text-generation"}
{"batchId": "20edaee5f25d4ee0b9c7b8ab0636d504", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:13:09.279519+00:00", "framework": "transformers", "intentId": "1f039965a65144a381ac40995993400c", "lastModified": "2026-09-16T16:32:52+00:00", "modelAddress": "https://modelscope.cn/models/IFM/K2-Horizon-7B-FP8", "repoId": "IFM/K2-Horizon-7B-FP8", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "pending", "targetGpu": "Iluvatar_bi-100", "taskType": "text-generation"}
{"batchId": "a4c9ee0777d5476985e7f9e4f3b2e81a", "completedAt": "2026-09-20T20:12:00.945122+00:00", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:11:59.902501+00:00", "framework": "transformers", "intentId": "2730f71610ba47f192403af4cf10343f", "repoId": "IFM/K2-Horizon-7B-FP8", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "framework_prerequisite_deferred", "targetGpu": "Iluvatar_bi-100", "taskId": null, "taskType": "text-generation"} {"batchId": "a4c9ee0777d5476985e7f9e4f3b2e81a", "completedAt": "2026-09-20T20:12:00.945122+00:00", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:11:59.902501+00:00", "framework": "transformers", "intentId": "2730f71610ba47f192403af4cf10343f", "repoId": "IFM/K2-Horizon-7B-FP8", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "framework_prerequisite_deferred", "targetGpu": "Iluvatar_bi-100", "taskId": null, "taskType": "text-generation"}
{"batchId": "a4c9ee0777d5476985e7f9e4f3b2e81a", "completedAt": "2026-09-20T20:12:00.945118+00:00", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:11:59.902440+00:00", "framework": "transformers", "intentId": "92106a540106410fbaa393ce865941a4", "repoId": "mlx-community/Ornith-1.0-35B-OptiQ-4bit-REAP-19B", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "framework_prerequisite_deferred", "targetGpu": "Iluvatar_bi-100", "taskId": null, "taskType": "text-generation"} {"batchId": "a4c9ee0777d5476985e7f9e4f3b2e81a", "completedAt": "2026-09-20T20:12:00.945118+00:00", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:11:59.902440+00:00", "framework": "transformers", "intentId": "92106a540106410fbaa393ce865941a4", "repoId": "mlx-community/Ornith-1.0-35B-OptiQ-4bit-REAP-19B", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "framework_prerequisite_deferred", "targetGpu": "Iluvatar_bi-100", "taskId": null, "taskType": "text-generation"}
{"batchId": "a4c9ee0777d5476985e7f9e4f3b2e81a", "completedAt": "2026-09-20T20:12:00.945115+00:00", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:11:59.902378+00:00", "framework": "transformers", "intentId": "ce0b9ee0c12045faa62b930a761a50be", "repoId": "mlx-community/XYZ-Aquila-mini-OptiQ-4bit-REAP-18B", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "framework_prerequisite_deferred", "targetGpu": "Iluvatar_bi-100", "taskId": null, "taskType": "text-generation"} {"batchId": "a4c9ee0777d5476985e7f9e4f3b2e81a", "completedAt": "2026-09-20T20:12:00.945115+00:00", "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configSource": "modelhub_live", "createdAt": "2026-09-20T20:11:59.902378+00:00", "framework": "transformers", "intentId": "ce0b9ee0c12045faa62b930a761a50be", "repoId": "mlx-community/XYZ-Aquila-mini-OptiQ-4bit-REAP-18B", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "framework_prerequisite_deferred", "targetGpu": "Iluvatar_bi-100", "taskId": null, "taskType": "text-generation"}

View File

@@ -1,24 +1,24 @@
{ {
"agentVersion": "2026.09.20.2", "agentVersion": "2026.09.20.2",
"checksums": { "checksums": {
".modelhub_state/architecture_compatibility_blacklist.json": "88f5ba203cc4d28d2796777e9caa5b1e014418173ce0208a2c6e28259ed9e355", ".modelhub_state/architecture_compatibility_blacklist.json": "8880c9aac31e582a779a343d55d019dddf979f44fc233a11924f295451a291e3",
".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab", ".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab",
".modelhub_state/market_intelligence.json": "3bbbe26e220c1a8c096de9269f6632d11054a9759c0d2e74b08a62b3ccb9ea81", ".modelhub_state/market_intelligence.json": "d2fcd9894834888a3aa9eeaf37b0dde76abb1375ee707fab088554edd715272b",
".modelhub_state/official_capabilities.json": "7e66e6da32206ce5b77eca122f58a807af5a537495c74477b69a4fe25fb980d7", ".modelhub_state/official_capabilities.json": "8273a447a613bdbcd6a8420fc2b5826c3c18a860168867dce358e700b4774ce7",
".modelhub_state/outcome_checkpoint.json": "eece9db0e52a5d969c2d1e33332d1c3cf610d0ea51da97e7173f26e8cd15fb88", ".modelhub_state/outcome_checkpoint.json": "eece9db0e52a5d969c2d1e33332d1c3cf610d0ea51da97e7173f26e8cd15fb88",
".modelhub_state/queue_cleanup_latest.json": "5c13f2f8897b2c666003846b350d4936c333a5667a4868e7bb80a2152e0ef233", ".modelhub_state/queue_cleanup_latest.json": "5c13f2f8897b2c666003846b350d4936c333a5667a4868e7bb80a2152e0ef233",
".modelhub_state/recent_outcomes.jsonl": "6ee261acbe5709629bf7d9b02ab8aaaf98a764786831a6fa85c8c8b031058b5d", ".modelhub_state/recent_outcomes.jsonl": "6ee261acbe5709629bf7d9b02ab8aaaf98a764786831a6fa85c8c8b031058b5d",
".modelhub_state/recovery_active_tasks.jsonl": "30441adaf2198d421b692468ad96eaa293af738c83eda829c45872cdb81a8d97", ".modelhub_state/recovery_active_tasks.jsonl": "30441adaf2198d421b692468ad96eaa293af738c83eda829c45872cdb81a8d97",
".modelhub_state/recovery_intents.jsonl": "ffe962799b98a9f0f8399e793bced1cb506d39b6350a066b86b7c0691c423bfe", ".modelhub_state/recovery_intents.jsonl": "062fb5034173d7877d015ba4f90697f3e9919741fa78f066b45197dc55b10995",
".modelhub_state/routing_intelligence.json": "26786ee13bb51709fc8cfe3de8b42c9a543af3ad29cab4374d8f58b1987e28e9", ".modelhub_state/routing_intelligence.json": "26786ee13bb51709fc8cfe3de8b42c9a543af3ad29cab4374d8f58b1987e28e9",
".modelhub_state/submission_exclusions.jsonl": "80315f370e9cc3cdadaf390e12573ef887794214779379c50b7b37b7631e8989", ".modelhub_state/submission_exclusions.jsonl": "80315f370e9cc3cdadaf390e12573ef887794214779379c50b7b37b7631e8989",
".modelhub_state/worker_crashes.jsonl": "a494412048eca6dce83e7284303a6b4b56a445c1274ac201ab8723c739a14f23", ".modelhub_state/worker_crashes.jsonl": "a494412048eca6dce83e7284303a6b4b56a445c1274ac201ab8723c739a14f23",
"ledger/submissions.jsonl": "4d7b0732e883a63b74956e057eb85c1ecedde0e8ca715af9b3a27fa4ce6f9edf", "ledger/submissions.jsonl": "4d7b0732e883a63b74956e057eb85c1ecedde0e8ca715af9b3a27fa4ce6f9edf",
"outcomes/submissions.jsonl": "0646fe4eb76c201595946afef0f87a4c475a242102ca3c4208592b751cb64a55" "outcomes/submissions.jsonl": "0e8e09602ad376bd98798c84f36d64f6d0faef38b95b39b639515257a6e68da3"
}, },
"generation": 10871, "generation": 10872,
"phase": "result", "phase": "intent",
"schemaVersion": 1, "schemaVersion": 1,
"updatedAt": "2026-09-20T20:12:01.078106+00:00", "updatedAt": "2026-09-20T20:13:09.459411+00:00",
"writerId": "fc715c06e24c4db2ae3e425e435db996" "writerId": "fc715c06e24c4db2ae3e425e435db996"
} }

View File

@@ -954,7 +954,7 @@
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T19:53:02.766146+00:00", "modelId": "RedHatAI/starcoder2-3b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4093180600, "estimatedRequiredGiB": 4.578, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 4096479058, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 3181366272, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4096479058}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T11:51:59.601108+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4978230", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T19:53:02.766146+00:00", "modelId": "RedHatAI/starcoder2-3b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4093180600, "estimatedRequiredGiB": 4.578, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 4096479058, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 3181366272, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4096479058}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T11:51:59.601108+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4978230", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T19:56:29.962409+00:00", "modelId": "neuralmagic/Phi-3-medium-128k-instruct-quantized.w4a16", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7686303632, "estimatedRequiredGiB": 8.592, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 7688299919, "modelscopeLicense": "llama2", "modelscopeParams": 13960238080, "modelscopeTags": ["license:llama2", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7688299919}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T11:52:06.534997+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4978249", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T19:56:29.962409+00:00", "modelId": "neuralmagic/Phi-3-medium-128k-instruct-quantized.w4a16", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7686303632, "estimatedRequiredGiB": 8.592, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 7688299919, "modelscopeLicense": "llama2", "modelscopeParams": 13960238080, "modelscopeTags": ["license:llama2", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7688299919}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T11:52:06.534997+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4978249", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "RedHatAI/Meta-Llama-3.1-8B-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9084040952, "estimatedRequiredGiB": 10.163, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9093251763, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9093251763}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-20T11:54:11.089175+00:00", "targetGpu": "Biren_166m", "taskId": "4978283", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "RedHatAI/Meta-Llama-3.1-8B-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "d341b8002cf39d3299fd429479e8c8e954583e49d4fec5a640ddc0f8f0cbd054", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9084040952, "estimatedRequiredGiB": 10.163, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9093251763, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9093251763}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-20T11:54:11.089175+00:00", "targetGpu": "Biren_166m", "taskId": "4978283", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "neuralmagic/starcoder2-7b-quantized.w8a8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7857274344, "estimatedRequiredGiB": 8.785, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 7860632064, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 7400416256, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7860632064}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-20T12:12:07.582993+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4978470", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T20:13:01.970350+00:00", "modelId": "neuralmagic/starcoder2-7b-quantized.w8a8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7857274344, "estimatedRequiredGiB": 8.785, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 7860632064, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 7400416256, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7860632064}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T12:12:07.582993+00:00", "targetGpu": "Ascend_910-b4", "taskId": "4978470", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "aisingapore/Gemma-SEA-LION-v4-27B-IT-NVFP4", "modelProfile": {"architectures": ["Gemma3ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 20886763512, "estimatedRequiredGiB": 23.388, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma3", "modelscopeFileSize": 20926892207, "modelscopeLicense": "gemma", "modelscopeParams": 28842037282, "modelscopeTags": ["license:gemma", "model_type:gemma3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 20926892207}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-20T12:12:07.735021+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4978493", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "aisingapore/Gemma-SEA-LION-v4-27B-IT-NVFP4", "modelProfile": {"architectures": ["Gemma3ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 20886763512, "estimatedRequiredGiB": 23.388, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma3", "modelscopeFileSize": 20926892207, "modelscopeLicense": "gemma", "modelscopeParams": 28842037282, "modelscopeTags": ["license:gemma", "model_type:gemma3", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 20926892207}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-20T12:12:07.735021+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4978493", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "RedHatAI/gemma-2-2b-it-quantized.w8a16", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4385544296, "estimatedRequiredGiB": 4.926, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 4407367933, "modelscopeLicense": "gemma", "modelscopeParams": 3204165888, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4407367933}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-20T12:13:32.801809+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4978494", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "RedHatAI/gemma-2-2b-it-quantized.w8a16", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4385544296, "estimatedRequiredGiB": 4.926, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 4407367933, "modelscopeLicense": "gemma", "modelscopeParams": 3204165888, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4407367933}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-20T12:13:32.801809+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4978494", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "neuralmagic/Meta-Llama-3.1-8B-quantized.w8a8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9084013360, "estimatedRequiredGiB": 10.162, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9093204103, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm", "custom_tag:quantized", "custom_tag:8-bit"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9093204103}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-20T12:20:00.435973+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4978589", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": null, "modelId": "neuralmagic/Meta-Llama-3.1-8B-quantized.w8a8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 9084013360, "estimatedRequiredGiB": 10.162, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 9093204103, "modelscopeLicense": "llama3.1", "modelscopeParams": 8030261248, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm", "custom_tag:quantized", "custom_tag:8-bit"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 9093204103}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-20T12:20:00.435973+00:00", "targetGpu": "Mthreads_s4000", "taskId": "4978589", "taskType": "text-generation", "verifyResult": null}