state: generation 13247 (cycle)

This commit is contained in:
2026-09-23 01:25:42 +00:00
parent b6c5ef564d
commit 32553d42c3
8 changed files with 1626 additions and 1627 deletions

View File

@@ -3023,7 +3023,7 @@
"taskType": "text-generation" "taskType": "text-generation"
} }
}, },
"generatedAt": "2026-09-23T01:20:53.543620+00:00", "generatedAt": "2026-09-23T01:25:27.978750+00:00",
"summary": { "summary": {
"activeBlockCount": 152, "activeBlockCount": 152,
"byGpuFramework": { "byGpuFramework": {

View File

@@ -396,7 +396,7 @@
} }
}, },
"frameworkUpdatedAt": null, "frameworkUpdatedAt": null,
"generatedAt": "2026-09-23T01:24:25.774048+00:00", "generatedAt": "2026-09-23T01:25:41.031132+00:00",
"gpuStats": { "gpuStats": {
"Ascend_910-b4": { "Ascend_910-b4": {
"available": true, "available": true,

View File

@@ -1,5 +1,5 @@
{ {
"catalogUpdatedAt": "2026-09-23T01:24:25.774048+00:00", "catalogUpdatedAt": "2026-09-23T01:25:41.031132+00:00",
"configuredTaskTypes": [ "configuredTaskTypes": [
"text-generation" "text-generation"
], ],
@@ -56,7 +56,7 @@
"time-series-forecasting" "time-series-forecasting"
], ],
"errors": [], "errors": [],
"generatedAt": "2026-09-23T01:24:25.774048+00:00", "generatedAt": "2026-09-23T01:25:41.031132+00:00",
"gpuCatalog": { "gpuCatalog": {
"Ascend_910-b3": { "Ascend_910-b3": {
"canVerify": true, "canVerify": true,
@@ -6669,6 +6669,6 @@
"updateTime": "2025-12-22 08:59:53" "updateTime": "2025-12-22 08:59:53"
} }
], ],
"taskTreeUpdatedAt": "2026-09-23T01:24:25.774048+00:00", "taskTreeUpdatedAt": "2026-09-23T01:25:41.031132+00:00",
"version": 1 "version": 1
} }

View File

@@ -1,6 +1,6 @@
{ {
"generatedAt": "2026-09-23T00:53:50.855166+00:00", "generatedAt": "2026-09-23T01:25:27.901094+00:00",
"lastSyncTime": "2026-09-23T00:53:50.560096+00:00", "lastSyncTime": "2026-09-23T01:25:27.158548+00:00",
"recentLimit": 300, "recentLimit": 300,
"report": { "report": {
"architectureCompatibilityBlocks": { "architectureCompatibilityBlocks": {
@@ -4679,32 +4679,32 @@
"unresolvedFailureCount": 130 "unresolvedFailureCount": 130
}, },
"Kunlunxin_p-800|vllm_tokenizer_patch|text-generation": { "Kunlunxin_p-800|vllm_tokenizer_patch|text-generation": {
"attributableFailureCount": 38, "attributableFailureCount": 39,
"decisionFailureRate": 0.8837, "decisionFailureRate": 0.8864,
"decisionSuccessRate": 0.1163, "decisionSuccessRate": 0.1136,
"decisionTotal": 43, "decisionTotal": 44,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 5, "ambiguous_runtime": 5,
"backend_operator": 8, "backend_operator": 8,
"framework_architecture_unsupported": 15, "framework_architecture_unsupported": 15,
"memory_capacity": 1, "memory_capacity": 1,
"model_load": 10, "model_load": 11,
"platform_infrastructure": 1, "platform_infrastructure": 1,
"repository_structure": 2, "repository_structure": 2,
"runtime_memory": 2, "runtime_memory": 2,
"参数/模板问题": 14 "参数/模板问题": 14
}, },
"failureCount": 58, "failureCount": 59,
"failureRate": 0.9206, "failureRate": 0.9219,
"framework": "vllm_tokenizer_patch", "framework": "vllm_tokenizer_patch",
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 1, "platformFailureCount": 1,
"successCount": 5, "successCount": 5,
"successRate": 0.0794, "successRate": 0.0781,
"targetGpu": "Kunlunxin_p-800", "targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation", "taskType": "text-generation",
"total": 63, "total": 64,
"unresolvedFailureCount": 19 "unresolvedFailureCount": 19
}, },
"Kunlunxin_p-800|vllm|text-generation": { "Kunlunxin_p-800|vllm|text-generation": {
@@ -5839,35 +5839,35 @@
"unresolvedFailureCount": 309 "unresolvedFailureCount": 309
}, },
"vllm_tokenizer_patch": { "vllm_tokenizer_patch": {
"attributableFailureCount": 105, "attributableFailureCount": 106,
"decisionFailureRate": 0.9292, "decisionFailureRate": 0.9298,
"decisionSuccessRate": 0.0708, "decisionSuccessRate": 0.0702,
"decisionTotal": 113, "decisionTotal": 114,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 145, "ambiguous_runtime": 145,
"backend_operator": 8, "backend_operator": 8,
"context_length": 4, "context_length": 4,
"framework_architecture_unsupported": 71, "framework_architecture_unsupported": 71,
"memory_capacity": 2, "memory_capacity": 2,
"model_load": 13, "model_load": 14,
"platform_infrastructure": 2, "platform_infrastructure": 2,
"repository_structure": 3, "repository_structure": 3,
"runtime_memory": 2, "runtime_memory": 2,
"tokenizer_compatibility": 2, "tokenizer_compatibility": 2,
"参数/模板问题": 28 "参数/模板问题": 28
}, },
"failureCount": 280, "failureCount": 281,
"failureRate": 0.9722, "failureRate": 0.9723,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 2, "platformFailureCount": 2,
"successCount": 8, "successCount": 8,
"successRate": 0.0278, "successRate": 0.0277,
"total": 288, "total": 289,
"unresolvedFailureCount": 173 "unresolvedFailureCount": 173
} }
}, },
"generatedAt": "2026-09-23T00:53:50.842972+00:00", "generatedAt": "2026-09-23T01:25:27.887500+00:00",
"gpuSummaries": { "gpuSummaries": {
"Ascend_910-b3": { "Ascend_910-b3": {
"attributableFailureCount": 102, "attributableFailureCount": 102,
@@ -6093,16 +6093,16 @@
"unresolvedFailureCount": 717 "unresolvedFailureCount": 717
}, },
"Kunlunxin_p-800": { "Kunlunxin_p-800": {
"attributableFailureCount": 48, "attributableFailureCount": 49,
"decisionFailureRate": 0.9057, "decisionFailureRate": 0.9074,
"decisionSuccessRate": 0.0943, "decisionSuccessRate": 0.0926,
"decisionTotal": 53, "decisionTotal": 54,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 208, "ambiguous_runtime": 208,
"backend_operator": 10, "backend_operator": 10,
"framework_architecture_unsupported": 21, "framework_architecture_unsupported": 21,
"memory_capacity": 2, "memory_capacity": 2,
"model_load": 11, "model_load": 12,
"platform_infrastructure": 1, "platform_infrastructure": 1,
"repository_structure": 2, "repository_structure": 2,
"runtime_memory": 2, "runtime_memory": 2,
@@ -6110,14 +6110,14 @@
"日志缺失": 1, "日志缺失": 1,
"验证失败": 23 "验证失败": 23
}, },
"failureCount": 313, "failureCount": 314,
"failureRate": 0.9843, "failureRate": 0.9843,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 1, "platformFailureCount": 1,
"successCount": 5, "successCount": 5,
"successRate": 0.0157, "successRate": 0.0157,
"total": 318, "total": 319,
"unresolvedFailureCount": 264 "unresolvedFailureCount": 264
}, },
"Kunlunxin_r-200-8f": { "Kunlunxin_r-200-8f": {
@@ -16849,15 +16849,15 @@
"unresolvedFailureCount": 1 "unresolvedFailureCount": 1
}, },
"Kunlunxin_p-800|vllm_tokenizer_patch|text-generation|gemma2|compressed-tensors": { "Kunlunxin_p-800|vllm_tokenizer_patch|text-generation|gemma2|compressed-tensors": {
"attributableFailureCount": 4, "attributableFailureCount": 5,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 4, "decisionTotal": 5,
"failureBreakdown": { "failureBreakdown": {
"model_load": 3, "model_load": 4,
"runtime_memory": 1 "runtime_memory": 1
}, },
"failureCount": 4, "failureCount": 5,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm_tokenizer_patch", "framework": "vllm_tokenizer_patch",
"modelType": "gemma2", "modelType": "gemma2",
@@ -16869,7 +16869,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Kunlunxin_p-800", "targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation", "taskType": "text-generation",
"total": 4, "total": 5,
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"Kunlunxin_p-800|vllm_tokenizer_patch|text-generation|gpt_oss|compressed-tensors": { "Kunlunxin_p-800|vllm_tokenizer_patch|text-generation|gpt_oss|compressed-tensors": {
@@ -40082,14 +40082,14 @@
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"Kunlunxin_p-800|vllm_tokenizer_patch|text-generation|gemma2|compressed-tensors|33": { "Kunlunxin_p-800|vllm_tokenizer_patch|text-generation|gemma2|compressed-tensors|33": {
"attributableFailureCount": 1, "attributableFailureCount": 2,
"decisionFailureRate": 1.0, "decisionFailureRate": 1.0,
"decisionSuccessRate": 0.0, "decisionSuccessRate": 0.0,
"decisionTotal": 1, "decisionTotal": 2,
"failureBreakdown": { "failureBreakdown": {
"model_load": 1 "model_load": 2
}, },
"failureCount": 1, "failureCount": 2,
"failureRate": 1.0, "failureRate": 1.0,
"framework": "vllm_tokenizer_patch", "framework": "vllm_tokenizer_patch",
"loadSizeLog2Bucket": 33, "loadSizeLog2Bucket": 33,
@@ -40102,7 +40102,7 @@
"successRate": 0.0, "successRate": 0.0,
"targetGpu": "Kunlunxin_p-800", "targetGpu": "Kunlunxin_p-800",
"taskType": "text-generation", "taskType": "text-generation",
"total": 1, "total": 2,
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
}, },
"Kunlunxin_p-800|vllm_tokenizer_patch|text-generation|gpt_oss|compressed-tensors|35": { "Kunlunxin_p-800|vllm_tokenizer_patch|text-generation|gpt_oss|compressed-tensors|35": {
@@ -45541,13 +45541,13 @@
"unresolvedFailureCount": 0 "unresolvedFailureCount": 0
} }
}, },
"terminalRecords": 16782, "terminalRecords": 16783,
"totalRecords": 16990, "totalRecords": 16991,
"totals": { "totals": {
"attributableFailureCount": 6006, "attributableFailureCount": 6007,
"decisionFailureRate": 0.8621, "decisionFailureRate": 0.8621,
"decisionSuccessRate": 0.1379, "decisionSuccessRate": 0.1379,
"decisionTotal": 6967, "decisionTotal": 6968,
"failureBreakdown": { "failureBreakdown": {
"ambiguous_runtime": 4278, "ambiguous_runtime": 4278,
"architecture_compatibility": 212, "architecture_compatibility": 212,
@@ -45556,7 +45556,7 @@
"context_length": 322, "context_length": 322,
"framework_architecture_unsupported": 2129, "framework_architecture_unsupported": 2129,
"memory_capacity": 1203, "memory_capacity": 1203,
"model_load": 524, "model_load": 525,
"platform_infrastructure": 929, "platform_infrastructure": 929,
"repository_structure": 740, "repository_structure": 740,
"runtime_memory": 91, "runtime_memory": 91,
@@ -45565,14 +45565,14 @@
"日志缺失": 719, "日志缺失": 719,
"验证失败": 676 "验证失败": 676
}, },
"failureCount": 15821, "failureCount": 15822,
"failureRate": 0.9427, "failureRate": 0.9427,
"pendingCount": 0, "pendingCount": 0,
"pendingRate": 0.0, "pendingRate": 0.0,
"platformFailureCount": 929, "platformFailureCount": 929,
"successCount": 961, "successCount": 961,
"successRate": 0.0573, "successRate": 0.0573,
"total": 16782, "total": 16783,
"unresolvedFailureCount": 8886 "unresolvedFailureCount": 8886
}, },
"warnings": [ "warnings": [
@@ -45630,6 +45630,6 @@
] ]
}, },
"storageMode": "decision_state_only", "storageMode": "decision_state_only",
"summarizedRecords": 16990, "summarizedRecords": 16991,
"version": 1 "version": 1
} }

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -2,24 +2,24 @@
"agentVersion": "2026.09.22.1", "agentVersion": "2026.09.22.1",
"checksums": { "checksums": {
".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1", ".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1",
".modelhub_state/architecture_compatibility_blacklist.json": "1c6ce22da1b2a89bab903edce5f5074aec4df1c171344e158fa1e237c9a8046d", ".modelhub_state/architecture_compatibility_blacklist.json": "c1cc7262046bed420c4b2c22a1ab719fd3317369eb7e13926ffa339fa658d295",
".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab", ".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab",
".modelhub_state/market_intelligence.json": "be4d8a9a24463b958d2402ac2c9918d673d86cd964ee49691fe231a5757751be", ".modelhub_state/market_intelligence.json": "f027380a868c21713f3310c8ca2af6884e55e1a0ee1128505fa9184c157a0571",
".modelhub_state/official_capabilities.json": "4b7fee0eb1bb733d598954a06b9912a70b7b391f9643e4c4893056af0d3bbff2", ".modelhub_state/official_capabilities.json": "c7da34b0c81e88f176f2713e51c6cdc93787f8e1e6e7e27583b4db484a71a31c",
".modelhub_state/outcome_checkpoint.json": "96788325cb4d6f19eda0b672864afdc436a0fab4a53d6788a718bd1fda27610b", ".modelhub_state/outcome_checkpoint.json": "596b2b43e599848933e6f8b878a5775ed296fb6bf0b9a6d8dfecfb29d6d12132",
".modelhub_state/queue_cleanup_latest.json": "70b12a33050de2b7d18becf5530413055730ba9da8e6ce7b09a99877bc0fd590", ".modelhub_state/queue_cleanup_latest.json": "70b12a33050de2b7d18becf5530413055730ba9da8e6ce7b09a99877bc0fd590",
".modelhub_state/recent_outcomes.jsonl": "79b6d55284c3f75cc08ad11b8ab20e4edff0f39ec4effad3abbee12ed1b7e175", ".modelhub_state/recent_outcomes.jsonl": "79b6d55284c3f75cc08ad11b8ab20e4edff0f39ec4effad3abbee12ed1b7e175",
".modelhub_state/recovery_active_tasks.jsonl": "4b2dbcded36624bdd1fc8821dcbf63bf4d8e1244297fc3c0c87216fb40169d5a", ".modelhub_state/recovery_active_tasks.jsonl": "08e0cd4fc9609acd5126e28891007a6c14033e0b48400d5660bd1d2621dccc30",
".modelhub_state/recovery_intents.jsonl": "1c01340a80dd8460ec6db6766ecd2329e6003373650a7185d227481f2b065db8", ".modelhub_state/recovery_intents.jsonl": "2143c18e29737f649c44d5b752caa4a6717dae4622f1975d3d9f2cad71c1d300",
".modelhub_state/routing_intelligence.json": "39ec7b5e77e11b96887ed828d68b094ab47d4d4e68b51e1ea92f4df7a81ab3e3", ".modelhub_state/routing_intelligence.json": "39ec7b5e77e11b96887ed828d68b094ab47d4d4e68b51e1ea92f4df7a81ab3e3",
".modelhub_state/submission_exclusions.jsonl": "80315f370e9cc3cdadaf390e12573ef887794214779379c50b7b37b7631e8989", ".modelhub_state/submission_exclusions.jsonl": "80315f370e9cc3cdadaf390e12573ef887794214779379c50b7b37b7631e8989",
".modelhub_state/worker_crashes.jsonl": "81a279620f26a6ff30e7cd3dca4b86844ec41a0d30ffee7d8a4b03ab754d2d4c", ".modelhub_state/worker_crashes.jsonl": "81a279620f26a6ff30e7cd3dca4b86844ec41a0d30ffee7d8a4b03ab754d2d4c",
"ledger/submissions.jsonl": "e41ca1b41c2d9fe7c553e3c10665298fcb8b0ac7fb7114270dbe689bfb7c6207", "ledger/submissions.jsonl": "e41ca1b41c2d9fe7c553e3c10665298fcb8b0ac7fb7114270dbe689bfb7c6207",
"outcomes/submissions.jsonl": "7b35b3b5a0a9c6d77f01c47c906f4b47280f65ced73b4d4e76cca5bbf3b39909" "outcomes/submissions.jsonl": "cc01a682c7533897a3a986e4b2967121707a42f240cf3383fdaf7b56d9c5603b"
}, },
"generation": 13246, "generation": 13247,
"phase": "cycle", "phase": "cycle",
"schemaVersion": 1, "schemaVersion": 1,
"updatedAt": "2026-09-23T01:24:26.493501+00:00", "updatedAt": "2026-09-23T01:25:42.433713+00:00",
"writerId": "0024d6b5efdf486184421da342f897ee" "writerId": "0024d6b5efdf486184421da342f897ee"
} }

View File

@@ -440,7 +440,6 @@
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-20T12:21:49.901937+00:00", "modelId": "LiquidAI/LFM2.5-1.2B-Instruct-MLX-4bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "cbe5569cdb6c42553436b837dd5b8f0cfa03334642a56f4ff0137f952f8eb84b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 658540250, "estimatedRequiredGiB": 0.742, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 663548868, "modelscopeLicense": "other", "modelscopeParams": 182975232, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 663548868}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:34.792755+00:00", "targetGpu": "Vastai_va16", "taskId": "4970571", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-20T12:21:49.901937+00:00", "modelId": "LiquidAI/LFM2.5-1.2B-Instruct-MLX-4bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "cbe5569cdb6c42553436b837dd5b8f0cfa03334642a56f4ff0137f952f8eb84b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 658540250, "estimatedRequiredGiB": 0.742, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 663548868, "modelscopeLicense": "other", "modelscopeParams": 182975232, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 663548868}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:34.792755+00:00", "targetGpu": "Vastai_va16", "taskId": "4970571", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-20T12:21:49.901659+00:00", "modelId": "RedHatAI/Meta-Llama-3.1-70B-Instruct-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 72670025872, "estimatedRequiredGiB": 81.225, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 72679340864, "modelscopeLicense": "llama3.1", "modelscopeParams": 70553706496, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int88", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 72679340864}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:34.788367+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4970568", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-20T12:21:49.901659+00:00", "modelId": "RedHatAI/Meta-Llama-3.1-70B-Instruct-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 72670025872, "estimatedRequiredGiB": 81.225, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 72679340864, "modelscopeLicense": "llama3.1", "modelscopeParams": 70553706496, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int88", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 72679340864}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:34.788367+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4970568", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-20T12:21:49.901932+00:00", "modelId": "RedHatAI/Phi-3-medium-128k-instruct-FP8", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 14289052464, "estimatedRequiredGiB": 15.972, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 14291553638, "modelscopeLicense": "mit", "modelscopeParams": 13960238080, "modelscopeTags": ["license:mit", "model_type:phi3", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 14291553638}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:34.920885+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4970573", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-20T12:21:49.901932+00:00", "modelId": "RedHatAI/Phi-3-medium-128k-instruct-FP8", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 14289052464, "estimatedRequiredGiB": 15.972, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 14291553638, "modelscopeLicense": "mit", "modelscopeParams": 13960238080, "modelscopeTags": ["license:mit", "model_type:phi3", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 14291553638}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:34.920885+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4970573", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T12:21:49.901724+00:00", "modelId": "RedHatAI/gemma-2-9b-it-quantized.w8a16", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11998647728, "estimatedRequiredGiB": 13.434, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 12020563851, "modelscopeLicense": "gemma", "modelscopeParams": 10159209984, "modelscopeTags": ["license:gemma", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 12020563851}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:34.911597+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4970578", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T12:21:49.901883+00:00", "modelId": "neuralmagic/starcoder2-7b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7857298896, "estimatedRequiredGiB": 8.785, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 7860673858, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 7400416256, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7860673858}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:34.922099+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4970574", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T12:21:49.901883+00:00", "modelId": "neuralmagic/starcoder2-7b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7857298896, "estimatedRequiredGiB": 8.785, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 7860673858, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 7400416256, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 7860673858}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:34.922099+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4970574", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T12:21:49.902090+00:00", "modelId": "RedHatAI/Qwen2-1.5B-Instruct-quantized.w8a8", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2245331488, "estimatedRequiredGiB": 2.522, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 2256941144, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1777088000, "modelscopeTags": ["license:apache-2.0", "model_type:qwen2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2256941144}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:34.856488+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4970570", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-20T12:21:49.902090+00:00", "modelId": "RedHatAI/Qwen2-1.5B-Instruct-quantized.w8a8", "modelProfile": {"architectures": ["Qwen2ForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2245331488, "estimatedRequiredGiB": 2.522, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen2", "modelscopeFileSize": 2256941144, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1777088000, "modelscopeTags": ["license:apache-2.0", "model_type:qwen2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2256941144}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:34.856488+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4970570", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-20T12:21:49.901716+00:00", "modelId": "LiquidAI/LFM2.5-2.6B", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5394427456, "estimatedRequiredGiB": 6.049, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 5412393192, "modelscopeLicense": "other", "modelscopeParams": 2697198592, "modelscopeTags": ["license:other", "model_type:lfm2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5412393192}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:41.844966+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4970589", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-20T12:21:49.901716+00:00", "modelId": "LiquidAI/LFM2.5-2.6B", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5394427456, "estimatedRequiredGiB": 6.049, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 5412393192, "modelscopeLicense": "other", "modelscopeParams": 2697198592, "modelscopeTags": ["license:other", "model_type:lfm2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5412393192}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-20T04:14:41.844966+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "4970589", "taskType": "text-generation", "verifyResult": null}