state: generation 16763 (cycle)
This commit is contained in:
@@ -828,7 +828,7 @@
|
||||
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-26T04:45:00.143041+00:00", "modelId": "ukisai/Swift-1.5-4bit-MLX", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 15826764635, "estimatedRequiredGiB": 17.725, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 15859852885, "modelscopeLicense": "other", "modelscopeParams": 4457894832, "modelscopeTags": ["license:other", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:4-bit", "custom_tag:affine", "custom_tag:qwen3_8"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 15859852885}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-25T20:40:46.446794+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5088553", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-26T16:03:49.560334+00:00", "modelId": "mlx-community/gpt-oss-20b-OptiQ-4bit", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11623702006, "estimatedRequiredGiB": 13.022, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 11651702017, "modelscopeLicense": "apache-2.0", "modelscopeParams": 3982569024, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:openai", "custom_tag:gpt-oss", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:4bit", "custom_tag:mixed-precision", "custom_tag:optiq", "custom_tag:moe", "custom_tag:apple-silicon", "custom_tag:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11651702017}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-26T08:01:50.847636+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5097139", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "mlx-community/gpt-oss-20b-OptiQ-4bit", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11623702006, "estimatedRequiredGiB": 13.022, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 11651702017, "modelscopeLicense": "apache-2.0", "modelscopeParams": 3982569024, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:openai", "custom_tag:gpt-oss", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:4bit", "custom_tag:mixed-precision", "custom_tag:optiq", "custom_tag:moe", "custom_tag:apple-silicon", "custom_tag:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11651702017}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-26T08:18:32.495861+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5097281", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "ibm-granite/granite-4.2-8b", "modelProfile": {"architectures": ["GraniteForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 17583228032, "estimatedRequiredGiB": 19.662, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "granite", "modelscopeFileSize": 17593027563, "modelscopeLicense": "apache-2.0", "modelscopeParams": 8791592960, "modelscopeTags": ["license:apache-2.0", "model_type:granite", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:granite", "custom_tag:granite-4.2", "custom_tag:reasoning", "custom_tag:thinking", "custom_tag:tool-calling", "custom_tag:ibm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 17593027563}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-26T11:27:31.250241+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5099581", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-26T19:33:09.154587+00:00", "modelId": "ibm-granite/granite-4.2-8b", "modelProfile": {"architectures": ["GraniteForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 17583228032, "estimatedRequiredGiB": 19.662, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "granite", "modelscopeFileSize": 17593027563, "modelscopeLicense": "apache-2.0", "modelscopeParams": 8791592960, "modelscopeTags": ["license:apache-2.0", "model_type:granite", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:granite", "custom_tag:granite-4.2", "custom_tag:reasoning", "custom_tag:thinking", "custom_tag:tool-calling", "custom_tag:ibm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 17593027563}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-26T11:27:31.250241+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5099581", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "ibm-granite/granite-4.2-8b", "modelProfile": {"architectures": ["GraniteForCausalLM"], "configFingerprint": "cbe5569cdb6c42553436b837dd5b8f0cfa03334642a56f4ff0137f952f8eb84b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 17583228032, "estimatedRequiredGiB": 19.662, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "granite", "modelscopeFileSize": 17593027563, "modelscopeLicense": "apache-2.0", "modelscopeParams": 8791592960, "modelscopeTags": ["license:apache-2.0", "model_type:granite", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:granite", "custom_tag:granite-4.2", "custom_tag:reasoning", "custom_tag:thinking", "custom_tag:tool-calling", "custom_tag:ibm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 17593027563}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-26T11:43:40.248293+00:00", "targetGpu": "Vastai_va16", "taskId": "5099879", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "ukisai/Swift-1.5-5bit-MLX", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19282103457, "estimatedRequiredGiB": 21.582, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 19310889023, "modelscopeLicense": "other", "modelscopeParams": 5321729392, "modelscopeTags": ["license:other", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:5-bit", "custom_tag:affine", "custom_tag:qwen3_8"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 19310895273}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-26T12:47:09.108765+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5100778", "taskType": "text-generation", "verifyResult": null}
|
||||
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": null, "modelId": "ukisai/Swift-1.5-5bit-MLX", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19282103457, "estimatedRequiredGiB": 21.582, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 19310889023, "modelscopeLicense": "other", "modelscopeParams": null, "modelscopeTags": ["license:other", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:5-bit", "custom_tag:affine", "custom_tag:qwen3_8"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 3}, "failureCount": 3, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-22T16:15:27.384896+00:00", "modelType": "qwen3_5", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Biren_166m", "taskType": "text-generation", "total": 3, "unresolvedFailureCount": 3}, "repositoryOnDiskBytes": 19310895273}, "outcome": "pending", "status": "pending", "submitTime": "2026-09-26T13:03:53.182632+00:00", "targetGpu": "Biren_166m", "taskId": "5100986", "taskType": "text-generation", "verifyResult": null}
|
||||
|
||||
Reference in New Issue
Block a user