diff --git a/.modelhub_state/recovery_intents.jsonl b/.modelhub_state/recovery_intents.jsonl index 6447a5955..1e9407530 100644 --- a/.modelhub_state/recovery_intents.jsonl +++ b/.modelhub_state/recovery_intents.jsonl @@ -2596,7 +2596,7 @@ {"batchId": "b1379bf2a3e7435882fe38f2cd3ed3f6", "completedAt": "2026-09-30T19:16:59.101039+00:00", "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configSource": "modelhub_live", "createdAt": "2026-09-30T19:16:56.779960+00:00", "framework": "vllm_tokenizer_patch", "intentId": "cf028da9e52c4ec4ba405fa5d9e3570f", "lastModified": "2026-09-30T18:43:38+00:00", "modelAddress": "https://modelscope.cn/models/mlx-community/K2-Horizon-3.7B-8bit", "reason": null, "reconciledAt": "2026-10-01T05:59:53.170222+00:00", "repoId": "mlx-community/K2-Horizon-3.7B-8bit", "safeConfigVector": {"gpuNum": 1}, "status": "recovered_active", "targetGpu": "Ascend_910-b4", "taskId": "5200707", "taskType": "text-generation"} {"batchId": "c4615b8c070a44b08e0db1c00e6552d6", "completedAt": "2026-10-01T05:41:59.519784+00:00", "configFingerprint": "8be5b78bdba5c4413c1e4ab91a46e27c34642b25d5dc059ad3a11d50d7e33593", "configSource": "modelhub_live", "createdAt": "2026-10-01T05:40:34.169188+00:00", "framework": "vllm_tokenizer_patch", "intentId": "f9b5eb43b4314e80b563519a6e72fa1d", "lastModified": "2026-10-01T05:29:53+00:00", "modelAddress": "https://modelscope.cn/models/OsaurusAI/Raptor-0.6-4B-JANG_4M", "reason": null, "reconciledAt": "2026-10-01T05:59:53.169171+00:00", "repoId": "OsaurusAI/Raptor-0.6-4B-JANG_4M", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "MetaX_c-500", "taskId": "5208880", "taskType": "text-generation"} {"batchId": "6e89b295ee56455dbdfa2669572dd618", "completedAt": "2026-10-01T05:59:47.406261+00:00", "configFingerprint": "8be5b78bdba5c4413c1e4ab91a46e27c34642b25d5dc059ad3a11d50d7e33593", "configSource": "modelhub_live", "createdAt": "2026-10-01T05:57:46.290086+00:00", "framework": "vllm_tokenizer_patch", "intentId": "652c6718ae794338878a318fd722d27c", "lastModified": "2026-10-01T05:45:00+00:00", "modelAddress": "https://modelscope.cn/models/shisa-ai/shisa-de-1-FP8-dynamic", "reason": null, "reconciledAt": "2026-10-01T05:59:53.170671+00:00", "repoId": "shisa-ai/shisa-de-1-FP8-dynamic", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "recovered_active", "targetGpu": "MetaX_c-500", "taskId": "5209080", "taskType": "text-generation"} -{"batchId": "f08085dbcdaf4177a4af5beaf5dd26f2", "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configSource": "modelhub_live", "createdAt": "2026-10-01T06:01:53.981886+00:00", "framework": "vllm_tokenizer_patch", "intentId": "12fac27052884855b46af55bafb94ec0", "lastModified": "2026-10-01T05:29:53+00:00", "modelAddress": "https://modelscope.cn/models/OsaurusAI/Raptor-0.6-4B-JANG_4M", "repoId": "OsaurusAI/Raptor-0.6-4B-JANG_4M", "safeConfigVector": {"gpuNum": 1}, "status": "pending", "targetGpu": "Ascend_910-b4", "taskType": "text-generation"} +{"batchId": "f08085dbcdaf4177a4af5beaf5dd26f2", "completedAt": "2026-10-01T06:01:56.204475+00:00", "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configSource": "modelhub_live", "createdAt": "2026-10-01T06:01:53.981886+00:00", "framework": "vllm_tokenizer_patch", "intentId": "12fac27052884855b46af55bafb94ec0", "lastModified": "2026-10-01T05:29:53+00:00", "modelAddress": "https://modelscope.cn/models/OsaurusAI/Raptor-0.6-4B-JANG_4M", "reason": null, "repoId": "OsaurusAI/Raptor-0.6-4B-JANG_4M", "safeConfigVector": {"gpuNum": 1}, "status": "submitted", "targetGpu": "Ascend_910-b4", "taskId": "5209103", "taskType": "text-generation"} {"batchId": "6ad67bedd5104b958247ed686fa4a8d7", "completedAt": "2026-09-29T14:16:48.925444+00:00", "configFingerprint": "8be5b78bdba5c4413c1e4ab91a46e27c34642b25d5dc059ad3a11d50d7e33593", "configSource": "modelhub_live", "createdAt": "2026-09-29T14:16:45.683768+00:00", "framework": "vllm_tokenizer_patch", "intentId": "ba30792e89b44ef5804d5f3613d7df71", "repoId": "nv-community/Qwen3.8-27B-NVFP4", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "uniqueness_rejected", "targetGpu": "MetaX_c-500", "taskId": null, "taskType": "text-generation"} {"batchId": "6ad67bedd5104b958247ed686fa4a8d7", "completedAt": "2026-09-29T14:16:48.925408+00:00", "configFingerprint": "8be5b78bdba5c4413c1e4ab91a46e27c34642b25d5dc059ad3a11d50d7e33593", "configSource": "modelhub_live", "createdAt": "2026-09-29T14:16:45.683638+00:00", "framework": "vllm_tokenizer_patch", "intentId": "69aec4d25f21464c860135eb90d77735", "repoId": "nv-community/NVIDIA-Nemotron-3-Nano-30B-A3B-FP8", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "uniqueness_rejected", "targetGpu": "MetaX_c-500", "taskId": null, "taskType": "text-generation"} {"batchId": "af702292a17240468562311292c55106", "completedAt": "2026-09-29T11:50:56.209408+00:00", "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configSource": "modelhub_live", "createdAt": "2026-09-29T11:50:53.929909+00:00", "framework": "vllm_tokenizer_patch", "intentId": "c488d875b85a4d699fe135674c2b940b", "repoId": "mlx-community/LFM2.5-1.2B-Instruct-6bit", "safeConfigVector": {"gpuNum": 1, "maxModelLen": 4096}, "status": "uniqueness_rejected", "targetGpu": "Ascend_910-b3", "taskId": null, "taskType": "text-generation"} diff --git a/.modelhub_state/routing_intelligence.json b/.modelhub_state/routing_intelligence.json index d24eb3315..8833ebdff 100644 --- a/.modelhub_state/routing_intelligence.json +++ b/.modelhub_state/routing_intelligence.json @@ -1,6 +1,6 @@ { "acceptedByCategory": { - "unified_success_first": 2735 + "unified_success_first": 2736 }, "acceptedByRoute": { "text-generation|Ascend_910-b3|llamacpp": 19, @@ -8,7 +8,7 @@ "text-generation|Ascend_910-b3|vllm_tokenizer_patch": 181, "text-generation|Ascend_910-b4|llamacpp": 16, "text-generation|Ascend_910-b4|vllm": 32, - "text-generation|Ascend_910-b4|vllm_tokenizer_patch": 209, + "text-generation|Ascend_910-b4|vllm_tokenizer_patch": 210, "text-generation|Biren_166m|vllm": 81, "text-generation|Biren_166m|vllm_fix_tokenizer": 149, "text-generation|Cambricon_mlu-370-x4|vllm": 73, @@ -39,8 +39,8 @@ "text-generation|hygon_k100-ai|vllm": 27, "text-generation|hygon_k100-ai|vllm-patch-tokenizer": 152 }, - "acceptedSinceRefresh": 2735, - "acceptedTotal": 2735, - "generatedAt": "2026-10-01T05:59:47.363451+00:00", + "acceptedSinceRefresh": 2736, + "acceptedTotal": 2736, + "generatedAt": "2026-10-01T06:01:56.157241+00:00", "version": 1 } diff --git a/ledger/submissions.jsonl b/ledger/submissions.jsonl index 0bceefdde..a19bdf665 100644 --- a/ledger/submissions.jsonl +++ b/ledger/submissions.jsonl @@ -962,3 +962,4 @@ {"framework": "transformers", "modelAddress": "https://modelscope.cn/models/RedHatAI/starcoder2-15b-quantized.w8a16", "modelId": "RedHatAI/starcoder2-15b-quantized.w8a16", "submitTime": "2026-09-21T18:32:49.780633+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5005549", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-transformers-iluvatar-bi-150"} {"framework": "vllm_tokenizer_patch", "modelAddress": "https://modelscope.cn/models/mlx-community/gpt-oss-20b-OptiQ-4bit", "modelId": "mlx-community/gpt-oss-20b-OptiQ-4bit", "submitTime": "2026-09-26T08:01:50.847636+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5097139", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-tokenizer-patch-ascend-910-b4"} {"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/mlx-community/gpt-oss-20b-OptiQ-4bit", "modelId": "mlx-community/gpt-oss-20b-OptiQ-4bit", "submitTime": "2026-09-26T08:18:32.495861+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5097281", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-kunlunxin-p-800"} +{"framework": "vllm_tokenizer_patch", "modelAddress": "https://modelscope.cn/models/OsaurusAI/Raptor-0.6-4B-JANG_4M", "modelId": "OsaurusAI/Raptor-0.6-4B-JANG_4M", "submitTime": "2026-10-01T06:01:55.960786+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5209103", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-tokenizer-patch-ascend-910-b4"} diff --git a/manifest.json b/manifest.json index 8b2facffd..d7cdd01b0 100644 --- a/manifest.json +++ b/manifest.json @@ -10,16 +10,16 @@ ".modelhub_state/queue_cleanup_latest.json": "2ab9713b25b7d4ba561d3c77969513a372db37a9de30ef70151fb0193b2bc7ce", ".modelhub_state/recent_outcomes.jsonl": "73f23566b5b4b8c0176d6e15dac2ca91200b082f28f05f39862b89485e9e092d", ".modelhub_state/recovery_active_tasks.jsonl": "a707b4172b612a60f3ff7e4cf1fe25f7811213b2474e123205ea559879199834", - ".modelhub_state/recovery_intents.jsonl": "2fe49ba7667b2094e521b3ab45c03a267df717b0232f0df8583ea839a4231f45", - ".modelhub_state/routing_intelligence.json": "d7ad87924bbb020cf87785bbc0dd718358c8ce37f60a1cf95125d229fefe245c", + ".modelhub_state/recovery_intents.jsonl": "f323d8b733eba636f47038c390f6ed0a2972a96ed1543289bb23956859f2736a", + ".modelhub_state/routing_intelligence.json": "87f5ede50d7c43b223984d5eb6a7940fe9ccba1a522b74a596add95fe814abdc", ".modelhub_state/submission_exclusions.jsonl": "1e62f6ba5bd2ba5f2f360bc134b44f7b69190230dd0e274919a87a73ea66761c", ".modelhub_state/worker_crashes.jsonl": "21a892d638884250c04f19e07a433baae065285327484e361c9e5067b0bc17dd", - "ledger/submissions.jsonl": "b727b6b6a2513055d32248bbd3fd797ba537e78a0ec8eabe9758ea2f29db81b5", - "outcomes/submissions.jsonl": "35d1a109a1ac6a6b1701723b19c87b5370c447ac63090e9fd753cc55e696d411" + "ledger/submissions.jsonl": "08d544976bcbe69aaf4e32d084e5e9601dc178dcfe7c925752afafae1df61297", + "outcomes/submissions.jsonl": "f7c86f147f7bdcfa5ed0fb1b82a46eb70c56e39ab595764bf24d002223f01823" }, - "generation": 19093, - "phase": "intent", + "generation": 19094, + "phase": "result", "schemaVersion": 1, - "updatedAt": "2026-10-01T06:01:54.117176+00:00", + "updatedAt": "2026-10-01T06:01:56.381910+00:00", "writerId": "a812d0e025c3474eb16b828a4d987334" } diff --git a/outcomes/submissions.jsonl b/outcomes/submissions.jsonl index 7d6182705..a866b1035 100644 --- a/outcomes/submissions.jsonl +++ b/outcomes/submissions.jsonl @@ -754,3 +754,4 @@ {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-01T03:19:50.448066+00:00", "modelId": "mlx-community/K2-Horizon-3.7B-8bit", "modelProfile": {"architectures": ["K2HorizonForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5374667178, "estimatedRequiredGiB": 6.03, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "k2_horizon", "modelscopeFileSize": 5395463319, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:k2_horizon", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:dense", "custom_tag:k2-horizon"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5395463319}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-30T19:16:58.857252+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5200707", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "OsaurusAI/Raptor-0.6-4B-JANG_4M", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "8be5b78bdba5c4413c1e4ab91a46e27c34642b25d5dc059ad3a11d50d7e33593", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2635323720, "estimatedRequiredGiB": 2.962, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:jang", "custom_tag:quantized", "custom_tag:apple-silicon", "custom_tag:reasoning", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:spark2_5", "custom_tag:imatrix", "custom_tag:awq", "custom_tag:gptq"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2650224659}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-01T05:41:58.050597+00:00", "targetGpu": "MetaX_c-500", "taskId": "5208880", "taskType": "text-generation", "verifyResult": null} {"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "shisa-ai/shisa-de-1-FP8-dynamic", "modelProfile": {"architectures": ["Gemma4ForConditionalGeneration"], "configFingerprint": "8be5b78bdba5c4413c1e4ab91a46e27c34642b25d5dc059ad3a11d50d7e33593", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 27165329828, "estimatedRequiredGiB": 30.398, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma4", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1144510513, "modelscopeTags": ["license:apache-2.0", "model_type:gemma4", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:decision-engine", "custom_tag:system-one", "custom_tag:text-classification", "custom_tag:gemma", "custom_tag:fp8", "custom_tag:compressed-tensors", "custom_tag:llm-compressor"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 27200059979}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-01T05:59:45.051636+00:00", "targetGpu": "MetaX_c-500", "taskId": "5209080", "taskType": "text-generation", "verifyResult": null} +{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": null, "modelId": "OsaurusAI/Raptor-0.6-4B-JANG_4M", "modelProfile": {"architectures": ["Spark2_5ForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2635323720, "estimatedRequiredGiB": 2.962, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "spark2_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": null, "modelscopeTags": ["license:apache-2.0", "model_type:spark2_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:jang", "custom_tag:quantized", "custom_tag:apple-silicon", "custom_tag:reasoning", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:spark2_5", "custom_tag:imatrix", "custom_tag:awq", "custom_tag:gptq"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2650224659}, "outcome": "pending", "status": "pending", "submitTime": "2026-10-01T06:01:55.960786+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5209103", "taskType": "text-generation", "verifyResult": null}