state: generation 22039 (cycle)

This commit is contained in:
2026-10-08 03:30:43 +00:00
parent cd3adc8e79
commit 670d870516
11 changed files with 2857 additions and 3431 deletions

View File

@@ -2417,6 +2417,27 @@
"targetGpu": "MetaX_c-500",
"taskType": "text-generation"
},
"metax_c-500|vllm|text-generation|model_type:mini_k3": {
"architectureSignature": "model_type:mini_k3",
"architectures": [],
"evidenceCount": 2,
"expiresAt": "2026-10-22T00:10:30.409776+00:00",
"framework": "vllm",
"latestFailureAt": "2026-09-22T00:10:30.409776+00:00",
"latestSuccessfulAt": null,
"matchType": "model_type",
"modelType": "mini_k3",
"sourceModelIds": [
"nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C",
"nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B"
],
"sourceTaskIds": [
"5009394",
"5009165"
],
"targetGpu": "MetaX_c-500",
"taskType": "text-generation"
},
"metax_c-500|vllm|text-generation|model_type:zaya": {
"architectureSignature": "model_type:zaya",
"architectures": [],
@@ -2900,9 +2921,9 @@
"taskType": "text-generation"
}
},
"generatedAt": "2026-10-08T02:59:39.035434+00:00",
"generatedAt": "2026-10-08T03:19:52.239477+00:00",
"summary": {
"activeBlockCount": 145,
"activeBlockCount": 146,
"byGpuFramework": {
"Ascend_910-b3|vllm": 9,
"Ascend_910-b3|vllm_tokenizer_patch": 8,
@@ -2921,7 +2942,7 @@
"Iluvatar_mrv-100|vllm": 1,
"Kunlunxin_p-800|vllm": 10,
"Kunlunxin_p-800|vllm_tokenizer_patch": 9,
"MetaX_c-500|vllm": 1,
"MetaX_c-500|vllm": 2,
"MetaX_c-500|vllm_tokenizer_patch": 2,
"Mthreads_s4000|vllm": 6,
"Sunrise_pt-200-x1|vllm": 2,

View File

@@ -1,8 +1,8 @@
{
"communityAttemptedAt": "2026-10-08T03:00:57.870681+00:00",
"communityAttemptedAt": "2026-10-08T03:23:51.636961+00:00",
"communityError": null,
"communitySample": {},
"communityUpdatedAt": "2026-10-08T03:00:57.870681+00:00",
"communityUpdatedAt": "2026-10-08T03:23:51.636961+00:00",
"frameworkAttemptedAt": "2026-10-08T03:00:57.870681+00:00",
"frameworkError": null,
"frameworkStats": {
@@ -434,7 +434,7 @@
}
},
"frameworkUpdatedAt": null,
"generatedAt": "2026-10-08T03:15:48.260759+00:00",
"generatedAt": "2026-10-08T03:23:51.636961+00:00",
"gpuStats": {
"Ascend_910-b3": {
"available": true,

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -14,13 +14,13 @@
100
],
"accounts": 12,
"activeScanned": 1101,
"activeScanned": 1072,
"ageCleanupMode": "admission_only",
"agePolicySkipped": {
"cleanupDisabled": true,
"reason": "admission_only"
},
"architectureBlockCount": 145,
"architectureBlockCount": 146,
"architectureFrameworkCatalog": {
"ascend_910-b3|text-generation": [
"llamacpp",
@@ -58,33 +58,12 @@
]
},
"architectureFrameworkCatalogErrors": {},
"architectureIncompatibleCount": 18,
"architectureIncompatibleCount": 9,
"architectureIncompatibleTasks": [
{
"accountIndex": 1,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-llama-gqa-block4-v1",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5353410,
"taskType": "text-generation"
},
{
"accountIndex": 2,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -92,20 +71,20 @@
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-8-v2_D",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5012786,
"taskId": 5011070,
"taskType": "text-generation"
},
{
"accountIndex": 2,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"accountIndex": 3,
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -113,41 +92,20 @@
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-decay-g64-v2_B",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5013340,
"taskType": "text-generation"
},
{
"accountIndex": 2,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-llama-mha-standard-v1",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360309,
"taskId": 5011026,
"taskType": "text-generation"
},
{
"accountIndex": 4,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -155,20 +113,20 @@
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g4-v1_C",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-64-v2",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360302,
"taskId": 5009122,
"taskType": "text-generation"
},
{
"accountIndex": 5,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"accountIndex": 4,
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -176,167 +134,20 @@
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-1-v2",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5353396,
"taskType": "text-generation"
},
{
"accountIndex": 6,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5012953,
"taskType": "text-generation"
},
{
"accountIndex": 6,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-16-v2",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5353400,
"taskType": "text-generation"
},
{
"accountIndex": 7,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-2-v2",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5353406,
"taskType": "text-generation"
},
{
"accountIndex": 7,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-llama-mha-block4-v1",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360294,
"taskType": "text-generation"
},
{
"accountIndex": 7,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-attnres-block1-v1_D",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360298,
"taskType": "text-generation"
},
{
"accountIndex": 8,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-decay-g64-v2_B",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5011832,
"taskType": "text-generation"
},
{
"accountIndex": 8,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-decay-g8-v2_C",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5013035,
"taskId": 5012814,
"taskType": "text-generation"
},
{
"accountIndex": 8,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"accountIndex": 6,
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -344,20 +155,20 @@
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-attn-2kda-2mla-nope-v2",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-attnres-block2-v1_B",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360317,
"taskId": 5011008,
"taskType": "text-generation"
},
{
"accountIndex": 9,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -365,20 +176,20 @@
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-decay-g4-v2_B",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-32-v2_D",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5013339,
"taskId": 5010247,
"taskType": "text-generation"
},
{
"accountIndex": 9,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -386,20 +197,41 @@
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-attn-1kda-3mla-nope-v2",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360316,
"taskId": 5011012,
"taskType": "text-generation"
},
{
"accountIndex": 9,
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm"
],
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5013070,
"taskType": "text-generation"
},
{
"accountIndex": 10,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -407,35 +239,14 @@
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-attnres-full-sublayer-v1_D",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-decay-g4-v2_B",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360291,
"taskType": "text-generation"
},
{
"accountIndex": 11,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-0-v2",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360293,
"taskId": 5013071,
"taskType": "text-generation"
}
],
@@ -466,42 +277,18 @@
"frameworkCatalogUnknown": 0,
"frameworkContextUnknown": 44,
"modelArchitectureUnknown": 163,
"noMatchingBlock": 904,
"noMatchingBlock": 884,
"partiallyBlockedFrameworkSet": 16,
"runningMatchedProtected": 0,
"submissionContextMismatch": 0,
"submissionContextUnknown": 0
},
"cancelledCount": 18,
"cancelledCount": 9,
"cancelledTasks": [
{
"accountIndex": 1,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-llama-gqa-block4-v1",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5353410,
"taskType": "text-generation"
},
{
"accountIndex": 2,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -512,20 +299,20 @@
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-8-v2_D",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5012786,
"taskId": 5011070,
"taskType": "text-generation"
},
{
"accountIndex": 2,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"accountIndex": 3,
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -536,44 +323,20 @@
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-decay-g64-v2_B",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5013340,
"taskType": "text-generation"
},
{
"accountIndex": 2,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-llama-mha-standard-v1",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360309,
"taskId": 5011026,
"taskType": "text-generation"
},
{
"accountIndex": 4,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -584,20 +347,20 @@
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g4-v1_C",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-64-v2",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360302,
"taskId": 5009122,
"taskType": "text-generation"
},
{
"accountIndex": 5,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"accountIndex": 4,
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -608,188 +371,20 @@
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-1-v2",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5353396,
"taskType": "text-generation"
},
{
"accountIndex": 6,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5012953,
"taskType": "text-generation"
},
{
"accountIndex": 6,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-16-v2",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5353400,
"taskType": "text-generation"
},
{
"accountIndex": 7,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-2-v2",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5353406,
"taskType": "text-generation"
},
{
"accountIndex": 7,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-llama-mha-block4-v1",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360294,
"taskType": "text-generation"
},
{
"accountIndex": 7,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-attnres-block1-v1_D",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360298,
"taskType": "text-generation"
},
{
"accountIndex": 8,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-decay-g64-v2_B",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5011832,
"taskType": "text-generation"
},
{
"accountIndex": 8,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-decay-g8-v2_C",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5013035,
"taskId": 5012814,
"taskType": "text-generation"
},
{
"accountIndex": 8,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"accountIndex": 6,
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -800,20 +395,20 @@
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-attn-2kda-2mla-nope-v2",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-attnres-block2-v1_B",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360317,
"taskId": 5011008,
"taskType": "text-generation"
},
{
"accountIndex": 9,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -824,20 +419,20 @@
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-decay-g4-v2_B",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-32-v2_D",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5013339,
"taskId": 5010247,
"taskType": "text-generation"
},
{
"accountIndex": 9,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -848,20 +443,44 @@
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-attn-1kda-3mla-nope-v2",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360316,
"taskId": 5011012,
"taskType": "text-generation"
},
{
"accountIndex": 9,
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm"
],
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5013070,
"taskType": "text-generation"
},
{
"accountIndex": 10,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureBlockEvidenceCount": 2,
"architectureBlockExpiresAt": "2026-10-22T00:10:30.409776+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
@@ -872,44 +491,20 @@
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
"vllm"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-attnres-full-sublayer-v1_D",
"framework": "vllm",
"gpuType": "MetaX_c-500",
"modelId": "nkkbr/Mini-K3-1H-decay-g4-v2_B",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360291,
"taskType": "text-generation"
},
{
"accountIndex": 11,
"architectureBlockEvidenceCount": 1,
"architectureBlockExpiresAt": "2026-10-22T00:26:48.653700+00:00",
"architectureMatchScope": "exact_framework",
"architectureMatchType": "model_type",
"architectureSignature": "model_type:mini_k3",
"architectureSignatures": [
"model_type:mini_k3"
],
"cleanupReasons": [
"known_framework_architecture_incompatible"
],
"evaluatedFrameworks": [
"vllm_0_17_0_corex_4_4_0"
],
"framework": "vllm_0_17_0_corex_4_4_0",
"gpuType": "Iluvatar_bi-150",
"modelId": "nkkbr/Mini-K3-1H-kda-kernel-0-v2",
"reason": "known_framework_architecture_incompatible",
"status": "waiting",
"taskId": 5360293,
"taskId": 5013071,
"taskType": "text-generation"
}
],
"certainOomCount": 0,
"certainOomTasks": [],
"cleanupCandidateCount": 18,
"cleanupCandidateCount": 9,
"dryRun": false,
"listingErrors": {},
"modelAgeErrors": {},
@@ -934,7 +529,7 @@
],
"oldOverflowCount": 0,
"oldOverflowTasks": [],
"policyCancelledRecorded": 18,
"policyCancelledRecorded": 9,
"policyNoLongerAppliesCount": 0,
"policyNoLongerAppliesTasks": [],
"recentModelDays": 7,

View File

@@ -29,6 +29,8 @@
{"failReason": "参数/模板问题", "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-10-07T11:42:31.164473+00:00", "modelId": "LessThanThreeAI/Qwen3.8-27B-Humanlike-Chat-2.0-GPTQ-Int4", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T09:15:22.866391+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5320518", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-10-07T11:42:31.164580+00:00", "modelId": "ukisai/Swift-1.5-5bit-MLX", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T09:15:22.761540+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5320515", "taskType": "text-generation", "verifyResult": null}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-06T19:00:42.266417+00:00", "modelId": "mlx-community/gpt-oss-20b-OptiQ-4bit", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11623702006, "estimatedRequiredGiB": 13.022, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 11651702017, "modelscopeLicense": "apache-2.0", "modelscopeParams": 3982569024, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:openai", "custom_tag:gpt-oss", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:4bit", "custom_tag:mixed-precision", "custom_tag:optiq", "custom_tag:moe", "custom_tag:apple-silicon", "custom_tag:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11651702017}, "outcome": "failed", "status": "success", "submitTime": "2026-10-06T09:15:22.648982+00:00", "targetGpu": "Biren_166m", "taskId": "5320514", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851090+00:00", "modelId": "nkkbr/Mini-K3-1H-attn-1kda-3mla-nope-v2", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T09:13:59.677111+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5320455", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851246+00:00", "modelId": "nkkbr/Mini-K3-1H-attn-2kda-2mla-nope-v2", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T09:13:59.676142+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5320466", "taskType": "text-generation", "verifyResult": null}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5_text"], "framework": "vllm", "lastSyncTime": "2026-10-07T00:15:56.875101+00:00", "modelId": "TokenRhythm/NeoHorse-1-4B", "modelProfile": {"architectures": ["Qwen3_5ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8411552560, "estimatedRequiredGiB": 9.428, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_text", "modelscopeFileSize": 8435794426, "modelscopeLicense": "Apache License 2.0", "modelscopeParams": 4205751296, "modelscopeTags": ["license:Apache License 2.0", "model_type:qwen3_5_text", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:agentic", "custom_tag:tool-use", "custom_tag:coding", "custom_tag:reasoning", "custom_tag:instruction-following"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 8435794426}, "outcome": "failed", "status": "success", "submitTime": "2026-10-06T08:52:27.660895+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5320023", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5_text"], "framework": "vllm", "lastSyncTime": "2026-10-07T00:04:30.851007+00:00", "modelId": "TokenRhythm/NeoHorse-1-9B", "modelProfile": {"architectures": ["Qwen3_5ForCausalLM"], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 17907657384, "estimatedRequiredGiB": 20.04, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5_text", "modelscopeFileSize": 17931574767, "modelscopeLicense": "Apache License 2.0", "modelscopeParams": 8953803264, "modelscopeTags": ["license:Apache License 2.0", "model_type:qwen3_5_text", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:agentic", "custom_tag:tool-use", "custom_tag:coding", "custom_tag:reasoning", "custom_tag:instruction-following"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 17931574767}, "outcome": "failed", "status": "success", "submitTime": "2026-10-06T08:52:27.648162+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5320021", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-10-07T11:42:31.164443+00:00", "modelId": "rapid-mlx/Qwen3.8-27B-4bit-MTP-fp16-MLX", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-06T08:52:27.549406+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5320020", "taskType": "text-generation", "verifyResult": null}
@@ -61,6 +63,17 @@
{"failReason": "参数/模板问题", "framework": "", "lastSyncTime": "2026-10-03T21:52:42.757662+00:00", "modelId": "empero-ai/Qwen3.8-9B-GGUF", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T21:52:11+00:00", "targetGpu": "hygon_k100-ai", "taskId": "4230414", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "", "lastSyncTime": "2026-10-03T21:52:42.757636+00:00", "modelId": "empero-ai/Qwen3.8-9B-GGUF", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T21:52:10+00:00", "targetGpu": "Ascend_910-b3", "taskId": "4261809", "taskType": "text-generation", "verifyResult": null}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "driver_error", "failureCode": "DRIVER_ERROR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-04T01:37:22.760175+00:00", "modelId": "mlx-community/gpt-oss-20b-OptiQ-4bit", "modelProfile": {"architectures": ["GptOssForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11623702006, "estimatedRequiredGiB": 13.022, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gpt_oss", "modelscopeFileSize": 11651702017, "modelscopeLicense": "apache-2.0", "modelscopeParams": 3982569024, "modelscopeTags": ["license:apache-2.0", "model_type:gpt_oss", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:openai", "custom_tag:gpt-oss", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:4bit", "custom_tag:mixed-precision", "custom_tag:optiq", "custom_tag:moe", "custom_tag:apple-silicon", "custom_tag:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11651702017}, "outcome": "failed", "status": "success", "submitTime": "2026-10-03T16:15:50.370736+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5260135", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851218+00:00", "modelId": "nkkbr/Mini-K3-1H-llama-mha-standard-v1", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:50.052404+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5260121", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851110+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-0-v2", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:49.560660+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5260110", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851022+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g4-v1_C", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:49.555638+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5260108", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851196+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block1-v1_D", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:49.469061+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5260106", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851140+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-full-sublayer-v1_D", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:49.446747+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5260107", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851284+00:00", "modelId": "nkkbr/Mini-K3-1H-llama-gqa-block4-v1", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:49.265263+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5260097", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851130+00:00", "modelId": "nkkbr/Mini-K3-1H-llama-mha-block4-v1", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:49.262277+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5260096", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851010+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-1-v2", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:49.256275+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5260098", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851172+00:00", "modelId": "nkkbr/Mini-K3-1H-llama-gqa-standard-v1", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:49.244657+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5260102", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851099+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-16-v2", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:48.964174+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5260086", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851274+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-2-v2", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:48.958081+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5260088", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T02:03:59.167802+00:00", "modelId": "nkkbr/Mini-K3-1H-attn-2kda-2mla-nope-v2", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:48.864267+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5260083", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T02:03:59.168071+00:00", "modelId": "nkkbr/Mini-K3-1H-attn-1kda-3mla-nope-v2", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-10-03T16:15:48.854605+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5260085", "taskType": "text-generation", "verifyResult": null}
{"failReason": "platform_infrastructure", "failureAction": "open_short_gpu_framework_circuit_and_retry_other_models", "failureCategory": "platform_infrastructure", "failureClassificationReason": "no_idle_device", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "gpu_framework", "failureUnsupportedModelTypes": ["qwen3_5"], "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-02T02:51:37.460202+00:00", "modelId": "logic65/Qwen3.8-Whittle-w50-18.3B-unrepaired", "modelProfile": {}, "outcome": "failed", "status": "success", "submitTime": "2026-10-02T02:42:08+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "4560331", "taskType": "text-generation", "verifyResult": -1}
@@ -128,8 +141,11 @@
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-10-08T01:25:54.566312+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-64-v2", "modelProfile": {"architectures": [], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2044205392, "estimatedRequiredGiB": 2.469, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": 2209448692, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2209448692}, "outcome": "failed", "status": "success", "submitTime": "2026-09-22T00:34:31.846322+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5009718", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-10-08T00:13:14.756688+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2018871528, "estimatedRequiredGiB": 2.26, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2022478516}, "outcome": "failed", "status": "success", "submitTime": "2026-09-22T00:33:50.449290+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5009715", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-10-07T22:01:50.158773+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2037838088, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2041445091}, "outcome": "failed", "status": "success", "submitTime": "2026-09-22T00:26:48.653700+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5009624", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm", "lastSyncTime": "2026-10-08T03:19:51.851162+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2018871528, "estimatedRequiredGiB": 2.26, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2022478516}, "outcome": "failed", "status": "success", "submitTime": "2026-09-22T00:10:30.409776+00:00", "targetGpu": "MetaX_c-500", "taskId": "5009394", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm", "lastSyncTime": "2026-10-08T03:19:51.851040+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2037838088, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2041445091}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T23:50:56.150801+00:00", "targetGpu": "MetaX_c-500", "taskId": "5009165", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T18:18:51.743129+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g2-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030713792, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039076183}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T22:21:59.843515+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5008078", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-10-07T20:23:14.668330+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T22:14:33.594032+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5008009", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851207+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-64-v2", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T21:04:43.408226+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5007290", "taskType": "text-generation", "verifyResult": null}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T23:00:29.672645+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2037838088, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2041445091}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T20:40:49.952519+00:00", "targetGpu": "Biren_166m", "taskId": "5007048", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T20:46:38.448901+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g2-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030713792, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039076183}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T20:38:42.647821+00:00", "targetGpu": "Biren_166m", "taskId": "5007028", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T16:12:59.741949+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T20:38:42.646739+00:00", "targetGpu": "Biren_166m", "taskId": "5007027", "taskType": "text-generation", "verifyResult": -1}
@@ -147,12 +163,22 @@
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-customized", "lastSyncTime": "2026-09-25T01:41:30.953868+00:00", "modelId": "mlx-community/LFM2.5-1.2B-Thinking-6bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "1b41437401598cde7836ccc25883635c2738b06a5af924b7497b6e747e655b4b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 951093016, "estimatedRequiredGiB": 1.068, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 955857175, "modelscopeLicense": "other", "modelscopeParams": 256113408, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"ambiguous_runtime": 4, "model_load": 1}, "failureCount": 5, "failureRate": 1.0, "framework": "vllm-customized", "lastTerminalAt": "2026-09-21T19:49:37.657075+00:00", "modelType": "lfm2", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Cambricon_mlu-370-x8", "taskType": "text-generation", "total": 5, "unresolvedFailureCount": 4}, "repositoryOnDiskBytes": 955857175}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:49:53.770533+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5006460", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T11:42:31.164621+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 5}, "failureCount": 5, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-21T16:50:30.559192+00:00", "modelType": "qwen3_5", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Biren_166m", "taskType": "text-generation", "total": 5, "unresolvedFailureCount": 5}, "repositoryOnDiskBytes": 19329296879}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:37:12.653471+00:00", "targetGpu": "Biren_166m", "taskId": "5006368", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-07T23:00:29.672674+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g2-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030713792, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039076183}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:37:12.459191+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006360", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851237+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T19:37:12.451588+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006358", "taskType": "text-generation", "verifyResult": null}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T02:59:38.470354+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2037838088, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2041445091}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:37:12.449585+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006359", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-07T19:02:02.168317+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:37:12.447446+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006364", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T02:21:33.753335+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:37:12.388268+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006357", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["mini_k3"], "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T02:39:47.345789+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:37:12.384898+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006356", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T09:53:21.160613+00:00", "modelId": "prithivMLmods/Nexus-9B-CodeCore-Merge", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 19306311000, "estimatedRequiredGiB": 21.602, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1562291952, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:text-generation-inference", "custom_tag:pytorch", "custom_tag:omnimergekit", "custom_tag:merge", "custom_tag:qwen3_5", "custom_tag:reasoning", "custom_tag:chain-of-thought", "custom_tag:sft", "custom_tag:agent", "custom_tag:tool-use", "custom_tag:function-calling", "custom_tag:coder", "custom_tag:9B"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 3, "consecutiveFailures": 3, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 3, "failureBreakdown": {"memory_capacity": 3}, "failureCount": 3, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-20T12:21:49.901832+00:00", "modelType": "qwen3_5", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Iluvatar_bi-150", "taskType": "text-generation", "total": 3, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 19329296879}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:21:51.849661+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5006201", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T13:06:44.750866+00:00", "modelId": "prithivMLmods/Qwen-Image-2.1-PE-T2I-MLX", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 35196531592, "estimatedRequiredGiB": 39.403, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": null, "modelscopeLicense": "other", "modelscopeParams": 1411666624, "modelscopeTags": ["license:other", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:text-generation-inference", "custom_tag:qwen3_5", "custom_tag:mlx-vlm", "custom_tag:prompt-rewriter", "custom_tag:prompt enhancer", "custom_tag:apple-silicon", "custom_tag:4-bit", "custom_tag:8-bit"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 5}, "failureCount": 5, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-21T16:50:30.559192+00:00", "modelType": "qwen3_5", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Biren_166m", "taskType": "text-generation", "total": 5, "unresolvedFailureCount": 5}, "repositoryOnDiskBytes": 35256868927}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:21:51.848154+00:00", "targetGpu": "Biren_166m", "taskId": "5006202", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851150+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-8-v2_D", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T19:21:51.846176+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006199", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851055+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g8-v2_C", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T19:21:51.844977+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006200", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851227+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T19:21:51.789058+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006198", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851078+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-32-v2_D", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T19:21:51.675420+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006197", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851256+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g64-v2_B", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T19:21:51.659014+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006195", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851265+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block2-v1_B", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T19:21:51.651884+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006196", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851120+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g4-v2_B", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T19:21:51.649992+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006193", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.850982+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T19:21:51.645382+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006189", "taskType": "text-generation", "verifyResult": null}
{"failReason": "参数/模板问题", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-08T03:19:51.851067+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T19:21:51.643154+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5006186", "taskType": "text-generation", "verifyResult": null}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T22:01:50.158710+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:21:51.640501+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006192", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-07T22:01:50.158742+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:21:51.639396+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006187", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-10-08T02:03:59.168051+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T19:21:51.636493+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5006190", "taskType": "text-generation", "verifyResult": -1}
@@ -272,29 +298,3 @@
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "transformers", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "framework": "transformers", "lastSyncTime": "2026-09-21T22:33:35.352083+00:00", "modelId": "JANGQ-AI/AppleScript-8B-JANG_4M", "modelProfile": {"architectures": ["ZayaForCausalLM"], "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7915599888, "estimatedRequiredGiB": 8.885, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "zaya", "modelscopeFileSize": 7950463599, "modelscopeLicense": "other", "modelscopeParams": 2274126328, "modelscopeTags": ["license:other", "model_type:zaya", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:applescript", "custom_tag:macos", "custom_tag:computer-use", "custom_tag:agent", "custom_tag:tool-calling", "custom_tag:function-calling", "custom_tag:mlx", "custom_tag:moe", "custom_tag:osaurus"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 7950463599}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T14:20:21.627234+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5002168", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-21T22:33:35.352105+00:00", "modelId": "neuralmagic/starcoder2-15b-FP8", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 16564748304, "estimatedRequiredGiB": 18.516, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 16568142341, "modelscopeLicense": "other", "modelscopeParams": 15957889024, "modelscopeTags": ["license:other", "model_type:starcoder2", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:fp8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-20T17:24:32.660469+00:00", "modelType": "starcoder2", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Iluvatar_bi-150", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 16568142341}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T14:17:59.395147+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5002153", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T16:15:27.384896+00:00", "modelId": "logic65/Qwen3.8-Whittle-w50-18.3B-unrepaired", "modelProfile": {"architectures": ["Qwen3_5ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 36679335352, "estimatedRequiredGiB": 41.028, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 36711610638, "modelscopeLicense": "apache-2.0", "modelscopeParams": 18339618304, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:pruning", "custom_tag:width-pruning", "custom_tag:zero-training", "custom_tag:qwen3_5", "custom_tag:gated-deltanet"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 4}, "failureCount": 4, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-21T12:09:51.363816+00:00", "modelType": "qwen3_5", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Biren_166m", "taskType": "text-generation", "total": 4, "unresolvedFailureCount": 4}, "repositoryOnDiskBytes": 36711610638}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T14:17:59.392335+00:00", "targetGpu": "Biren_166m", "taskId": "5002152", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm_fix_tokenizer", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-21T22:33:35.352115+00:00", "modelId": "neuralmagic/gemma-2-9b-it-quantized.w4a16", "modelProfile": {"architectures": ["Gemma2ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7963207224, "estimatedRequiredGiB": 8.924, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma2", "modelscopeFileSize": 7985124714, "modelscopeLicense": "llama2", "modelscopeParams": 10159209984, "modelscopeTags": ["license:llama2", "model_type:gemma2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-20T17:24:32.660437+00:00", "modelType": "gemma2", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Iluvatar_bi-150", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 1}, "repositoryOnDiskBytes": 7985124714}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T14:17:59.387901+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5002151", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T16:11:25.363122+00:00", "modelId": "ddalcu/Qwen3.8-27B-MLX-Serve-iQ-MLX-3.8bpw", "modelProfile": {"architectures": ["Qwen3_5ForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 12999919368, "estimatedRequiredGiB": 14.555, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "qwen3_5", "modelscopeFileSize": 13023155398, "modelscopeLicense": "apache-2.0", "modelscopeParams": 3544073216, "modelscopeTags": ["license:apache-2.0", "model_type:qwen3_5", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:mlx-serve", "custom_tag:qwen3_5", "custom_tag:apple-silicon", "custom_tag:imatrix", "custom_tag:mtp", "custom_tag:speculative-decoding"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 0, "consecutiveFailures": 0, "decisionFailureRate": 0.0, "decisionSuccessRate": 0.0, "decisionTotal": 0, "failureBreakdown": {"ambiguous_runtime": 4}, "failureCount": 4, "failureRate": 1.0, "framework": "vllm_fix_tokenizer", "lastTerminalAt": "2026-09-21T12:09:51.363816+00:00", "modelType": "qwen3_5", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Biren_166m", "taskType": "text-generation", "total": 4, "unresolvedFailureCount": 4}, "repositoryOnDiskBytes": 13023155398}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T14:17:59.385934+00:00", "targetGpu": "Biren_166m", "taskId": "5002154", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T04:22:26.358545+00:00", "modelId": "webAI-Official/TwIL-LM3", "modelProfile": {"architectures": ["SmolLM3ForCausalLM"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 6150235096, "estimatedRequiredGiB": 24.879, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "smollm3", "modelscopeFileSize": 22261451381, "modelscopeLicense": "other", "modelscopeParams": 3075098624, "modelscopeTags": ["license:other", "model_type:smollm3", "library:pytorch", "library:transformer", "library:lora", "library:safetensors", "library:gguf", "task:text-generation", "custom_tag:formal-logic", "custom_tag:reasoning", "custom_tag:lora", "custom_tag:model-merging", "custom_tag:wise-ft", "custom_tag:reinforcement-learning", "custom_tag:grpo", "custom_tag:smollm3", "custom_tag:twil-lm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 22261451381}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T14:17:59.369215+00:00", "targetGpu": "Biren_166m", "taskId": "5002150", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T16:20:26.367867+00:00", "modelId": "ddalcu/Muse-Glimmer-30B-MLX-Serve-8bit", "modelProfile": {"architectures": ["MuseGlimmerForConditionalGeneration"], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 35620174949, "estimatedRequiredGiB": 39.84, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "muse_glimmer", "modelscopeFileSize": 35648665467, "modelscopeLicense": "apache-2.0", "modelscopeParams": 9345525760, "modelscopeTags": ["license:apache-2.0", "model_type:muse_glimmer", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:mlx-serve", "custom_tag:muse_glimmer"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 35648665467}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T13:43:30.755806+00:00", "targetGpu": "Biren_166m", "taskId": "5001736", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-mlu", "lastSyncTime": "2026-09-25T16:52:49.659909+00:00", "modelId": "RedHatAI/SmolLM-135M-Instruct-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "b3ef6bcf57e6bb4fc9ede989e67a765b0e40b19fbd407f1f8452833c12bd5c38", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 219876272, "estimatedRequiredGiB": 0.25, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 223261617, "modelscopeLicense": "apache-2.0", "modelscopeParams": 162826560, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 223261617}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T13:17:35.253765+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5001324", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "vllm", "lastSyncTime": "2026-09-23T09:34:36.959573+00:00", "modelId": "ddalcu/Qwen3.8-27B-MLX-Serve-iQ-MLX-3.8bpw", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T13:17:35.237740+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5001319", "taskType": "text-generation", "verifyResult": null}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "driver_error", "failureCode": "DRIVER_ERROR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-30T01:23:45.362482+00:00", "modelId": "mlx-community/LFM2.5-1.2B-Thinking-6bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "53aadead5bb69dd6c72976cf6353832080116244f86ffae86297646e5bb48fdc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 951093016, "estimatedRequiredGiB": 1.068, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 955857175, "modelscopeLicense": "other", "modelscopeParams": 256113408, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 955857175}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T13:01:28.899242+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5001186", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "backend_operator", "failureAction": "prefer_other_proven_framework_or_gpu", "failureCategory": "backend_operator", "failureClassificationReason": "backend_version_dependent", "failureCode": "MISSING_OPERATOR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "gpu_framework", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-23T19:00:27.302859+00:00", "modelId": "RedHatAI/Phi-3-mini-128k-instruct-quantized.w8a16", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4020365960, "estimatedRequiredGiB": 4.496, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 4022810352, "modelscopeLicense": "mit", "modelscopeParams": 3821079552, "modelscopeTags": ["license:mit", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4022810352}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:49:01.259499+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5001065", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "missing_structured_error_code", "failureCode": null, "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm", "lastSyncTime": "2026-09-24T01:02:06.567778+00:00", "modelId": "BAAI/AquilaMed-RL", "modelProfile": {"architectures": ["AquilaForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 6968, "estimatedRequiredGiB": 18.386, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "aquila3", "modelscopeFileSize": 16451477782, "modelscopeLicense": "other", "modelscopeParams": 8223748096, "modelscopeTags": ["license:other", "model_type:aquila3", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:arxiv:2406.12182"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 16451477782}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:49:01.257127+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5001059", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "driver_error", "failureCode": "DRIVER_ERROR", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-10-01T11:31:46.146588+00:00", "modelId": "RedHatAI/Mistral-Nemo-Instruct-2407-quantized.w4a16", "modelProfile": {"architectures": ["MistralForCausalLM"], "configFingerprint": "7b5500238d52e9e2a21471d722bc1636ca047e1a12ba49c491593b86bec602b8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 8308282608, "estimatedRequiredGiB": 9.319, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mistral", "modelscopeFileSize": 8338221450, "modelscopeLicense": "llama2", "modelscopeParams": 12247782400, "modelscopeTags": ["license:llama2", "model_type:mistral", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 8338221450}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:49:01.251589+00:00", "targetGpu": "Ascend_910-b3", "taskId": "5001057", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "backend_operator", "failureAction": "prefer_other_proven_framework_or_gpu", "failureCategory": "backend_operator", "failureClassificationReason": "backend_version_dependent", "failureCode": "MISSING_OPERATOR", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-23T16:10:53.658817+00:00", "modelId": "aisingapore/Llama-SEA-LION-v3.5-70B-R-NVFP4", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 42709318472, "estimatedRequiredGiB": 47.753, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 42728540075, "modelscopeLicense": "llama3.1", "modelscopeParams": 70553707056, "modelscopeTags": ["license:llama3.1", "model_type:llama", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 42728540075}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:49:01.249214+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5001061", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-23T10:22:44.160467+00:00", "modelId": "LiquidAI/LFM2.5-1.2B-Thinking-MLX-8bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 1243645809, "estimatedRequiredGiB": 1.395, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 1248516007, "modelscopeLicense": "other", "modelscopeParams": 329251584, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx", "custom_tag:reasoning"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 1248516007}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:49:01.247906+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5001064", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "failureUnsupportedModelTypes": ["lfm2_moe"], "framework": "vllm", "lastSyncTime": "2026-09-23T18:42:51.656977+00:00", "modelId": "LiquidAI/LFM2.5-8B-A1B", "modelProfile": {"architectures": ["Lfm2MoeForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 16936006912, "estimatedRequiredGiB": 18.948, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2_moe", "modelscopeFileSize": 16953948786, "modelscopeLicense": "other", "modelscopeParams": 8467856832, "modelscopeTags": ["license:other", "model_type:lfm2_moe", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 16953948786}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:49:01.246640+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5001066", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "vllm", "lastSyncTime": "2026-09-23T00:07:02.456914+00:00", "modelId": "XHToken/Spark-X2.5-4B-FP8", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T12:49:01.244975+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5001063", "taskType": "text-generation", "verifyResult": null}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm-mlu", "lastSyncTime": "2026-09-27T12:27:45.263949+00:00", "modelId": "RedHatAI/SmolLM-1.7B-Instruct-quantized.w8a16", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "b3ef6bcf57e6bb4fc9ede989e67a765b0e40b19fbd407f1f8452833c12bd5c38", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2014810120, "estimatedRequiredGiB": 2.256, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 2018195467, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1812039680, "modelscopeTags": ["license:apache-2.0", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:int8", "custom_tag:vllm"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 2018195467}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:49:01.243460+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5001060", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-23T17:48:44.156555+00:00", "modelId": "RedHatAI/Phi-3-mini-128k-instruct-quantized.w8a8", "modelProfile": {"architectures": ["Phi3ForCausalLM"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 4020349648, "estimatedRequiredGiB": 4.496, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "phi3", "modelscopeFileSize": 4022916227, "modelscopeLicense": "mit", "modelscopeParams": 3821079552, "modelscopeTags": ["license:mit", "model_type:phi3", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 4022916227}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:49:01.241568+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5001058", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "missing_structured_error_code", "failureCode": null, "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-23T16:37:26.959824+00:00", "modelId": "RedHatAI/Llama-2-7b-chat-quantized.w8a8", "modelProfile": {"architectures": ["LlamaForCausalLM"], "configFingerprint": "1c0a4f69628b2a0ad37a6eee139a4c98afed7d8c93529a9ef42a90756e4e1940", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7003604832, "estimatedRequiredGiB": 7.829, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "llama", "modelscopeFileSize": 7005626505, "modelscopeLicense": "llama2", "modelscopeParams": 6738415616, "modelscopeTags": ["license:llama2", "model_type:llama", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "recentProfileFeedback": {"attributableFailureCount": 1, "consecutiveFailures": 1, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 1, "failureBreakdown": {"backend_operator": 1}, "failureCount": 1, "failureRate": 1.0, "framework": "vllm_tokenizer_patch", "lastTerminalAt": "2026-09-21T12:09:51.363747+00:00", "modelType": "llama", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "compressed-tensors", "successCount": 0, "successRate": 0.0, "targetGpu": "Kunlunxin_p-800", "taskType": "text-generation", "total": 1, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 7005626505}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:49:01.239846+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5001056", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "model_load", "failureAction": "inspect_root_exception_then_llm_if_unknown", "failureCategory": "model_load", "failureClassificationReason": "broad_load_error", "failureCode": "MODEL_LOAD_FAILED", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-23T19:04:32.562742+00:00", "modelId": "LiquidAI/LFM2.5-1.2B-Thinking-MLX-6bit", "modelProfile": {"architectures": ["Lfm2ForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 951093016, "estimatedRequiredGiB": 1.068, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "lfm2", "modelscopeFileSize": 955963132, "modelscopeLicense": "other", "modelscopeParams": 256113408, "modelscopeTags": ["license:other", "model_type:lfm2", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:liquid", "custom_tag:lfm2.5", "custom_tag:edge", "custom_tag:mlx", "custom_tag:reasoning"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 955963132}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:49:01.237142+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5001062", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "backend_operator", "failureAction": "prefer_other_proven_framework_or_gpu", "failureCategory": "backend_operator", "failureClassificationReason": "backend_version_dependent", "failureCode": "MISSING_OPERATOR", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "gpu_framework", "framework": "vllm", "lastSyncTime": "2026-09-23T02:35:34.755698+00:00", "modelId": "neuralmagic/starcoder2-15b-quantized.w8a16", "modelProfile": {"architectures": ["Starcoder2ForCausalLM"], "configFingerprint": "2ebd1d3ee8ed952dd08e24120ad5d7342c9a018f55c478225a242b664721e8d0", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 17785269848, "estimatedRequiredGiB": 19.88, "gpuMemoryEvidence": {"memoryGiB": 100.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 100.0, "maximumRepositorySizeGiB": 83.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "starcoder2", "modelscopeFileSize": 17788663867, "modelscopeLicense": "bigcode-openrail-m", "modelscopeParams": 15957889024, "modelscopeTags": ["license:bigcode-openrail-m", "model_type:starcoder2", "library:transformer", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:code"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 17788663867}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:49:01.235875+00:00", "targetGpu": "Kunlunxin_p-800", "taskId": "5001055", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "参数/模板问题", "framework": "vllm-customized", "lastSyncTime": "2026-09-22T09:59:25.057632+00:00", "modelId": "mlx-community/gemma-4-e4b-it-OptiQ-4bit", "modelProfile": {}, "outcome": "failed", "status": "failed", "submitTime": "2026-09-21T12:25:50.997483+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5000706", "taskType": "text-generation", "verifyResult": null}
{"failReason": "ambiguous_runtime", "failureAction": "send_compact_profile_and_root_exception_to_llm", "failureCategory": "ambiguous_runtime", "failureClassificationReason": "execute_empty_result", "failureCode": "EXECUTE_EMPTY_RESULT", "failureDetectedFramework": "vllm", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "unknown", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-21T20:22:53.859282+00:00", "modelId": "mlx-community/Devstral-Small-2-24B-Instruct-2512-OptiQ-4bit", "modelProfile": {"architectures": ["Mistral3ForConditionalGeneration"], "configFingerprint": "3b6ff6a21da290a9b1ca3ac432aa93c3d06a816b4b694cc9a45180f81f107aa5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 17367755740, "estimatedRequiredGiB": 19.429, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mistral3", "modelscopeFileSize": 17385072379, "modelscopeLicense": "apache-2.0", "modelscopeParams": 4929899520, "modelscopeTags": ["license:apache-2.0", "model_type:mistral3", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:mixed-precision", "custom_tag:4bit", "custom_tag:8bit", "custom_tag:optiq", "custom_tag:apple-silicon", "custom_tag:text-generation", "custom_tag:mistral", "custom_tag:mistral3", "custom_tag:devstral"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 17385072379}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:10:32.453427+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5000553", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-21T20:22:53.859263+00:00", "modelId": "mlx-community/gemma-4-e2b-it-OptiQ-4bit", "modelProfile": {"architectures": ["Gemma4ForConditionalGeneration"], "configFingerprint": "3b6ff6a21da290a9b1ca3ac432aa93c3d06a816b4b694cc9a45180f81f107aa5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5226595850, "estimatedRequiredGiB": 5.878, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma4", "modelscopeFileSize": 5259113427, "modelscopeLicense": "gemma", "modelscopeParams": 1141165347, "modelscopeTags": ["license:gemma", "model_type:gemma4", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:mixed-precision", "custom_tag:4bit", "custom_tag:8bit", "custom_tag:optiq", "custom_tag:apple-silicon", "custom_tag:text-generation", "custom_tag:gemma-4"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 5259113427}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:10:32.451262+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5000554", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "tokenizer_compatibility", "failureAction": "check_tokenizer_files_then_llm", "failureCategory": "tokenizer_compatibility", "failureClassificationReason": "broad_tokenizer_error", "failureCode": "TOKENIZER_FAILED", "failureDetectedFramework": "transformers", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_framework", "framework": "transformers", "lastSyncTime": "2026-09-21T20:22:53.859269+00:00", "modelId": "mlx-community/gemma-4-26B-A4B-it-qat-OptiQ-4bit", "modelProfile": {"architectures": ["Gemma4ForConditionalGeneration"], "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 21855018733, "estimatedRequiredGiB": 24.461, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma4", "modelscopeFileSize": 21887495988, "modelscopeLicense": "apache-2.0", "modelscopeParams": 6144703054, "modelscopeTags": ["license:apache-2.0", "model_type:gemma4", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:mixed-precision", "custom_tag:4bit", "custom_tag:8bit", "custom_tag:optiq", "custom_tag:qat", "custom_tag:moe", "custom_tag:apple-silicon", "custom_tag:text-generation", "custom_tag:image-text-to-text", "custom_tag:gemma-4"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 2, "consecutiveFailures": 2, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 2, "failureBreakdown": {"tokenizer_compatibility": 2}, "failureCount": 2, "failureRate": 1.0, "framework": "transformers", "lastTerminalAt": "2026-09-20T13:30:42.155893+00:00", "modelType": "gemma4", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Iluvatar_bi-150", "taskType": "text-generation", "total": 2, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 21887495988}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:10:32.448125+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5000552", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "tokenizer_compatibility", "failureAction": "check_tokenizer_files_then_llm", "failureCategory": "tokenizer_compatibility", "failureClassificationReason": "broad_tokenizer_error", "failureCode": "TOKENIZER_FAILED", "failureDetectedFramework": "transformers", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_framework", "framework": "transformers", "lastSyncTime": "2026-09-21T20:22:53.859276+00:00", "modelId": "mlx-community/gemma-4-31B-it-qat-OptiQ-4bit", "modelProfile": {"architectures": ["Gemma4ForConditionalGeneration"], "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 23524076260, "estimatedRequiredGiB": 26.327, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma4", "modelscopeFileSize": 23556606333, "modelscopeLicense": "apache-2.0", "modelscopeParams": 6649116524, "modelscopeTags": ["license:apache-2.0", "model_type:gemma4", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:mixed-precision", "custom_tag:4bit", "custom_tag:8bit", "custom_tag:optiq", "custom_tag:qat", "custom_tag:apple-silicon", "custom_tag:text-generation", "custom_tag:image-text-to-text", "custom_tag:gemma-4"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 2, "consecutiveFailures": 2, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 2, "failureBreakdown": {"tokenizer_compatibility": 2}, "failureCount": 2, "failureRate": 1.0, "framework": "transformers", "lastTerminalAt": "2026-09-20T13:30:42.155893+00:00", "modelType": "gemma4", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Iluvatar_bi-150", "taskType": "text-generation", "total": 2, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 23556606333}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:10:32.445988+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5000556", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "framework_architecture_unsupported", "failureAction": "block_gpu_framework_architecture", "failureCategory": "framework_architecture_unsupported", "failureClassificationReason": "explicit_framework_model_unsupported", "failureCode": "MODEL_NOT_SUPPORTED", "failureDetectedFramework": "vllm", "failureDeterministic": true, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": false, "failureScope": "model_gpu_framework", "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-21T20:22:53.859237+00:00", "modelId": "mlx-community/gemma-4-e4b-it-OptiQ-4bit", "modelProfile": {"architectures": ["Gemma4ForConditionalGeneration"], "configFingerprint": "3b6ff6a21da290a9b1ca3ac432aa93c3d06a816b4b694cc9a45180f81f107aa5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 7486327132, "estimatedRequiredGiB": 8.403, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma4", "modelscopeFileSize": 7518908360, "modelscopeLicense": "gemma", "modelscopeParams": 2227418442, "modelscopeTags": ["license:gemma", "model_type:gemma4", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:mixed-precision", "custom_tag:4bit", "custom_tag:8bit", "custom_tag:optiq", "custom_tag:apple-silicon", "custom_tag:text-generation", "custom_tag:gemma-4"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 7518908360}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:10:32.443643+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5000551", "taskType": "text-generation", "verifyResult": -1}
{"failReason": "tokenizer_compatibility", "failureAction": "check_tokenizer_files_then_llm", "failureCategory": "tokenizer_compatibility", "failureClassificationReason": "broad_tokenizer_error", "failureCode": "TOKENIZER_FAILED", "failureDetectedFramework": "transformers", "failureDeterministic": false, "failureEnrichmentAttempts": 1, "failureEnrichmentError": null, "failureNeedsLlm": true, "failureScope": "model_framework", "framework": "transformers", "lastSyncTime": "2026-09-21T20:22:53.859288+00:00", "modelId": "mlx-community/gemma-4-e2b-it-qat-OptiQ-4bit", "modelProfile": {"architectures": ["Gemma4ForConditionalGeneration"], "configFingerprint": "3086a71adcdca90005b4967eb30749c44cd82389aff8d599758e4b91675d40dc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 5222073830, "estimatedRequiredGiB": 5.872, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "gemma4", "modelscopeFileSize": 5254590634, "modelscopeLicense": "apache-2.0", "modelscopeParams": 1140034851, "modelscopeTags": ["license:apache-2.0", "model_type:gemma4", "library:mlx", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:mlx", "custom_tag:quantized", "custom_tag:mixed-precision", "custom_tag:4bit", "custom_tag:8bit", "custom_tag:optiq", "custom_tag:qat", "custom_tag:apple-silicon", "custom_tag:text-generation", "custom_tag:image-text-to-text", "custom_tag:gemma-4"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "recentProfileFeedback": {"attributableFailureCount": 2, "consecutiveFailures": 2, "decisionFailureRate": 1.0, "decisionSuccessRate": 0.0, "decisionTotal": 2, "failureBreakdown": {"tokenizer_compatibility": 2}, "failureCount": 2, "failureRate": 1.0, "framework": "transformers", "lastTerminalAt": "2026-09-20T13:30:42.155893+00:00", "modelType": "gemma4", "pendingCount": 0, "pendingRate": 0.0, "platformFailureCount": 0, "quantizationMethod": "none", "successCount": 0, "successRate": 0.0, "targetGpu": "Iluvatar_bi-150", "taskType": "text-generation", "total": 2, "unresolvedFailureCount": 0}, "repositoryOnDiskBytes": 5254590634}, "outcome": "failed", "status": "success", "submitTime": "2026-09-21T12:10:32.440298+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5000546", "taskType": "text-generation", "verifyResult": -1}

File diff suppressed because it is too large Load Diff

File diff suppressed because it is too large Load Diff

View File

@@ -228,7 +228,6 @@
{"framework": "vllm-mlu", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "submitTime": "2026-09-21T23:42:59.365888+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5009079", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-mlu-cambricon-mlu-370-x4"}
{"framework": "vllm-mlu", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "submitTime": "2026-09-21T23:42:59.367573+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5009080", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-mlu-cambricon-mlu-370-x4"}
{"framework": "vllm-mlu", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "submitTime": "2026-09-21T23:42:59.369315+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5009078", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-mlu-cambricon-mlu-370-x4"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-kda-kernel-64-v2", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-64-v2", "submitTime": "2026-09-21T23:46:25.882874+00:00", "targetGpu": "MetaX_c-500", "taskId": "5009122", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-metax-c-500"}
{"framework": "vllm-mlu", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-kda-kernel-32-v2_D", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-32-v2_D", "submitTime": "2026-09-21T23:50:56.149099+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5009164", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-mlu-cambricon-mlu-370-x4"}
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "submitTime": "2026-09-21T23:58:44.401705+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5009282", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-sunrise-pt-200-x1"}
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "submitTime": "2026-09-22T00:00:45.685170+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5009297", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-sunrise-pt-200-x1"}
@@ -247,17 +246,12 @@
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-kda-kernel-64-v2", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-64-v2", "submitTime": "2026-09-22T00:49:51.852373+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5009925", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-iluvatar-mrv-100"}
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "submitTime": "2026-09-22T00:58:16.750277+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5010000", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-sunrise-pt-200-x1"}
{"framework": "vllm-mlu", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g8-v2_C", "modelId": "nkkbr/Mini-K3-1H-decay-g8-v2_C", "submitTime": "2026-09-22T01:11:32.577223+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5010129", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-mlu-cambricon-mlu-370-x4"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-kda-kernel-32-v2_D", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-32-v2_D", "submitTime": "2026-09-22T01:22:36.312093+00:00", "targetGpu": "MetaX_c-500", "taskId": "5010247", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-metax-c-500"}
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "submitTime": "2026-09-22T01:56:27.860891+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5010580", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-sunrise-pt-200-x1"}
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "submitTime": "2026-09-22T01:58:27.285909+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5010597", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-sunrise-pt-200-x1"}
{"framework": "vllm-mlu", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g4-v2_B", "modelId": "nkkbr/Mini-K3-1H-decay-g4-v2_B", "submitTime": "2026-09-22T02:13:58.644255+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5010805", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-mlu-cambricon-mlu-370-x4"}
{"framework": "vllm-mlu", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B", "submitTime": "2026-09-22T02:13:58.642770+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5010804", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-mlu-cambricon-mlu-370-x4"}
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-kda-kernel-64-v2", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-64-v2", "submitTime": "2026-09-22T02:14:32.985862+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5010817", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-sunrise-pt-200-x1"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-attnres-block2-v1_B", "modelId": "nkkbr/Mini-K3-1H-attnres-block2-v1_B", "submitTime": "2026-09-22T02:29:17.911042+00:00", "targetGpu": "MetaX_c-500", "taskId": "5011008", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-metax-c-500"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "submitTime": "2026-09-22T02:29:17.947638+00:00", "targetGpu": "MetaX_c-500", "taskId": "5011012", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-metax-c-500"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g64-v2_B", "modelId": "nkkbr/Mini-K3-1H-decay-g64-v2_B", "submitTime": "2026-09-22T02:30:43.557430+00:00", "targetGpu": "MetaX_c-500", "taskId": "5011026", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-metax-c-500"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g8-v2_C", "modelId": "nkkbr/Mini-K3-1H-decay-g8-v2_C", "submitTime": "2026-09-22T02:34:36.605602+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5011056", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-mthreads-s4000"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-kda-kernel-8-v2_D", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-8-v2_D", "submitTime": "2026-09-22T02:36:21.088411+00:00", "targetGpu": "MetaX_c-500", "taskId": "5011070", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-metax-c-500"}
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-kda-kernel-32-v2_D", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-32-v2_D", "submitTime": "2026-09-22T02:38:35.435001+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5011087", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-sunrise-pt-200-x1"}
{"framework": "vllm_tokenizer_patch", "modelAddress": "https://modelscope.cn/models/Panyuqi/SpikingBrain-2.0-base-8k", "modelId": "Panyuqi/SpikingBrain-2.0-base-8k", "submitTime": "2026-09-22T03:14:37.507855+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5011473", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-tokenizer-patch-ascend-910-b4"}
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g64-v2_B", "modelId": "nkkbr/Mini-K3-1H-decay-g64-v2_B", "submitTime": "2026-09-22T03:16:30.260551+00:00", "targetGpu": "Vastai_va16", "taskId": "5011484", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-vastai-va16"}
@@ -271,13 +265,10 @@
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-kda-kernel-8-v2_D", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-8-v2_D", "submitTime": "2026-09-22T05:12:33.860275+00:00", "targetGpu": "Vastai_va16", "taskId": "5012700", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-vastai-va16"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "submitTime": "2026-09-22T05:14:31.254072+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5012734", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-iluvatar-mrv-100"}
{"framework": "vllm-patch-tokenizer", "modelAddress": "https://modelscope.cn/models/Panyuqi/SpikingBrain-2.0-base-8k", "modelId": "Panyuqi/SpikingBrain-2.0-base-8k", "submitTime": "2026-09-22T05:16:28.475085+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5012757", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-patch-tokenizer-hygon-k100-ai"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g8-v2_C", "modelId": "nkkbr/Mini-K3-1H-decay-g8-v2_C", "submitTime": "2026-09-22T05:20:37.680892+00:00", "targetGpu": "MetaX_c-500", "taskId": "5012814", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-metax-c-500"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g4-v2_B", "modelId": "nkkbr/Mini-K3-1H-decay-g4-v2_B", "submitTime": "2026-09-22T05:22:37.690620+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5012841", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-iluvatar-mrv-100"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B", "submitTime": "2026-09-22T05:22:37.689299+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5012840", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-iluvatar-mrv-100"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/Panyuqi/SpikingBrain-2.0-base-8k", "modelId": "Panyuqi/SpikingBrain-2.0-base-8k", "submitTime": "2026-09-22T05:32:05.479742+00:00", "targetGpu": "MetaX_c-500", "taskId": "5012980", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-metax-c-500"}
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-kda-kernel-8-v2_D", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-8-v2_D", "submitTime": "2026-09-22T05:34:46.454174+00:00", "targetGpu": "Biren_166m", "taskId": "5013017", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-biren-166m"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g4-v2_B", "modelId": "nkkbr/Mini-K3-1H-decay-g4-v2_B", "submitTime": "2026-09-22T05:38:45.308684+00:00", "targetGpu": "MetaX_c-500", "taskId": "5013071", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-metax-c-500"}
{"framework": "vllm", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B", "submitTime": "2026-09-22T05:38:45.307245+00:00", "targetGpu": "MetaX_c-500", "taskId": "5013070", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-metax-c-500"}
{"framework": "vllm-patch-tokenizer", "modelAddress": "https://modelscope.cn/models/amd/Instella-MoE-16B-A3B-SFT-w4a16-llmcompressor", "modelId": "amd/Instella-MoE-16B-A3B-SFT-w4a16-llmcompressor", "submitTime": "2026-09-22T05:42:55.602315+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5013164", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-patch-tokenizer-hygon-k100-ai"}
{"framework": "vllm_fix_tokenizer", "modelAddress": "https://modelscope.cn/models/nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "submitTime": "2026-09-22T05:45:37.003989+00:00", "targetGpu": "Biren_166m", "taskId": "5013207", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-fix-tokenizer-biren-166m"}
{"framework": "vllm-mlu", "modelAddress": "https://modelscope.cn/models/Panyuqi/SpikingBrain-2.0-base-8k", "modelId": "Panyuqi/SpikingBrain-2.0-base-8k", "submitTime": "2026-09-22T05:48:17.265295+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5013248", "taskType": "text-generation", "templateId": "modelhub-live-text-generation-vllm-mlu-cambricon-mlu-370-x8"}

View File

@@ -2,24 +2,24 @@
"agentVersion": "2026.09.04.4",
"checksums": {
".modelhub_state/account_capacity.json": "930f9869793c3d1aa071c53f05b7cf82a4e372f002be88361d6d6189e27c12a1",
".modelhub_state/architecture_compatibility_blacklist.json": "36e7a9467feda347f17f8ae56cbb8ffa294dea59eb992a5b00671f6e03d0446b",
".modelhub_state/architecture_compatibility_blacklist.json": "5b164a9667ba96218c71d8ae56a6186547380c9a9c30d6b5a5182666186ba706",
".modelhub_state/architecture_history_backfill.json": "a92348206605da04f75c9e26e7c818b76f259e0b28983f18b6375ef94802f0ab",
".modelhub_state/market_intelligence.json": "c07eee5b5aef7b76d0d33cc1bb6d595b0f522c9d52844c7578cee6cb4f1caeaf",
".modelhub_state/official_capabilities.json": "e4fff700acf76c16d2b56d439089e5674b95eb5eab57335cb75b8cdb74bbfa8c",
".modelhub_state/outcome_checkpoint.json": "07a97640b3f1492e2efadeeb16d54c316244d11258ad5bc1d3ae271edbcf818e",
".modelhub_state/queue_cleanup_latest.json": "568ae8813ea4bc8c494aef8be02f77b1c9756ab49dd7d307b81483e6cca30468",
".modelhub_state/recent_outcomes.jsonl": "02efc3df01d483297d069ce832cd156b5aa08594eb683261888019db3e1a0fee",
".modelhub_state/recovery_active_tasks.jsonl": "a8a448e09690d07bbf4c29374150713f6bb460e3fa5ad558534d494b29dfc9e6",
".modelhub_state/recovery_intents.jsonl": "4e9ed1cb27784ea47972c946479b9d740e02dadd92459d0f26c8b62f5ce61fde",
".modelhub_state/market_intelligence.json": "a78ca30f1cfd844339c4e3feef1d881627ecc6277c0a42f6766bc722dded63e2",
".modelhub_state/official_capabilities.json": "f4e12c212078da50a389ba5fe5175fb0f157a7505461e50e3da73be88e71bccf",
".modelhub_state/outcome_checkpoint.json": "98b9af18e2e6a3477684dfea55796d70ea760b022e5b16a45560267d9a9beb3f",
".modelhub_state/queue_cleanup_latest.json": "3d432dc3a249651598159389a8cfb70ad5ce9faa561e8808832492d8bdcc76ca",
".modelhub_state/recent_outcomes.jsonl": "3ad9b4922d97645919af1b3a1bc3843965cb67d0ab18bd42f4892254a8d94e82",
".modelhub_state/recovery_active_tasks.jsonl": "c9e6c68b9630120a9e186cf2bc454fa7611a4683df2c1e61e79d6f15a52035b3",
".modelhub_state/recovery_intents.jsonl": "304c618aca893c6d62ef7e3ac8a7b4d0b14840a080fa935f9fd70c037a662678",
".modelhub_state/routing_intelligence.json": "a312187abffa011156b64da1fed551d1816329b725ab3f38c5221900b7cc793e",
".modelhub_state/submission_exclusions.jsonl": "dca7091e8b1da8bf9b3ecb95fe573b2a41666601edf86cea13ce9ce738b9eb7b",
".modelhub_state/worker_crashes.jsonl": "b321ea3648ae6b322601ed30ef8c3b1da0f13612af1bde3a64b0d41dc18a7b9f",
"ledger/submissions.jsonl": "8c343b64dbb7821cc9c14d0d825bb4720aacda83a13fbd87476d14a51c5e4b5b",
"outcomes/submissions.jsonl": "119be017afc4556753022369ce45b6403006b66ca82501a91d190fed62caed4f"
"ledger/submissions.jsonl": "52621bd2c4995762cf48c9be99e451bbf591cf6e36166b89627f588fe7599163",
"outcomes/submissions.jsonl": "5739da3b3917b0be3a1547b87739e624af4817ec96b5df721452ae10dcfb766c"
},
"generation": 22038,
"generation": 22039,
"phase": "cycle",
"schemaVersion": 1,
"updatedAt": "2026-10-08T03:18:50.339018+00:00",
"updatedAt": "2026-10-08T03:30:43.836794+00:00",
"writerId": "33ed03361c5848e88b8ce6204fb4f7d2"
}

View File

@@ -259,14 +259,11 @@
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-22T07:46:29.676532+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030685704, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039047610}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T23:42:59.367573+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5009080", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-22T07:46:29.676527+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031556216, "estimatedRequiredGiB": 2.28, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039918195}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T23:42:59.369315+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5009078", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T07:46:29.676457+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T23:44:30.789761+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5009101", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T07:46:29.676505+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-64-v2", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2044205392, "estimatedRequiredGiB": 2.469, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": 2209448692, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2209448692}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T23:46:25.882874+00:00", "targetGpu": "MetaX_c-500", "taskId": "5009122", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-22T07:53:59.361381+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-32-v2_D", "modelProfile": {"architectures": [], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2038896936, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042511760}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T23:50:56.149099+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5009164", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T07:53:59.361400+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2037838088, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2041445091}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T23:50:56.150801+00:00", "targetGpu": "MetaX_c-500", "taskId": "5009165", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T07:57:46.581693+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g2-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030713792, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039076183}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T23:54:44.050989+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5009242", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T08:01:56.366347+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block6-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042626482}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-21T23:58:44.401705+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5009282", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T08:01:56.366387+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g16-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031106928, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039475672}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T00:00:45.685170+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5009297", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T08:05:56.157061+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "cbe5569cdb6c42553436b837dd5b8f0cfa03334642a56f4ff0137f952f8eb84b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2037838088, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2041445091}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T00:04:31.388498+00:00", "targetGpu": "Vastai_va16", "taskId": "5009346", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T08:13:39.456313+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2018871528, "estimatedRequiredGiB": 2.26, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2022478516}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T00:10:30.409776+00:00", "targetGpu": "MetaX_c-500", "taskId": "5009394", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T08:13:39.456367+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block2-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042625829}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T00:12:27.759306+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5009429", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T08:13:39.456351+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T00:12:27.760772+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5009428", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T08:13:39.456374+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030685704, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039047610}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T00:12:27.762342+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5009427", "taskType": "text-generation", "verifyResult": null}
@@ -283,7 +280,6 @@
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T09:01:27.058096+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T00:58:16.750277+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5010000", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-22T09:12:16.751573+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g8-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030882272, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": 1015108684, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039244968}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T01:11:32.577223+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5010129", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T09:12:16.751624+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g64-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2032454776, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2040816815}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T01:11:32.582811+00:00", "targetGpu": "Biren_166m", "taskId": "5010128", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T09:23:10.683676+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-32-v2_D", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2038896936, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042511760}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T01:22:36.312093+00:00", "targetGpu": "MetaX_c-500", "taskId": "5010247", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T09:59:25.057595+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n128-g8-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2037838088, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2041445091}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T01:56:27.860891+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5010580", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T09:59:25.057651+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g8-v1_C", "modelProfile": {"architectures": [], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2018871528, "estimatedRequiredGiB": 2.26, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2022478516}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T01:58:27.285909+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5010597", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-22T10:15:00.768899+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g4-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "36ec94e289a8da5fd70b98a2f401fc5159740daf9e2a076da4fd490f34bcbc0b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030769952, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039132310}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T02:13:58.644255+00:00", "targetGpu": "Cambricon_mlu-370-x4", "taskId": "5010805", "taskType": "text-generation", "verifyResult": null}
@@ -291,12 +287,8 @@
{"failReason": null, "framework": "vllm_0_17_0_corex_4_4_0", "lastSyncTime": "2026-09-22T10:15:00.768833+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-32-v2_D", "modelProfile": {"architectures": [], "configFingerprint": "1cc16a7df03cf7b1485e2fda7e5c05e286a546d04e80bdd595c015004b3852a8", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2038896936, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042511760}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T02:13:58.677566+00:00", "targetGpu": "Iluvatar_bi-150", "taskId": "5010811", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T10:15:00.768930+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-64-v2", "modelProfile": {"architectures": [], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2044205392, "estimatedRequiredGiB": 2.469, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": 2209448692, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2209448692}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T02:14:32.985862+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5010817", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T10:18:38.460452+00:00", "modelId": "amd/Qwen3.6-35B-A3B-w4a16-llmcompressor", "modelProfile": {"architectures": ["InstellaMoEForCausalLM"], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 51304360808, "estimatedRequiredGiB": 57.349, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "deepseek_v3", "modelscopeFileSize": 51315158961, "modelscopeLicense": "apache-2.0", "modelscopeParams": 35107181936, "modelscopeTags": ["license:apache-2.0", "model_type:deepseek_v3", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:quantized", "custom_tag:int4", "custom_tag:w4a16", "custom_tag:weight-only", "custom_tag:4-bit", "custom_tag:llm-compressor", "custom_tag:zendnn", "custom_tag:compressed-tensors", "custom_tag:amd", "custom_tag:cpu-inference"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 51315158961}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T02:17:04.547143+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5010847", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T10:29:23.958248+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-block2-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034251896, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042625829}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T02:29:17.911042+00:00", "targetGpu": "MetaX_c-500", "taskId": "5011008", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T10:29:23.958207+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g1-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030685704, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039047610}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T02:29:17.944417+00:00", "targetGpu": "MetaX_c-500", "taskId": "5011010", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T10:29:23.958254+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031556216, "estimatedRequiredGiB": 2.28, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039918195}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T02:29:17.947638+00:00", "targetGpu": "MetaX_c-500", "taskId": "5011012", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T10:32:55.574125+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g64-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2032454776, "estimatedRequiredGiB": 2.281, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2040816815}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T02:30:43.557430+00:00", "targetGpu": "MetaX_c-500", "taskId": "5011026", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T10:36:39.771358+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g8-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "a494b1667fab53609b94cc853db1a12c8d3b9fcf98795ecbab3dd5eb3a3c77f6", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030882272, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 48.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 48.0, "maximumRepositorySizeGiB": 40.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": 1015108684, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039244968}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T02:34:36.605602+00:00", "targetGpu": "Mthreads_s4000", "taskId": "5011056", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T10:36:39.771397+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-8-v2_D", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034915504, "estimatedRequiredGiB": 2.278, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2038530279}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T02:36:21.088411+00:00", "targetGpu": "MetaX_c-500", "taskId": "5011070", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T10:40:24.557236+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-32-v2_D", "modelProfile": {"architectures": [], "configFingerprint": "2e9cebc01b20081f0839fa18fe9ca4f7d059509f235699027201fe328177b304", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2038896936, "estimatedRequiredGiB": 2.283, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042511760}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T02:38:35.435001+00:00", "targetGpu": "Sunrise_pt-200-x1", "taskId": "5011087", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_tokenizer_patch", "lastSyncTime": "2026-09-22T11:15:21.052966+00:00", "modelId": "Panyuqi/SpikingBrain-2.0-base-8k", "modelProfile": {"architectures": ["SSESWAMoBAForCausalLM"], "configFingerprint": "167e80c9a74f5acd91819ac9a661546c8992cc5beb0bdd0a1dc9fc9659a5e778", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11110611058, "estimatedRequiredGiB": 12.435, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "sse_swa_moba", "modelscopeFileSize": 11126702363, "modelscopeLicense": "Apache License 2.0", "modelscopeParams": null, "modelscopeTags": ["license:Apache License 2.0", "model_type:sse_swa_moba", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11126702363}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T03:14:37.507855+00:00", "targetGpu": "Ascend_910-b4", "taskId": "5011473", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T11:18:58.160177+00:00", "modelId": "nkkbr/Mini-K3-1H-attnres-standard-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "cbe5569cdb6c42553436b837dd5b8f0cfa03334642a56f4ff0137f952f8eb84b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034135144, "estimatedRequiredGiB": 2.282, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2042280856}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T03:16:30.263298+00:00", "targetGpu": "Vastai_va16", "taskId": "5011485", "taskType": "text-generation", "verifyResult": null}
@@ -311,13 +303,10 @@
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T13:13:03.464312+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-8-v2_D", "modelProfile": {"architectures": [], "configFingerprint": "cbe5569cdb6c42553436b837dd5b8f0cfa03334642a56f4ff0137f952f8eb84b", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034915504, "estimatedRequiredGiB": 2.278, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2038530279}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:12:33.860275+00:00", "targetGpu": "Vastai_va16", "taskId": "5012700", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T13:16:35.758306+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031556216, "estimatedRequiredGiB": 2.28, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039918195}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:14:31.254072+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5012734", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-22T13:16:35.758272+00:00", "modelId": "Panyuqi/SpikingBrain-2.0-base-8k", "modelProfile": {"architectures": ["SSESWAMoBAForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11110611058, "estimatedRequiredGiB": 12.435, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "sse_swa_moba", "modelscopeFileSize": 11126702266, "modelscopeLicense": "Apache License 2.0", "modelscopeParams": null, "modelscopeTags": ["license:Apache License 2.0", "model_type:sse_swa_moba", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11126702266}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:16:28.475085+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5012757", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T13:24:17.269104+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g8-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030882272, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": 1015108684, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039244968}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:20:37.680892+00:00", "targetGpu": "MetaX_c-500", "taskId": "5012814", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T13:24:17.269070+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g4-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030769952, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039132310}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:22:37.690620+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5012841", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T13:24:17.269118+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "71d6e16091ba0289f01acffc8e39bb8c25703488dc49b9e390e08951fe1f2b33", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2009388256, "estimatedRequiredGiB": 2.25, "gpuMemoryEvidence": {"memoryGiB": 32.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 32.0, "maximumRepositorySizeGiB": 26.667, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2012995244}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:22:37.689299+00:00", "targetGpu": "Iluvatar_mrv-100", "taskId": "5012840", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T13:34:05.154403+00:00", "modelId": "Panyuqi/SpikingBrain-2.0-base-8k", "modelProfile": {"architectures": ["SSESWAMoBAForCausalLM"], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11110611058, "estimatedRequiredGiB": 12.435, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "sse_swa_moba", "modelscopeFileSize": 11126702266, "modelscopeLicense": "Apache License 2.0", "modelscopeParams": null, "modelscopeTags": ["license:Apache License 2.0", "model_type:sse_swa_moba", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11126702266}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:32:05.479742+00:00", "targetGpu": "MetaX_c-500", "taskId": "5012980", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T13:37:53.563477+00:00", "modelId": "nkkbr/Mini-K3-1H-kda-kernel-8-v2_D", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2034915504, "estimatedRequiredGiB": 2.278, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2038530279}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:34:46.454174+00:00", "targetGpu": "Biren_166m", "taskId": "5013017", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T13:42:23.869755+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g4-v2_B", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2030769952, "estimatedRequiredGiB": 2.279, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039132310}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:38:45.308684+00:00", "targetGpu": "MetaX_c-500", "taskId": "5013071", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm", "lastSyncTime": "2026-09-22T13:42:23.869797+00:00", "modelId": "nkkbr/Mini-K3-1H-mamba2-n64-g4-v1_B", "modelProfile": {"architectures": [], "configFingerprint": "533968aac3b9c90272dfbe2866791f782e077f0dceee5b6ffffce48ba6674a10", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2009388256, "estimatedRequiredGiB": 2.25, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:mamba2", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2012995244}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:38:45.307245+00:00", "targetGpu": "MetaX_c-500", "taskId": "5013070", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-patch-tokenizer", "lastSyncTime": "2026-09-22T13:46:14.276964+00:00", "modelId": "amd/Instella-MoE-16B-A3B-SFT-w4a16-llmcompressor", "modelProfile": {"architectures": ["InstellaMoEForCausalLM"], "configFingerprint": "0d5bc82787a89d4313672808d1a8629a1fc675c91aa6a08865f770aa24447fbc", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 30350903424, "estimatedRequiredGiB": 33.932, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "deepseek_v3", "modelscopeFileSize": null, "modelscopeLicense": "other", "modelscopeParams": 5134171936, "modelscopeTags": ["license:other", "model_type:deepseek_v3", "library:pytorch", "library:transformer", "library:safetensors", "task:text-generation", "custom_tag:quantized", "custom_tag:int4", "custom_tag:w4a16", "custom_tag:weight-only", "custom_tag:4-bit", "custom_tag:llm-compressor", "custom_tag:zendnn", "custom_tag:compressed-tensors", "custom_tag:amd", "custom_tag:cpu-inference"], "modelscopeTasks": ["text-generation"], "quantizationMethod": "compressed-tensors", "repositoryOnDiskBytes": 30361724387}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:42:55.602315+00:00", "targetGpu": "hygon_k100-ai", "taskId": "5013164", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm_fix_tokenizer", "lastSyncTime": "2026-09-22T13:46:14.277018+00:00", "modelId": "nkkbr/Mini-K3-1H-decay-g32-v2_C", "modelProfile": {"architectures": [], "configFingerprint": "16f74ea0f409861ab0c8169a25d9484cb482e27d6a3ad7c529a70b7cdbfabee3", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 2031556216, "estimatedRequiredGiB": 2.28, "gpuMemoryEvidence": {"memoryGiB": 64.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 64.0, "maximumRepositorySizeGiB": 53.333, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "mini_k3", "modelscopeFileSize": null, "modelscopeLicense": null, "modelscopeParams": null, "modelscopeTags": ["model_type:mini_k3", "library:safetensors", "library:pytorch", "task:text-generation", "custom_tag:kimi-k3", "custom_tag:pretraining", "custom_tag:mixture-of-experts", "custom_tag:linear-attention", "custom_tag:architecture-ablation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 2039918195}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:45:37.003989+00:00", "targetGpu": "Biren_166m", "taskId": "5013207", "taskType": "text-generation", "verifyResult": null}
{"failReason": null, "framework": "vllm-mlu", "lastSyncTime": "2026-09-22T13:49:59.752651+00:00", "modelId": "Panyuqi/SpikingBrain-2.0-base-8k", "modelProfile": {"architectures": ["SSESWAMoBAForCausalLM"], "configFingerprint": "1566bbd6c69427ad32f7f86aeba4e39850a1a7af5c6f4ef3c9ca82f0e882f3c5", "configOptimization": {"applied": false, "source": "official"}, "configSource": "modelhub_live", "estimatedLoadBytes": 11110611058, "estimatedRequiredGiB": 12.435, "gpuMemoryEvidence": {"memoryGiB": 24.0, "source": "local_modelhub_preflight_oom"}, "gpuMemoryGiB": 24.0, "maximumRepositorySizeGiB": 20.0, "memorySizingBasis": "recursive_repository_on_disk", "modelCard": {}, "modelType": "sse_swa_moba", "modelscopeFileSize": 11126702266, "modelscopeLicense": "Apache License 2.0", "modelscopeParams": null, "modelscopeTags": ["license:Apache License 2.0", "model_type:sse_swa_moba", "library:pytorch", "task:text-generation"], "modelscopeTasks": ["text-generation"], "quantizationMethod": null, "repositoryOnDiskBytes": 11126702266}, "outcome": "pending", "status": "waiting", "submitTime": "2026-09-22T05:48:17.265295+00:00", "targetGpu": "Cambricon_mlu-370-x8", "taskId": "5013248", "taskType": "text-generation", "verifyResult": null}