diff --git a/main.py b/main.py index c72f6c6..f180287 100644 --- a/main.py +++ b/main.py @@ -47,7 +47,7 @@ SUPPORTED_SPECIAL_ARCHS = ['Eagle3Speculator', 'LlamaForCausalLMEagle3'] MODELHUB_API = "https://modelhub.org.cn/api" # 搜索关键词 -SEARCH_KEYWORDS = ['qwen', 'Qwen2', 'Qwen3', 'Qwen3.5', 'Qwen1.5', 'Qwen-'] +SEARCH_KEYWORDS = ['qwen', 'Qwen2', 'Qwen3', 'Qwen3.5', 'Llama-3', 'Llama-3.1', 'Mistral', 'DeepSeek'] # ============================================================ # 全局状态 @@ -366,25 +366,14 @@ def run_pipeline(submit_limit: int = 2): hf_models.append(m) log(f"格式筛选: {len(hf_models)} 通过, {format_skipped} 跳过 (GPTQ/AWQ)") - # 3. 架构筛选(排除 Qwen3.5 在 Iluvatar 上不支持) - log("\n--- 阶段3: 架构筛选 ---") - arch_passed = [] - arch_rejected = 0 - SKIP_ARCHS = ['qwen3_5', 'Qwen3_5', 'Qwen3.5'] + # 3. 架构筛选(参考检查,不做严格过滤,让平台决定兼容性) + log("\n--- 阶段3: 架构检查 ---") for m in hf_models: ok, reason = check_architecture(m['model_id']) if not ok: - arch_rejected += 1 - log(f" x {m['model_id']}: {reason}") - continue - arch_str = str(reason).upper() - if any(a.upper() in arch_str for a in SKIP_ARCHS): - arch_rejected += 1 - log(f" x {m['model_id']}: Qwen3.5(Iluvatar不支持)") - continue - arch_passed.append(m) - time.sleep(0.15) - log(f"架构筛选: {len(arch_passed)} 通过, {arch_rejected} 拒绝") + log(f" ! {m['model_id']}: {reason} (仍保留)") + time.sleep(0.1) + log(f"架构检查: {len(hf_models)} 个模型进入下一阶段") # 4. 筛选并提交(只针对目标GPU) log(f"\n--- 阶段4: 筛选并提交 [{TARGET_GPU}] ---") @@ -398,7 +387,7 @@ def run_pipeline(submit_limit: int = 2): # 筛选 to_submit = [] - for m in arch_passed: + for m in hf_models: model_id = m['model_id'] # 检查全平台验证状态