初始化项目,由ModelHub XC社区提供模型
Model: FutureLivingLab/iFlow-ROME Source: Original Platform
This commit is contained in:
36
.gitattributes
vendored
Normal file
36
.gitattributes
vendored
Normal file
@@ -0,0 +1,36 @@
|
||||
*.7z filter=lfs diff=lfs merge=lfs -text
|
||||
*.arrow filter=lfs diff=lfs merge=lfs -text
|
||||
*.bin filter=lfs diff=lfs merge=lfs -text
|
||||
*.bz2 filter=lfs diff=lfs merge=lfs -text
|
||||
*.ckpt filter=lfs diff=lfs merge=lfs -text
|
||||
*.ftz filter=lfs diff=lfs merge=lfs -text
|
||||
*.gz filter=lfs diff=lfs merge=lfs -text
|
||||
*.h5 filter=lfs diff=lfs merge=lfs -text
|
||||
*.joblib filter=lfs diff=lfs merge=lfs -text
|
||||
*.lfs.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.mlmodel filter=lfs diff=lfs merge=lfs -text
|
||||
*.model filter=lfs diff=lfs merge=lfs -text
|
||||
*.msgpack filter=lfs diff=lfs merge=lfs -text
|
||||
*.npy filter=lfs diff=lfs merge=lfs -text
|
||||
*.npz filter=lfs diff=lfs merge=lfs -text
|
||||
*.onnx filter=lfs diff=lfs merge=lfs -text
|
||||
*.ot filter=lfs diff=lfs merge=lfs -text
|
||||
*.parquet filter=lfs diff=lfs merge=lfs -text
|
||||
*.pb filter=lfs diff=lfs merge=lfs -text
|
||||
*.pickle filter=lfs diff=lfs merge=lfs -text
|
||||
*.pkl filter=lfs diff=lfs merge=lfs -text
|
||||
*.pt filter=lfs diff=lfs merge=lfs -text
|
||||
*.pth filter=lfs diff=lfs merge=lfs -text
|
||||
*.rar filter=lfs diff=lfs merge=lfs -text
|
||||
*.safetensors filter=lfs diff=lfs merge=lfs -text
|
||||
saved_model/**/* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar.* filter=lfs diff=lfs merge=lfs -text
|
||||
*.tar filter=lfs diff=lfs merge=lfs -text
|
||||
*.tflite filter=lfs diff=lfs merge=lfs -text
|
||||
*.tgz filter=lfs diff=lfs merge=lfs -text
|
||||
*.wasm filter=lfs diff=lfs merge=lfs -text
|
||||
*.xz filter=lfs diff=lfs merge=lfs -text
|
||||
*.zip filter=lfs diff=lfs merge=lfs -text
|
||||
*.zst filter=lfs diff=lfs merge=lfs -text
|
||||
*tfevents* filter=lfs diff=lfs merge=lfs -text
|
||||
tokenizer.json filter=lfs diff=lfs merge=lfs -text
|
||||
108
README.md
Normal file
108
README.md
Normal file
@@ -0,0 +1,108 @@
|
||||
---
|
||||
license: apache-2.0
|
||||
pipeline_tag: text-generation
|
||||
arxiv: 2512.24873
|
||||
tags:
|
||||
- agent
|
||||
- moe
|
||||
---
|
||||
|
||||
# ROME-30B-A3B
|
||||
|
||||
<p align="left" style="display: flex; gap: 8px; align-items: center;">
|
||||
<a href="https://arxiv.org/pdf/2512.24873" target="_blank">
|
||||
<img src="https://img.shields.io/badge/Paper-arXiv%3A2512.24873-red" alt="Paper">
|
||||
</a>
|
||||
<a href="https://faithful-almanac-add.notion.site/The-Bitter-Lesson-Behind-Building-Agentic-RL-in-Terminal-Environments-2eaddd45837f80c9ad2ed6a15ef3c1a1?pvs=74" target="_blank">
|
||||
<img src="https://img.shields.io/badge/Blog-Notion-orange" alt="Blog">
|
||||
</a>
|
||||
<img src="https://img.shields.io/badge/License-Apache%202.0-blue.svg" alt="License">
|
||||
<img src="https://img.shields.io/badge/Model%20Type-MoE-green" alt="Model Type">
|
||||
</p>
|
||||
|
||||
|
||||
|
||||
---
|
||||
|
||||
|
||||
**ROME** (**R**OME is **O**bviously an **A**gentic **M**odEl) is an open-source **agentic model** incubated within the **ALE (Agentic Learning Ecosystem)**.
|
||||
|
||||
Rather than scaling performance purely by increasing parameter count, ROME achieves parameter-scale–crossing performance through full-stack infrastructure integration and advanced Reinforcement Learning optimization.
|
||||
|
||||
<img src="https://rlhf.oss-cn-hangzhou.aliyuncs.com/iFLOW-ROME/performance.png" width="600"/>
|
||||
|
||||
|
||||
---
|
||||
|
||||
|
||||
|
||||
## 🚀 Highlights
|
||||
|
||||
<img src="https://rlhf.oss-cn-hangzhou.aliyuncs.com/iFLOW-ROME/ALE.PNG" width="600"/>
|
||||
|
||||
|
||||
### 🔧 ALE Full-Stack Infrastructure
|
||||
- [**ROLL**](https://github.com/alibaba/ROLL) – Large-scale reinforcement learning optimization engine
|
||||
|
||||
- [**ROCK**](https://github.com/alibaba/ROCK) – Secure sandbox and environment orchestration for agent execution
|
||||
|
||||
- **iFlow CLI** – Unified agent framework and developer interface
|
||||
|
||||
|
||||
|
||||
### 🧠 IPA Policy Optimization Algorithm
|
||||
- Introduces **Interaction-Perceptive Agentic Policy Optimization (IPA)**
|
||||
- Performs credit assignment at the level of **Semantic Interaction Chunks**
|
||||
- Significantly improves **training stability** and **success rates** on **long-horizon tasks**
|
||||
|
||||
|
||||
|
||||
### 🚀 Strong Agentic Performance
|
||||
- Despite being a **mid-sized model** (30B MoE with 3B active parameters), ROME outperforms same-scale models on standard agent benchmarks:
|
||||
- **Terminal-Bench 2.0**: 24.72%
|
||||
- **SWE-bench Verified**: 57.40%
|
||||
|
||||
- Performance is competitive with, and in some cases comparable to, models exceeding **100B parameters**
|
||||
|
||||
|
||||
|
||||
### 🔒 Production-Grade Safety
|
||||
- Designed for autonomous agent execution in real environments
|
||||
- Rigorously aligned and red-teamed against risks such as:
|
||||
- Unauthorized access
|
||||
- Illegal or unsafe tool invocation
|
||||
- Built with **deployment-grade safety guarantees** in mind
|
||||
|
||||
---
|
||||
|
||||
|
||||
|
||||
## 📊 Performance (Preview)
|
||||
|
||||
### Terminal-Based Benchmarks
|
||||
|
||||
| **Model** | **Terminal-Bench 2.0** | **SWE-bench Verified** |
|
||||
| ---------------------------- | ---------------------- | ---------------------- |
|
||||
| Qwen3-Coder-30B-A3B-Instruct | 13.48% | 46.33% |
|
||||
| **ROME-30B-A3B** | **24.72%** | **57.40%** |
|
||||
| GPT-OSS-120B | 21.12% | 43.93% |
|
||||
| GLM-4.5 Air (106B) | 17.30% | 56.20% |
|
||||
|
||||
> See the technical report for full experimental details.
|
||||
|
||||
---
|
||||
|
||||
|
||||
|
||||
## 📜 Citation
|
||||
|
||||
If you find our work useful, please consider citing:
|
||||
|
||||
```bibtex
|
||||
@article{rome2025ale,
|
||||
title={Let It Flow: Agentic Crafting on Rock and Roll - Building the ROME Model within an Open Agentic Learning Ecosystem},
|
||||
author={Wang, Weixun and Xu, XiaoXiao and An, Wanhe and Dai, Fangwen and others},
|
||||
journal={arXiv preprint arXiv:2512.24873},
|
||||
year={2025}
|
||||
}
|
||||
```
|
||||
28
added_tokens.json
Normal file
28
added_tokens.json
Normal file
@@ -0,0 +1,28 @@
|
||||
{
|
||||
"</think>": 151668,
|
||||
"</tool_call>": 151658,
|
||||
"</tool_response>": 151666,
|
||||
"<think>": 151667,
|
||||
"<tool_call>": 151657,
|
||||
"<tool_response>": 151665,
|
||||
"<|box_end|>": 151649,
|
||||
"<|box_start|>": 151648,
|
||||
"<|endoftext|>": 151643,
|
||||
"<|file_sep|>": 151664,
|
||||
"<|fim_middle|>": 151660,
|
||||
"<|fim_pad|>": 151662,
|
||||
"<|fim_prefix|>": 151659,
|
||||
"<|fim_suffix|>": 151661,
|
||||
"<|im_end|>": 151645,
|
||||
"<|im_start|>": 151644,
|
||||
"<|image_pad|>": 151655,
|
||||
"<|object_ref_end|>": 151647,
|
||||
"<|object_ref_start|>": 151646,
|
||||
"<|quad_end|>": 151651,
|
||||
"<|quad_start|>": 151650,
|
||||
"<|repo_name|>": 151663,
|
||||
"<|video_pad|>": 151656,
|
||||
"<|vision_end|>": 151653,
|
||||
"<|vision_pad|>": 151654,
|
||||
"<|vision_start|>": 151652
|
||||
}
|
||||
40
config.json
Normal file
40
config.json
Normal file
@@ -0,0 +1,40 @@
|
||||
{
|
||||
"architectures": [
|
||||
"Qwen3MoeForCausalLM"
|
||||
],
|
||||
"attention_bias": false,
|
||||
"attention_dropout": 0.0,
|
||||
"decoder_sparse_step": 1,
|
||||
"eos_token_id": 151645,
|
||||
"head_dim": 128,
|
||||
"hidden_act": "silu",
|
||||
"hidden_size": 2048,
|
||||
"initializer_range": 0.02,
|
||||
"intermediate_size": 5472,
|
||||
"max_position_embeddings": 262144,
|
||||
"max_window_layers": 28,
|
||||
"mlp_only_layers": [],
|
||||
"model_type": "qwen3_moe",
|
||||
"moe_intermediate_size": 768,
|
||||
"norm_topk_prob": true,
|
||||
"num_attention_heads": 32,
|
||||
"num_experts": 128,
|
||||
"num_experts_per_tok": 8,
|
||||
"num_hidden_layers": 48,
|
||||
"num_key_value_heads": 4,
|
||||
"output_router_logits": false,
|
||||
"qkv_bias": false,
|
||||
"rms_norm_eps": 1e-06,
|
||||
"rope_scaling": null,
|
||||
"rope_theta": 10000000,
|
||||
"router_aux_loss_coef": 0.0,
|
||||
"shared_expert_intermediate_size": 0,
|
||||
"sliding_window": null,
|
||||
"tie_word_embeddings": false,
|
||||
"torch_dtype": "bfloat16",
|
||||
"transformers_version": "4.51.1",
|
||||
"use_cache": true,
|
||||
"use_qk_norm": true,
|
||||
"use_sliding_window": false,
|
||||
"vocab_size": 151936
|
||||
}
|
||||
5
generation_config.json
Normal file
5
generation_config.json
Normal file
@@ -0,0 +1,5 @@
|
||||
{
|
||||
"_from_model_config": true,
|
||||
"eos_token_id": 151645,
|
||||
"transformers_version": "4.51.1"
|
||||
}
|
||||
151388
merges.txt
Normal file
151388
merges.txt
Normal file
File diff suppressed because it is too large
Load Diff
3
model-00001-of-00013.safetensors
Normal file
3
model-00001-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:d6ca3965ea6a82b086ad5722d18b8b4a48d8d4e2072efea7dd68708e9e8aadbe
|
||||
size 4997184968
|
||||
3
model-00002-of-00013.safetensors
Normal file
3
model-00002-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:20a3f3747bf5829aea14c6fe3281258d870c8115e7316eba2497816c83c33417
|
||||
size 4997741608
|
||||
3
model-00003-of-00013.safetensors
Normal file
3
model-00003-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:65cdae861c56d8e72b2c2a6288745130405eaf14c0d7de3157573a1f9118bd61
|
||||
size 4997742208
|
||||
3
model-00004-of-00013.safetensors
Normal file
3
model-00004-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:5926cbef3474ec3b06a3bff0267d891bbb8104b1e4b79d8f2811d9e0ab1255ac
|
||||
size 4997743184
|
||||
3
model-00005-of-00013.safetensors
Normal file
3
model-00005-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:7a0aa651c3bbb392df2ca98126f0adc4c3a8e0a3567fd9d08878e7d884f2d19e
|
||||
size 4997743184
|
||||
3
model-00006-of-00013.safetensors
Normal file
3
model-00006-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:3f22d6ca9e953ded574c33862f79018c36767437275db7526c9d5a7fb9d8dcdb
|
||||
size 4997743184
|
||||
3
model-00007-of-00013.safetensors
Normal file
3
model-00007-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:14a328a591c9d40f60a507e3e4e76cf876132b50430129a5f1f2fe93bd70c073
|
||||
size 4997743184
|
||||
3
model-00008-of-00013.safetensors
Normal file
3
model-00008-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:f93186cbdbea7d4390f1bfc13605caff3f1b9cd7c271ea0397fd4587edfebf1c
|
||||
size 4997743184
|
||||
3
model-00009-of-00013.safetensors
Normal file
3
model-00009-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:f64f8d4ce7ba37a5e298fbfa9a824f562f10e75ebc86e95b1249f106500743a5
|
||||
size 4997743184
|
||||
3
model-00010-of-00013.safetensors
Normal file
3
model-00010-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:8e6a22c20d7841488b27e136f686ecd9458d0e8138f1b7c9fe32c27621e47e9e
|
||||
size 4997743184
|
||||
3
model-00011-of-00013.safetensors
Normal file
3
model-00011-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:d97dee591c2af0c20740124fc599716f5d804e0918194e4a83f6fb8e39130d14
|
||||
size 4997743184
|
||||
3
model-00012-of-00013.safetensors
Normal file
3
model-00012-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:5bfc1f86b9933f7a8e4f69472ed7d3e8b70f455c34d6d70c7b749c4471c3657d
|
||||
size 4997743184
|
||||
3
model-00013-of-00013.safetensors
Normal file
3
model-00013-of-00013.safetensors
Normal file
@@ -0,0 +1,3 @@
|
||||
version https://git-lfs.github.com/spec/v1
|
||||
oid sha256:8b0ae7d95a3f212f096081ded579cdccd8cf453ae971981cdef56e461f4f3b71
|
||||
size 1094220288
|
||||
18874
model.safetensors.index.json
Normal file
18874
model.safetensors.index.json
Normal file
File diff suppressed because it is too large
Load Diff
31
special_tokens_map.json
Normal file
31
special_tokens_map.json
Normal file
@@ -0,0 +1,31 @@
|
||||
{
|
||||
"additional_special_tokens": [
|
||||
"<|im_start|>",
|
||||
"<|im_end|>",
|
||||
"<|object_ref_start|>",
|
||||
"<|object_ref_end|>",
|
||||
"<|box_start|>",
|
||||
"<|box_end|>",
|
||||
"<|quad_start|>",
|
||||
"<|quad_end|>",
|
||||
"<|vision_start|>",
|
||||
"<|vision_end|>",
|
||||
"<|vision_pad|>",
|
||||
"<|image_pad|>",
|
||||
"<|video_pad|>"
|
||||
],
|
||||
"eos_token": {
|
||||
"content": "<|im_end|>",
|
||||
"lstrip": false,
|
||||
"normalized": false,
|
||||
"rstrip": false,
|
||||
"single_word": false
|
||||
},
|
||||
"pad_token": {
|
||||
"content": "<|endoftext|>",
|
||||
"lstrip": false,
|
||||
"normalized": false,
|
||||
"rstrip": false,
|
||||
"single_word": false
|
||||
}
|
||||
}
|
||||
BIN
tokenizer.json
(Stored with Git LFS)
Normal file
BIN
tokenizer.json
(Stored with Git LFS)
Normal file
Binary file not shown.
241
tokenizer_config.json
Normal file
241
tokenizer_config.json
Normal file
File diff suppressed because one or more lines are too long
1
vocab.json
Normal file
1
vocab.json
Normal file
File diff suppressed because one or more lines are too long
Reference in New Issue
Block a user