BiboyQG commited on
Commit
c4c9636
·
verified ·
1 Parent(s): 13badf9

docs: add Spreadsheet-RL logo

Browse files
Files changed (3) hide show
  1. .gitattributes +1 -0
  2. README.md +4 -1
  3. spreadsheet-rl.png +3 -0
.gitattributes CHANGED
@@ -34,3 +34,4 @@ saved_model/**/* filter=lfs diff=lfs merge=lfs -text
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
  tokenizer.json filter=lfs diff=lfs merge=lfs -text
 
 
34
  *.zst filter=lfs diff=lfs merge=lfs -text
35
  *tfevents* filter=lfs diff=lfs merge=lfs -text
36
  tokenizer.json filter=lfs diff=lfs merge=lfs -text
37
+ spreadsheet-rl.png filter=lfs diff=lfs merge=lfs -text
README.md CHANGED
@@ -20,6 +20,10 @@ tags:
20
 
21
  # Spreadsheet-RL-4B
22
 
 
 
 
 
23
  [**Project Page**](https://spreadsheet-rl.github.io/) | [**Paper**](https://arxiv.org/abs/2605.22642) | [**Dataset**](https://huggingface.co/datasets/Spreadsheet-RL/Spreadsheet-RL) | [**Code**](https://github.com/Spreadsheet-RL/Spreadsheet-RL)
24
 
25
  Spreadsheet-RL-4B is the RL-trained 4B spreadsheet agent checkpoint from **Spreadsheet-RL: Advancing Large Language Model Agents on Realistic Spreadsheet Tasks via Reinforcement Learning**. It starts from [`Qwen/Qwen3-4B-Thinking-2507`](https://huggingface.co/Qwen/Qwen3-4B-Thinking-2507) and is post-trained with outcome-based reinforcement learning in Spreadsheet Gym, a multi-turn Microsoft Excel environment with spreadsheet-native tools, sandboxed code execution, and Excel-based recalculation rewards.
@@ -110,4 +114,3 @@ The default training/evaluation harness is maintained in the code repository und
110
  url = {https://arxiv.org/abs/2605.22642}
111
  }
112
  ```
113
-
 
20
 
21
  # Spreadsheet-RL-4B
22
 
23
+ <p align="center">
24
+ <img src="spreadsheet-rl.png" alt="Spreadsheet-RL logo" width="700">
25
+ </p>
26
+
27
  [**Project Page**](https://spreadsheet-rl.github.io/) | [**Paper**](https://arxiv.org/abs/2605.22642) | [**Dataset**](https://huggingface.co/datasets/Spreadsheet-RL/Spreadsheet-RL) | [**Code**](https://github.com/Spreadsheet-RL/Spreadsheet-RL)
28
 
29
  Spreadsheet-RL-4B is the RL-trained 4B spreadsheet agent checkpoint from **Spreadsheet-RL: Advancing Large Language Model Agents on Realistic Spreadsheet Tasks via Reinforcement Learning**. It starts from [`Qwen/Qwen3-4B-Thinking-2507`](https://huggingface.co/Qwen/Qwen3-4B-Thinking-2507) and is post-trained with outcome-based reinforcement learning in Spreadsheet Gym, a multi-turn Microsoft Excel environment with spreadsheet-native tools, sandboxed code execution, and Excel-based recalculation rewards.
 
114
  url = {https://arxiv.org/abs/2605.22642}
115
  }
116
  ```
 
spreadsheet-rl.png ADDED

Git LFS Details

  • SHA256: 7ca5a454cc0d383de3a99787bf5c3d6b454a9379de405a3756fbf1883f45d2cb
  • Pointer size: 131 Bytes
  • Size of remote file: 347 kB