RTL Generation on RTLLM VerilogEval CVDP Combined v2
94Mean Z-score Pass@10GPT-OSS-120B
Evaluation Results
| Method | Links | |
|---|---|---|
| GPT-OSS-120BRole=Teacher, SFT=null, RL=null2026.06 | 94 | |
| STGRole=Fine-tuned, Base Model=Qwen3-8B, SFT=true, RL=false2026.06 | 77 | |
| STGRole=Fine-tuned, Base Model=Qwen3-4B-Thinking, SFT=true, RL=false2026.06 | 68 | |
| STGRole=Fine-tuned, Base Model=Qwen2.5-C-7B-Instruct, SFT=true, RL=false2026.06 | 56 | |
| CodeV-R1Role=Fine-tuned, Base Model=Qwen2.5-C-7B-Instruct, SFT=true, RL=true2026.06 | 54 | |
| SiliconMind-V1Role=Fine-tuned, Base Model=Qwen3-8B, SFT=true, RL=false2026.06 | 46 | |
| SiliconMind-V1Role=Fine-tuned, Base Model=Qwen3-4B-Thinking, SFT=true, RL=false2026.06 | 37 | |
| SiliconMind-V1Role=Fine-tuned, Base Model=Qwen2.5-C-7B-Instruct, SFT=true, RL=false2026.06 | 30 | |
| VeriRL (reproduced)Role=Fine-tuned, Base Model=Qwen2.5-C-7B-Instruct, SFT=true, RL=true2026.06 | -29 | |
| Qwen3-8BRole=Base, SFT=null, RL=null2026.06 | -80 | |
| Qwen2.5-C-7B-InstructRole=Base, SFT=null, RL=null2026.06 | -151 | |
| Qwen3-4B-ThinkingRole=Base, SFT=null, RL=null2026.06 | -200 |