#artificial intelligence
Apr 2026
Scientific Graphics Program Synthesis via Dual Self-Consistency Reinforcement Learning
A novel Dual Self-Consistency Reinforcement Learning optimization paradigm is introduced, which utilizes Round-Trip Verification to penalize degenerate code and boost overall self-consistency in TikZ code.
Juekai Lin, Yun Zhu, Honglin Lin et al.
· arXiv.org · 5 citations