Research1w ago
Reinforcement Learning for improving Large Language Models' Catalan text simplification capabilities
Researchers apply reinforcement learning using a novel reward function and GRPO to improve automatic text simplification for Catalan using…
#Reinforcement Learning#Catalan#Large Language Models#Text Simplification#GRPO#Benchmarks