CARREGANDO O RADAR…
SocialRL: Refining LLMs' Social Intelligence through Multi-turn Reinforcement Learning and Reward Design | Radar arXiv · portela.dev