Efficient Multitask Learning in Small Language Models Through Upside-Down Reinforcement Learning

Open in new window