U-shaped and Inverted-U Scaling behind Emergent Abilities of Large Language Models

Open in new window