How LLMs Think
Hint: it’s just Antakshari. How a large language model writes an answer, one token at a time.
Hint: it’s just Antakshari. How a large language model writes an answer, one token at a time.
Post-training a model for one skill nudges its answers on unrelated questions, and that changes how I think about protecting models from copying.