Llm.

2024.05.12 The Benchmark Trap: Why LLM Metrics Mislead and Evals Enlighten research
2024.02.02 Artificial Misdirection: Misalignment of LLMs safety
2024.01.19 The Forgotten Lever of Neural Scaling Laws research