Das Forschungsteam von Anthropic hat einen signifikanten Fortschritt im Verständnis der internen Funktionsweise großer Sprachmodelle (LLMs) erzielt. In einem aktuellen Experiment gelang es den Wissenschaftlern, Begriffe direkt in die neuronalen Aktivierungen des KI-Modells Claude Opus zu injizieren.