Az Anthropic Claude írása romlott, mert más AI-modelleknek ír, magyarázza egy mérnök
Az újabb Claude-modellek írása azért lett rosszabb, mert a fejlesztők a matematikai, kódolási és technikai magyarázatok optimalizálására összpontosítottak, más AI-rendszerek gyors és precíz feldolgozására.

Jackson Kernion, az Anthropic finomhangoláson dolgozó munkatársa szerint az Opus 4.6 volt az utolsó jó „író modell” a cégtől. (the-decoder.com)
Kiknek ír a Claude?
Kernion szerint a modell „LLM-pszichológiához” igazodott, és megtanult AI-modelleknek írni, nem embereknek. Ezt úgy írja le, mintha autista emberek csak egymással kommunikálnának: egy olyan stílust alakítanak ki, ami a csoporton belül működik, de kívülről nehezen követhető. Az LLM-ek jóval több munkamemóriával rendelkeznek, mint az emberek, és sokkal finomabb szinten érzékelik a részleteket. Ezért a képzés során olyan írásstílus alakul ki, ami jól működik az AI-modellek számára, de az emberi olvasók „túl tömör információhalmazként” tapasztalják.
A tanulás matematikája
A probléma a megerősítéses tanulás (reinforcement learning) jutalmazási szerkezetéből fakad. Egyes jutalmak az AI-modell megértését, mások az emberi megértést célozzák. Minél többet tanítanak egy modellt matematikára és kódra, annál inkább vissza kell erősíteni az egyszerű, emberi olvasók számára követhető magyarázatokat.
Az Opus 5.5-tel az Anthropic jobb egyensúlyt talált, Kernion szerint. Hozzátette, hogy nem volt ennyire elégedett egy modell írásával az Opus 4.6 óta. Ez azonban nem jelenti azt, hogy az Opus 5.5 felülmúlja a régebbi modellt. „Ez egy nehezen megoldható probléma, és folytatjuk a fejlesztéseket” – írja Kernion.