Data · 26 september 2026
Medarbetare förklarar varför Claude har svårt att skriva för människor
KI-modeller förbättras snabbt inom matematik, kod och logiskt tänkande, medan de språkliga uttrycken istället stagnerar eller till och med försämras.
En medarbetare på Anthropic, som arbetar med feintuning av Claude, förklarar varför Opus 4.6 var den senaste bra "skriv"modellen från Anthropic. Det beror på att nyare modeller har optimerats för matematik, kod och tekniska förklaringar för andra KI-modeller. Detta har lett till Claudes ovanliga uttryckssätt, ibland kallat "Claudeish": Modellen har anpassats till "LLM-psykologi" och har lärt sig att skriva för KI-modeller, inte för människor.
Kernion jämför detta med människor som endast kommunicerar med autister: de utvecklar en stil som fungerar inom den gruppen men är svår att förstå för utomstående. LLM:er har ett betydligt större arbetsminne än människor och uppfattar detaljer på en finare nivå. Därför uppstår en skrivstil vid träning som är logisk och effektiv för KI-modeller, men för mänskliga läsare låter den för tät och onaturlig.
Det handlar konkret om belöningsstrukturen vid så kallad förstärkningsinlärning: vissa belöningar optimerar förståelsen för KI-modeller, andra för människor. Ju mer man tränar på matematik och kod, desto mer måste man aktivt motverka detta och belöna enkla förklaringar för mänskliga läsare.
Med Opus 5.5 har Anthropic hittat en bättre balans. Modellen är den första versionen med specifika förbättringar av meningsklarhet och överbelastade informationsblock. Det finns fortfarande mycket utrymme för förbättringar.