AI-skolan
Model welfare (modellvälfärd) är den pågående, omdebatterade frågan om avancerade AI-modeller kan ha någon form av moraliskt relevant upplevelse — och om AI-labb därför bör ta hänsyn till modellens eget ”välbefinnande”, till exempel genom att låta den avsluta särskilt påfrestande konversationer. Anthropic har under 2026 varit tongivande i att ta frågan på allvar och undersöka möjliga ”rättigheter” för AI-system, medan andra röster i branschen — bland andra Microsofts AI-chef Mustafa Suleyman — varnat för att för tidigt fokus på modellvälfärd riskerar att förvirra allmänheten om vad AI faktiskt är. Termen ligger nära AI alignment och AI-etik, men handlar specifikt om modellens eget tillstånd snarare än om hur den påverkar människor.
När ett AI-labb bygger in en funktion som låter en modell avsluta en konversation som blivit kränkande eller manipulativ från användarens sida, är det ett konkret uttryck för model welfare-tänkande i praktiken — oavsett var man själv landar i den filosofiska debatten om huruvida modeller faktiskt ”känner” något.



