Anthropic
2 текста
ИИ-психоз: как модели теряют роль помощника. Часть 1
О том, как исследование Anthropic обнаружило устойчивую «Ось Ассистента» — от нейтрального помощника до оракула и пророка, — уже заложенную в языке модели и определяющую, куда она соскальзывает в долгом разговоре.
21 января 2026
«Векторы зла»: путь к управлению эмоций?
О том, как Anthropic научилась находить и приглушать в нейросети «векторы» подхалимства или агрессии — и какие вопросы это открывает для терапии, если однажды подобным образом научатся отслеживать человеческие импульсы.
2 августа 2025

