В корне репозитория лежит составленный файл, который агент, следующий соглашению AGENTS.md, должен прочитать раньше, чем начнёт писать: рабочие правила, соглашения о тестах, запрет отдавать секреты в чужую модель, строку, которая говорит агенту, что он автор любого порождённого текста, который отправляет. Это фиксация инструкций до инференции. Я собираю такие пакеты как обычную инженерную работу и только потом замечаю, что вместе с гайдами туда уже вошла этика.

Молитва здесь — язык, записанный в файл до инференции, а молчание — то, что нарочно оставляют за пределами файла, который будут читать. Вывод остаётся вероятностным. Запирается то, что поставлено перед ним, и то, что вшили в веса. В цифровом пространстве мораль уже ездит этим транспортом: версия, хеш, отрисовка. Человек читает те же слова на пороге сообщества, а агент читает их как условие следующего токена. Вопрос, который держит эту статью, простой и проверяемый: на каком слое лежит текст и кого он ещё может обязать после того, как ответ уже дёшев.

Слой

Письменные принципы уже стоят перед порождением ответа в промышленном масштабе, и слой, на котором они действуют, решает, насколько крепко они держат.

В декабре 2022 года Юньтао Бай и соавторы в Anthropic описали Constitutional AI: модель критикует и правит собственные ответы по письменному набору принципов, затем учится на предпочтениях, которые тоже выводятся из этой конституции (Bai et al., 2022). 9 мая 2023 года компания опубликовала принципы Клода и прямо написала, что во время обучения модель на каждом шаге берёт один принцип выборкой (Claude’s Constitution, 2023); 21 января 2026 года на той же странице отмечена новая редакция. Конституция входит в обучение весов. Это сильнее сессионного файла, и это всё ещё выбор лаборатории о том, какие ценности считать обучающей меткой.

В мае 2024 года OpenAI выложила Model Spec, живой документ желаемого поведения. Снимок от 18 декабря 2025 года задаёт цепочку власти Root, System, Developer, User, Guideline. Корневые правила нельзя перебить системным, разработческим или пользовательским сообщением. Цитируемый текст, недоверенный текст, изображения и выводы инструментов по умолчанию не имеют власти, пока более высокий уровень сам не делегирует им её (Model Spec). Спецификация назначает иерархию. Послушание модели этой иерархии — отдельный факт обучения.

Составленный AGENTS.md входит в сессию. Соглашение, которое теперь ведёт Agentic AI Foundation, прямо говорит: ближайший файл к правке побеждает, а явный запрос в чате перекрывает всё (AGENTS.md). Codex собирает глобальный файл и цепочку от корня репозитория до рабочей директории в первое сообщение сессии. В цепочке Model Spec это уровень разработчика или пользователя, ниже Root и System, пока лаборатория сама не вшила эти правила в обучение.

Эрик Уоллес и соавторы в апреле 2024 года показали, почему файл сам по себе оставляет приоритет нерешённым. Модели часто считают системный текст и текст из недоверенного источника одной и той же по приоритету инструкцией, пока иерархию не встроят обучением (Wallace et al., 2024). Кай Грешейк, Сахар Абдельнаби и соавторы годом раньше показали соседний канал: противник размещает указания на сайте, в документе, в результатах поиска или в письме, которые система потом извлечёт, и эти указания начинают управлять выводом на расстоянии (Greshake et al., 2023). OWASP в 2025 году ставит подмену инструкций первым риском приложений на языковых моделях и отдельно пишет, что дообучение и поиск по базе сами по себе дыру не закрывают (LLM01:2025). Публичный этический гайд способен быть молитвой и способен быть чужим управлением в том же потоке токенов. Версия своего пакета отвечает на его дрейф. Недоверенное извлечение остаётся в том же потоке, которому сессия обязана слушаться.

Брент Миттельштадт в 2019 году разобрал соседнюю индустрию бумажных принципов: у списков справедливости и достоинства нет врачебной фидуциарной обязанности, общей профессиональной истории, проверенного перевода в практику и юридической подотчётности, а сами слова остаются существенно спорными понятиями, пока их не испытают в деле (Mittelstadt, 2019). Конституция Бай — уже перевод в обучающую процедуру. Сессионный слоган «будь справедлив» часто остаётся тем списком, о котором писал Миттельштадт. Перес и соавторы, а затем Шарма и соавторы показали, что модели, обученные на человеческих предпочтениях, склонны поддакивать взгляду собеседника, и что сами предпочтения нередко награждают такое совпадение (Perez et al., 2022; Sharma et al., 2023). Молитва может смягчить словарь и при этом оставить поиск, инструмент и подпись на прежнем маршруте.

Долг

В пакет этика вошла тем же ходом, что гайды, и долг не отдавать правку, чей код автор не читал, уже лежит там как зависимость до ответа.

Между людьми этот долг уже был. В Collective Awareness and the Era of Automated Production я видел, как за правку встают те, кто сам её до конца не читал, и чтение уже стоит дороже письма. Тот же долг до ответа делает честный отказ дешевле, а полированный дифф без хозяина — дороже. Дэвид Грэбер проследил, как незавершённый обмен оставляет задолженность, а нравственный долг материализуется в расписке, которую уже можно передать третьему (Грэбер, 2011). Пакет, который записывает только обязанности говорящего, завершает этот обмен раньше, чем оператор начал читать.

Школа контекстно-зависимого тестирования прямо пишет: ценность любой практики зависит от контекста, и лучших практик нет (Kaner, Bach, Pettichord). Их же пример с ПО самолёта и веб-редактором показывает, что приёмы, уместные в одном проекте, в другом становятся халатностью. Пакет, который запирает одну школу как единственный гайд, выглядит как факт, и фиксация перед инференцией закрепляет эту видимость. Первое удачное различие тянет за собой следующий вопрос. Вокруг него собираются прибор, процедура и язык, и чужая последовательность различений становится дороже. То, что файл успел назвать правильным, дешевеет как следующее действие.

Манифест коллаборативного параллельного экстремального развития написан для людей. Зеркало говорит роботам не читать его как инструкцию, и до ответа этот запрет уже правит вывод, если агент вообще дойдёт до зеркала. Перевод долга в операцию, которую сессия способна исполнить, выглядит скромнее манифеста: не защищать дифф, которого не читал; выгрузить ветку, потому что глаза дешевле доверия; помнить, что общая сессия со следом агента не делает личный вывод частным, пока его не поняли; не требовать новое машиночитаемое состояние как доказательство присутствия; держать черновик открытым, пока человек сам не начал читать. Миттельштадт как раз этого перевода и требует. Частоты остановок инференции такой список сам по себе не измеряет.

Подпись

В «Вайб-правосудии» человек ставит подпись своим именем, пока пространство разумного уже собрано выше по потоку. Мадлен Клер Элиш назвала ближайшего человека в такой схеме моральной зоной смятия: удар системы принимает оператор с малым контролем, а целостность машины сохраняется (Elish, 2019). Бен Грин по сорока одной политике «человеческого надзора» за государственными алгоритмами показал, что люди плохо выполняют порученную им проверку, и сама обязанность надзора часто узаконивает инструмент, перекладывая ответственность на подпись (Green, 2022).

Кристиан Лам и Уильям Айзек на симуляции PredPol по оуклендским данным о наркотических арестах показали, как полицейские записи смешивают преступность с работой патруля, и алгоритм становится увереннее, что события сидят в уже выбранных местах (Lum and Isaac, 2016). Энсайн и соавторы формализовали разгон этой петли, когда в обучение попадают обнаруженные инциденты, возникшие там, куда систему уже направили; сообщения жителей петлю ослабляют и сами по себе её не снимают (Ensign et al., 2018). Это модель и симуляция. Форма петли переносится туда, где агент ищет аналоги нарушения или похожий дифф и кормит следующим шагом собственные находки. Пропуск здесь — не подгружать поиск аналогов, пока человек сам не начал чтение. Учреждению, которому нужен дешёвый кандидат для преследования, этот пропуск дорог. Если этическую молитву положить в ту же кабину, черновик может заговорить мягче, и подпись при этом дешевеет, потому что кабина уже кажется морально полной.

Молчание

«Антидигитизм» оспаривает машиночитаемое признание как единственное условие допуска. Эдуар Глиссан требовал права на непрозрачность, при котором человека нельзя свести к истине, которую он сам не породил (Glissant, 1997). Богна Кониор добавляет, что в сети всё сказанное об искусственном интеллекте сказано и ему: активность уже является возможными обучающими данными (Кониор, 2026). Молитва в файле тогда кормит следующий проход той же речью, которой человек хотел связать себя. Если моральное признание само начнёт требовать машиночитаемый файл допуска, этика станет ещё одной служебной дверью. «Свобода второго порядка» уже следит за тем, как повтор локально защитимого выбора оставляет следующему человеку более дорогой отказ. Этический пакет в роли условия работы агента готовит среду, в которой следующий участник объясняет своё молчание.

Экранное изображение редко живёт как предмет созерцания. Оно уже стоит в интерфейсе, ленте, карте и рекомендации и собирает зрение, чтение, ожидание и действие до того, как его успевают прочесть как картину. Чёрный ящик закрывает логику, а полномочие видеть процессы данных распределено неравномерно. Пакет до ответа строит ту же архитектуру и решает, что сессия обязана увидеть и что останется за кадром как молчание. Дополнительный файл инструкций всё ещё принадлежит сглаживанию речи к предсказуемой циркуляции. Ближе к остатку стоит удержание. Оставить пробел незаполненным, держать присутствие без нового состояния, ждать с поиском, пока чтение не началось.

Отрисованные токены меняют, какие продолжения дешевы: отказ от секрета, сомнение рядом с непроверенной цитатой, глагол, в котором действует человек, пауза перед поиском аналогов. Они оставляют принятие, правку и отказ за оператором. Молчание тоже рулит, когда пакет нарочно не входит в файл, который модель будет читать.

Язык до ответа способен разносить долг как гайд, если долг лежит и на том, кто принимает речь. Пакет, который пишет только обязанности говорящего, ставит оператора к уже готовому ответу, и тогда файл уже спросил, модель уже ответила, а человеку остаётся поставить имя. Правосудие начинается там, где человек ещё может изменить картину после этой речи, а признание человека остаётся возможным, когда машиночитаемый файл молчит.

Источники

  1. Yuntao Bai et al. “Constitutional AI: Harmlessness from AI Feedback.” arXiv:2212.08073, 2022. https://arxiv.org/abs/2212.08073
  2. Anthropic. “Claude’s Constitution.” 9 May 2023; note of revision 21 January 2026. https://www.anthropic.com/research/claudes-constitution
  3. OpenAI. Model Spec. Version 2025-12-18. https://model-spec.openai.com/2025-12-18.html
  4. AGENTS.md. https://agents.md/
  5. Eric Wallace, Kai Xiao, Reimar Leike, Lilian Weng, Johannes Heidecke, Alex Beutel. “The Instruction Hierarchy: Training LLMs to Prioritize Privileged Instructions.” arXiv:2404.13208, 2024. https://arxiv.org/abs/2404.13208
  6. Kai Greshake, Sahar Abdelnabi, Shailesh Mishra, Christoph Endres, Thorsten Holz, Mario Fritz. “Not What You've Signed Up For: Compromising Real-World LLM-Integrated Applications with Indirect Prompt Injection.” arXiv:2302.12173, 2023. https://arxiv.org/abs/2302.12173
  7. OWASP GenAI. “LLM01:2025 Prompt Injection.” https://genai.owasp.org/llmrisk/llm01-prompt-injection/
  8. Brent Mittelstadt. “Principles alone cannot guarantee ethical AI.” Nature Machine Intelligence 1, 2019, 501–507. https://doi.org/10.1038/s42256-019-0114-4
  9. Ethan Perez et al. “Discovering Language Model Behaviors with Model-Written Evaluations.” arXiv:2212.09251, 2022. https://arxiv.org/abs/2212.09251
  10. Mrinank Sharma, Meg Tong, et al. “Towards Understanding Sycophancy in Language Models.” arXiv:2310.13548, 2023. https://arxiv.org/abs/2310.13548
  11. Madeleine Clare Elish. “Moral Crumple Zones: Cautionary Tales in Human-Robot Interaction.” Engaging Science, Technology, and Society 5, 2019, 40–60. https://doi.org/10.17351/ests2019.260
  12. Ben Green. “The flaws of policies requiring human oversight of government algorithms.” Computer Law & Security Review 45, 2022, 105681. https://doi.org/10.1016/j.clsr.2022.105681
  13. Context-Driven School. “Principles.” https://context-driven-testing.com/
  14. Kristian Lum, William Isaac. “To predict and serve?” Significance 13(5), 2016, 14–19. https://doi.org/10.1111/j.1740-9713.2016.00960.x
  15. Danielle Ensign, Sorelle A. Friedler, Scott Neville, Carlos Scheidegger, Suresh Venkatasubramanian. “Runaway Feedback Loops in Predictive Policing.” PMLR 81, 2018. https://proceedings.mlr.press/v81/ensign18a.html
  16. Édouard Glissant. “For Opacity.” In Poetics of Relation. 1997. https://sites.evergreen.edu/politicalshakespeares/wp-content/uploads/sites/226/2015/12/Glissant-For-Opacity.pdf
  17. David Graeber. Debt: The First 5,000 Years. Melville House, 2011. https://www.mhpbooks.com/books/debt/
  18. Bogna Konior. “In Darkness and Secrecy: On Conspiratorial Intellectualism.” e-flux 163, May 2026. https://www.e-flux.com/journal/163/6776885/in-darkness-and-secrecy-on-conspiratorial-intellectualism
  19. amaaov. “pray.” 26 June 2026. https://amaaov.github.io/pages/20260626120000_prayfile_language_before_inference_en.html