Нужно чётко разделить два этапа, которые слово «данные» стирает в одно понятие. На этапе генерации то, что вы ПИШЕТЕ — ваше описание и текст прикреплённых файлов — передаётся поставщику моделей для создания спецификации и кода; поставщики перечислены в политике конфиденциальности. После этого, когда приложение уже запущено, ничего не уходит: в готовом коде нет ни одного клиента искусственного интеллекта среди зависимостей, а конфигурационный файл, записываемый на сервер при развёртывании, не содержит ни одной API-ключ. То есть ваши клиенты, заявки на обслуживание, участники — всё, что вы введёте позже — физически не может попасть в модель. Единственное, что покидает вашу систему, это содержимое, которое вы предоставили для описания своей задачи: ваше собственное описание и текст прикреплённых файлов.
Что отправляется модели и когда
Генерация должна понять ваш бизнес: именно ваше описание даёт ей эту информацию, поэтому оно передаётся поставщику моделей вместе с текстом прикреплённых файлов. В политике конфиденциальности они названы явно — Anthropic, OpenAI, xAI и Google — и указано, что такая обработка может происходить за пределами Европейского союза в рамках стандартных договорных условий Европейской комиссии. Это не деталь, которую нужно читать между строк: это исходный материал для генерации, и не существует версии продукта, при которой ваше описание оставалось бы у вас, но при этом создавалось бы приложение, отражающее ваш бизнес-контекст.
Эта передача имеет чёткое завершение. Она происходит только во время генерации — сначала для составления спецификации, затем для генерации кода — и повторяется лишь при следующей генерации: если вы перезапускаете процесс или просите внести изменения. Между генерациями ничего не происходит: нет постоянной синхронизации, нет обратной передачи данных об использовании модели, нет фонового анализа содержимого вашего приложения.
Что туда никогда не попадает: данные, которые вы введёте позже
Развернутое приложение — это обычное программное обеспечение, и это можно проверить в трёх местах готового кода. Список зависимостей не содержит ни одного клиента ИИ — только Next.js, React, Prisma и библиотеки отрисовки. Конфигурационный файл, записываемый на сервер при развёртывании, состоит всего из четырёх строк: адрес базы данных, два технических секрета и номер сборки — ни одного API-ключа там нет. А цифры в вашей панели управления рассчитываются детерминированными запросами к вашей базе данных, а не моделью, которой поручили прочитать ваши строки.
Это следствие особенно важно для самого тревожного вопроса — вопроса об обучении моделей. Даже в самом неблагоприятном сценарии объектом обработки может быть только ваше первоначальное описание — фраза, в которой вы объясняете, что управляете мастерской, принимаете заявки и работаете с клиентами. Никогда — ни содержимое карточек клиентов, ни история заявок, ни список участников, поскольку эти строки в принципе не имеют пути к модели.
Прикреплённые файлы: два маршрута, один из них проходит через модель
Прикреплённый файл не всегда следует одним и тем же путём — различие чётко прописано в коде. Электронные таблицы, CSV-, PDF-файлы и текстовые документы читаются НА СЕРВЕРЕ с помощью стандартных средств извлечения: модель сама файл не видит. Фотография или скриншот, напротив, действительно отправляются в модель компьютерного зрения, задача которой — описать изображение. Только так можно распознать бумажную форму или фотографию таблицы.
Один момент стоит сказать прямо — он влияет на практическое решение: извлечённый из файла текст попадает в контекст, передаваемый модели, но не более чем на двенадцать тысяч символов на файл. Поэтому электронная таблица, прикреплённая для демонстрации структуры ваших данных, отправляется как текст вместе с вашим описанием. Если в этом файле содержатся реальные персональные данные, лучшая практика умещается в одном предложении: прикрепите строку заголовков и несколько примеров строк с анонимизированными данными. Генератору нужна ФОРМА ваших столбцов, а не имена ваших клиентов.
Что гарантировано, а что — нет
Сначала — конкретная гарантия, прописанная прямо в коде: когда вы прикрепляете CSV-файл, чтобы начать работу с реальными данными, эти строки помещаются в вашу базу с помощью детерминированного сопоставления — определение разделителя, сопоставление заголовков с полями и типизированное преобразование. Модель в этом шаге не участвует. Причина указана чёрным по белому в этом месте кода: данные пользователя не подлежат «переизобретению». Модель, которая «дополнила бы» таблицу участников, создала бы правдоподобные, но ложные строки — и это единственный по-настоящему недопустимый результат.
Что эта страница не гарантирует: внутреннюю политику каждого поставщика моделей относительно повторного использования переданных им данных. Это регулируется их договорными обязательствами, а не поведением данного продукта; в политике конфиденциальности они названы, а условия передачи описаны подробно — именно туда стоит обращаться за уточнениями. Что гарантирует сам продукт — это ПЕРИМЕТР: что уходит, когда и, главное, что никогда не уходит. Именно потому что этот периметр очень узкий, вопрос обучения моделей не касается вашей таблицы клиентов.