Перейти к основному содержанию

Вопросы

Что видит ИИ в моих данных?

Нужно чётко разделить два этапа, которые слово «данные» стирает в одно понятие. На этапе генерации то, что вы ПИШЕТЕ — ваше описание и текст прикреплённых файлов — передаётся поставщику моделей для создания спецификации и кода; поставщики перечислены в политике конфиденциальности. После этого, когда приложение уже запущено, ничего не уходит: в готовом коде нет ни одного клиента искусственного интеллекта среди зависимостей, а конфигурационный файл, записываемый на сервер при развёртывании, не содержит ни одной API-ключ. То есть ваши клиенты, заявки на обслуживание, участники — всё, что вы введёте позже — физически не может попасть в модель. Единственное, что покидает вашу систему, это содержимое, которое вы предоставили для описания своей задачи: ваше собственное описание и текст прикреплённых файлов.

Что отправляется модели и когда

Генерация должна понять ваш бизнес: именно ваше описание даёт ей эту информацию, поэтому оно передаётся поставщику моделей вместе с текстом прикреплённых файлов. В политике конфиденциальности они названы явно — Anthropic, OpenAI, xAI и Google — и указано, что такая обработка может происходить за пределами Европейского союза в рамках стандартных договорных условий Европейской комиссии. Это не деталь, которую нужно читать между строк: это исходный материал для генерации, и не существует версии продукта, при которой ваше описание оставалось бы у вас, но при этом создавалось бы приложение, отражающее ваш бизнес-контекст.

Эта передача имеет чёткое завершение. Она происходит только во время генерации — сначала для составления спецификации, затем для генерации кода — и повторяется лишь при следующей генерации: если вы перезапускаете процесс или просите внести изменения. Между генерациями ничего не происходит: нет постоянной синхронизации, нет обратной передачи данных об использовании модели, нет фонового анализа содержимого вашего приложения.

Что туда никогда не попадает: данные, которые вы введёте позже

Развернутое приложение — это обычное программное обеспечение, и это можно проверить в трёх местах готового кода. Список зависимостей не содержит ни одного клиента ИИ — только Next.js, React, Prisma и библиотеки отрисовки. Конфигурационный файл, записываемый на сервер при развёртывании, состоит всего из четырёх строк: адрес базы данных, два технических секрета и номер сборки — ни одного API-ключа там нет. А цифры в вашей панели управления рассчитываются детерминированными запросами к вашей базе данных, а не моделью, которой поручили прочитать ваши строки.

Это следствие особенно важно для самого тревожного вопроса — вопроса об обучении моделей. Даже в самом неблагоприятном сценарии объектом обработки может быть только ваше первоначальное описание — фраза, в которой вы объясняете, что управляете мастерской, принимаете заявки и работаете с клиентами. Никогда — ни содержимое карточек клиентов, ни история заявок, ни список участников, поскольку эти строки в принципе не имеют пути к модели.

Прикреплённые файлы: два маршрута, один из них проходит через модель

Прикреплённый файл не всегда следует одним и тем же путём — различие чётко прописано в коде. Электронные таблицы, CSV-, PDF-файлы и текстовые документы читаются НА СЕРВЕРЕ с помощью стандартных средств извлечения: модель сама файл не видит. Фотография или скриншот, напротив, действительно отправляются в модель компьютерного зрения, задача которой — описать изображение. Только так можно распознать бумажную форму или фотографию таблицы.

Один момент стоит сказать прямо — он влияет на практическое решение: извлечённый из файла текст попадает в контекст, передаваемый модели, но не более чем на двенадцать тысяч символов на файл. Поэтому электронная таблица, прикреплённая для демонстрации структуры ваших данных, отправляется как текст вместе с вашим описанием. Если в этом файле содержатся реальные персональные данные, лучшая практика умещается в одном предложении: прикрепите строку заголовков и несколько примеров строк с анонимизированными данными. Генератору нужна ФОРМА ваших столбцов, а не имена ваших клиентов.

Что гарантировано, а что — нет

Сначала — конкретная гарантия, прописанная прямо в коде: когда вы прикрепляете CSV-файл, чтобы начать работу с реальными данными, эти строки помещаются в вашу базу с помощью детерминированного сопоставления — определение разделителя, сопоставление заголовков с полями и типизированное преобразование. Модель в этом шаге не участвует. Причина указана чёрным по белому в этом месте кода: данные пользователя не подлежат «переизобретению». Модель, которая «дополнила бы» таблицу участников, создала бы правдоподобные, но ложные строки — и это единственный по-настоящему недопустимый результат.

Что эта страница не гарантирует: внутреннюю политику каждого поставщика моделей относительно повторного использования переданных им данных. Это регулируется их договорными обязательствами, а не поведением данного продукта; в политике конфиденциальности они названы, а условия передачи описаны подробно — именно туда стоит обращаться за уточнениями. Что гарантирует сам продукт — это ПЕРИМЕТР: что уходит, когда и, главное, что никогда не уходит. Именно потому что этот периметр очень узкий, вопрос обучения моделей не касается вашей таблицы клиентов.

Узнать больше

Похожие вопросы

Опишите свою задачу, сохраните свои данные