Ассистент для длинных документов, анализа и кода. В платных тарифах — Claude Code и Cowork.
Тестировщик AI-систем
ПоявляетсяПроверяет, как отвечает ассистент или агент, до запуска и после каждого изменения: собирает проверочные вопросы, ищет ошибки, выдумки и способы обмануть систему. Без такой проверки о проблемах узнают от клиентов.
Что меняется
Ответ модели нельзя проверить один раз: при смене модели или инструкции весь набор примеров прогоняют заново.
Появилась проверка на атаки: попытки заставить ассистента нарушить правила или раскрыть данные (red teaming).
Часть оценки делает другая модель, но правила оценки и спорные случаи остаются за человеком.
AI делает черновик, решает человек
Как здесь делится работа: AI готовит черновик, человек его проверяет и принимает решение.
Что делает AI
- Придумывает много проверочных вопросов, в том числе с подвохом
- Оценивает ответы по заданным критериям
- Сравнивает две версии ассистента на одном наборе вопросов
- Группирует ошибки по типам и пишет сводку
Что остаётся за человеком
- Решение, что считать правильным ответом в этой предметной области
- Проверочные случаи из реальной жизни клиентов
- Вывод «можно запускать» или «рано»
- Описание рисков понятным языком для руководства
Чему учиться в первую очередь
6 уроков из курса по порядку. Начни с первого.
- Как работает LLM изнутри — без математики, через образыС нуляКак устроена языковая модель: токены, контекст, температура и галлюцинации, без математики.Начни отсюда
- Как ставить задачу AI: основы промптаПользовательКак ставить задачу AI: пять элементов хорошего промпта, Plan Mode и нормальные итерации.
- Этика и безопасность AI — галлюцинации, атаки, предвзятость: как не доверять AI слепоПользовательГаллюцинации, prompt injection, предвзятость, приватность и авторское право: как не доверять AI слепо.
- MLOps для indie — мониторинг, drift, retraining без DevOps командыИнженерMLOps без DevOps-команды: трейсинг вызовов, тесты промптов на регрессии, контроль расходов и версии промптов.
- Evals — самоулучшающиеся скиллыИнженерEvals для скиллов: тесты, pass rate, проверка срабатывания и цикл улучшения по данным.
- Prompt Injection Defense — главная security угроза 2026ИнженерPrompt injection: шесть типов атак, восемь уровней защиты, red team тесты и план реакции на инцидент
Какими инструментами пользоваться
- Фримиум
Массовый AI-ассистент OpenAI: чат, голос, изображения, агент Work и Codex.
ФримиумАссистент Google, встроенный в Gmail, Docs и Sheets. Deep Research, Gemini Live, Canvas.
ФримиумБесплатная студия Google: режим Build собирает приложение по описанию или эскизу.
ФримиумGemini в Google Таблицах: таблицы, формулы и разбор данных по описанию.
Платно
Готовые материалы
- Проверка ответа AI перед публикациейChecklist
Факты, смысл, риски и голос — что проверить, прежде чем текст от AI увидят клиенты.
Бесплатно - Как проверять ответ AIChecklist
Оценка риска, признаки выдуманного ответа и проверка за 5 минут, прежде чем действовать по ответу.
Бесплатно - Проверь ответ на ошибкиPrompt
Разбор ответа AI по утверждениям: что верно, что сомнительно, где ошибка и что проверить по первоисточнику.
Бесплатно - Безопасность данных при работе с AIChecklist
Что не отправлять в чат, какие настройки проверить, как ограничить AI-агентов.
Бесплатно
Как заработать с AI
Доход мы не обещаем: результат зависит от ниши, рынка и твоей работы.
- Работа
Тестировщику или специалисту поддержки взять на себя проверку AI-ассистента в своей компании: наборы вопросов, отчёты об ошибках, повторные прогоны.
- Услуга
Проверка чат-бота или ассистента перед запуском: набор вопросов, отчёт об ошибках и рисках, повторная проверка после исправлений.
- Продукт
Готовый набор проверочных вопросов и критериев для ассистентов одной отрасли, например интернет-магазинов.
Похожие профессии
Проверено: октябрь 2026