Чем предстоит заниматься:
- Разработка LLM/VLM-пайплайнов: от подбора модели и подготовки данных до сборки результата в заданном формате
- Задачи над разнородными и слабоструктурированными данными
- Валидация и постобработка результата
- Оценка качества: эталонные наборы, метрики, LLM-as-a-judge
- Развёртывание LLM через vLLM или Ollama, упаковка пайплайнов в сервисы
Требования:
- Опыт с LLM: промптинг, подготовка контекста, structured output, дообучение. Умение довести пайплайн от «работает на примерах» до предсказуемого поведения на потоке
- Опыт с VLM: разбор изображений и сканов, чтение текста и разметки, поиск и локализация объектов, извлечение структуры, дообучение под свои задачи
- Опыт бенчмарков: собрать эталонный набор, выбрать метрики, проверить решение — а не полагаться на впечатление от нескольких примеров
- Умение переключаться между R&D и production delivery
- Самостоятельность: разбиваете задачу на шаги, не ждёте детальной постановки, вникаете в предметную область
Будет плюсом:
- речевые модели (Whisper, GigaAM) и видео;
- FastAPI, PostgreSQL, Docker;
- запуск моделей на ограниченных ресурсах; опыт промышленных проектов.
https://kopernik.ai/
