Прямой работодатель  Interexy.com

Сайт:   interexy.com


Роль:
Вы будете проектировать и сопровождать LLM-пайплайны от сбора данных до продакшена. Работа с нуля (0→1), прямое взаимодействие с основателями и ключевыми заказчиками.

Задачи:

Полный цикл разработки LLM-приложений: индексация → дообучение → мониторинг.

Построение RAG-систем с использованием гибридного поиска (BM25 + плотные векторы) и кэширования.

Внедрение CI/CD для моделей: автоматическое тестирование качества, A/B-тесты, канареечные развёртывания.

Разработка инструментов для оценки и логирования (groundedness, фактологическая точность, задержки).

Участие в технических продажах: помощь в оценке задач, прототипирование под ключевого клиента.

Требования:

Опыт работы с LLM от 2 лет (продакшен, не пет-проекты).

Глубокое понимание внимания (attention), transformer-архитектур и методов квантизации (GPTQ, AWQ).

Коммерческий опыт с LangChain, LlamaIndex, а также с фреймворками для оценки (Ragas, DeepEval).

Уверенное знание Python + FastAPI, опыт с асинхронностью и потоковой передачей данных.

Администрирование векторных БД (Qdrant, Milvus) и обычных (Postgres + pgvector, Redis Stack).

Развёртывание в Kubernetes (Helm, Kustomize), опыт с GPU-воркерами (NVIDIA Triton, vLLM).

Навыки написания автотестов для LLM (метрики precision/recall по эталонным наборам).

Будет плюсом:

Опыт работы с мультимодальными моделями (LLaVA, GPT-4V, CLIP).

Понимание техник долговременной памяти для агентов (MemGPT, векторные хранилища с временными метками).

Публикации на arXiv или участие в open-source LLM-проектах.

Опыт руководства парой младших разработчиков (code review, архитектурные сессии).

 

Открытые вакансии компании