Middle ML Engineer в Verigram
📍 Verigram, Алматы
🏢 Формат работы: оффлайн
Также рассматриваем кандидатов на позиции: intern / junior / junior+.
📩 Резюме отправлять в лс: @meruyert1111
Verigram — международная AI-компания в сфере цифровой идентификации и antifraud-решений. Нашими продуктами пользуются банки, финтех-компании и онлайн-платформы для удаленной идентификации пользователей и предотвращения мошенничества.
Ищем ML Engineer, который сможет доводить модели от research до production и масштабирования. Подойдет тем, кому интересно строить LLM-системы, computer vision пайплайны и высоконагруженные AI-сервисы для тысяч пользователей.
🔹 Чем занимаемся:
• Face biometrics и liveness detection
• Document verification / KYC / AML
• Real-time video analytics
• LLM assistants и RAG systems
• High-load ML services
💻 Задачи:
LLM / Generative AI:
• Fine-tuning open-source LLMs (LoRA / PEFT)
• Разработка и масштабирование RAG-систем
• Embeddings и vector search pipelines
• AI-ассистенты и внутренние AI-инструменты
• Prompt engineering и evaluation pipelines
• A/B testing и эксперименты с LLM
• Оптимизация inference (latency / throughput / GPU)
Data & ML Pipelines:
• Построение ETL/ELT пайплайнов для ML
• Data validation и versioning датасетов
• Автоматизация обучения и переобучения моделей
• Experiment tracking и quality metrics
ML Infrastructure & Production:
• Разработка ML-сервисов на FastAPI
• Контейнеризация и деплой моделей
• Оптимизация GPU inference
• Batch и real-time inference pipelines
Мониторинг моделей:
• data/model drift
• деградация качества
• latency и reliability
Engineering culture:
• Участие в архитектурных решениях
• Code review и документация
• Развитие ML engineering best practices
🛠 Tech stack:
Python • PyTorch • FastAPI • PostgreSQL • Redis • Kafka • Docker
LangChain • LangGraph • RAG • Vector Search • GPU inference
✅ Требования:
Must-have:
• 2–4 года опыта в ML / DL / NLP
• Опыт вывода ML-моделей в production
• Сильный Python (backend + ML)
• Практический опыт с PyTorch
• Понимание полного ML lifecycle
Будет плюсом:
• Опыт с LLM / RAG / embeddings
• Оптимизация inference
• Опыт разработки high-load сервисов
🎁 Что предлагаем:
• Реальные production ML и LLM проекты
• Доступ к GPU-инфраструктуре
• Влияние на архитектуру AI-продуктов
• Конкурентную зарплату
• Сильную инженерную культуру и минимум бюрократии
Присоединяйтесь к команде, которая строит AI-продукты для реального мира.
8
3
1
1May 20, 2026 2.1K 47