fokcus

Computer Vision Research Engineer / Computer Vision Engineer

Виктори-Технолоджи · Астана · офис · полная

Свежая вакансия Появилась 17 дн назад

Разработка и внедрение ML-моделей для анализа видео и аудио, детекция и классификация эмоций и психофизиологических состояний по мимике, жестам, голосу. Построение пайплайнов обработки данных, извлечение признаков, разработка моделей на базе CNN, RNN, Transformer, Audio/Video Fusion, LLM/RAG. Валидация моделей, эксперименты с Vision и Audio Transformers, Bi-LSTM, GRU. Исследование интерпретируемости моделей, проведение code review, оптимизация архитектуры, поддержка в production, разработка API для интеграции результатов.

Требования: опыт от 3 лет в ML/CV/NLP/RAG, глубокие знания Computer Vision, аудиообработки, мультимодальных данных. Опыт с PyTorch, TensorFlow, CNN, RNN, Transformer, Vision/Audio Transformers, multimodal fusion, RAG-архитектурами, LLM, API-интеграцией, ML-пайплайнами, MLOps, Docker.

Условия: полная занятость, оформление в штат, испытательный срок 3 месяца, график 5/2 с 09:00 до 18:00, работа в офисе в Астане, проекты в LegalTech и цифровизации.

Навыки

Показать как в источнике
#jobs #Офис

📍 Формат/working arrangement: на месте работодателя, полная занятость
✔️ Должность/position: Computer Vision Research Engineer / Computer Vision Engineer
🏢 Место работы/workplace: Виктори-Технолоджи
💸 Заработная плата/salary estimate: от 800 000 ₸ в месяц на руки

📈 Обязанности/responsibilities:
— Разработка и внедрение ML-моделей для анализа видео- и аудиоданных
— Детекция и классификация эмоций и психофизиологических состояний на основе мимики, микродвижений, жестов, тембра голоса и интонации
— Построение пайплайнов предварительной обработки видео и аудио, извлечение признаков: landmarks, аудио-эмбеддинги, спектрограммы
— Разработка моделей с использованием CNN, RNN, Transformer, Audio/Video Fusion, LLM/RAG-архитектур
— Разработка методик валидации моделей, включая синхронизацию аудио и видео, cross-validation и оценку метрик
— Эксперименты с Vision Transformers, Audio Transformers, Bi-LSTM и GRU
— Исследование методов интерпретируемости и объяснимости моделей для юридически значимых выводов
— Проведение code review существующих ML-моделей и оценка качества реализации
— Оптимизация и изменение архитектуры моделей для повышения точности, стабильности и производительности
— Поддержка моделей в production-среде, мониторинг результатов и устранение ошибок
— Разработка API для передачи интерпретированных результатов ML-моделей в действующие системы

📌 Требования/requirements:
— Опыт работы от 3 лет в ML/CV/NLP/RAG, желательно с проектами анализа видео и аудио
— Глубокое понимание Computer Vision, обработки аудио и мультимодальных данных
— Опыт работы с PyTorch и TensorFlow
— Опыт разработки и внедрения CNN, RNN, Transformer, Vision/Audio Transformers и multimodal fusion
— Практические знания подготовки данных, аугментации и извлечения признаков
— Опыт работы с RAG-архитектурами или LLM для интерпретации результатов ML-моделей
— Опыт интеграции ML-моделей через API с внешними системами
— Опыт работы с ML-пайплайнами, MLOps и Docker

Ключевые навыки:
— Computer Vision
— Machine Learning
— Deep Learning
— PyTorch
— TensorFlow
— CNN
— RNN
— Transformer
— Vision Transformer
— Audio Transformer
— Multimodal Fusion
— RAG
— LLM
— NLP
— MLOps
— Docker
— API
— Explainable AI

✅ Условия/working conditions:
— Полная занятость
— Оформление в штат
— Испытательный срок — 3 месяца
— График 5/2
— Рабочие часы: 09:00–18:00
— Работа в офисе
— Проекты в области LegalTech и цифровизации
— Живые задачи, быстрые решения и пространство для инициативы

📍 Адрес/work location:
Астана, улица Жошы хана, 27

📢❗️🚨 Контакты для связи/Contact information: https://hh.kz/vacancy/136087076?query=AI%2FML+Engineer&hhtmFrom=vacancy_search_list

Похожие вакансии