К содержимому

ML/LLM Engineer

Формат
Удалённо
Занятость
Частичная
Категория
Программист
Источник
💻☕️ Jobs_IT

Контакт HR — бесплатно после входа

Войдите через Telegram — покажем, кому писать напрямую. Без резюме и анкет.

Описание

#vacancy #job #MLEngineer #LLMEngineer
ML/LLM Engineer – Сооснователь стартапа (за долю в проекте без оклада на старте)

Мы создаем собственную AI-платформу, которая позволяет компаниям создавать AI-агентов и веб-приложения.
Наша платформа это low-code + AI-coding + собственная децентрализованная GPU-сеть в одном продукте. Компании получают всё необходимое для разработки и запуска AI-агентов.

Где мы находимся
Команда сформирована, архитектура продукта проработана.
Low-code платформа готова примерно на 90%, на ней уже реализованы пилотные и коммерческие проекты.
Сейчас нам необходимы доработки по AI-coding.
Мы ищем ML/LLM инженера, который будет отвечать за архитектуру AI-инфраструктуры платформы и будет играть важную роль в развитии всего проектоа.

Чем предстоит заниматься
– Развёртывание и эксплуатация LLM на распределённых серверах
– Участие в построении децентрализованных пулов вычислений
– Интеграция LLM-слоя с low-code платформой
– Оптимизация производительности и стоимости инференса
– Мониторинг, логирование, алертинг, отказоустойчивость

Что важно в кандидате
– Опыт эксплуатации ML/LLM-сервисов в production (инференс важнее обучения)
– Уверенный Linux, понимание GPU-стека (NVIDIA drivers, CUDA)
– Docker, Python
– Понимание производительности инференса: батчинг, параллелизм, очереди, backpressure
– Мониторинг (Prometheus / Grafana или аналоги)
– Понимание RAG и инфраструктуры векторного поиска
Плюсом будет опыт с LLM-инференс-движками и оптимизациями (квантование, KV-cache, speculative decoding), а также работа с on-prem или закрытыми инфраструктурными контурами.

Условия
Мы развиваем собственный технологический проект, поэтому на текущем этапе работа без оклада. Зарплата появится после запуска платформы и появления первых клиентов.
Взамен предлагаем долю в проекте – на уровне сооснователя.
Занятость: 15–20 часов в неделю, полностью удалённо. Формат совместим с основной работой.

Кому подойдёт
Тем, кто хочет строить технологический продукт, а не просто работать в найме.
Если вам интересна AI-инфраструктура, LLM-платформы и распределённые вычисления, и вы хотите, чтобы ваш технический вклад стал частью масштабируемого продукта, давайте поговорим более предметно.

По всем вопросам пишите контакт скрыт
  • ml
  • llm
  • ai
  • python
  • docker
  • linux
  • gpu
  • nvidia
  • cuda
  • prometheus
  • grafana
  • rag
  • vector_search
  • distributed_computing

Оценка вакансии

39/100 · минимум информации

  • Оценка описания недоступна
  • Зарплата не указана
  • Компания не названа
  • Контакт HR подтверждён
  • Стек описан подробно
  • Формат описан частично
Как считается

Похожие вакансии