Вступить в клуб →
← К вакансиям
BrainShells88/100

ML Researcher / Research Scientist (Probabilistic Modeling & Decision Making)

от 7 000 USD
Опубликовано: 1 октября 2026
seniorremoteML / Data Sciencefulltimerupythonpytorchreinforcement learningpomdpbayesian mlprobabilistic modelsmulti-agent systemsuncertainty estimationmonte carlooff-policy evaluationworld modelsresearch
🔒 Контакты и отклик открываются после вступления в клубВступить →
Исследовательская роль уровня Senior/Staff в BrainShells: моделирование поведения агентов в стохастической многоагентной среде с частичной наблюдаемостью и десятками миллионов эпизодов, применение прогнозов для принятия решений при ограниченном inference budget. Нужен сильный математический бэкграунд и опыт собственных R&D-разработок в probabilistic ML, RL/sequential decision making, Bayesian-методах, opponent modeling или off-policy evaluation. Формат remote, контракт от 3 месяцев, стек Python/PyTorch.
ML Researcher / Research Scientist — Probabilistic Modeling & Decision Making Компания: BrainShells Вилка: от 7000$ Ищем сильного ML Researcher уровня Senior / Staff для сложной исследовательской задачи на стыке probabilistic ML, sequential decision making и моделирования поведения агентов. Это не классическая вакансия Data Scientist с задачами на табличные данные. Нужен человек, который самостоятельно разрабатывал или существенно улучшал ML/математические методы, умеет работать с неопределённостью и может экспериментально доказать, почему новый подход лучше сильного baseline. Задача: есть стохастическая многоагентная среда с частичной наблюдаемостью и десятки миллионов исторических эпизодов. Необходимо моделировать поведение участников и использовать эти прогнозы для принятия решений в условиях неопределённости и ограниченного inference budget. Особенно интересен опыт в одном или нескольких направлениях: — RL / sequential decision making / POMDP / world models; — probabilistic & Bayesian ML, latent-variable models, uncertainty estimation; — behavior / opponent modeling, multi-agent systems; — off-policy evaluation, importance sampling, doubly robust estimation, variance reduction; — Monte Carlo / Markov models / stochastic optimization; — algorithmic trading / HFT / pricing / decision systems с реальными ограничениями на latency. Кого особенно хотим увидеть: исследователей с сильной математической базой, опытом собственных R&D-разработок и публикациями либо сильным applied research опытом. PhD будет плюсом, но не является обязательным. Важнее возможность разобрать свой проект в формате: проблема → baseline → ваша идея → альтернативы → эксперимент → измеримый результат. Стек для прототипирования: Python / PyTorch. Данные и вычислительная инфраструктура есть, задача предполагает много экспериментов и достаточно высокую исследовательскую свободу. Формат: remote, контракт от 3 месяцев. Приоритетно рассматриваем full-time, но для сильного кандидата готовы обсуждать part-time Если ваш опыт близок — присылайте CV + 2–3 предложения про наиболее релевантный research/ML-проект: что улучшали, какой был baseline, что сделали лично и каким результатом доказали эффект. Контакт: @••••••

Похожие вакансии

Все вакансии →
Toloka AIНидерланды / Сербияremotefulltimesenior40

Senior ML Researcher

Toloka AI ищет Senior ML Researcher для работы над решениями end-to-end разметки данных на основе краудсорсинга, экспертов и ML. Возможна удалённая работа или гибрид (Нидерланды, Сербия); подробности в посте на LinkedIn.

machine learningresearchpythonpytorchnlpllm+2
16 сентября 2026
Москваhybridfulltimemiddle70

Middle / Senior Quantitative Researcher

Ищем Middle/Senior Quantitative Researcher для разработки торговых стратегий на reinforcement learning. Кандидат должен закрывать полный цикл ресерча, от идеи до запуска в прод. Условия: гибрид в Москве, фикс в USDT/USDC и квартальный profit sharing.

pythonpytorchscikit-learncatboostxgboostoptuna+4
12 августа 2026
СберРоссияremotefulltimelead70

MLE Руководитель направления RL Efficiency (Lead)

Развивать направление RL Efficiency целиком, определять критичные узкие места и критерии прогресса, вести направление от гипотез до внедрения результатов в цикл обучения.

cudaembedded softwarehardwarekubernetesllmopen source+6
1 июля 2026650 000–850 000 RUB
FastForwardМоскваhybridfulltime70

DL Researcher

Ищем молодого и сильного DL Researcher в Quant-команду. Разработка deep learning моделей для высокочастотной торговли.

deep learningpythonpytorchc++cudaprobability+5
15 июня 2026