Старший бэкенд-разработчик в команду Quality
1 мес. назад
RussiaSeniorRemote
pythongoragllma/b testing
Старший бэкенд-разработчик в команду Quality, работающий над созданием платформы для AI-агентов и разработкой инструментов наблюдаемости и оценки качества на базе GenAI.
Обязанности
- построить единую платформу для работы AI-агентов в рамках кластера — от концепции до внедрения
- построить единую платформу для работы AI-агентов в рамках кластера — от концепции до внедрения
- построить единую платформу для работы AI-агентов в рамках кластера — от концепции до внедрения
- построить единую платформу для работы AI-агентов в рамках кластера — от концепции до внедрения
- разработать инструменты наблюдаемости, оценки качества и проводить исследования, чтобы понимать, какие подходы, фреймворки и технологии работают в реальных сценариях
- разработать инструменты наблюдаемости, оценки качества и проводить исследования, чтобы понимать, какие подходы, фреймворки и технологии работают в реальных сценариях
- разработать инструменты наблюдаемости, оценки качества и проводить исследования, чтобы понимать, какие подходы, фреймворки и технологии работают в реальных сценариях
- разработать инструменты наблюдаемости, оценки качества и проводить исследования, чтобы понимать, какие подходы, фреймворки и технологии работают в реальных сценариях
- внедрять архитектурные решения для ключевых инициатив в области GenAI, обеспечивая масштабируемость, надёжность и эффективность
- внедрять архитектурные решения для ключевых инициатив в области GenAI, обеспечивая масштабируемость, надёжность и эффективность
- внедрять архитектурные решения для ключевых инициатив в области GenAI, обеспечивая масштабируемость, надёжность и эффективность
- внедрять архитектурные решения для ключевых инициатив в области GenAI, обеспечивая масштабируемость, надёжность и эффективность
Требования
- обладаете опытом разработки на Python/Go
- обладаете опытом разработки на Python/Go
- обладаете опытом разработки на Python/Go
- обладаете опытом разработки на Python/Go
- глубоко понимаете ограничения LLM: контекстные окна, галлюцинации, задержки и стоимость — и умеете проектировать решения с учётом этих факторов
- глубоко понимаете ограничения LLM: контекстные окна, галлюцинации, задержки и стоимость — и умеете проектировать решения с учётом этих факторов
- глубоко понимаете ограничения LLM: контекстные окна, галлюцинации, задержки и стоимость — и умеете проектировать решения с учётом этих факторов
- глубоко понимаете ограничения LLM: контекстные окна, галлюцинации, задержки и стоимость — и умеете проектировать решения с учётом этих факторов
- имеете опыт построения RAG-пайплайнов на realtime данных
- имеете опыт построения RAG-пайплайнов на realtime данных
- имеете опыт построения RAG-пайплайнов на realtime данных
- имеете опыт построения RAG-пайплайнов на realtime данных
- разбираетесь в архитектурных выборах: когда использовать harness, а когда — framework (Claude Code, Dify, n8n и др.), и как правильно подбирать модель под задачу
- разбираетесь в архитектурных выборах: когда использовать harness, а когда — framework (Claude Code, Dify, n8n и др.), и как правильно подбирать модель под задачу
- разбираетесь в архитектурных выборах: когда использовать harness, а когда — framework (Claude Code, Dify, n8n и др.), и как правильно подбирать модель под задачу
- разбираетесь в архитектурных выборах: когда использовать harness, а когда — framework (Claude Code, Dify, n8n и др.), и как правильно подбирать модель под задачу
- умеете считать token economics: оптимизировать маршрутизацию моделей, кешировать промпты, оценивать ROI on-prem решений
- умеете считать token economics: оптимизировать маршрутизацию моделей, кешировать промпты, оценивать ROI on-prem решений
- умеете считать token economics: оптимизировать маршрутизацию моделей, кешировать промпты, оценивать ROI on-prem решений
- умеете считать token economics: оптимизировать маршрутизацию моделей, кешировать промпты, оценивать ROI on-prem решений
- проводите бенчмаркинг AI-агентов с помощью precision/recall, LLM-as-judge и A/B-тестов на production-данных
- проводите бенчмаркинг AI-агентов с помощью precision/recall, LLM-as-judge и A/B-тестов на production-данных
- проводите бенчмаркинг AI-агентов с помощью precision/recall, LLM-as-judge и A/B-тестов на production-данных
- проводите бенчмаркинг AI-агентов с помощью precision/recall, LLM-as-judge и A/B-тестов на production-данных
- автономно ведёте квартальные проекты «под ключ» — от постановки цели до сдачи результата
- автономно ведёте квартальные проекты «под ключ» — от постановки цели до сдачи результата
- автономно ведёте квартальные проекты «под ключ» — от постановки цели до сдачи результата
- автономно ведёте квартальные проекты «под ключ» — от постановки цели до сдачи результата