Компания не указана
Senior Kernel Generation Engineer
2 нед. назад
SeniorRemote
llm inferenceattentionkv-cacheprefilldecodecompute pipelinesmemory hierarchydata movement
Сильного инженера на стыке AI и hardware, отвечающего за оптимизацию и генерацию вычислительных ядер для LLM inference.
Требования
- Сильного инженера на стыке AI и hardware, который понимает, как устроен LLM inference на математическом и архитектурном уровне.
- LLM inference, attention, KV-cache, prefill/decode.
- Compute pipelines, memory hierarchy и data movement.
- Оптимизация kernels: tiling, fusion, buffering, scheduling.
- Большим плюсом будет опыт с FPGA / GPU / CUDA / Triton / TVM / MLIR / XLA и другими accelerator architectures.
Условия
- Локация: удалённо из любой точки мира.