a16z portfolio
Inferact
From the creators and core maintainers of vLLM, the open-source LLM inference engine. Growing vLLM to make inference cheaper and faster, so serving a frontier model doesn't take its own infra team.
20 open roles
Member of Technical Staff, Cloud Orchestration (Remote)
Member of Technical Staff, Cluster Administration
Member of Technical Staff, Site Reliability Engineer
Founding Product Designer
Head of Engineering
Product Marketing Manager
Member of Technical Staff, AMD GPU Performance Engineering
Member of Technical Staff, TPU Performance Engineering
Member of Technical Staff, AMD GPU Performance Engineering
Member of Technical Staff, Performance and Scale
Member of Technical Staff, Kernel Engineering
Member of Technical Staff, Inference
Member of Technical Staff, Cloud Orchestration
Member of Technical Staff, Inference
Member of Technical Staff, Developer Relations
Member of Technical Staff, TPU Performance Engineering
Member of Technical Staff, Exceptional Generalist (Remote)
Member of Technical Staff, Cloud Orchestration
Member of Technical Staff, Kernel Engineering
Member of Technical Staff, Performance and Scale