B2B
StartupOneTriangle
OneTriangle optimizes multi-model inference by transferring KV cache between models, cutting redundant prefill cost.
Milestones
Milestone
YC Summer 20268 upvotes
OneTriangle - The fastest, cheapest inference, powered by KV cache transfer
Lightweight novel inference