Architect Financial Technologies har lanserat Liquid Inference, en LLM-router som håller en liveauktion för varje förfrågan. Leverantörer lämnar bud på att hantera varje prompt, och köparen betalar det lägsta bud som uppfyller kraven. Utvecklare behöver bara ändra basadressen i koden för att använda tjänsten.
Varför det spelar roll
Utvecklare kan potentiellt sänka inferenskostnaderna genom att automatiskt välja den billigaste leverantör som uppfyller deras kriterier.