Launch HN: Tokenless (YC S26) – Automatic model switching to save money
9 hours ago
- Tokenless通过将请求路由至最合适的模型并取消不必要的请求,将推理成本降低一半。
- 该服务在显著降低每项任务成本的同时,保持了与顶尖模型(如Opus 4.8)相当的输出质量。
- 它提供与OpenAI/Anthropic API的无缝兼容,并提供PRO、GPT 5.5、Opus 4.8和MAX等模型选项,实现不同质量与节省成本的平衡。
- 基准数据显示,PRO模式以每项任务0.32美元的价格完成72%的任务量,相较于GPT 5.5节省高达57%的成本。
- MAX模式通过将任务路由至最佳可用模型来优先保证最高质量。
- 该平台由来自顶尖机构的AI研究人员构建,并得到Y Combinator的支持。