Fireworks сократила расход токенов Kimi K3 на 40%
Fireworks выпустила Ember-1 — оптимизированную версию модели Kimi K3, которая расходует на 40% меньше токенов при сопоставимом качестве ответов. Модель переучили сокращать лишние рассуждения и повторения. В тестах на реальных задачах двух клиентов Ember-1 сократила расход токенов примерно на треть, и один клиент уже перешёл на неё.
Цена за токен осталась на уровне Kimi K3 — экономия достигается за счёт их меньшего количества. Модель доступна через API Fireworks как исследовательский релиз на две недели.
Источник: GPT/ChatGPT/AI Central Александра Горного
Новости этого рынка выходят у нас в телеграме первыми — @adposium_ai.