Перейти к основному содержимому
Версия: 6.1

AI Observability: Расходы LLM

Дашборд AI Observability: Расходы LLM предназначен для контроля потребления и стоимости LLM-запросов.
Он помогает понять, сколько токенов и ресурсов потребляется, какие модели и провайдеры наиболее дорогостоящие, и выявить аномальный рост расходов.

Кому полезен: инженеру эксплуатации, менеджеру AI-команды, финансовому аналитику.

Источник данных: gen_ai_cost*


Основные разделы

1. Провайдеры и модели

Показывает сводную таблицу по LLM-провайдерам и моделям, которые использовались за выбранный период:

  • количество запросов по моделям
  • средняя длительность выполнения запросов
  • стоимость использования моделей
  • сравнение затрат между провайдерами и моделями

Провайдеры и модели

2. Сводка токенов и стоимости

Показывает ключевые показатели потребления LLM и динамику расходов во времени:

  • общий расход токенов
  • входные и выходные токены
  • стоимость 1M токенов
  • общая стоимость использования моделей
  • динамика токенов, запросов и стоимости по времени

Сводка токенов и стоимости

3. Распределение расходов

Показывает, какие модели и пользователи формируют основной расход токенов и стоимости:

  • расход токенов и стоимость по моделям
  • расход токенов и стоимость по пользователям
  • сравнение моделей по объему потребления и затратам
  • выявление наиболее затратных моделей и пользователей

Распределение расходов

4. Самые дорогие запросы

Показывает LLM-запросы с наибольшей стоимостью за выбранный период:

  • время выполнения запроса
  • идентификатор запроса и пользователь
  • провайдер и модель
  • входные, выходные и суммарные токены
  • длительность и стоимость запроса

Самые дорогие запросы