ИНСТРУМЕНТЫ / ПРОВЕРЬТЕ ЭКОНОМИКУ
Оцените память для модели и расходы на сервер или API. Начальные тарифы — условные примеры, замените их предложением своего провайдера.
Размер весов = число параметров × бит на параметр ÷ 8. В калькуляторе 1 ГиБ = 2³⁰ байт. Требуемая память = веса × (1 + запас / 100) + заданный объём KV-кеша. Нижняя оценка числа GPU — округление требуемой памяти вверх к памяти одной GPU.
Для MoE указывайте все параметры, а не только активные. Расчёт не определяет совместимость модели, допустимую схему параллелизма или скорость. KV-кеш зависит от архитектуры, контекста и числа одновременных запросов; здесь его размер задаётся вручную. Для обучения этот расчёт не подходит.
Аренда = GPU в выбранной конфигурации × тариф × часы + остальные расходы. Если провайдер дал цену за весь узел, разделите её на число GPU или задайте одну единицу аренды. Хранилище, CPU/RAM, сеть и налоги добавьте в прочие расходы, если они не входят в тариф.
Запросы за период = запросы в день × дни. Расход = запросы × (входные токены × входной тариф + выходные токены × выходной тариф) ÷ 1 000 000 + прочие расходы.
Это базовый расчёт текстовых запросов. Кеширование, пакетные скидки, изображения, аудио, платные инструменты и повторные запросы учитывайте отдельно. Скрытые reasoning-токены могут входить в оплачиваемый выход: проверьте правила своей модели. Подписка на чат и API могут оплачиваться отдельно.
Расчёт выполняется в вашем браузере. События аналитики передаются без значений полей; поля и результаты исключены из записи Вебвизора.
Экосистема проектов TeleCobra