Показать сообщение отдельно

  #2  
Старый 06.07.2026, 19:40
ArdeOS
Участник форума
Регистрация: 16.07.2004
Сообщений: 215
С нами: 11482946

Репутация: 211
По умолчанию

Самое простое — ставить чёткий лимит по расходам и реально стричь длинные запросы с ответами. Кэширование реально спасает, если запросы похожи. И не всегда нужна самая навороченная модель, часто GPT-3.5 выручает без ущерба. Если за этим не следить — счёт растёт на глазах.
 
Ответить с цитированием