Оптимизация промптов: как я сократила расход токенов на 50% и убрала вежливость из запросов к ChatGPT
Анна, ведущий инженер по тестированию в Рексофт, два года работает с большими языковыми моделями: интегрирует их в CI/CD, использует для генерации тестов и анализа логов. Она столкнулась с жёстким ограничением: недельный лимит на проекте — всего 10 000 токенов, а один вежливый запрос с «пожалуйста» съедал около 500 токенов на входе и ещё пару тысяч на выходе.
Чтобы уложиться в бюджет, пришлось пересмотреть подход к формулировке промптов. Оказалось, что русский язык обходится примерно в полтора раза дороже английского из-за особенностей токенизации. Анна рассказывает, как устроена механика токенов и как строить запросы, чтобы получать точные ответы за минимальные деньги.
Главный результат — экономия 50% бюджета без потери качества. Статья будет полезна всем, кто работает с платными API языковых моделей и хочет сократить расходы.