[{"data":1,"prerenderedAt":10},["ShallowReactive",2],{"$fDoFg9Icn72OfhDwfx6RrSRsy2udvv8d94WrcquxcVgU":3},{"id":4,"slug":5,"title":6,"text":7,"image":8,"publishedAt":9},"4d048bc9-0a4e-49aa-9272-89565e0a81aa","dlinnye-chaty-stali-zametno-deshevle-vklyuchili-effektivnoe-keshirovanie-zaprosov","Длинные чаты стали заметно дешевле: включили эффективное кэширование запросов","Мы настроили prompt caching для диалогов в GPT-Chat. Теперь при работе с длинной историей чата повторяющийся контекст не пересчитывается каждый раз «с нуля» — модели переиспользуют уже обработанный префикс разговора.\r\n\r\nДля вас это значит проще и выгоднее: чем длиннее диалог, тем сильнее экономия на входных токенах. Особенно заметно это в многоходовых беседах, при работе с документами, коде и больших инструкциях — там, где история сообщений занимает основную часть запроса.\r\n\r\nКэширование работает автоматически на поддерживаемых моделях. Вам ничего дополнительно включать не нужно: просто продолжайте общение в чате как обычно — и платите меньше за повторное использование контекста.\r\n\r\nМы продолжаем оптимизировать стоимость и скорость ответов, чтобы GPT-Chat оставался удобным и выгодным инструментом для повседневных задач.","cache-illustration.png","2026-07-27T17:36:55+03:00",1785528600037]