Opus 5.5 сделал чтение из кэша на 60% дешевле. Я пересчитал архитектуру своего Text-to-SQL

Выпуск Claude Opus 5.5 существенно изменил анализ затрат и выгод для приложений Text-to-SQL. Благодаря тому, что чтение из кэша стало на 60% дешевле, ценовой разрыв между извлечением подмножеств схемы и отправкой всей схемы в виде кэшированного префикса сократился с 2.1x до 1.2x. Для разработчиков, таких как автор CRM-ассистента «Aria», это означает, что архитектурные решения должны отдавать приоритет точности, а не методам экономии затрат. Кроме того, миграция на Opus 5.5 вводит критические изменения, такие как отказ от принудительного использования инструментов и более строгие требования к формату диалогов. Эти обновления, в сочетании с новой ценовой политикой, стимулируют переход к статическим кэшированным системным промптам. Автор планирует провести бенчмаркинг, сравнив точность и производительность традиционного RAG-поиска по схеме с подходом на основе полного кэшированного контекста, чтобы определить наиболее эффективный путь для генерации SQL.
This is a summary. Read the full article at the original source:
Dev.toПохожие
Claude Opus 5.5 теперь в Google Cloud, и я считаю, что это важное событие для разработчиков
Компания Anthropic выпустила Claude Opus 5.5, который теперь доступен в Google Cloud, AWS и Azure. Новая модель предлагает значительные улучшения прои…
Я заставил своего агента подтверждать каждую цитату исходным документом
Разработчик Chanadev представил TSB Oracle, ИИ-агента, предназначенного для повышения точности поиска информации о сервисных бюллетенях автомобилей. Р…
Jev — это отличный классификатор в обертке передовой модели
Недавно выпущенный ИИ-инструмент Jev позиционируется как революционная передовая модель, однако технический анализ показывает, что это прежде всего вы…



