Sonnet 5 может стоить на 30% дороже Sonnet 4.6

Sonnet 5 может стоить на 30% дороже Sonnet 4.6

Причина в новом методе разбиения текста на токены. Из-за него модель может тратить на один и тот же текст до 30% больше токенов по сравнению с прошлой версией. В Anthropic говорят, что новая система улучшает качество ответов.

Сейчас Sonnet 5 временно дешевле Sonnet 4.6, но из-за токенизатора реальная экономия может быть не 33%, а около 13%. После 1 сентября 2026 номинальный прайс сравняется с 4.6, и тогда Sonnet 5 может оказаться на 30% дороже на одинаковых промптах.

https://platform.claude.com/docs/en/about-claude/pricing

Авторский взгляд на новости технологий Реклама: https://docs.google.com/presentation/d/1glQMXYyKAYpzNP8VXzM4gl2YkEgLjkeD_Fxvzbu5QUE/edit РКН: https://clck.ru/3FPkup Личный аккаунт: @gornal О рекламе: @Vzuhcha ВП нет

💬Discussion (12)

Тимофей Инишев@inishev
Попробовал, намного больше она надумывает, опус намного шустрее и «компактнее» по рассуждениям, отчего лимиты кушает медленнее. Обе на максимальном эффорте гонял
Fun Craft@funsett
Хорошо, что более высокая версия означает то же качество или хуже 👍
Проще ориентироваться 😉
Илья К@iliakozha
Та же история что с flash 3.5 - думает больше и выходит дороже pro 3.1…
Саша Зеленков@sasha_zelenkov
Соннет - тупой. Как был, так и остался.
Ilya Partin GMT+2@ilyapar
Я вообще не понимаю для каких задач нужен Соннет… Если у тебя задача более простая, это не значит, что более простая версия с ней справится. Она может справиться по форме, но по содержанию придется потом перепроверять и в результате можно больше токенов потратить, чем если сразу Опус использовать. Кто-нибудь здесь использует Соннет осознанно? Просто интересно.
James Kvakiani@i80486dx
Я. С ним хорошо рефлексировать, развивать мысли и идеи, продумывать планы, разбирать варианты. Здесь только вопрос в подходе. И иногда обширный диалог (меншьше токенов) более полезен чем "быстро что то сделать".
Ilya Partin GMT+2@ilyapar
А если это делать с опусом 4.6, то чем будет хуже?
James Kvakiani@i80486dx
Ничем совершенно. Просто глубина нужна не всегда и не везде, или она нужна разная :)
Ilya Partin GMT+2@ilyapar
Тогда перефразирую вопрос. Если есть выбор - порефлексировать с умным человеком час или с глупым два, что выберете?)
James Kvakiani@i80486dx
"умный" и "глупый" это субъективно и относительно. И иногда вывод об этом делается скорее на основе оправдания своих ожиданий, так как нет метрик "умный" и "глупый" для LLM.
Zinkovska Oksana@zinkoxide
Как это нет? Если едет на автомойку с перевернутой чашкой, то умный. Если пешком идёт, не снимая свитер, то глупый. 😄
James Kvakiani@i80486dx
это же не про "умный/глупый", а про то, что чашку на автомойку и разгадывание квантовой гравитации нельзя мерить одной шкалой 😄 Модель, которая идеально решает узкую задачу за копейки токенов, не "глупее" той, что тащит любой контекст - она просто заточена под другое.
Join discussion on TelegramComments are synced from Telegram

Связанные темы

Читать далее