Anthropic выпустила Claude Sonnet 5.5 — она быстрее Sonnet 5 на 30% при той же цене API

Anthropic представила Claude Sonnet 5.5, вторую модель семейства Claude 5.5 после флагманской Opus 5.5. По ряду сложных тестов новинка вплотную подошла к Opus 5.5, а в Terminal-Bench 4.0 набрала 70,6% против 10,3% у Sonnet 5. Цена токенов осталась прежней: $2 ≈ 6,01 BYN за миллион входных и $10 ≈ 30,05 BYN за миллион выходных.
Anthropic представила Claude Sonnet 5.5 — вторую модель семейства Claude 5.5 после флагманской Opus 5.5. Компания описывает новинку как быструю и недорогую модель для повседневных задач с чётко поставленной целью: правки в коде, работа с документами, презентациями и таблицами. На части сложных тестов Sonnet 5.5 уже почти не уступает Opus 5.5.
Программирование и работа с компьютером
Самый резкий рост — в программировании. В тесте Terminal-Bench 4.0, где модель должна выполнять многоэтапные задачи через командную строку, Sonnet 5.5 набрала 70,6%, тогда как Sonnet 5 — 10,3%. У Opus 5.5 на максимальном уровне усилий результат 66,4%. В CursorBench 4.0 Sonnet 5.5 получила 55,5%, Opus 5.5 — 57,8%.
В работе с компьютером разрыв ещё меньше: в OSWorld 2.1 у Sonnet 5.5 80,1% против 81,8% у Opus 5.5 и 57% у Sonnet 5. В GDPval-AA v2.1, который имитирует реальные профессиональные задачи в 44 профессиях, модели набрали 1844 и 1846 баллов соответственно. Anthropic отдельно оговаривает: результат Sonnet 5.5 в GDPval-AA получен на предварительной версии модели с ошибкой в работе со структурированным выводом, и компания ждёт, что исправление лишь немного поднимет показатель.
Отдельный практический тест — прохождение Pokémon Red: Sonnet 5.5 стала первой моделью линейки Sonnet, которая справилась с игрой, ориентируясь только по скриншотам. В Anthropic этот результат приводят как пример работы с длинными последовательностями действий и визуальной информацией.
Sonnet не заменяет Opus
Полностью заменить Opus 5.5 новинка не должна. Opus в Anthropic описывают как модель для сложной работы, требующей долгих рассуждений и самостоятельных решений, а Sonnet — как инструмент под хорошо определённые задачи. На максимальном уровне усилий результаты двух моделей в части тестов сопоставимы, но в открытых задачах с длительным самостоятельным суждением Opus 5.5 по-прежнему сильнее.
Sonnet 5.5 отвечает более чем на 30% быстрее Sonnet 5 и обычно тратит меньше токенов, поэтому в Anthropic оценивают снижение стоимости выполнения типичной задачи до 30%. Цена самих токенов не изменилась: $2 ≈ 6,01 BYN за миллион входных, $10 ≈ 30,05 BYN за миллион выходных, чтение из кэша — $0,20 за миллион токенов. Модель уже доступна в Claude, через API и на облачных платформах Amazon Web Services, Google Cloud и Microsoft Azure.
Пересчёт в белорусские рубли — по официальному курсу Национального банка на 04.10.2026: $1 = 3,0051 BYN.
iXBT · права на исходный материал принадлежат автору.
Материал носит информационный характер и не является индивидуальной инвестиционной рекомендацией. Операции с криптовалютами связаны с риском полной потери вложенных средств. Подробнее — «Отказ от ответственности».
Разборы событий, итоги дня и то, что двигает рынок. Без сигналов и обещаний — только факты и что они значат.
Читать в Telegram →По теме
- ▪OpenAI заявила о более 16 000 запросов с 4000 аккаунтов при попытке скопировать логику её моделейiXBT · 3 октября
- ▪Калифорния запретила увольнять сотрудников по решению ИИiXBT · 3 октября
- ▪OpenAI тратит более $500 000 в день на разбор заходов своих ИИ-агентов на госсайты АвстралииiXBT · 3 октября
- ▪Capcom расширит применение ИИ в движке RE Engine3DNews · 3 октября