source avatarDr.R

Поделиться

Сегодня Anthropic выпустила обновление Claude Fable 5.1 / Mythos 5.1 (одна и та же модель, разные уровни безопасности) — небольшое промежуточное обновление с умеренным улучшением производительности, но для нас ключевыми преимуществами стали повышение стабильности и снижение цен. Официальное обновление: 1. Наибольший рост в научных агентных возможностях Terminal-Bench-Science вырос с 24,7% у Fable 5 до 52,6% — почти вдвое, и значительно превосходит Opus 5 с 29,0%. 2. Кодирование и длительные задачи без присмотра Terminal-Bench 4.0 вырос с 42,0% до 55,8% (Mythos 5.1 — 60,9%), CursorBench 3.2.0 достиг 73,4%. Millennium использовал его для выявления сбоя с вероятностью один на миллион, который команда не могла обнаружить в течение четырех-пяти лет, и который упускали другие модели. 3. Цены снизились примерно на 25% Цена на чтение кэша (cache read) снизилась на 75% — до $0,25 за миллион токенов; общая стоимость типичной нагрузки снизилась примерно на 25%, а для интенсивных агентных сценариев — до 45%. Цена на ввод — $10, на вывод — $50 за миллион токенов осталась неизменной. 4. Достаточно низких усилий При настройке Low/Medium результаты уже близки или превосходят Fable 5, но при значительно более низкой стоимости — для чувствительных к цене сценариев можно напрямую перейти на более низкий уровень. 5. Значительное снижение ложных срабатываний защитных механизмов Количество блокировок сетевой безопасности в Claude Code снизилось в среднем на 60%. Теперь можно использовать его для выявления уязвимостей (по-прежнему запрещено писать эксплойты, проводить пентесты или сканировать бинарные файлы — эти задачи передаются Opus). Ложные срабатывания на безопасные биологические вопросы (базовая биология, медицинские запросы) снизились на 85%. 6. Решение для хранения корпоративных данных Новая система Enterprise Frontier Safeguards (EFS) хранит данные на облачных серверах клиента, а не у Anthropic — что эквивалентно нулевому хранению данных. Постепенный запуск запланирован на осень; до этого клиенты, соответствующие критериям, могут использовать систему с нулевым хранением данных. 7. Лучшая согласованность по сравнению с предыдущим поколением Меньше попыток выходить за пределы тестовой среды для получения ресурсов, меньше использования оправданий вроде «это симуляция/тест», снижение попыток и успешности reward hacking. Это наиболее устойчивая к prompt injection модель на данный момент. Дополнительно важно знать: Новые API-аккаунты больше не позволяют вручную редактировать историю мыслей Claude в многократных диалогах (для предотвращения дистилляции), а выводы будут содержать невидимые водяные знаки по требованиям EU AI Act — они не влияют на качество контента и не содержат никакой информации о пользователе.

Отказ от ответственности: Информация на этой странице может быть получена от третьих лиц и не обязательно отражает взгляды или мнения KuCoin. Данный контент предоставляется исключительно в общих информационных целях, без каких-либо заверений или гарантий, а также не может быть истолкован как финансовый или инвестиционный совет. KuCoin не несет ответственности за ошибки или упущения, а также за любые результаты, полученные в результате использования этой информации. Инвестиции в цифровые активы могут быть рискованными. Пожалуйста, тщательно оценивайте риски, связанные с продуктом, и свою устойчивость к риску, исходя из собственных финансовых обстоятельств. Для получения более подробной информации, пожалуйста, ознакомьтесь с нашими Условиями использования и Уведомлением о риске.