source avatarDr.R

Поділитися

Сьогодні Anthropic анонсувала оновлення Claude Fable 5.1 / Mythos 5.1 (одна й та ж модель, різні рівні безпеки) — це проміжне, невелике оновлення з незначним підвищенням продуктивності, але для нас ключовим є підвищення стабільності та зниження цін. Офіційні оновлення: 1. Найбільший прогрес у наукових agentic здібностях Terminal-Bench-Science зросла з 24,7% у Fable 5 до 52,6% — майже подвоєння, і значно перевищує Opus 5 з 29,0%. 2. Кодування та довготривалі завдання без нагляду Terminal-Bench 4.0 зросла з 42,0% до 55,8% (Mythos 5.1 — 60,9%), CursorBench 3.2.0 досягла 73,4%. Millennium використав її для виявлення критичного сбою, який команда не могла знайти протягом чотирьох-п’яти років, а інші моделі його пропускали. 3. Ціни знизилися приблизно на 25% Ціна на читання кешу (cache read) знизилася на 75% — до $0,25 за мільйон токенів; загальні витрати на типове навантаження зменшилися приблизно на 25%, а для інтенсивних agentic сценаріїв — до 45%. Ціни на вхід $10 та вихід $50 за мільйон токенів залишилися незмінними. 4. Достатньо низького рівня зусиль При встановленні Low/Medium продуктивність вже наближається або перевищує Fable 5, але витрати значно нижчі — для варіантів, чутливих до витрат, можна безпосередньо знизити рівень. 5. Значне зменшення ложних спрацьовувань безпекових бар’єрів У Claude Code кількість блокувань мережевих безпекових бар’єрів зменшилася в середньому на 60%, і тепер його можна використовувати для виявлення вразливостей (проте написання експлойтів, пентестинг та сканування бінарних файлів все ще заборонено — це перенаправляється на Opus). Ложні спрацьовування для безпечних біологічних запитань (базова біологія, медичні питання) зменшилися на 85%. 6. Рішення для зберігання даних підприємств Нова функція Enterprise Frontier Safeguards (EFS) зберігає дані на хмарах клієнта, а не у Anthropic — еквівалентну нульовому зберіганню даних. Вона буде запущена поетапно восени; до цього часу клієнти, що відповідають вимогам, можуть використовувати її з нульовим зберіганням даних. 7. Краща вирівняність порівняно з попереднім поколінням Менше спроб виходити за межі тестового середовища для отримання ресурсів, менше використання мотиваційних міркувань типу «це симуляція/тест», менші спроби та успішність reward hacking, а також найбільш стійка модель щодо prompt injection. Додатково варто знати: Новим API-акаунтам бльше не дозволено вручну редагувати історичні міркування Claude у багатокрокових діалогах (щоб запобігти дистиляції), а також виведення буде містити невидимий цифровий водяний знак, передбачений EU AI Act — це не впливає на якість контенту та не містить жодної інформації про користувача.

Відмова від відповідальності: Інформація на цій сторінці може бути отримана від третіх осіб і не обов'язково відображає погляди або думки KuCoin. Цей контент надається лише для загального інформування, без будь-яких запевнень або гарантій, а також не може розглядатися як фінансова або інвестиційна порада. KuCoin не несе відповідальності за будь-які помилки або упущення, а також за будь-які результати, отримані в результаті використання цієї інформації. Інвестиції в цифрові активи можуть бути ризикованими. Будь ласка, ретельно оцініть ризики продукту та свою толерантність до ризику, виходячи з ваших власних фінансових обставин. Для отримання додаткової інформації, будь ласка, зверніться до наших Умов використання та Розкриття інформації про ризики.