Ramp SWE-Bench Benchmark: Claude Fable 5 посідає перше місце з показником успішності 87,5%
KuCoinFlashПоділитися
Ramp, фінтех-унікорн, випустив бенчмарк SWE-Bench для AI-агентів з кодуванням, що включає 80 завдань із реальних виробничих середовищ. Claude Fable 5 від Anthropic показав результат 87,5% — найвищий серед 14 моделей. У новинах про AI та криптовалюту підкреслюється ефективність Claude Opus 4.8 — $1,09 за запуск. Домашні моделі Kimi K2.6 та GLM 5.1 поступилися з результатами 72,5% та 71,25%. GPT-5.4 Mini став лідером серед легковагих моделей з результатом 58,75%. Ramp зазначив, що компроміси між продуктивністю, швидкістю та витратами є ключовими для розгортання. Новини щодо процентних ставок залишаються окремою темою для трейдерів.
Джерело:Показати оригінал
Відмова від відповідальності: Інформація на цій сторінці може бути отримана від третіх осіб і не обов'язково відображає погляди або думки KuCoin. Цей контент надається лише для загального інформування, без будь-яких запевнень або гарантій, а також не може розглядатися як фінансова або інвестиційна порада. KuCoin не несе відповідальності за будь-які помилки або упущення, а також за будь-які результати, отримані в результаті використання цієї інформації.
Інвестиції в цифрові активи можуть бути ризикованими. Будь ласка, ретельно оцініть ризики продукту та свою толерантність до ризику, виходячи з ваших власних фінансових обставин. Для отримання додаткової інформації, будь ласка, зверніться до наших Умов використання та Розкриття інформації про ризики.