Чи витрати на AI-кодування наближаються до неконтрольованого рівня? Щоб вирішити проблеми бізнесу, AMD, Supermicro та Spectro Cloud 5-го числа оголосили про запуск універсального рішення для AI-виведення «AMD Instinct Coder». Рішення засноване на принципі «локальна пріоритетність» та інтелектуальній маршрутизації, що дозволяє компаніям забезпечити безпеку конфіденційного коду та значно знизити витрати на токени.
(Попередній контекст: Meta представила найпотужнішу модель AI-агенту Muse Spark 1.1! Підтримує мільйони контекстів, досконало володіє кодуванням та автономним керуванням комп’ютером)
(Додаткова інформація: SpaceXAI, що належить Маску, офіційно запустив найпотужнішу модель «Grok 4.5»! У співпраці з Cursor він активно розвиває AI-агенти для програмування та ідеально інтегрується з офісними програмами Office)
З поширенням інструментів штучного інтелекту (AI) для написання коду серед спільноти розробників, витрати на споживання токенів для бізнесу стрімко зростають. Щоб вирішити цю проблему для бізнесу, провайдерів хмарних послуг та операторів суверенного AI, компанії AMD, виробник обладнання Supermicro та хмарний стартап Spectro Cloud 5 серпня за тайванським часом оголосили про запуск корпоративного рішення для AI-кодування під назвою «AMD Instinct Coder».
Розв’язання проблем з витратами та кібербезпекою: технологія розумного маршрутизації
Згідно з прогнозами дослідницької компанії Gartner, якщо не буде налагоджено відповідної моделі управління, до 2028 року витрати на AI-кодування в компаніях можуть навіть перевищити середню зарплату розробників. Основна цінність AMD Instinct Coder полягає у «гібридній моделі операцій», яка розумно визначає, на основі складності завантаження: автоматично направляти звичайні завдання кодування на локально розгорнуті моделі, а складніші логічні висновки — на зовнішні передові моделі.
Цей дизайн не лише значно знижує високі витрати на токени, але й дозволяє компаніям зберігати конфіденційний код та контекстні дані локально, уникнувши проблем безпеки, пов’язаних із передачею секретів одному хмарному провайдеру.
Три сильні технології на повній потужності: MI325X виступає як основна сила
Ця універсальна рішення ідеально інтегрує передові технології трьох провідних компаній. Щодо апаратного забезпечення, початкова конфігурація передбачає використання найновіших GPU AMD Instinct MI325X з 256 ГБ пам’яті HBM3E та піковою пропускною здатністю пам’яті до 6 ТБ/с, що ідеально підходить для пам’яттємістких завдань AI-виведення; а також використання восьми-GPU підприємницької AI-інфраструктури від Supermicro з варіантами повітряного та рідинного охолодження.
На рівні програмного забезпечення підтримку надає PaletteAI Inference Launchpad від Spectro Cloud, що дозволяє командам платформ підприємств легко налаштовувати квоти, метрики та політики маршрутизації моделей для реалізації дрібнозернистого багатокористувацького контролю та функцій управління.
Зламати залежність від постачальників, прискорити впровадження ШІ в бізнес
Щодо цієї важливої співпраці, виконавчий директор Spectro Cloud Тенрі Фу підкреслив, що компанії не повинні змушувати вибирати між здатністю моделей та економічним контролем; старший віце-президент AMD Дан МакНамара також зазначив, що AI-кодування вже перетворилося з інструменту для окремих розробників на ключове рішення на рівні підприємств.
Наразі це рішення демонструється на виставці Ai4 у Лас-Вегасі. За допомогою цієї попередньо інтегрованої та перевіреної комбінації програмного та апаратного забезпечення підприємства зможуть замінити складні проекти DIY-інфраструктури, значно скоротивши час від доставки до готовності до виробництва та прискоривши впровадження виробничих рішень на основі ШІ.

