Стоимость кодирования с использованием ИИ вот-вот выйдет из-под контроля? Чтобы решить проблемы предприятий, AMD, Supermicro и Spectro Cloud совместно объявили 5-го числа о запуске комплексного решения для ИИ-вывода «AMD Instinct Coder». Решение ориентировано на принцип «локальный приоритет» и технологию интеллектуальной маршрутизации, позволяя предприятиям обеспечить безопасность конфиденциального кода и значительно снизить затраты на токены.
(Предыдущая информация: Meta представила мощнейшую модель AI-агента Muse Spark 1.1! Поддержка миллионов контекстов, отличное владение кодированием и автономное управление компьютером)
(Дополнительный контекст: SpaceXAI, принадлежащая Маску, официально запустила самую мощную модель «Grok 4.5»! В партнерстве с Cursor активно продвигает AI-агенты для программирования, идеально интегрируясь с офисными приложениями Office)
С ростом популярности инструментов для написания кода с использованием искусственного интеллекта (ИИ) среди разработчиков, затраты компаний на потребление токенов резко возрастают. Чтобы решить эту проблему для компаний, облачных провайдеров и операторов суверенного ИИ, лидер в области вычислений AMD, производитель оборудования Supermicro и облачный стартап Spectro Cloud 5 августа по тайбэйскому времени совместно анонсировали запуск корпоративного решения для вывода ИИ-кодирования под названием «AMD Instinct Coder».
Решение проблем с затратами и безопасностью: технология интеллектуальной маршрутизации
Согласно прогнозам исследовательской компании Gartner, к 2028 году стоимость ИИ-кодирования для предприятий может превысить среднюю зарплату разработчиков, если не будет внедрена надлежащая модель управления. Основная ценность AMD Instinct Coder заключается в «гибридной модели эксплуатации», которая на основе сложности рабочей нагрузки интеллектуально определяет: автоматически направлять обычные задачи кодирования на локально развернутые модели, а сложные продвинутые рассуждения — на внешние передовые модели.
Этот дизайн не только значительно снижает высокую стоимость токенов, но и позволяет компаниям сохранять конфиденциальный код и контекстные данные локально, исключая риски утечки конфиденциальной информации в сторону единственного облачного провайдера.
Три мощных технологических силы в полном разгаре: MI325X в качестве основного продукта
Эта всеобъемлющая решение идеально интегрирует передовые технологии трех ведущих компаний. В плане аппаратного обеспечения начальная конфигурация, как ожидается, будет использовать самые новые GPU AMD Instinct MI325X с 256 ГБ памяти HBM3E и пиковой пропускной способностью памяти до 6 ТБ/с, что идеально подходит для задач AI-вывода, требующих больших объемов памяти; а также в сочетании с восьмикарточной корпоративной AI-инфраструктурой от Supermicro, предлагающей варианты воздушного и жидкостного охлаждения.
На программном уровне поддержку обеспечивает PaletteAI Inference Launchpad от Spectro Cloud, позволяя командам платформ предприятий легко настраивать квоты, метрики и политики маршрутизации моделей для реализации детализированного многопользовательского контроля и функций управления.
Преодоление зависимости от поставщиков и ускорение внедрения ИИ в бизнесе
По поводу этого значимого партнерства генеральный директор Spectro Cloud Тенри Фу подчеркнул, что компании не должны вынуждены идти на компромисс между возможностями модели и экономическим контролем; старший вице-президент AMD Дан МакНамара также отметил, что AI-кодирование перешел от инструментов для отдельных разработчиков к уровню корпоративных платформ как ключевое решение.
Сейчас это решение демонстрируется на выставке Ai4 в Лас-Вегасе. Благодаря этой предварительно интегрированной и проверенной комбинации программного и аппаратного обеспечения компании смогут заменить сложные проекты по созданию собственной инфраструктуры, значительно сократив время от доставки до готовности к производству и ускорив внедрение производственного ИИ.

