Хтось просто випустив потужну нову AI-модель на платформі API OpenRouter і пішов, не залишивши візитівки. Ox Alpha, яку вказано під ім’ям провайдера «Stealth», була запущена 20 серпня з контекстним вікном у 1 048 576 токенів, багатомодальним міркуванням на основі тексту, зображень та відео та ціною рівно нуль доларів під час тижневого періоду ознайомлення.
Анонімний дебют моделі вивів спільноту розробників у повний режим детектива: відбитки токенізатора та збіги сигнатур API сильно вказують на знайомого підозрюваного — китайську Zhipu AI, тепер відому як Z.ai.
Що насправді робить Ox Alpha
Мільйонний контекстний вікон — це головна функція, і варто зрозуміти, що це означає на практиці. Більшість великих мовних моделей можуть обробляти від 8 000 до 128 000 токенів одночасно. Мільйон токенів — це приблизно еквівалентно наданню моделі цілого кодового базису або декількох повноформатних романів у одному запиті.
Така потужність робить Ox Alpha особливо підходящим для завдань з розробки програмного забезпечення з довгим горизонтом, де агенту ШІ потрібно розуміти величезні обсяги існуючого коду перед внесенням змін. Перші тестувальники вже зауважили його безперебійну інтеграцію в редактори та агенти для кодування.
Початкові тестові дані від спільноти свідчать про пропускну здатність приблизно 29 токенів за секунду, що є гідним показником для моделі, яка обробляє такий обсяг контексту. Модель також підтримує виклик інструментів і функцій разом із структурованим виводом у форматі JSON — такі можливості роблять її негайно корисною для виробничих робочих процесів, а не лише для чат-взаємодій.
Під час періоду попереднього перегляду постачальник заявив, що запити не будуть використовуватися для навчання.
Детективна робота
Ox Alpha — це п’ятий раз, коли анонімна модель ШІ, пов’язана з китайськими лабораторіями, з’явилася на платформі OpenRouter.
Найсильніші докази вказують на те, що Ox Alpha є варіантом GLM-5.3, який є частиною сімейства GLM, розробленого Zhipu AI. Фінгерпрінтинг токенізатора, який аналізує, як модель розбиває текст на токени, створює підпис, який важко приховати. Шаблони відповідей API додають ще один рівень ідентифікації. Обидва вказують на походження з GLM.
Друга теорія стосується команди MiMo від Xiaomi, яка раніше використовувала подібні стратегії таємного випуску. Попередні анонімні випуски на OpenRouter, зокрема GLM-5 та MiMo-V2-Pro, після закінчення початкового періоду попереднього перегляду були оголошені китайськими лабораторіями.
Деталі архітектури, формальні бенчмарки чи ціни після передперегляду не були розкриті. Заява про лістинг моделі стверджує, що її обслуговувальна потужність становить понад 100 трильйонів токенів на добу.
