ждёт вопроса
Консилиум
Загадайте загадку — две платы ответят одновременно, а при споре слово возьмёт старшая модель. Под ответом: чей голос совпал, кто решал и сколько это заняло.
ПопробоватьДля кого. Тем, кто хочет надёжность ИИ-ответов на своём железе, не покупая сервер с видеокартой
Что забирает. Снимает недоверие к малым моделям: не «поверьте, она умная», а живой механизм самопроверки — согласие двух разных моделей или честная эскалация
Как попробовать. Нажмите загадку под полем — или загадайте свою. Смотрите на карточки голосов: совпадут ли ответы
Спросите консилиум
Две малые модели на двух платах отвечают одновременно и не видят ответов друг друга. Совпали — это и есть ответ, за время одной быстрой генерации. Разошлись — вопрос независимо решает старшая модель: она тоже не видит вариантов пары, чтобы не подсуживать своим.
ждёт вопроса
При споре решает:
Демо ограничено общей квотой витрины; один вопрос консилиуму считается одним запуском, хотя работают два-три вычислителя. Все контуры каскада местные: данные не покидают периметр. Состав каскада фиксирован по итогам отбора на 110 проверочных задачах. И честно: консилиум повышает точность, но не гарантирует её — и пара, и старшая модель могут ошибиться; согласие двух разных моделей — это вероятность 96 %, а не справочник.
Что это даёт бизнесу
На 110 проверочных задачах сочетание двух малых моделей показало результат лучше, чем модель вдвое большего размера. Если обе модели давали одинаковый ответ, в 96 % случаев он был верным. Пользователь при этом видит весь путь к результату — от двух независимых ответов до итогового решения.
На чём это работает
- GPU-сервер — гипервизор Proxmox VE: Xeon E5-2696 v2, 32 vCPU, 121 ГБ RAM; GPU передана в гостевую ВМ через PCIe passthrough (VFIO)
- Repka Pi 5 — Repka Pi 5: Rockchip RK3588 (4×Cortex-A76 2,26 ГГц + 4×Cortex-A55 1,8 ГГц), 16 ГБ LPDDR4X, модуль eMMC 64 ГБ; российская плата в форм-факторе Raspberry Pi 5
- CM3588 Plus — FriendlyElec CM3588 Plus: Rockchip RK3588 (4×Cortex-A76 до 2,4 ГГц + 4×Cortex-A55 1,8 ГГц), 32 ГБ LPDDR5, 4 слота M.2 NVMe (PCIe 3.0 ×1), накопители 3 × Intel Optane
Подробные паспорта стендов, их загрузка и потребление — на странице Стенды.
Хотите такое у себя?
Если две модели расходятся в ответе, запрос можно направлять не старшей модели, а вашему оператору. Получается поддержка, где ИИ самостоятельно обрабатывает типовые обращения, а сложные случаи передаёт человеку. Настроим такую схему под вашу задачу и покажем её точность на ваших вопросах
Нашли неточность или есть предложение по витрине? .