Чат

Консилиум

Загадайте загадку — две платы ответят одновременно, а при споре слово возьмёт старшая модель. Под ответом: чей голос совпал, кто решал и сколько это заняло.

Живое демо

Две платы отвечают порознь — и сходятся в ответе

Послезавтра будет пятница. Какой день недели был позавчера?
Голос А · Repka Pi 5 · нейроускорительqwen3.5-4b_w8a8_rk3588

Если послезавтра пятница, то завтра четверг, сегодня среда, а вчера вторник. Следовательно, позавчера был понедельник.

35 с · первое слово 28 с · 4,7 ток/с
Голос Б · CM3588 Plus · процессорgemma4:e4b

Если послезавтра — пятница, то завтра должна быть четверг. Следовательно, сегодня должен быть среда. Если сегодня среда, то позавчера был понедельник.

54 с · первое слово 18 с · 1,3 ток/с

Ответы совпали: Понедельник — это и есть ответ консилиума; старшая модель не понадобилась.

Настоящий прогон 09.09.2026 21:21 UTC · голоса не видят ответов друг друга · весь путь 54 с
54 с — и ответ согласованДве малые модели на двух платах считали одновременно: нейроускоритель Repka Pi 5 и процессор CM3588 Plus; прогон 09.09.2026.
96 % верных, когда пара согласнаНа 110 проверочных задачах согласие двух разных моделей было верным в 96 % случаев; разошлись — вопрос независимо решает старшая модель.
Две малые модели лучше одной большойСочетание двух малых моделей на платах показало результат лучше, чем модель вдвое большего размера, — и весь путь к ответу виден.

Демо ограничено общей квотой витрины; один вопрос консилиуму считается одним запуском, хотя работают два-три вычислителя. Все контуры каскада местные: данные не покидают периметр. Состав каскада фиксирован по итогам отбора на 110 проверочных задачах. И честно: консилиум повышает точность, но не гарантирует её — и пара, и старшая модель могут ошибиться; согласие двух разных моделей — это вероятность 96 %, а не справочник.

Польза

Что это забирает у людей

На 110 проверочных задачах сочетание двух малых моделей показало результат лучше, чем модель вдвое большего размера. Если обе модели давали одинаковый ответ, в 96 % случаев он был верным. Пользователь при этом видит весь путь к результату — от двух независимых ответов до итогового решения.

Для кого

Тем, кто хочет надёжность ИИ-ответов на своём железе, не покупая сервер с видеокартой

Что забирает

Снимает недоверие к малым моделям: не «поверьте, она умная», а живой механизм самопроверки — согласие двух разных моделей или честная эскалация

Как попробовать

Нажмите загадку под полем — или загадайте свою. Смотрите на карточки голосов: совпадут ли ответы

02 · Железо

На чём это работает

  • GPU-сервер — гипервизор Proxmox VE: Xeon E5-2696 v2, 32 vCPU, 121 ГБ RAM; GPU передана в гостевую ВМ через PCIe passthrough (VFIO)
  • Repka Pi 5 — Repka Pi 5: Rockchip RK3588 (4×Cortex-A76 2,26 ГГц + 4×Cortex-A55 1,8 ГГц), 16 ГБ LPDDR4X, модуль eMMC 64 ГБ; российская плата в форм-факторе Raspberry Pi 5
  • CM3588 Plus — FriendlyElec CM3588 Plus: Rockchip RK3588 (4×Cortex-A76 до 2,4 ГГц + 4×Cortex-A55 1,8 ГГц), 32 ГБ LPDDR5, 4 слота M.2 NVMe (PCIe 3.0 ×1), накопители 3 × Intel Optane

Подробные паспорта стендов, их загрузка и потребление — на странице Стенды.

03 · Дальше

Хотите такое у себя?

Если две модели расходятся в ответе, запрос можно направлять не старшей модели, а вашему оператору. Получается поддержка, где ИИ самостоятельно обрабатывает типовые обращения, а сложные случаи передаёт человеку. Настроим такую схему под вашу задачу и покажем её точность на ваших вопросах

Нашли неточность или есть предложение по витрине? .

Проводник по лаборатории отвечает облачная модель — вопросы уходят провайдеру
Я проводник по лаборатории. Расскажите своими словами, что за задача — подскажу, какое демо посмотреть и что оно вам даст. Или начните с готового вопроса.

С чего начать: