О GLM-4.6V

Модель GLM-4.6V достигает SOTA (State-of-the-Art) точности в визуальном понимании среди моделей с такими же параметрами. Впервые в мире она встраивает возможности функциональных вызовов непосредственно в архитектуру визуальной модели, что позволяет устранить разрыв между «Визуальным восприятием» и «Исполнимым действием». Это предоставляет единую техническую основу для Multimodal агентов в реальных бизнес-сценариях. Кроме того, визуальное контекстное окно было расширено до 128k, поддерживая обработку длинных видеопотоков и анализ многократных изображений высокого разрешения.

Метаданные

Создать на

Лицензия

MIT

Поставщик

Z.ai

HuggingFace

Спецификация

Государство

Deprecated

Архитектура

Multimodal MoE

Калибровка

Да

Смешение экспертов

Да

Общее количество параметров

106B

Активированные параметры

106B

Мышление

Нет

Точность

ФП8

Контекст length

131K

Максимум Tokens

131K

Сравнить с другими Model

Посмотрите, как эта Model сравнивается с другими.

Готовы ускорить ваше развитие ИИ?

Готовы ускорить ваше развитие ИИ?

Готовы ускорить ваше развитие ИИ?