GLM 5.2: в чём его уникальность?
Автор: Prompt Engineering
Загружено: 2026-06-21
Просмотров: 16709
Описание:
GLM 5.2: объяснение: 1 миллион контекстов, эффективность MoE, разреженное внимание и дешевый вывод
В этом видео я подробно разбираю GLM 5.2 и объясняю, почему это один из самых впечатляющих релизов с открытыми весами на сегодняшний день, уделяя особое внимание архитектуре, лежащей в основе его низкой стоимости и высокой производительности кода. Я рассматриваю его архитектуру Mixture-of-Experts с 744 байтами данных, распространяемую по лицензии MIT, с 384 экспертами (около 40 байт активных на токен), контекстное окно в 1 миллион токенов и то, как разреженное внимание с «индексатором» снижает затраты на внимание. Я объясняю «долю индекса», которая повторно использует индексацию на четырех слоях, что в 2,9 раза сокращает вычислительные операции при полном контексте, а также предсказание нескольких токенов, которое повышает коэффициент принятия примерно на 20% для более быстрого вывода. Я также обсуждаю режимы мыслительных усилий, результаты агентного кодирования, такие как 74,4% на Frontier SWE, ценообразование по сравнению с моделями США, самостоятельное размещение, проблемы обмена данными и ограничения, такие как формат только текста.
Моё приложение для преобразования голоса в текст: whryte.com
Веб-сайт: https://engineerprompt.ai/
Курс RAG Beyond Basics:
https://prompt-s-site.thinkific.com/c...
Подпишитесь на рассылку localgpt:
https://tally.so/r/3y9bb0
Давайте общаться:
🦾 Discord: / discord
☕ Поддержите меня на Ko-fi: https://ko-fi.com/promptengineering
|🔴 Patreon: / promptengineering
💼Консультации: https://calendly.com/engineerprompt/c...
📧 Контакт для деловых вопросов: [email protected]
Станьте участником: http://tinyurl.com/y5h28s6h
💻 Предварительно настроенная виртуальная машина localGPT: https://bit.ly/localGPT (используйте код PromptEngineering для скидки 50%).
Подпишитесь на новостную рассылку localgpt:
https://tally.so/r/3y9bb0
ВРЕМЕННЫЕ МЕТКИ:
00:00 Почему GLM 5.2 важен
00:29 Эффективность важнее масштабируемости
01:02 Объяснение архитектуры MoE
01:59 Разреженное внимание к миллиону токенов
04:07 Более быстрый вывод с многотокеновым прогнозированием
05:37 Бенчмарки и сильные стороны кода
06:29 Компромиссы в ценообразовании и заключительный вывод
Повторяем попытку...
Доступные форматы для скачивания:
Скачать видео
-
Информация по загрузке: