ycliper

Популярное

Музыка Кино и Анимация Автомобили Животные Спорт Путешествия Игры Юмор

Интересные видео

2025 Сериалы Трейлеры Новости Как сделать Видеоуроки Diy своими руками

Топ запросов

смотреть а4 schoolboy runaway турецкий сериал смотреть мультфильмы эдисон
Скачать

GLM 5.2: в чём его уникальность?

prompt engineering

Prompt Engineer

LLMs

AI

artificial Intelligence

Llama

GPT-4

fine-tuning LLMs

Автор: Prompt Engineering

Загружено: 2026-06-21

Просмотров: 16709

Описание: GLM 5.2: объяснение: 1 миллион контекстов, эффективность MoE, разреженное внимание и дешевый вывод

В этом видео я подробно разбираю GLM 5.2 и объясняю, почему это один из самых впечатляющих релизов с открытыми весами на сегодняшний день, уделяя особое внимание архитектуре, лежащей в основе его низкой стоимости и высокой производительности кода. Я рассматриваю его архитектуру Mixture-of-Experts с 744 байтами данных, распространяемую по лицензии MIT, с 384 экспертами (около 40 байт активных на токен), контекстное окно в 1 миллион токенов и то, как разреженное внимание с «индексатором» снижает затраты на внимание. Я объясняю «долю индекса», которая повторно использует индексацию на четырех слоях, что в 2,9 раза сокращает вычислительные операции при полном контексте, а также предсказание нескольких токенов, которое повышает коэффициент принятия примерно на 20% для более быстрого вывода. Я также обсуждаю режимы мыслительных усилий, результаты агентного кодирования, такие как 74,4% на Frontier SWE, ценообразование по сравнению с моделями США, самостоятельное размещение, проблемы обмена данными и ограничения, такие как формат только текста.

Моё приложение для преобразования голоса в текст: whryte.com
Веб-сайт: https://engineerprompt.ai/
Курс RAG Beyond Basics:
https://prompt-s-site.thinkific.com/c...
Подпишитесь на рассылку localgpt:
https://tally.so/r/3y9bb0

Давайте общаться:
🦾 Discord:   / discord  
☕ Поддержите меня на Ko-fi: https://ko-fi.com/promptengineering
|🔴 Patreon:   / promptengineering  
💼Консультации: https://calendly.com/engineerprompt/c...
📧 Контакт для деловых вопросов: [email protected]
Станьте участником: http://tinyurl.com/y5h28s6h

💻 Предварительно настроенная виртуальная машина localGPT: https://bit.ly/localGPT (используйте код PromptEngineering для скидки 50%).

Подпишитесь на новостную рассылку localgpt:
https://tally.so/r/3y9bb0

ВРЕМЕННЫЕ МЕТКИ:

00:00 Почему GLM 5.2 важен
00:29 Эффективность важнее масштабируемости
01:02 Объяснение архитектуры MoE
01:59 Разреженное внимание к миллиону токенов
04:07 Более быстрый вывод с многотокеновым прогнозированием
05:37 Бенчмарки и сильные стороны кода
06:29 Компромиссы в ценообразовании и заключительный вывод

Не удается загрузить Youtube-плеер. Проверьте блокировку Youtube в вашей сети.
Повторяем попытку...
GLM 5.2: в чём его уникальность?

Поделиться в:

Доступные форматы для скачивания:

Скачать видео

  • Информация по загрузке:

Скачать аудио

Похожие видео

© 2025 ycliper. Все права защищены.



  • Контакты
  • О нас
  • Политика конфиденциальности



Контакты для правообладателей: [email protected]