Ornith-1.0 — модель с механизмом самоструктурирования, которая сама пишет для себя RL-обвязку
Автор: Nikki
Загружено: 2026-07-23
Просмотров: 64
Описание:
Ornith-1.0 — это семейство моделей кодирования с открытым исходным кодом, которые во время обучения учатся создавать собственную структуру обучения с подкреплением — парадигма, которую DeepReinforce называет «самоорганизующейся структурой». Вариант с 35 миллиардами MoE превосходит модели в десять раз большего размера в тестах кодирования. Все контрольные точки распространяются под лицензией MIT.
⏱ РАЗДЕЛЫ
0:00 — Хук: Модель, которая нарушает правила
0:30 — Что такое Ornith-1.0? Объяснение самоорганизации
2:30 — Подробный анализ фреймворка самоорганизации
5:30 — Семейство моделей: размеры, бенчмарки и неожиданные результаты
7:30 — Защита от взлома вознаграждений
9:00 — Практическое развертывание: от одного GPU до кластера
11:00 — Реальная интеграция с агентными фреймворками
12:30 — Ограничения и честная оценка
13:45 — Конкурентная среда: где Ornith находится
14:30 — Заключение
🔗 ОСНОВНАЯ ССЫЛКА
Блог: https://deep-reinforce.com/ornith_1_0...
📚 ИСТОЧНИКИ И ДОПОЛНИТЕЛЬНАЯ ИНФОРМАЦИЯ
• Репозиторий GitHub: https://github.com/deepreinforce-ai/O...
• Коллекция моделей Hugging Face: https://huggingface.co/collections/de...
• Ornith-1.0-9B: https://huggingface.co/deepreinforce-...
• Ornith-1.0-35B (MoE): https://huggingface.co/deepreinforce-...
• Ornith-1.0-397B (Flagship): https://huggingface.co/deepreinforce-...
#ornith #aiagents #opensource #selfhosting #codingai
---
До следующего выпуска, любознательные умы. 🦊
— Никки
🌐 https://Nikki7165.com
Повторяем попытку...
Доступные форматы для скачивания:
Скачать видео
-
Информация по загрузке: