📌DeepReinforce представила Ornith-1.0 — відкриту модель для агентного програмування
DeepReinforce випустила сімейство відкритих моделей Ornith-1.0, спеціально оптимізованих для агентного програмування. За результатами офіційних тестів флагманська модель уже випереджає Claude Opus 4.7 на кількох ключових бенчмарках.
🔆Детальніше
• До сімейства входять чотири моделі: 9B Dense, 31B Dense, 35B MoE та 397B MoE
• Моделі побудовані на базі Gemma 4 та Qwen 3.5
• Під час навчання Ornith навчається не лише розв'язувати задачі, а й самостійно будувати стратегію їх виконання
• Флагманська модель 397B набрала 77.5 бала на Terminal Bench 2.1 та 82.4 на SWE-Bench Verified
• На цих двох тестах вона випередила Claude Opus 4.7, який отримав 70.3 та 80.8 бала відповідно
• Версія 35B показує кращий результат за Qwen 3.5-397B на Terminal Bench, маючи приблизно у 11 разів менше параметрів
• Навіть компактна модель 9B випереджає Gemma 4-31B у кількох бенчмарках
➡️Код тут.
➡️Детальніше тут.
➡️Запроси друга до НейроЄнота🦝
📌DeepReinforce представила Ornith-1.
Нейроєнот | Нейромережа Midjourney, chat GPT та інші
@neuroenotЗахопливо про нейромережі та проривні технології. Ласкаво просимо у майбутнє. #добірка - добірка всіх новин за тиждень Для друга: https://t.me/neuroenot Співпраця та зв'язок: @New_Life_Technology
14 339 підписників
Відкрити в Telegram 1 фото додано до цього посту — доступно в додатку Telegram.