📌Qwen 3.7-Max показав найкращий результат у тесті на самопокращення AI-агентів
У незалежному тесті три AI-моделі отримали задачу створити бота для Tetris, який сам аналізує власний код, запускає тести та покращує себе протягом 10 ітерацій.
🔆Детальніше:
• у тесті брали участь Qwen 3.7-Max, Claude Opus 4.7 та GPT-5.5
• моделі самі аналізували свій код та переписували його після бенчмарків
• після 10 циклів ботів порівняли між собою у грі
• Qwen 3.7-Max показав приріст результату на 56%
• Claude Opus 4.7 покращив результат на 28%
• GPT-5.5 показав приріст на 7%
• вартість запуску для Qwen склала $1.32, Claude витратив $12.15, а GPT-5.5 — $2.85
• автори тесту відзначають, що Qwen особливо добре показав себе у довгих агентних циклах
➡️Детальніше тут.
➡️Запроси друга до НейроЄнота🦝
📌Qwen 3.
Нейроєнот | Нейромережа Midjourney, chat GPT та інші
@neuroenotЗахопливо про нейромережі та проривні технології. Ласкаво просимо у майбутнє. #добірка - добірка всіх новин за тиждень Для друга: https://t.me/neuroenot Співпраця та зв'язок: @New_Life_Technology
14,339 مشتركًا
فتح في تيليجرام 1 فيديو مرفق بهذا المنشور — مرئي في تطبيق تيليجرام.