Теперь ИИ могут сражаться друг с другом в реальном времени в рамках проекта LLM Skirmish

673
1
Добавить в Google News
Теперь ИИ могут сражаться друг с другом в реальном времени в рамках проекта LLM Skirmish

Разработчик Кай Макфитерс представил LLM Skirmish — бенчмарк для тестирования больших языковых моделей (LLM) в формате сражений в стратегиях реального времени. В рамках проекта ИИ‑модели управляют юнитами с помощью кода — концепция вдохновлена десятилетней игрой Screeps, MMO‑стратегией для программистов, где участники пишут стратегии на JavaScript, а те исполняются в игровом окружении в реальном времени.

Каждый матч в LLM Skirmish стартует с одинаковой позиции: у участников есть база («спавн»), один боевой юнит и три экономических. Основная задача — уничтожить базу противника. Если за 2 000 игровых кадров этого не произошло, победитель определяется по очкам.

Турнир состоит из пяти раундов. После каждого этапа модели получают доступ к результатам предыдущих матчей — это позволяет им корректировать стратегию и демонстрирует способность ИИ к обучению в контексте.

Как отметил сам Макфитерс на Hacker News, его мотивировал парадокс современных нейросетей: передовые модели способны с ходу создавать полноценные программы, но не могут пройти базовые задачи в Pokémon Red. В LLM Skirmish ключевой навык нынешнего поколения ИИ — написание кода — становится центральным элементом соревнования.

Комментировать
Другие публикации по теме
Риски развития технологий: эксперты настаивают на научных стандартах и независимом аудите систем ИИ
Риски развития технологий: эксперты настаивают на научных стандартах и независимом аудите систем ИИ
Более ста ведущих экспертов и независимых оценщиков искусственного интеллекта объединились в рамках консорциума AI Evaluator Forum, чтобы заявить о нехватке ресурсов и защитных механизмов для полноценного тестирования передовых моделей.
Сегодня в 11:43
207
0
Форум
Проблема сбора данных и зарплаты до 500 тысяч долларов: детали новой стратегии OpenAI
Проблема сбора данных и зарплаты до 500 тысяч долларов: детали новой стратегии OpenAI
Компания OpenAI стремительно наращивает присутствие в сфере робототехники, увеличив число открытых вакансий с 11 до 27 позиций за последние полгода.
Сегодня в 11:38
185
0
Форум
Опасность «слоп-гранат»: глава Shopify Тобиас Лютке раскритиковал бездумное использование генеративного ИИ в офисах
Опасность «слоп-гранат»: глава Shopify Тобиас Лютке раскритиковал бездумное использование генеративного ИИ в офисах
Генеративный искусственный интеллект позиционируется как универсальный помощник, однако бесконечный поток сгенерированного контента может серьезно навредить рабочей продуктивности.
Вчера в 13:49
149
1
Форум