Представьте, что вы можете создать собственную игру, просто обучив искусственный интеллект (ИИ) на небольшом наборе видеороликов. Это стало возможным благодаря фреймворку GameFactory, разработанному исследователями из Гонконгского университета. GameFactory использует предобученные диффузионные видеомодели для создания новых игровых сцен, которые реагируют на действия игрока, такие как нажатия на клавиатуру и движения мыши. Давайте разберемся, как это работает […]
Обзор мультиагентного дообучения: Как несколько агентов помогают ИИ становиться лучше Введение Представьте, что у вас есть команда экспертов, каждый из которых специализируется на определенной задаче. Один генерирует идеи, другой критикует их, а третий улучшает финальный результат. Такой подход позволяет достичь лучших результатов, чем если бы один человек делал всё сам. Исследователи из Гарварда, Оксфорда, MIT […]
Представьте, что у вас есть очень длинный текст, например, книга или большая статья, и вы хотите, чтобы искусственный интеллект (ИИ) помог вам его обработать. Обычно ИИ может работать только с ограниченным объемом текста за раз. Но что, если текст слишком длинный? Разработчики из Google Cloud AI Research предложили решение — метод Chain-of-Agents (CoA), который позволяет […]
Исследователи из Стэнфорда и Беркли представили новый подход к рассуждению в больших языковых моделях (LLMs), названный Meta Chain-of-Thought (Meta-CoT). Этот метод расширяет традиционный подход Chain-of-Thought (CoT), добавляя явное моделирование внутренних процессов рассуждения, необходимых для достижения окончательного ответа. Meta-CoT позволяет моделям решать более сложные задачи, приближая их рассуждения к "Системе 2" из когнитивной психологии, которая отвечает […]
Представьте себе экзамен, который оценивает не только знания, но и умения современных искусственных интеллектов (ИИ). Это и есть Humanity’s Last Exam (HLE) — бенчмарк, разработанный исследователями из центра по ИИ-безопасности. Этот бенчмарк помогает оценить, насколько хорошо большие языковые модели (LLMs) справляются с задачами высокого уровня, такими как те, которые встречаются в PhD-исследованиях. Давайте разберемся, что […]
В мире, где искусственный интеллект становится движущей силой инноваций, правильное регулирование этой технологии становится критически важным. Так считает компания OpenAI, разработчик известного ChatGPT, которая недавно предложила ряд рекомендаций правительству США, направленных на обеспечение лидерства страны в глобальной ИИ-гонке. В этой статье мы рассмотрим ключевые аспекты этих предложений и их потенциальное влияние на бизнес и технологическое […]
7 ноября 2024 года в Москве успешно прошел масштабный форум “Демонстрация”, собравший ведущих разработчиков и интеграторов искусственного интеллекта в России. Мероприятие состоялось по адресу: Переведеновский пер, 18с3 и было организовано при поддержке Агентства искусственного интеллекта (AIA). В форуме приняли участие более 200 представителей ведущих технологических компаний, среди которых такие ключевые игроки отрасли, как “Умка ИИ” […]
30 ноября 2022 года стал знаковым днем в мире искусственного интеллекта: компания OpenAI анонсировала запуск ChatGPT, модели, основанной на архитектуре GPT-3.5, разработанной для ведения диалогов и предоставления ответов на широкий спектр вопросов. Эта новая версия модели продемонстрировала значительные улучшения в понимании и генерации текста по сравнению с предыдущими итерациями, что открыло новые горизонты для взаимодействия […]
29 августа 2022 года на Colorado State Fair произошло знаковое событие в мире искусства: художник Джейсон Аллен завоевал первый приз в категории "Цифровое искусство/цифровая фотография" с работой, созданной с использованием ИИ-модели MidJourney. Картина под названием "Théâtre D'opéra Spatial" была сгенерирована на основе текстовых запросов, а затем доработана с помощью программного обеспечения Adobe Photoshop и Gigapixel […]
20 августа 2022 года состоялся выпуск Stable Diffusion 1.4, новой версии модели генерации изображений, разработанной для создания фотографически реалистичных визуализаций на основе текстовых описаний. Эта версия модели является значительным улучшением по сравнению с Stable Diffusion 1.2 и прошла дополнительное обучение на обширном наборе данных laion-aesthetics v2 5+, используя 225 тысяч шагов на разрешении 512x512 пикселей. […]