20 августа 2022 года состоялся выпуск Stable Diffusion 1.4, новой версии модели генерации изображений, разработанной для создания фотографически реалистичных визуализаций на основе текстовых описаний. Эта версия модели является значительным улучшением по сравнению с Stable Diffusion 1.2 и прошла дополнительное обучение на обширном наборе данных laion-aesthetics v2 5+, используя 225 тысяч шагов на разрешении 512x512 пикселей. […]
12 июля 2022 года компания MidJourney анонсировала запуск открытой бета-версии своей модели генерации изображений, доступной через платформу Discord. Этот шаг открыл новые возможности для пользователей, желающих создавать уникальные визуализации на основе текстовых описаний, и стал важным событием в области генеративного искусственного интеллекта. Пользователи, подключившиеся к серверу MidJourney на Discord, получили возможность генерировать изображения по своим […]
12 июля 2022 года стал важной вехой в мире искусственного интеллекта с запуском Bloom, крупной языковой модели с открытым исходным кодом, разработанной в рамках проекта BigScience и поддержанной стартапом Hugging Face. Bloom, обладающая 176 миллиардами параметров, заслуженно занимает одну из лидирующих позиций среди открытых языковых моделей, сопоставимых по размеру с известной GPT-3 от OpenAI. Bloom […]
В мае 2022 года Google анонсировала свою новую текст-изображение модель под названием Imagen, которая предназначена для генерации фотореалистичных изображений на основе текстовых описаний. Эта модель сочетает в себе мощь больших языковых моделей (LLMs) и диффузионных моделей, что позволяет ей достигать выдающихся результатов в сравнении с конкурентами, такими как DALL-E 2. Imagen привлекла внимание исследователей и […]
6 апреля 2022 года OpenAI официально анонсировала DALL-E 2, новую версию своей революционной модели генерации изображений, которая значительно превосходит своего предшественника, DALL-E. Эта обновленная модель предлагает пользователям не только более реалистичные и детализированные изображения, но и новые функциональные возможности, такие как редактирование существующих изображений (inpainting) и создание вариаций. DALL-E 2 использует передовые методы генерации изображений, […]
В феврале 2022 года компания DeepMind представила AlphaCode, новую систему искусственного интеллекта, предназначенную для генерации программного кода на основе текстовых описаний задач. Этот прорыв в области программирования привлек внимание экспертов и исследователей, продемонстрировав впечатляющие результаты в соревнованиях по программированию, где AlphaCode превзошла 54% участников, решая задачи, требующие глубокого понимания алгоритмов и теоретических концепций в области […]
В 2021 году компании Canva и Shutterstock сделали значительные шаги в направлении интеграции технологий искусственного интеллекта в свои платформы. Хотя не было официальных анонсов о запуске новых инструментов ИИ, обе компании активно работали над развитием и внедрением инновационных решений, которые изменили подход к дизайну и обработке изображений. Canva, популярный онлайн-редактор графики, продолжила развивать свои инструменты, […]
В октябре 2020 года на конференции GTC 2020 состоялся первый анонс NVIDIA Omniverse — революционной платформы, предназначенной для создания и совместной работы в 3D-пространстве. С тех пор Omniverse стал важным инструментом для разработчиков, дизайнеров и предприятий, стремящихся использовать возможности искусственного интеллекта и высокопроизводительных вычислений для создания визуально впечатляющих и интерактивных 3D-сред. NVIDIA Omniverse предлагает пользователям […]
В 2021 году Amazon продолжила активно развивать и внедрять технологии искусственного интеллекта (ИИ) в свои сервисы, несмотря на отсутствие конкретных анонсов о новых ИИ-решениях в области рекламы. Компания сфокусировалась на улучшении пользовательского опыта и повышении эффективности своих рекламных кампаний, используя мощные инструменты машинного обучения и аналитики. Одним из ключевых направлений работы Amazon в 2021 году […]
15 октября 2021 года на совместном мероприятии NVIDIA и Microsoft была представлена Megatron-Turing Natural Language Generation (MT-NLG) — крупнейшая в мире монолитная трансформаторная языковая модель, обладающая впечатляющими 530 миллиардами параметров. Этот прорыв в области обработки естественного языка был продемонстрирован на фоне стремительного развития технологий искусственного интеллекта и их применения в различных сферах. MT-NLG была обучена […]