Модель теперь воспринимает текст и визуальные данные как единое пространство
В последнем обновлении GPT-4o значительно улучшилось качество генерации изображений. Теперь модель рисует более фотореалистичные сцены, точнее передает текст на изображениях и уверенно редактирует их: добавляет или удаляет объекты, применяет стилизации, такие как перерисовка в стиле студии Ghibli.
Ключевое отличие: GPT-4o теперь нативно обрабатывает текст и изображения вместе, без необходимости задействовать отдельную нейросеть вроде DALL·E. Такой подход, впервые анонсированный при запуске GPT-4o («o» — от слова Omni), позволил интегрировать работу с визуальными и аудиоданными в единую систему.
Полноценный доступ к этим возможностям стал доступен только сейчас.
Документ вводит юридическое определение искусственного интеллекта, а также суверенной и национальной языковых моделей. Им придется проходить проверку на соответствие традиционным…
Генеративная поэзия появилась задолго до ChatGPT. Компьютеры генерируют стихи уже больше 60 лет, а сама мечта заставить машину рифмовать —…
Как специалисты по машинному обучению наводят порядок при работе с большими корпусами? Что нужно сделать, чтобы эксперимент был воспроизводимым, качество…