Главная/Новости/OpenAI представила улучшенную версию GPT-4 Turbo с Vision в API
OpenAI представила улучшенную версию GPT-4 Turbo с Vision в API

OpenAI представила улучшенную версию GPT-4 Turbo с Vision в API

10-04-2024, 20:00

OpenAI представила улучшенную версию GPT-4 Turbo с возможностями Vision. Чат-бот доступен через API. Компания также анонсировала новые ИИ-инструменты на базе GPT-4 Turbo с Vision.

Обновление GPT-4 Turbo

Модель GPT-4 Turbo теперь оснащена возможностями компьютерного зрения, что позволяет ей обрабатывать и анализировать входные мультимедийные данные.

Чат-бот может отвечать на вопросы об изображении, видео и многом другом. Компания также представила несколько ИИ-инструментов, работающих на GPT-4 Turbo с Vision, включая помощника по программированию Devin и функцию Snap от Healthify.

Ранее модель с Vision могла отвечать на общие вопросы о том, что присутствует на изображениях. Сейчас она оптимизирована для ответа о конкретных деталях.

Что может сделать GPT-4 Turbo с Vision?

Некоторые пользователи, включая разработчиков OpenAI, поделились соображениями о возможностях модели после ее тестирования. Среди них:

  1.  Извлечение неструктурированного текста и изображений в таблицы базы данных. Пользователь по имени Саймон Уиллисон отправил в чат-бот изображение и извлек все тексты с него.
  2.  Написание кода на основе чертежа интерфейса. Разработчики OpenAI отметили, что GPT-4 Turbo с Vision может помочь написать код в Make Real для создания работающего веб-сайта.
  3.  Разнообразные задачи кодирования. Первый в мире автономный агент искусственного интеллекта для кодирования Devin также работает на GPT-4 Turbo Vision.
  4.  Определение состава и калорийности пищи по фотографии. Healthify, крупнейшее в мире приложение для здоровья и фитнеса, использовало возможности GPT-4 Turbo с Vision для создания функции Snap. Она помогает пользователям получать информацию о питательных веществах на основе изображений продуктов со всего мира.
  5.  Извлечение веб-данных. Kadoa использует возможности GPT-4 Turbo с Vision для автоматизации конкретных задач веб-очистки и RPA, которые не работают только с текстовым представлением.
  6.  Создание новостей. Combinator, американский акселератор технологических стартапов, поделился тем, как его специалисты создают пользовательский интерфейс шаблонов для новостей о хакерах с помощью GPT-4 Turbo с Vision.
  7.  Преобразование макетов в функциональные интерактивные панели. Хароен Вермилен, эксперт по визуализации данных из Luzmo, объявил, что они используют API GPT-4 Turbo с Vision для запуска Instach.art, инструмента для преобразования макета Figma в полнофункциональную интерактивную панель с демонстрационными данными.

Расширенные возможности GPT-4 Turbo с системой Vision позволяют добиться успеха с несколькими вариантами использования и функциями, которые раньше были невозможны.

Ссылка на источник
Нажимая кнопку «Отправить», я принимаю условия публичной оферты и даю согласие на обработку персональных данных