реклама
Новости Software

Apple незаметно выпустила нейросеть Ferret, которая работает с текстом и изображениями

Apple при поддержке учёных Корнеллского университета ещё в октябре выложила в открытый доступ собственную мультимодальную большую языковую модель Ferret, которая в качестве запросов может принимать фрагменты изображений.

 Источник изображения: Laurenz Heymann / unsplash.com

Источник изображения: Laurenz Heymann / unsplash.com

Выход Ferret на GitHub в октябре не сопровождался со стороны Apple крупными объявлениями, но проект впоследствии привлёк участие специалистов отрасли. Принцип работы Ferret состоит в том, что модель изучает указанный фрагмент изображения, идентифицирует объекты на этом участке и очерчивает их рамкой. Распознанные на фрагменте изображения объекты система воспринимает как часть запроса, ответ на который предоставляется в текстовом формате. К примеру, пользователь может выделить на картинке изображение животного и попросить Ferret распознать его. Модель даст ответ, к какому виду относится животное, и ей можно будет задать дополнительные вопросы в контексте, уточнив информацию по другим объектам или действиям.

 Источник изображения: twitter.com/zhegan4

Источник изображения: twitter.com/zhegan4

Открытая модель Ferret — это система, способная «давать ссылки и обосновывать что угодно, где угодно и с любыми подробностями», пояснил исследователь из ИИ-подразделения Apple Чжэ Гань (Zhe Gan). Отраслевые эксперты отмечают важность выхода проекта в этом формате — он демонстрирует открытость традиционно закрытой компании. По одной из версий, Apple решилась на этот шаг, поскольку стремится конкурировать с Microsoft и Google, но не обладает сопоставимыми вычислительными ресурсами. Из-за этого она не смогла рассчитывать на выпуск собственного конкурента ChatGPT и была вынуждена выбирать между партнёрством с облачным гиперскейлером и выпуском проекта в открытом формате, как это ранее сделала Meta.

Источник:

Если вы заметили ошибку — выделите ее мышью и нажмите CTRL+ENTER.
Вечерний 3DNews
Каждый будний вечер мы рассылаем сводку новостей без белиберды и рекламы. Две минуты на чтение — и вы в курсе главных событий.
Материалы по теме
window-new
Soft
Hard
Тренды 🔥
Гендиректор Take-Two: Rockstar постарается выпустить GTA VI без багов, но это не главное 14 мин.
«Обязателен для всех фанатов»: для ремастера культового квеста Grim Fandango вышел мод с улучшениями графики 2 ч.
С конца мая ЦБ начнет проверять, как в банках идёт импортозамещение ПО 2 ч.
Инсайдер раскрыл следующую тайную игру, которую раздадут во время мегараспродажи Epic Games Store 2 ч.
Apple и OpenAI объявят о сотрудничестве на конференции WWDC в июне 4 ч.
Дождались: Ghost of Tsushima стала самой популярной одиночной игрой Sony в Steam, обогнав God of War и Marvel's Spider-Man 5 ч.
Газпромбанк переведет ИТ-инфраструктуру на решения виртуализации «Базис» 5 ч.
Apple, Microsoft, Meta и Google сосредоточились на создании небольших ИИ-моделей с мощными возможностями из-за высокой стоимости LLM 7 ч.
Veeam обзаведётся поддержкой Proxmox VE 18 ч.
Китайские компании выбирают локальный «ИИ в коробке», оставляя облачные сервисы не у дел 18 ч.