Биохакинг 1 мин 22.06.2026
Мультимодальные модели: текст + изображение + аудио
GPT-4o, Claude и Gemini могут обрабатывать не только текст, но и изображения и аудио 📸. Например, сфотографируйте блюдо в кафе, и модель вернет его калорийност...
GPT-4o, Claude и Gemini могут обрабатывать не только текст, но и изображения и аудио 📸. Например, сфотографируйте блюдо в кафе, и модель вернет его калорийность и БЖУ. Это закрывает задачи: • определения состава блюда, • подсчета калорий, • предоставления информации о питании. Такие мультимодальные модели открывают новые возможности для автоматизации и анализа данных. Как часто вы сталкиваетесь с необходимостью анализировать данные из разных источников? 🤔
Этот материал создан с помощью AI-конвейера Miss Illusia. Подписывайтесь на канал @missillusia для ежедневных инсайтов.