Содержание
- Пошаговая инструкция: веб-версия и приложение
- Поддерживаемые форматы и максимальный размер
- Можно ли отправить фото без регистрации
- Умеет ли DeepSeek генерировать изображения
- Чем DeepSeek отличается от Midjourney, DALL-E и Stable Diffusion
- Как DeepSeek распознаёт и анализирует фото
- Почему DeepSeek не рисует и что использовать вместо
- Как заставить DeepSeek описать фото или извлечь текст
- Частые ошибки при загрузке и их решение
- Режим фото: как включить и где кнопка
- Альтернативы для генерации изображений
- Частые вопросы
Как загрузить фото в Дипсик: пошаговая инструкция
Черновик готовит редакция с помощью ИИ. За стандарт издания отвечает главный редактор — Валерий Курземнек.
Материал редакции Зерокодера. Счёт по выдаче снят собственным прогоном 6 октября 2026 года; цитаты источников приведены дословно. Обновлено: октябрь 2026.
Чтобы загрузить фото в Дипсик, откройте новый чат, нажмите скрепку рядом с полем ввода и выберите файл с диска — в приложении это плюс у строки ввода. Отдельная кнопка «Распознавание» включает режим, в котором модель смотрит на картинку и отвечает по её содержимому. Дальше напишите, что именно нужно: описать сцену, вытащить текст, разобрать скриншот. Мы скачали топ-10 выдачи DuckDuckGo (ru-RU) по запросу «как загрузить фото в дипсик»: текст отдали 8 из 10.
Пошаговая инструкция: веб-версия и приложение
После выбора файла дождитесь, пока он прикрепится: в обзоре на дипсик.рус сказано, что файл загружается за 5-15 секунд в зависимости от размера. Когда вложение появилось в поле, добавьте текстовую задачу. Формулировка решает больше, чем сам факт загрузки: без вопроса модель может ограничиться пересказом подписей.
Отдельный вход — режим распознавания изображений. По данным Промтбазы, это отдельная кнопка сверху чата, рядом с быстрым и экспертным режимами; раскатку начали 29 апреля 2026 года, 9 мая она пошла шире. В обзоре на дипсик.рус указано, что с апреля 2026 года функция «Распознавание» стала доступна всем пользователям.
Порядок для веб-версии:
- Откройте новый чат на chat.deepseek.com и включите кнопку «Распознавание» вверху окна, если нужен разбор содержимого.
- Нажмите скрепку у поля ввода.
- Выберите файл изображения на диске.
- Дождитесь появления вложения в поле.
- Проверьте, что кнопка «Распознавание» подсвечена: так режим активен.
- Напишите задачу к картинке.
В приложении шаги те же, меняется только элемент интерфейса: вместо скрепки — плюс. Если вложение не появилось, начните с проверки формата и размера, об этом ниже.
Поддерживаемые форматы и максимальный размер
По данным обзора на дипсик.рус, максимальный размер файла — 100 МБ, и для фото этого хватает с запасом: даже снимок с профессиональной камеры весит 20-30 МБ. Там же перечислены форматы, которые не поддерживаются: RAW-форматы камер (CR2, NEF), PSD (Photoshop), HEIC (с iPhone — нужно конвертировать в JPG), видеофайлы.
Цифры лимитов в источниках расходятся, и это стоит держать в голове. В обзоре на CometAPI приводятся такие ориентиры: до 20 изображений на загрузку через веб-интерфейс, большинство принимают 10–25 МБ на изображение, некоторые платные уровни поддерживают до 50 МБ. Там же сказано, что 8K (7680 × 4320) поддерживается, но пользователям рекомендуется оптимизировать разрешение.
Отдельная позиция — подпись у скрепки. По данным Промтбазы, интерфейс сам называет рамки: до 50 файлов, каждый до 100 МБ. Там же отмечено, что статьи, где расписано «10 МБ на бесплатном и 50 МБ на Pro», описывают тарифы, которых нет.
| Параметр | Значение | Источник |
|---|---|---|
| Максимальный размер файла | 100 МБ | обзор на дипсик.рус |
| Подпись у скрепки | до 50 файлов, каждый до 100 МБ | Промтбаза |
| Вес снимка с профкамеры | 20-30 МБ | обзор на дипсик.рус |
| Форматы вне поддержки | CR2, NEF, PSD, HEIC, видео | обзор на дипсик.рус |
| Ориентир по веб-загрузке | до 20 изображений | обзор на CometAPI |
| Разрешение | до 8K (7680 × 4320) | обзор на CometAPI |
Можно ли отправить фото без регистрации
Для загрузки фото нужен вход: в обзоре на дипсик.рус первый шаг инструкции — открыть chat.deepseek.com и, если вы не авторизованы, войти через Google-аккаунт или почту. Практический вопрос здесь другой — платить не нужно. В обзоре на дипсик.рус отмечено, что ChatGPT требует платной подписки для полноценной работы с фото (GPT-4o), а ДипСик работает бесплатно.
По данным CometAPI, уровень бесплатного пользования — 50–100 изображений в день, около 1 000 в месяц, при ограничении на одно изображение обычно ≤5 МБ. Там же указано, что некоторые отчёты называют 1 изображение за сеанс для бесплатных пользователей. Профессиональные пользователи, по тем же данным, получают до 1 000 в день и 20 000–30 000 в месяц.
Разброс в цифрах объясняется тем, что источники описывают разные версии платформы и разные типы аккаунтов. Для повседневной задачи — разобрать скриншот или прочитать текст с фотографии — бесплатного уровня хватает. Если работа с изображениями становится регулярной, ориентируйтесь на суточные квоты.
Умеет ли DeepSeek генерировать изображения
Нет. Ни в веб-версии, ни в приложении, ни через API генерации изображений нет: сеть только читает и разбирает то, что вы загрузили. Это ключевой ответ для всех, кто ищет «дипсик генерирует изображения» или «дипсик создает изображения».
Путаницу создаёт то, что у самой компании модель для картинок есть. По данным Промтбазы, в январе 2025 года DeepSeek выложила Janus-Pro — открытые веса, которые тогда сравнивали с DALL·E 3 по бенчмаркам генерации.
Второй источник путаницы — история. В феврале 2025 года дипсик разом отключил обработку PDF и картинок на волне наплыва пользователей, и на вопрос «почему» сервис отвечал, что возможности его текущей версии ограничены. С тех пор многое изменилось, но старые тексты в выдаче остались.
| Вопрос | Ответ |
|---|---|
| Генерация картинок в чате | нет |
| Генерация через API | нет |
| Чтение и разбор загруженного фото | да |
| Своя модель для картинок у компании | Janus-Pro, открытые веса, январь 2025 |
| Запуск Janus-Pro | самостоятельно, вне чата |
Чем DeepSeek отличается от Midjourney, DALL-E и Stable Diffusion
Это разные классы инструментов. Midjourney, DALL-E и Stable Diffusion создают изображение по текстовому описанию. DeepSeek работает в обратную сторону: получает готовую картинку и отвечает по её содержанию. Сравнивать их по качеству «рисования» бессмысленно — задачи не пересекаются.
В обзоре на дипсик.рус о загрузке файлов DeepSeek описан как сеть, которая читает текст на изображении и не описывает саму картинку; там это названо принципиальным отличием от ChatGPT с GPT-4V или Claude.
Stable Diffusion, по описанию в обзоре на shtruzel.ru, — бесплатная нейросеть с открытым кодом, которая превращает текст в картинки прямо на вашем ПК, без подписки и без VPN. Там же указано, что сила Stable Diffusion — в моделях сообщества, а чекпоинты выкладывают на Civitai и Hugging Face.
| Инструмент | Что делает с изображением | Где работает |
|---|---|---|
| DeepSeek | читает и разбирает загруженное | чат, приложение |
| Midjourney | создаёт по описанию | облако |
| DALL-E | создаёт по описанию | облако |
| Stable Diffusion | создаёт по описанию | ваш ПК |
| Llama 3.2 Vision | распознаёт и классифицирует объекты | локально или на сервере |
Как DeepSeek распознаёт и анализирует фото
Функция анализа изображений появилась в ДипСик весной 2026 года. В обзоре на shtruzel.ru уточняется: 1 мая 2026 в чате появилась кнопка «Распознавание», а с выходом DeepSeek V4 — полноценный режим работы с изображениями (Vision). Раньше дипсик умел только вытаскивать текст с картинки (OCR).
Что модель делает хорошо, по данным Промтбазы: печатный текст со снимка — инструкция, страница учебника, состав на упаковке, скан договора; скриншот интерфейса и окно ошибки — коллега прислал в мессенджере скрин с красной строкой из 1С, режим распознавания прочитает текст ошибки и предположит, куда смотреть; график и диаграмма — оси, подписи, единицы, направление тренда. Все пункты списка относятся к чтению и разбору готового изображения.
Практический вывод: формулируйте задачу как вопрос по содержимому. «Что на фото», «какой текст», «что за ошибка на скриншоте», «сравни два снимка». Модель отвечает по тому, что видит, и не достраивает картинку.
Почему DeepSeek не рисует и что использовать вместо
Причина простая: в продукте нет генератора изображений. Поэтому запросы «дипсик нарисуй» и «дипсик сделай фото» упираются в отсутствие функции.
Задача «сделать картинку» требует другого инструмента. В подборке готовых промтов Промтбазы для снимков товара упоминается предметное фото для объявления в Qwen — чистый фон за минуту. Для генерации с нуля используют Midjourney, DALL-E и Stable Diffusion.
Промежуточный вариант — использовать DeepSeek как составителя промта. Опишите ему желаемую сцену словами, попросите собрать подробное описание, а готовый текст отнесите в генератор. Модель хорошо работает с формулировками, и это ровно та задача, которую она решает.
Как заставить DeepSeek описать фото или извлечь текст
Для описания задайте рамку: что именно вас интересует. Общий вопрос даёт общий ответ. Работает последовательность: сначала «что на изображении», потом уточнения по деталям. Если нужен текст, скажите прямо, что требуется расшифровка, и укажите, что делать с неразборчивыми местами.
По данным Промтбазы, в промтах для распознавания рукописи применяют приём: не читается буква или слово — ставь [неразборчиво] или [возможно: вариант 1 / вариант 2] и иди дальше. Это защищает от выдуманных слов в расшифровке.
Промт, чтобы разобрать загруженное фото:
Разбери изображение, которое я приложил. Сначала опиши, что на нём видно: объекты, людей, обстановку, заметные детали. Затем ответь на мой вопрос по содержимому. Если на изображении есть текст — приведи его дословно, сохраняя структуру строк и абзацев. Неразборчивые места помечай [неразборчиво] или [возможно: вариант 1 / вариант 2]. Не додумывай то, чего на изображении не видно: если деталь неразличима, напиши об этом прямо. Тема: [ваша тема]. Что нужно узнать: [ваш вопрос].
Меняйте под себя две вещи: [ваша тема] и [ваш вопрос]. Если нужен только текст без описания сцены, уберите первый пункт про объекты и оставьте расшифровку.
Вариации той же задачи:
Прочитай текст с фотографии документа. Выведи его дословно, сохрани нумерацию пунктов и абзацы. Отдельно перечисли места, которые не удалось разобрать.
На скриншоте — окно с ошибкой. Найди текст ошибки, объясни, что она означает, и предположи, в каком месте программы искать причину.
Сравни два приложенных снимка. Перечисли, что на них совпадает, а что отличается. Отдельно отметь детали, которые видны только на одном из них.
Составь описание товара по фотографии для объявления: что это, из чего сделано, в каком состоянии, какие детали видно. Пиши нейтрально, без оценки качества.
Переведи текст с изображения на русский. Сначала приведи оригинал, затем перевод, затем список слов, которые могут иметь несколько значений.
Разбери рукописный текст на фото. Если слово читается неоднозначно, дай оба варианта и отметь, какой вероятнее по контексту.
Частые ошибки при загрузке и их решение
В обзоре на дипсик.рус перечислены пять типовых ошибок. Первая — не включена кнопка «Распознавание»: файл прикрепился, но модель отвечает по подписям. Вторая — неподдерживаемый формат. Третья — файл слишком большой. Четвёртая — изображение слишком тёмное или размытое. Пятая — к фото не задан вопрос: без него нейросеть не начнёт анализ.
Решения там же. По размеру: сожмите фото — для просмотра на экране достаточно качества 80%. По формату: конвертируйте HEIC с iPhone в JPG, RAW и PSD пересохраните в распространённый формат. По качеству: осветлите снимок перед загрузкой.
Отдельная причина — молчаливый отказ на тяжёлых файлах. По данным Промтбазы, подпись обещает 100 МБ, но тяжёлые файлы часто отваливаются молча: полоска дошла до конца, вложение не прикрепилось. Там же дан ориентир: кадр с телефона обычно весит 2–4 МБ, а вот скан разворота в 600 dpi лучше пересохранить.
| Ошибка | Что делать |
|---|---|
| Не включено «Распознавание» | включить режим перед вопросом |
| Неподдерживаемый формат | конвертировать в JPG или PNG |
| Файл слишком большой | сжать до качества 80% |
| Тёмное или размытое фото | осветлить снимок перед загрузкой |
| Вложение не прикрепилось | уменьшить файл и повторить |
Режим фото: как включить и где кнопка
Скрепка и режим распознавания — это два разных входа. Скрепка прикрепляет файл к сообщению, режим распознавания переключает способ обработки.
Отсюда и половина жалоб: человек находит гайд, написанный в январе 2026-го, прикрепляет фото скрепкой и получает пересказ подписей вместо разбора. Проверьте, что режим включён, прежде чем формулировать вопрос.
Альтернативы для генерации изображений
Midjourney и DALL-E создают картинки по описанию в облаке. По данным обзора на shtruzel.ru, установка Stable Diffusion на ПК в 2026 делается в один клик через ComfyUI Desktop и Forge Neo.
Для предметных фото под задачи объявлений в подборке Промтбазы упоминается Qwen: предметное фото для объявления с чистым фоном за минуту. Этот вариант подходит для аккуратной обработки снимка товара.
Отдельно стоит модель Llama 3.2 Vision. По данным обзора на DICloak, модели Llama 3.2 Vision обучены распознавать и классифицировать объекты на изображениях, что делает их полезными для создания подписей к изображениям и ответов на визуальные вопросы. Такие модели могут быть развёрнуты локально на серверах или персональных компьютерах.
| Инструмент | Тип задачи | Где работает |
|---|---|---|
| Midjourney | генерация по описанию | облако |
| DALL-E | генерация по описанию | облако |
| Stable Diffusion | генерация по описанию | ваш ПК |
| Qwen | обработка предметного фото | облако |
| Llama 3.2 Vision | распознавание объектов | локально |
Частые вопросы
Дипсик может генерировать фото?
Нет. Ни в веб-версии, ни в приложении, ни через API генерации изображений нет: сеть только читает и разбирает то, что вы загрузили. Своя картиночная модель у компании есть — Janus-Pro, выложенная открытыми весами в январе 2025 года, — но её надо запускать самостоятельно, а в самом дипсике её нет. Для генерации используйте Midjourney, DALL-E или Stable Diffusion.
Как отправить фото в дипсик с телефона?
В приложении рядом с полем ввода есть плюс — он открывает выбор файла из галереи. После выбора дождитесь появления вложения и включите режим распознавания, если нужен разбор содержимого. Дальше напишите задачу к картинке: что описать, какой текст извлечь, что проверить.
Почему в дипсик не загружаются фото?
Четыре типовые причины: не включена кнопка «Распознавание», неподдерживаемый формат, слишком большой файл, тёмное или размытое изображение. Отдельно встречается молчаливый отказ на тяжёлых файлах: полоска доходит до конца, а вложение не прикрепляется. Уменьшите файл и повторите загрузку.
Дипсик распознаёт текст с фото?
Да. Расшифровка текста с изображения была первой функцией такого рода, а с выходом DeepSeek V4 добавился полноценный режим работы с изображениями. В промте укажите, что нужно дословно, и попросите помечать неразборчивые места как [неразборчиво], чтобы модель не подставляла выдуманные слова.
Что за режим фото в дипсике и как его включить?
Это режим распознавания изображений — отдельная кнопка сверху чата, рядом с быстрым и экспертным режимами. Раскатку начали 29 апреля 2026 года, 9 мая она пошла шире. Не путайте его со скрепкой: скрепка прикрепляет файл, а режим распознавания переключает способ обработки.
