
Главное за минуту
- На официальном сайте Qwen можно зарегистрироваться через электронную почту, Google или GitHub.
- Qwen принимает текстовые и голосовые запросы, работает с Word и PDF, переводит и анализирует изображения.
- Qwen можно использовать в браузере, мобильном приложении, через Model API или локально на своём компьютере.
Что умеет Qwen и кому пригодится нейросеть Alibaba
Qwen можно использовать из России через официальный сайт: для начала работы потребуется зарегистрироваться, но иностранный номер и карта иностранного банка на этом этапе не нужны. По данным источника, Qwen3 доступен россиянам бесплатно и без ограничений, однако условия доступа лучше перепроверять на официальной странице сервиса перед регистрацией.
Семейство гибридных моделей Qwen3 Alibaba представила в апреле 2025 года. Эти модели позволяют менять глубину рассуждения, а также анализировать прикреплённые аудио и видео.
- Веди диалог с нейросетью и задавай вопросы в формате чата.
- Создавай тексты и другой контент по описанию задачи.
- Извлекай информацию из материалов и составляй краткие пересказы.
- Переводи тексты, работай с программным кодом и решай математические задачи.
- Подключай инструменты, используй агентные возможности и режим интерпретатора кода в поддерживающих их чат-моделях.
Какие языки поддерживаются
В источнике для Qwen3 заявлена поддержка 119 языков и диалектов. В перечень входят русский и украинский, поэтому запросы и ответы не обязательно переводить на английский.
В мобильном приложении отдельно заявлен мгновенный перевод более чем на 100 языков и диалектов. Это может пригодиться для перевода переписки, документов и отдельных фрагментов текста.
Какие рабочие задачи можно поставить
Чат-модели Qwen предназначены для общения, создания контента, извлечения и суммирования информации, перевода, программирования и решения математических задач. Формулируй запрос так, чтобы в нём были сама задача, исходный материал и ожидаемый результат.
Запрос можно напечатать или продиктовать голосом в приложении. Qwen использует такой ввод для подготовки идей, планов и развёрнутых ответов.
Для работы с документами приложение поддерживает файлы Word и PDF. Их можно передать Qwen, чтобы быстрее получить нужную информацию из содержимого.
Что умеет визуальный модуль
Визуальный модуль Qwen использует OCR, то есть распознавание текста на изображениях. Он также умеет решать математические задачи по фотографии и интерпретировать диаграммы.
При создании изображения можно выбрать соотношение сторон 1:1, 3:4, 4:3, 16:9 или 9:16. К запросу разрешается приложить до пяти референсов.

Что подготовить перед началом работы
Сначала выбери способ запуска: официальный сайт, мобильное приложение, Model API или локальная модель. Требования заметно различаются: для сайта нужна учётная запись, а локальная установка требует подходящего программного и аппаратного окружения.
- Для работы на официальном сайте подготовь электронную почту либо аккаунт Google или GitHub.
- Для мобильного приложения реши, будешь ли входить в аккаунт: без дополнительной регистрации чат доступен, но загрузка файлов и генерация изображений недоступны.
- Для старого проекта из репозитория QwenLM/Qwen подготовь Python 3.8 или новее.
- Установи PyTorch 1.12 или новее; разработчики рекомендуют PyTorch 2.0 или новее.
- Используй Transformers 4.32 или новее.
- Для GPU и flash-attention рекомендована CUDA 11.4 или новее.
Что учесть пользователю сайта
Для начала работы на официальном сайте требуется регистрация. Источник отдельно уточняет, что при создании учётной записи не нужно вводить иностранный номер или карту иностранного банка.
Условия доступа и функции аккаунта могут меняться. Перед началом работы проверь актуальные правила на официальной странице Qwen, особенно если собираешься загружать рабочие документы или подключать платные возможности.
Что учесть пользователю приложения
Приложение Qwen в App Store распространяется бесплатно, но внутри доступны покупки. Для iPhone требуется iOS 16.0 или новее; требования для других устройств проверь на официальной странице приложения.
Для запуска приложения на Mac указаны macOS 13.0 или новее и процессор Apple M1 либо новее. В карточке App Store также сказано, что приложение не проверено для macOS.
Версия из Google Play также содержит встроенные покупки. На странице магазина указано более 5 млн скачиваний, а последняя приведённая в источнике дата обновления — 28 сентября 2026 года.
Что подготовить для локального запуска
Любую модель семейства Qwen можно установить локально из опубликованных на Hugging Face файлов. Конкретную модель выбирай с учётом доступного оборудования и способа запуска.
Для классических моделей Qwen3-0.6B и Qwen3-4B подходит локальный компьютер с CUDA-совместимым GPU. Для MoE-моделей требуется мощный GPU, например NVIDIA A100 или аналогичный.
Если планируешь запуск через Ollama, скачивай модель в формате GGUF. Это требование относится именно к описанному варианту локального запуска.
Как зарегистрироваться и начать пользоваться Qwen на сайте
Основной путь для пользователя без локальной установки состоит из перехода на сайт, регистрации и первого запроса. Не добавляй к этому процессу сторонние сайты, чужие аккаунты или неофициальных продавцов доступа.
- Открой официальный сайт chat.qwen.ai.
- Нажми кнопку «Зарегистрироваться» в правом верхнем углу экрана.
- Создай учётную запись через электронную почту, Google или GitHub.
- Введи первый запрос после входа в учётную запись.
Как сформулировать первый запрос
Поставь Qwen задачу, которая соответствует заявленным функциям чат-модели: диалог, создание контента, извлечение данных, краткий пересказ, перевод, программирование или математика. Если работаешь с исходным текстом, передай его вместе с запросом.
Для задачи, которой нужен разбор вариантов, можно использовать настройку глубины рассуждения в Qwen3. Для этих моделей бюджет рассуждений настраивается от 1024 до 38 912 токенов.
- Назови действие: перевести, суммировать, извлечь сведения, написать код или решить задачу.
- Передай материал, который нужно обработать, если задача основана на тексте или документе.
- Выбери подходящую глубину рассуждения, если эта настройка доступна в используемой модели Qwen3.
Как работать с голосом и файлами
В приложении запрос можно ввести текстом или голосом. Выбери тот способ ввода, который подходит для текущей задачи.
Для разбора документа загрузи файл Word или PDF. Без учётной записи мобильное приложение не позволяет загружать файлы, поэтому для этой функции потребуется войти в аккаунт.
- Введи запрос текстом или произнеси его голосом.
- Прикрепи файл Word или PDF, если нужно извлечь из него информацию.
- Войди в учётную запись, если мобильное приложение не даёт загрузить файл.
Как передать аудио или видео
Qwen3 умеет анализировать прикреплённые аудио и видео. Для видео- и аудиофайлов действует ограничение по продолжительности: не более трёх минут.
Перед загрузкой проверь длительность материала. Если файл укладывается в ограничение, приложи его и сформулируй, какую информацию нужно извлечь или проанализировать.

Как пользоваться генерацией и анализом изображений
Qwen может распознавать текст на изображении, решать математические задачи по фотографии, интерпретировать диаграммы и создавать изображения с заданным форматом. Часть возможностей мобильного приложения требует учётной записи.
- Загрузи изображение с текстом, если нужно распознать его содержимое.
- Прикрепи фотографию математической задачи, если нужно разобрать её средствами визуального модуля.
- Передай диаграмму, если нужно получить её интерпретацию.
- Выбери формат 1:1, 3:4, 4:3, 16:9 или 9:16 при создании изображения.
- Приложи до пяти референсов, если результат должен учитывать визуальные примеры.
Какие форматы доступны генератору
Для создаваемого изображения доступны пять указанных в источнике соотношений сторон: 1:1, 3:4, 4:3, 16:9 и 9:16. Выбери формат до генерации с учётом места, где собираешься использовать результат.
К запросу можно прикрепить до пяти референсов. Референс здесь означает изображение-пример, на которое модель может ориентироваться при обработке запроса.
Какое ограничение есть у режима изображений
В режиме генерации изображений нельзя настраивать глубину рассуждений. Не ищи эту настройку внутри генератора: описанная для Qwen3 регулировка бюджета рассуждений к данному режиму не применяется.
Если мобильное приложение открыто без учётной записи, генерация изображений недоступна. Для использования этой функции войди в аккаунт.
Сколько стоит Qwen и как устроена тарификация API
Вызовы Model API по умолчанию оплачиваются по фактическому использованию. Документ с ценами содержит стандартные ставки, а актуальные акции публикуются в консоли Model Studio, поэтому значения ниже относятся к данным на 5 октября 2026 года.
Qwen-Max тарифицирует входные и выходные токены. Входные токены относятся к переданному запросу, а выходные — к ответу модели.
- Сверяй стандартную цену с актуальными условиями в консоли Model Studio.
- Учитывай отдельно входные и выходные токены Qwen-Max.
- Читай K как 1 000, а M как 1 000 000 в таблицах тарифных уровней.
- Проверяй регион тарификации: в источнике приведены разные ставки для Сингапура, Гонконга, материкового Китая и международного доступа.
Как определяется цена многоуровневого тарифа
В многоуровневом тарифе цена определяется общим числом входных токенов одного запроса. Все токены такого запроса оплачиваются по ставке уровня, в который попал запрос.
Для международного qwen-plus запрос до 256K стоит $0.4 за вход, $1.2 за выход без рассуждений и $4 за выход с рассуждениями на 1 млн токенов. При объёме от 256K до 1M ставки составляют $1.2 за вход, $3.6 за выход без рассуждений и $12 за выход с рассуждениями.
Как работают пакетные вызовы и кеш
Если модель поддерживает пакетные вызовы, входные и выходные токены стоят 50% цены инференса в реальном времени. Скидка пакетного инференса не складывается со скидкой контекстного кеша.
В приведённом сервисом примере создание явного кеша оплачивается по ставке 125% стандартной цены ввода. Попадание в кеш стоит 10% стандартной цены ввода.
В старом репозитории Qwen указано, что пакетный инференс с включённым flash attention может дать ускорение на 40%. Это характеристика описанной конфигурации локального запуска, а не обещание для любого устройства.
Какие ставки указаны для других моделей
В Сингапуре qwen3.8-max при запросе до 1M стоит $2 за 1 млн входных токенов и $6 за 1 млн выходных токенов. По курсу ЦБ РФ на 3 октября 2026 года это примерно 167 ₽ и 501 ₽ соответственно.
В Сингапуре qwen3.7-max при запросе до 1M стоит $2.5 за 1 млн входных токенов и $7.5 за 1 млн выходных токенов. По курсу ЦБ РФ на 3 октября 2026 года это примерно 209 ₽ и 626 ₽.
В Сингапуре qwen3.6-max-preview до 128K стоит $1.3 за вход и $7.8 за выход на 1 млн токенов. По курсу ЦБ РФ на 3 октября 2026 года это примерно 109 ₽ и 651 ₽.
Международный qwen3.6-plus до 256K стоит $0.5 за вход и $3 за выход в обоих режимах на 1 млн токенов. Для международного qwen-max без многоуровневого тарифа ставки составляют $1.6 за вход и $6.4 за выход на 1 млн токенов.
Примеры стандартных цен Model API на дату проверки
| Модель и условие | Вход за 1 млн токенов | Выход за 1 млн токенов |
|---|---|---|
| qwen3.8-max, Сингапур, до 1M | $2, примерно 167 ₽ по курсу ЦБ на 3 октября 2026 года | $6, примерно 501 ₽ по курсу ЦБ на 3 октября 2026 года |
| qwen3.7-max, Сингапур, до 1M | $2.5, примерно 209 ₽ по курсу ЦБ на 3 октября 2026 года | $7.5, примерно 626 ₽ по курсу ЦБ на 3 октября 2026 года |
| qwen3.6-max-preview, Сингапур, до 128K | $1.3, примерно 109 ₽ по курсу ЦБ на 3 октября 2026 года | $7.8, примерно 651 ₽ по курсу ЦБ на 3 октября 2026 года |
| qwen3-max, Сингапур, до 32K | $1.2, примерно 100 ₽ по курсу ЦБ на 3 октября 2026 года | $6, примерно 501 ₽ по курсу ЦБ на 3 октября 2026 года |
| qwen3-max, Сингапур, от 32K до 128K | $2.4, примерно 200 ₽ по курсу ЦБ на 3 октября 2026 года | $12, примерно 1002 ₽ по курсу ЦБ на 3 октября 2026 года |
| qwen3-max, Сингапур, от 128K до 256K | $3, примерно 250 ₽ по курсу ЦБ на 3 октября 2026 года | $15, примерно 1252 ₽ по курсу ЦБ на 3 октября 2026 года |
| qwen-max, международный, без многоуровневого тарифа | $1.6 | $6.4 |
| qwen-max, материковый Китай, без многоуровневого тарифа | $0.345 | $1.377 |
| qwen3.8-max, Гонконг, до 1M | $1.65 | $4.951 |

Бесплатная квота и покупки в мобильном приложении
Бесплатный доступ в чате, бесплатная квота Model Studio и покупки внутри приложения — разные условия. Проверяй их отдельно для выбранного способа работы и региона.
- У перечисленных в документе моделей бесплатная квота доступна только в Сингапуре.
- В других регионах для этих моделей бесплатная квота не предоставляется.
- Квота действует 90 дней с наиболее поздней из дат активации Model Studio, выпуска модели или одобрения заявки.
- Приложение в App Store бесплатно для скачивания, но содержит встроенные покупки.
- Версия из Google Play также содержит встроенные покупки.
Какие покупки указаны в App Store
В карточке App Store указаны три встроенные покупки: Qwen Pro за QAR 399.99, Qwen Plus за QAR 69.99 и Qwen Go за QAR 14.99. Это цены из конкретной карточки магазина, поэтому перед оформлением проверь валюту, период списания и актуальные условия непосредственно в приложении.
Рублёвый эквивалент этих покупок не приводится, поскольку в источниках указан курс для USD, EUR и CNY, но цены приложения обозначены в QAR. Самостоятельный пересчёт здесь не используется.
Когда заканчивается бесплатная квота
Срок бесплатной квоты отсчитывается 90 дней от наиболее позднего подходящего события: активации Model Studio, выпуска модели или одобрения заявки. Для расчёта срока используй дату, которую показывает сервис для твоего проекта.
Ограничение по региону относится к перечисленным в ценовом документе моделям: бесплатная квота для них доступна только в Сингапуре. Не переноси это правило автоматически на другие продукты Qwen, если они не указаны в том же условии.

Как установить Qwen локально
Локальный запуск подходит, если требуется использовать опубликованные файлы модели на собственном оборудовании. Модели семейства Qwen доступны для установки из файлов на Hugging Face, а конкретный порядок зависит от выбранной модели и среды запуска.
- Выбери модель с учётом доступного GPU.
- Скачай вариант в формате GGUF, если собираешься запускать Qwen через Ollama.
- Проверь требования Python, PyTorch, Transformers и CUDA для старого репозитория QwenLM/Qwen.
- Используй готовый Docker-образ, если хочешь пропустить большую часть настройки окружения.
- Установи зависимые библиотеки командой pip install -r requirements.txt, если запускаешь проект без Docker.
Какое окружение требуется старому репозиторию
Для описанного в QwenLM/Qwen запуска нужен Python 3.8 или новее, PyTorch 1.12 или новее и Transformers 4.32 или новее. Для PyTorch рекомендована версия 2.0 или новее.
Пользователям GPU и flash-attention рекомендуется CUDA 11.4 или новее. Перед установкой сравни эти требования с конфигурацией своего компьютера.
Сам репозиторий QwenLM/Qwen больше активно не поддерживается из-за существенных различий в кодовой базе. Поэтому перед развёртыванием проверь, какой актуальный репозиторий и документацию рекомендует команда Qwen.
Когда использовать Docker
Готовые Docker-образы позволяют пропустить большую часть настройки окружения. Это вариант для случая, когда подходящий образ соответствует выбранной модели и способу запуска.
Без Docker сначала настрой окружение, выполни требования проекта и установи зависимые библиотеки. В репозитории для этого приведена команда pip install -r requirements.txt.
Нужен ли flash-attention
Flash-attention рекомендуется для повышения эффективности и снижения потребления памяти на устройствах, поддерживающих fp16 или bf16. В описанном проекте поддерживается flash attention 2.
Установка flash-attention необязательна. Проект может нормально работать без него, поэтому отсутствие этого компонента само по себе не означает, что запуск невозможен.
Что делать, если Qwen не запускается или работает медленно
Начни с проверки способа запуска и требований именно для него. Проблемы сайта, мобильного приложения, API и локальной модели требуют разных действий.
- Проверь версию Python: требуется Python 3.8 или новее.
- Проверь версию PyTorch: требуется 1.12 или новее, рекомендована 2.0 или новее.
- Проверь версию Transformers: требуется 4.32 или новее.
- Проверь CUDA для GPU или flash-attention: рекомендована 11.4 или новее.
- Установи библиотеки командой pip install -r requirements.txt, если используешь запуск без Docker.
- Попробуй готовый Docker-образ, чтобы исключить часть ошибок настройки окружения.
Модель не скачивается из-за сети
При сетевых проблемах контрольную точку модели можно сначала получить из ModelScope, а затем загрузить из локальной папки. Используй этот вариант вместо повторных попыток загрузки тем же способом.
После скачивания укажи локальную папку как источник модели. Этот порядок описан именно как альтернативный подход при проблемах с сетью.
Локальная модель медленно работает на CPU
Для развёртывания на CPU разработчики настоятельно рекомендуют qwen.cpp, чистую реализацию Qwen и tiktoken на C++. Прямой запуск модели на CPU, вероятно, будет отличаться крайне низкой эффективностью инференса.
Если работа на CPU слишком медленная, проверь возможность использования qwen.cpp. Для классических Qwen3-0.6B и Qwen3-4B в источнике также указан вариант компьютера с CUDA-совместимым GPU.
Не получается загрузить файл или создать изображение
В мобильном приложении без дополнительной регистрации можно пользоваться чат-ботом, но нельзя загружать файлы и генерировать изображения. Войди в учётную запись и повтори действие.
Если не удаётся изменить глубину рассуждений в генераторе изображений, это соответствует указанному ограничению режима. Такая настройка для генерации изображений недоступна.
Аудио или видео не принимается
Проверь продолжительность файла: Qwen анализирует видео- и аудиоматериалы длительностью не более трёх минут. Если материал превышает этот лимит, описанный режим не соответствует условиям источника.
Для поддерживаемого файла сформулируй задачу анализа и прикрепи материал. Возможность анализа аудио и видео относится к Qwen3.
Чем отличаются сайт, приложение, API и локальная модель
Выбор зависит от задачи: официальный сайт даёт готовый чат после регистрации, приложение добавляет мобильный ввод и работу с файлами, API тарифицируется по использованию, а локальный запуск требует собственного оборудования и настройки.
- Выбирай сайт, если нужен готовый чат и подходит регистрация через почту, Google или GitHub.
- Выбирай приложение, если важны текстовый и голосовой ввод, а также работа с Word и PDF.
- Выбирай Model API, если нужен программный вызов моделей с оплатой по фактическому использованию.
- Выбирай локальную модель, если готов установить опубликованные файлы на собственное оборудование.
- Для CPU рассмотри qwen.cpp, поскольку прямой запуск может иметь крайне низкую эффективность.
Чем базовые модели отличаются от чат-моделей
В старом репозитории открыты базовые модели Qwen размеров 1.8B, 7B, 14B и 72B. Там же опубликованы чат-модели Qwen-1.8B-Chat, Qwen-7B-Chat, Qwen-14B-Chat и Qwen-72B-Chat.
Базовые модели предварительно обучались максимум на 3 трлн токенов многоязычных данных с охватом разных областей и акцентом на китайский и английский языки. Чат-модели отдельно описаны как инструменты для диалога, создания контента и решения прикладных задач.
Какие возможности были добавлены в старую линейку
30 ноября 2023 года были выпущены Qwen-72B, Qwen-72B-Chat, Qwen-1.8B и Qwen-1.8B-Chat. Qwen-72B и Qwen-72B-Chat обучались на 3T токенов и поддерживали контекст 32k.
17 октября 2023 года появились квантованные модели Qwen-7B-Chat-Int8 и Qwen-14B-Chat-Int8. 12 сентября 2023 года для Qwen-7B добавили полное дообучение, LoRA и Q-LoRA.
Эти сведения относятся к старому репозиторию QwenLM/Qwen, который больше активно не поддерживается. Для нового проекта проверь актуальную линейку и инструкции команды Qwen.
Ограничения, которые важно проверить до работы
У Qwen различаются ограничения сайта, приложения, API и локальных моделей. Перед выбором варианта проверь регион, аккаунт, формат файла, оборудование и правила тарификации.
- Для перечисленных моделей бесплатная квота Model Studio действует только в Сингапуре.
- Срок бесплатной квоты составляет 90 дней по правилу наиболее поздней даты.
- Без аккаунта в мобильном приложении нельзя загружать файлы и генерировать изображения.
- Бюджет рассуждений Qwen3 настраивается от 1024 до 38 912 токенов.
- В генераторе изображений глубина рассуждений не настраивается.
- Аудио и видео для анализа должны быть продолжительностью не более трёх минут.
- Для MoE-моделей требуется мощный GPU, например NVIDIA A100 или аналогичный.
Кому локальный запуск может не подойти
Локальный вариант может не подойти, если компьютер не соответствует требованиям выбранной модели. Для MoE-моделей указан мощный GPU уровня NVIDIA A100 или аналогичный, тогда как для Qwen3-0.6B и Qwen3-4B подходит компьютер с CUDA-совместимым GPU.
Запуск непосредственно на CPU может отличаться крайне низкой эффективностью инференса. Для CPU разработчики рекомендуют qwen.cpp.
Когда мобильного режима без аккаунта недостаточно
Режим без дополнительной регистрации подходит для общения с чат-ботом. Он не подходит для задачи, где нужно загрузить файл или создать изображение, поскольку эти функции без учётной записи недоступны.
Если планируешь работать с Word, PDF или генерацией изображений, заранее войди в аккаунт. Приложение поддерживает Word и PDF, а генератор позволяет использовать до пяти референсов.
Что учесть при работе с данными
В Google Play указано, что данные приложения шифруются при передаче. Пользователь также может запросить удаление данных.
Эти сведения не описывают все условия обработки данных. Перед загрузкой рабочих материалов проверь актуальную политику конфиденциальности и параметры удаления на официальной странице приложения.
Что перепроверить на официальных страницах Qwen
Цены, акции, доступность приложений и модельный ряд могут меняться. Перед оплатой или техническим развёртыванием сверь выбранный сценарий с официальной страницей продукта и актуальной документацией.
- Проверь действующие акции в консоли Model Studio: ценовой документ содержит только стандартные ставки.
- Проверь регион и наличие бесплатной квоты для конкретной модели.
- Проверь дату начала и окончания своей бесплатной квоты по правилу 90 дней.
- Проверь актуальные цены и условия встроенных покупок Qwen Go, Qwen Plus и Qwen Pro.
- Проверь требования приложения для конкретного устройства на его официальной странице.
- Проверь актуальный репозиторий для локальной установки, поскольку QwenLM/Qwen больше активно не поддерживается.
- Проверь подходящую модель и требования к GPU до загрузки локальных файлов.
Что сверить перед оплатой API
Уточни регион, модель, режим рассуждений, объём входных токенов и ожидаемый объём ответа. В многоуровневой схеме ставка определяется общим числом входных токенов одного запроса, а все токены запроса оплачиваются по цене соответствующего уровня.
Проверь, поддерживает ли выбранная модель пакетные вызовы и контекстный кеш. Скидки пакетного инференса и контекстного кеша одновременно не применяются.
Что сверить перед локальной установкой
Проверь формат модели, программные версии и доступное оборудование. Для Ollama указан формат GGUF, а старый репозиторий требует Python 3.8 или новее, PyTorch 1.12 или новее и Transformers 4.32 или новее.
Если планируется GPU или flash-attention, проверь CUDA 11.4 или новее. Flash-attention остаётся необязательным компонентом, хотя на fp16 или bf16 он рекомендован для большей эффективности и меньшего потребления памяти.

Частые вопросы
Можно ли зарегистрироваться в Qwen из России?
По данным источника, для начала работы на официальном сайте нужно зарегистрироваться, но иностранный номер и карта иностранного банка не требуются. Создать учётную запись можно через электронную почту, Google или GitHub.
Можно ли пользоваться мобильным приложением без аккаунта?
Да, сразу после скачивания чат-бот доступен без дополнительной регистрации. Однако без учётной записи нельзя загружать файлы и генерировать изображения.
Поддерживает ли Qwen русский язык?
Для Qwen3 заявлена поддержка 119 языков и диалектов, включая русский и украинский. В приложении также указан мгновенный перевод более чем на 100 языков и диалектов.
Можно ли загрузить в Qwen документ?
Приложение работает с файлами Word и PDF. В мобильном режиме без учётной записи загрузка файлов недоступна.
Можно ли анализировать аудио и видео?
Qwen3 умеет анализировать прикреплённые аудио и видео. Продолжительность такого файла должна быть не более трёх минут.
Сколько стоит использование Qwen API?
Model API по умолчанию оплачивается по фактическому использованию, а Qwen-Max тарифицирует входные и выходные токены. Стандартная ставка зависит от модели, региона и уровня запроса; действующие акции нужно проверять в консоли Model Studio.
Есть ли бесплатная квота для API?
У перечисленных в ценовом документе моделей бесплатная квота доступна только в Сингапуре и действует 90 дней с наиболее поздней из дат активации Model Studio, выпуска модели или одобрения заявки.
Можно ли установить Qwen на свой компьютер?
Любую модель семейства можно установить локально из опубликованных на Hugging Face файлов. Для Ollama требуется формат GGUF; Qwen3-0.6B и Qwen3-4B подходят для компьютера с CUDA-совместимым GPU, а MoE-моделям нужен мощный GPU, например NVIDIA A100 или аналогичный.
Что делать, если Qwen очень медленно работает на CPU?
Разработчики настоятельно рекомендуют для CPU реализацию qwen.cpp. Прямой запуск модели на CPU, вероятно, будет отличаться крайне низкой эффективностью инференса.
Источники и проверка
- Model inference pricing - Alibaba Cloud, alibabacloud.com (первоисточник). Прочитано 5 октября 2026.
- GitHub - QwenLM/Qwen: The official repo of Qwen (通义千问) chat & pretrained large language model proposed by Alibaba Cloud., github.com (первоисточник). Прочитано 5 октября 2026.
- Qwen - Alibaba AI Assistant App - App Store, apps.apple.com (первоисточник). Прочитано 5 октября 2026.
- Qwen - Alibaba AI Assistant - Apps on Google Play, play.google.com (первоисточник). Прочитано 5 октября 2026.
- Qwen от Alibaba — обзор vc.ru, vc.ru. Прочитано 5 октября 2026.
Суммы в рублях пересчитаны по курсу ЦБ РФ на 03.10.2026 и даны ориентировочно: комиссии банков и налоги не учтены.
Подготовлено с помощью ИИ по первоисточникам и проверено автоматически: факты, числа и цитаты сверены с источниками. Человек статью перед выходом не читал. Если нашёл ошибку, напиши через контакты.