Создание искусственного интеллекта на смартфоне: как работают нейросети и какие функции доступны уже сегодня

Подробный разбор технологий ИИ в смартфонах: NPU, гибридные вычисления, примеры функций от Samsung, Apple и Google, ограничения и будущее мобильного ИИ.

Что такое искусственный интеллект в смартфоне и как он работает

Искусственный интеллект (ИИ) в мобильных устройствах — это не магия, а набор алгоритмов, которые имитируют человеческое мышление. В отличие от облачных сервисов, мобильный ИИ обрабатывает данные прямо на устройстве, используя специализированные компоненты. Ключевой элемент — нейропроцессор (NPU), который входит в состав однокристальной системы (SoC). NPU не отвечает за графику или общую логику приложений, его задача — ускорять операции машинного обучения: распознавание образов, обработку естественного языка, генерацию контента. Вместе с CPU и GPU он позволяет выполнять задачи локально, без отправки данных в облако. Это снижает задержки, экономит трафик и повышает конфиденциальность. Например, когда вы фотографируете, NPU помогает распознать лицо, настроить фокус и улучшить снимок в реальном времени. Современные чипы, такие как Snapdragon 8 Gen 3, поддерживают модели с до 10 миллиардов параметров, работающие исключительно на устройстве.

NPU и SoC: аппаратная основа мобильного ИИ

Нейропроцессор (NPU) — это специализированный блок внутри SoC, оптимизированный для матричных вычислений, характерных для нейросетей. В отличие от CPU, который выполняет последовательные задачи, и GPU, ориентированного на параллельную обработку графики, NPU спроектирован для эффективного выполнения операций свёртки и активации. Это позволяет обрабатывать изображения, голос и текст с минимальным энергопотреблением. Например, в чипах Google Tensor используется EdgeTPU, а Qualcomm внедрила AI Engine. NPU отвечает за такие функции, как улучшение фото (шумоподавление, суперразрешение), распознавание лиц и объектов, обработка голоса (шумоподавление, распознавание речи), AR-фильтры и локальная генерация текста. Благодаря NPU данные остаются на устройстве, что критически важно для приватности. Однако не все задачи решаются локально: ресурсоёмкие операции, такие как обучение моделей или сложная генерация, могут требовать облачных вычислений. В таких случаях используется гибридный подход: быстрые задачи выполняются на NPU, а сложные отправляются в облако.

Гибридный ИИ: как сочетаются локальные и облачные вычисления

Большинство современных смартфонов используют гибридную модель ИИ. Локальный NPU обрабатывает простые и частые задачи — например, распознавание лиц при разблокировке или улучшение фото. Облачные серверы подключаются для сложных операций: генерация изображений по текстовому запросу, перевод длинных текстов, анализ больших объёмов данных. Такой подход балансирует скорость, приватность и вычислительные возможности. Например, функция Circle to Search от Google работает локально для распознавания объектов на экране, но для поиска информации обращается к облаку. Samsung Galaxy AI использует собственные модели и Google Gemini Nano: часть функций выполняется на устройстве, часть — через облако. Пользователь может контролировать этот процесс в настройках конфиденциальности, выбирая, какие данные обрабатывать локально. Гибридная архитектура позволяет смартфонам оставаться компактными и энергоэффективными, не жертвуя функциональностью.

Основные функции ИИ на смартфонах: от фото до перевода

ИИ на смартфонах охватывает несколько ключевых областей. Фото и видео: автоматическое улучшение снимков, удаление объектов (Object Eraser), перемещение элементов, создание клипов из лучших моментов (Auto Trim), шумоподавление в видео. Текст и коммуникации: генерация и редактирование текста, проверка орфографии, изменение стиля, перевод в реальном времени во время звонков, расшифровка аудиозаписей, создание сводок. Поиск и навигация: Circle to Search позволяет обвести любой объект на экране и найти его в интернете, распознавание текста на изображениях. Здоровье: анализ сна, подсчёт шагов, персонализированные рекомендации на основе данных с носимых устройств. Безопасность: проверка вызовов на спам, автоматическое завершение подозрительных звонков, шифрование данных. Например, Samsung Galaxy AI предлагает функцию «Мой день» — персонализированный дайджест с погодой, событиями и напоминаниями. Apple Intelligence включает Genmoji (генерация эмодзи) и Image Playground (создание изображений). Google Pixel использует Gemini для контекстных подсказок и автоматизации.

Samsung Galaxy AI: возможности и ограничения

Samsung Galaxy AI, представленный в 2024 году, доступен на устройствах начиная с серии S24. Он включает функции: синхронный перевод звонков, редактирование фото (удаление/перемещение объектов), создание клипов, шумоподавление, ассистент по письму, проверка вызовов. Используется гибридный ИИ: часть задач выполняется локально, часть — через облако. Пользователи отмечают, что некоторые функции работают нестабильно, зависят от региона и языка, а также требуют подключения к интернету для лучшего качества. Samsung заявляет, что ИИ-функции бесплатны до конца 2025 года, после чего возможен переход на подписку. Это вызвало недовольство среди владельцев флагманов. По данным опросов, 87% владельцев Galaxy считают ИИ-функции бесполезными, а 94,5% не готовы платить за них. Тем не менее, компания продолжает развивать технологию, интегрируя её в бюджетные модели серии A и обсуждая партнёрство с Perplexity для замены Bixby.

Apple Intelligence: особенности экосистемы и ограничения

Apple Intelligence, анонсированный на WWDC 2024, доступен на устройствах с процессором A17 Pro (iPhone 15 Pro и новее) под управлением iOS 18.1. Функции включают: генерацию и редактирование текста, создание изображений (Image Playground), генерацию эмодзи (Genmoji), улучшение фото, конспектирование заметок, интеграцию с ChatGPT. Apple делает упор на приватность: данные обрабатываются локально, а при необходимости — в приватных облаках, которые не сохраняют информацию. Однако Apple Intelligence не поддерживает русский язык, что ограничивает его использование в России. Пользователи жалуются на неточности в сводках уведомлений — нейросети плохо улавливают контекст и иронию. Регуляторы США запретили Apple заявлять, что Apple Intelligence «уже доступен», так как многие функции находятся в тестировании. Несмотря на это, интеграция с ChatGPT и улучшенная Siri делают экосистему Apple привлекательной для англоязычных пользователей.

Google Pixel и Gemini: ИИ от поискового гиганта

Google Pixel использует собственные модели Gemini, которые интегрированы в систему на уровне ядра. Функции включают: Circle to Search, Magic Editor (редактирование фото с генеративным заполнением), Best Take (выбор лучших лиц из серии снимков), распознавание музыки, контекстные подсказки. Gemini Nano — облегчённая версия модели, работающая локально на устройстве. Она отвечает за такие задачи, как суммирование сообщений, умные ответы и улучшение качества съёмки. Google также предлагает облачные функции через Gemini Assistant, который может анализировать документы, генерировать текст и отвечать на вопросы. Преимущество Pixel — глубокая интеграция с сервисами Google и постоянные обновления. Однако, как и у конкурентов, некоторые функции требуют подключения к интернету и доступны не во всех регионах. Google активно развивает ИИ на устройстве, чтобы снизить зависимость от облака и повысить конфиденциальность.

Как включить и настроить ИИ на смартфоне

Настройка ИИ зависит от производителя. Samsung: войдите в Samsung Account, затем перейдите в Настройки → Дополнительные функции → AI-функции или Galaxy AI. Здесь можно включить или отключить отдельные опции, такие как перевод звонков или редактирование фото. Apple: на iPhone с iOS 18.1 откройте Настройки → Apple Intelligence и Siri → включите Apple Intelligence. Для работы потребуется около 7 ГБ свободного места для загрузки модели. Google Pixel: ИИ-функции обычно включены по умолчанию, но их можно настроить в Настройки → Google → Gemini. Важно помнить, что некоторые функции требуют подключения к интернету и могут быть недоступны в определённых странах. Рекомендуется регулярно обновлять ПО, так как производители добавляют новые возможности. Также стоит обратить внимание на настройки конфиденциальности: можно выбрать, какие данные обрабатываются локально, а какие — в облаке.

Будущее мобильного ИИ: тренды и прогнозы

Мобильный ИИ продолжает эволюционировать. Основные тренды: увеличение производительности NPU — новые чипы смогут запускать модели с сотнями миллиардов параметров локально; расширение функционала — ИИ будет управлять питанием, предсказывать поведение пользователя, автоматизировать рутинные задачи; интеграция с носимыми устройствами — умные часы и наушники получат собственные NPU для обработки данных без смартфона; развитие генеративного ИИ — создание контента (текст, изображения, видео) прямо на устройстве; повышение конфиденциальности — всё больше данных будет обрабатываться локально. Однако остаются вызовы: ограничения аппаратного обеспечения, высокая стоимость флагманов с NPU, необходимость в постоянном интернет-соединении для некоторых функций. По прогнозам, к 2027 году большинство смартфонов среднего сегмента будут оснащены NPU, а ИИ-функции станут стандартом, как когда-то стали камеры и сканеры отпечатков пальцев.

Ограничения и критика современных ИИ-функций

Несмотря на прогресс, пользователи и эксперты отмечают ряд проблем. Нестабильная работа: многие функции работают с перебоями, зависят от региона, языка и модели устройства. Навязчивость: ИИ-подсказки могут мешать, заменяя обычный поиск. Платный доступ: Samsung и другие производители рассматривают подписку на ИИ, что вызывает негативную реакцию. Конфиденциальность: хотя локальная обработка повышает безопасность, облачные компоненты всё ещё могут передавать данные. Ограниченная полезность: по данным опросов, большинство пользователей не видят практической ценности в ИИ-функциях. Ошибки: нейросети могут неправильно интерпретировать контекст, что приводит к курьёзам (например, неверная сводка уведомлений). Производителям предстоит решить这些问题, чтобы ИИ стал действительно востребованным инструментом, а не маркетинговой фишкой.

Вопросы и ответы

Что такое NPU в смартфоне и зачем он нужен?

NPU (Neural Processing Unit) — это специализированный процессор для ускорения задач машинного обучения. Он отвечает за распознавание лиц, улучшение фото, обработку голоса и другие ИИ-функции. NPU работает быстрее и энергоэффективнее, чем CPU или GPU, при выполнении нейросетевых операций.

Какие смартфоны поддерживают ИИ на устройстве?

ИИ на устройстве поддерживают флагманы последних лет: Samsung Galaxy S24 и новее, iPhone 15 Pro и новее (с iOS 18.1), Google Pixel 8 и новее. Некоторые функции постепенно появляются и в моделях среднего сегмента, например, в Samsung Galaxy A серии.

Нужен ли интернет для работы ИИ на смартфоне?

Не всегда. Базовые функции (распознавание лиц, улучшение фото) работают локально. Для сложных задач (генерация изображений, перевод длинных текстов) часто требуется интернет, так как они выполняются в облаке. Пользователь может настроить, какие данные обрабатывать локально.

Безопасны ли ИИ-функции для личных данных?

Производители заявляют о высоком уровне конфиденциальности: данные шифруются и обрабатываются локально или в приватных облаках. Однако некоторые функции всё же передают информацию на серверы. Рекомендуется проверять настройки конфиденциальности и отключать облачную обработку для чувствительных данных.

Почему ИИ-функции на смартфонах часто критикуют?

Основные жалобы: нестабильная работа, зависимость от региона, навязчивость, возможный переход на платную подписку, а также недостаточная полезность. Многие пользователи считают, что ИИ не приносит реальной пользы, а лишь усложняет интерфейс.

Как включить ИИ на Samsung Galaxy?

Войдите в Samsung Account, затем перейдите в Настройки → Дополнительные функции → AI-функции или Galaxy AI. Там можно активировать нужные опции: перевод звонков, редактирование фото, ассистент по письму и другие.

Будет ли ИИ на смартфонах платным?

Samsung заявляет, что Galaxy AI бесплатен до конца 2025 года, после чего возможен переход на подписку. Apple пока не объявляла о платных функциях, но не исключает этого в будущем. Google сохраняет базовые функции бесплатными, но продвинутые могут требовать подписки на Gemini.