[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"glossary-edge-ai::ru":3,"gloss-cluster-edge-ai::ru":23,"gloss-next-edge-ai::ru":9},{"slug":4,"category":5,"name":6,"definition":7,"meta_desc":8,"faq":9,"schema_markup":9,"related":10},"edge-ai","cloud","Edge AI (ИИ на устройстве)","Edge AI выполняет инференс модели на устройстве, порождающем данные, или рядом с ним — телефоны, браузеры, IoT-датчики, заводские шлюзы — вместо похода в облачный API. Выигрыши: задержка (без сетевого прыжка реальны ответы быстрее 50 мс), приватность (сырые данные не покидают устройство), устойчивость офлайн и нулевые счета за инференс по запросам. Ограничение — возможности: на edge-железо помещаются квантизованные малые языковые модели, дистиллированные модели зрения и речи, но не фронтирные LLM, поэтому точность отстаёт от облака. Мейнстрим-примеры — on-device-уровень Apple Intelligence, Gemini Nano на Android и инференс в браузере через WebGPU и ONNX Runtime. Доминирующий продакшн-паттерн — гибрид: частые, чувствительные к задержке или приватные запросы обрабатываются локально, а сложные эскалируются в облачную модель. Для SaaS-команд edge AI — это ещё и история о цене: стоимость инференса переносится с вашей маржи на железо, которым клиент уже владеет.","Edge AI выполняет инференс на устройстве, а не в облаке: ниже задержка, лучше приватность, работа офлайн и нулевая стоимость запросов.",null,[11,14,17,20],{"slug":12,"name":13},"inference","Инференс",{"slug":15,"name":16},"latency","Задержка (Latency)",{"slug":18,"name":19},"quantization","Квантизация",{"slug":21,"name":22},"small-language-model","Малая языковая модель (SLM)",[24,28,31,34,38,41,44,47,50,53,56,59],{"slug":25,"category":5,"name":26,"updated_at":27},"autoscaling","Автомасштабирование (Autoscaling)","2026-08-24T02:46:37+00:00",{"slug":29,"category":5,"name":30,"updated_at":27},"availability-zone","Зона доступности (Availability Zone)",{"slug":32,"category":5,"name":33,"updated_at":27},"block-storage","Блочное хранилище (Block Storage)",{"slug":35,"category":5,"name":36,"updated_at":37},"disaster-recovery","Аварийное восстановление","2026-08-24T02:46:38+00:00",{"slug":39,"category":5,"name":40,"updated_at":27},"egress-fees","Плата за исходящий трафик (Egress)",{"slug":42,"category":5,"name":43,"updated_at":27},"finops","FinOps (управление облачными расходами)",{"slug":45,"category":5,"name":46,"updated_at":37},"immutable-infrastructure","Неизменяемая инфраструктура",{"slug":48,"category":5,"name":49,"updated_at":37},"infrastructure-drift","Дрейф инфраструктуры",{"slug":51,"category":5,"name":52,"updated_at":27},"managed-kubernetes","Управляемый Kubernetes (Managed Kubernetes)",{"slug":54,"category":5,"name":55,"updated_at":27},"multi-region","Мультирегиональная архитектура (Multi-Region)",{"slug":57,"category":5,"name":58,"updated_at":37},"noisy-neighbor","Шумный сосед",{"slug":60,"category":5,"name":61,"updated_at":27},"platform-as-a-service","Платформа как услуга (PaaS)"]