Рубрика

IT & RAG

LLM-инженерия, RAG, open source модели, API и инфраструктура.

Обновлено 31 июл. 2026 г., 01:20 85 материалов

Лента

Страница 6 из 15
Корпоративный ИИ переходит на малые языковые модели (SLM): приватность и экономия в 10–30 раз
IT & RAG Модели LLM & SLM 9 июл. 2026 г., 20:27 1 мин

Корпоративный ИИ переходит на малые языковые модели (SLM): приватность и экономия в 10–30 раз

Бизнес-сектор 2026 года совершает парадигмальный переход от универсальных больших языковых моделей (LLM) к специализированным малым языковым моделям (SLM). Новая архитектура, объединяющая периферийные SLM с облачными LLM, решает критические проблемы конфиденциальности данных и снижает стоимость инференса в десятки раз, делая ИИ рациональным выбором для массовых бизнес-задач.

Венчурный капитал концентрируется вокруг AI-инфраструктуры: чипы для inference, дата-центры и корпоративные агенты
IT & RAG Железо и инфраструктура 9 июл. 2026 г., 13:16 1 мин

Венчурный капитал концентрируется вокруг AI-инфраструктуры: чипы для inference, дата-центры и корпоративные агенты

Венчурные инвестиции в сегмент AI-инфраструктуры демонстрируют новую фазу роста: капитал перераспределяется от потребительских приложений к базовому слою экономики — чипам, вычислительным кластерам и инструментам внедрения ИИ в бизнес-процессы.

Open Source RAG-движок LlamaIndex 4.0 анонсирован с поддержкой гибридного поиска и автоматической оптимизации пайплайнов
IT & RAG Open Source 7 июл. 2026 г., 01:21 1 мин

Open Source RAG-движок LlamaIndex 4.0 анонсирован с поддержкой гибридного поиска и автоматической оптимизации пайплайнов

Компания LlamaIndex, один из ключевых разработчиков инфраструктуры для построения систем генеративного поиска (RAG), официально выпустила версию 4.0 своего открытого движка. Новое обновление фокусируется на решении фундаментальных проблем масштабируемости и точности извлечения данных в бизнес-средах, предлагая гибридный поиск и автоматическую оптимизацию пайплайнов без участия человека.

Архитектура RAG становится стандартом для корпоративного ИИ: Microsoft и Google внедряют гибридные поисковые модели в бизнес-платформы
IT & RAG Архитектура RAG 6 июл. 2026 г., 22:20 1 мин

Архитектура RAG становится стандартом для корпоративного ИИ: Microsoft и Google внедряют гибридные поисковые модели в бизнес-платформы

В последние дни на технологическом рынке произошла знаковая трансформация, связанная с массовым переходом корпоративных секторов на архитектуру RAG (Retrieval-Augmented Generation). Крупнейшие игроки индустрии, включая Microsoft и Google, официально подтвердили интеграцию гибридных поисковых моделей в свои ключевые бизнес-платформы, что фактически закрепляет RAG как новый стандарт для искусственного интеллекта в бизнесе. Эта новость, озвученная в ходе технических презентаций за последние 48 часо

LLM и SLM в действии: как RAG-технологии меняют бизнес-аналитику и генеративный поиск
IT & RAG Модели LLM & SLM 6 июл. 2026 г., 20:21 1 мин

LLM и SLM в действии: как RAG-технологии меняют бизнес-аналитику и генеративный поиск

Большие языковые модели (LLM) и их компактные аналоги (SLM) перешли из стадии экспериментальных разработок в фазу реального промышленного применения, где ключевым драйвером эффективности становится технология RAG (Retrieval-Augmented Generation). В отличие от универсальных LLM, обученных на гигантских массивах текстов, малые модели SLM демонстрируют заметное преимущество в решении узкоспециализированных задач, требующих высокой точности и минимальных вычислительных ресурсов. Суть современного по

NVIDIA и Microsoft объявили о создании первой в мире инфраструктуры RAG на базе чипов Blackwell для обработки триллионов запросов в реальном времени
IT & RAG Железо и инфраструктура 6 июл. 2026 г., 13:10 1 мин

NVIDIA и Microsoft объявили о создании первой в мире инфраструктуры RAG на базе чипов Blackwell для обработки триллионов запросов в реальном времени

Крупнейшие технологические гиганты мира, NVIDIA и Microsoft, совершили стратегический прорыв, который переопределяет архитектуру искусственного интеллекта в бизнесе. В ходе совместного анонса компании подтвердили запуск первой в мире масштабируемой инфраструктуры для систем генеративного поиска (RAG), построенной исключительно на базе новейших чипов NVIDIA Blackwell. Это решение предназначено для обработки триллионов запросов в реальном времени, устраняя критические ограничения пропускной способ

Контекст рубрики

IT & RAG — технический раздел DigestAI для разработчиков, ML/LLM-инженеров и CTO. Здесь собраны новости о моделях, retrieval augmented generation, inference, API, open source проектах, бенчмарках и практических ограничениях внедрения.