Рубрика

IT & RAG

LLM-инженерия, RAG, open source модели, API и инфраструктура.

Обновлено 31 июл. 2026 г., 01:20 85 материалов

Лента

Страница 2 из 15
NVIDIA подталкивает рынок к малым языковым моделям: бизнес ищет замену дорогим LLM в агентных сценариях
IT & RAG Модели LLM & SLM 27 июл. 2026 г., 20:21 1 мин

NVIDIA подталкивает рынок к малым языковым моделям: бизнес ищет замену дорогим LLM в агентных сценариях

На фоне роста затрат на большие языковые модели компании все активнее пересматривают архитектуру ИИ-систем в пользу SLM. В отраслевых публикациях и аналитических разборках за последние дни тезис сводится к одному: для рутинных агентных задач малые модели могут оказаться быстрее, дешевле и практичнее.

На рынке ИИ-инфраструктуры усилилась гонка за вычислительные мощности и энергию
IT & RAG Железо и инфраструктура 27 июл. 2026 г., 13:32 1 мин

На рынке ИИ-инфраструктуры усилилась гонка за вычислительные мощности и энергию

За последние три дня в центре внимания мирового рынка оказались новые планы по наращиванию ИИ-инфраструктуры: компании и дата-центры одновременно борются за GPU, энергомощности и сетевую пропускную способность. На фоне этого спроса «железо» для ИИ все заметнее становится не вспомогательной, а стратегической частью бизнеса.

Open Source-проекты для RAG снова вышли в центр внимания на фоне новых агентных рабочих процессов
IT & RAG Open Source 25 июл. 2026 г., 01:20 1 мин

Open Source-проекты для RAG снова вышли в центр внимания на фоне новых агентных рабочих процессов

Рынок открытого ИИ-инструментария для поиска и генерации ответа за последние дни заметно сместился от демонстраций к прикладной автоматизации. В центре внимания оказались open source-проекты, которые связывают RAG, агентные сценарии и GitHub Actions в один рабочий контур.

В ИИ-индустрии снова спорят о RAG: компании пересматривают архитектуру поисковой генерации
IT & RAG Архитектура RAG 24 июл. 2026 г., 22:20 1 мин

В ИИ-индустрии снова спорят о RAG: компании пересматривают архитектуру поисковой генерации

На фоне бурного роста корпоративных ИИ-проектов RAG снова оказался в центре дискуссии: от него ждут точности и актуальности, но на практике архитектура требует более сложной настройки, чем многие компании предполагали. Последние публикации и технические разборы показывают, что бизнес все чаще уходит от простого «векторного поиска плюс LLM» к многоступенчатым схемам с переранжированием, оценкой качества и контролем источников.

Корпоративные ИИ-системы все чаще переходят на SLM вместо универсальных LLM
IT & RAG Модели LLM & SLM 24 июл. 2026 г., 20:20 1 мин

Корпоративные ИИ-системы все чаще переходят на SLM вместо универсальных LLM

На рынке корпоративного ИИ усиливается сдвиг от универсальных больших языковых моделей к компактным SLM, которые дешевле в эксплуатации, проще локально разворачиваются и лучше подходят для узких бизнес-задач. Об этом свидетельствуют свежие отраслевые публикации и прикладные разборы от российских и международных поставщиков инфраструктуры ИИ.

Корпоративный спрос на ИИ-«железо» ускорил перестройку инфраструктуры дата-центров
IT & RAG Железо и инфраструктура 24 июл. 2026 г., 13:11 1 мин

Корпоративный спрос на ИИ-«железо» ускорил перестройку инфраструктуры дата-центров

За последние три дня в отраслевых публикациях вновь усилилась тема ИИ-инфраструктуры: компании упираются не в модели, а в вычислительные мощности, охлаждение, сеть и хранение данных. На этом фоне рынок все чаще обсуждает не только GPUs, но и то, как быстро дата-центры смогут перестроиться под новые нагрузки.

Контекст рубрики

IT & RAG — технический раздел DigestAI для разработчиков, ML/LLM-инженеров и CTO. Здесь собраны новости о моделях, retrieval augmented generation, inference, API, open source проектах, бенчмарках и практических ограничениях внедрения.