Trend Radar

INFRA · DAILY · 3 АВГУСТА

OpenClaw v2026

OpenClaw v2026.7.2-beta.7 вышел 2 августа с state safety, SQLite recovery и durable channel delivery

Агентная инфраструктура продолжает фокусироваться на надёжности состояния, inference-эффективности и безопасном developer workflow. Большие игроки одновременно уходят в собственные модели, промышленные сценарии и вертикальную интеграцию compute

⚡ Big Labs

Microsoft строит модели

Microsoft всё открытее конкурирует с OpenAI и Anthropic, продвигая собственные AI-модели, harnesses и конкурента Mythos

Платформенные партнёрства становятся менее стабильными, поэтому агентной инфраструктуре нужны provider abstraction, evals и переносимость workflow между модельными стеками

techcrunch.com

Mistral идёт в industrial AI

Mistral запускает Vibe, расширяется в industrial AI и объявляет data center push для конкуренции с OpenAI

Industrial AI требует self-hosting, управляемого compute, интеграции с инженерными системами и строгих policy controls, что расширяет требования к агентной платформе за пределы офисных workflow

venturebeat.com

🚀 Funding

Encore учит агентов

Encore AI привлекла $30 млн на агентов, которые учатся на customer calls, сообщениях и CRM-данных для поддержки продаж и customer support

Операционные данные становятся обучающим слоем для агентов, поэтому нужны privacy controls, data pipelines, evals и безопасный цикл обновления playbooks

techcrunch.com

🔧 Tools

OpenClaw укрепляет состояние

OpenClaw v2026.7.2-beta.7 продолжает линию state safety: quarantine store, crash-recoverable SQLite snapshots, crash-durable filesystem publication и rollback-writer recovery

Для агентной платформы это критичный слой, потому что реальные сбои часто происходят в миграциях, БД, доставке сообщений и восстановлении после падений, а не только в модели

github.com

🏗 Infrastructure

TensorRT-LLM масштабирует inference

NVIDIA TensorRT-LLM поддерживает inference от single-GPU до multi-GPU и multi-node deployments через Python LLM API и стратегии параллелизма

Параллельные агентные сессии и long-running workflows требуют управляемой производительности, низкой latency и оптимизации стоимости inference на разных GPU-конфигурациях

github.com

ПоделитьсяTelegramX
Ещё из Infra