Trend Radar

INFRA · DAILY · 30 ИЮЛЯ

Nvidia вложит $5 млрд в Safe Superintelligence Ильи Суцкевера на фоне новой волны AI-финансирования

Nvidia вложит $5 млрд в Safe Superintelligence Ильи Суцкевера на фоне новой волны AI-финансирования

AI-инфраструктура снова концентрируется вокруг капитала, compute и контроля над модельными стеком, но параллельно растёт давление за сохранение open-weight моделей. Для агентных платформ ключевыми становятся локальный inference, provider routing, безопасность sandbox и гибридная эксплуатация

🧠 Model

Gemini 3.5 задержан

Google задерживает Gemini 3.5 Pro на месяцы, чтобы подтянуть качество модели, особенно в coding-сценариях

Даже лидеры срывают roadmap по качеству, поэтому агентной инфраструктуре нужны независимые evals, model fallback и отсутствие ставки на один будущий релиз

bloomberg.com

⚡ Big Labs

Open weights под давлением

Nvidia, Mistral и другие AI-компании призывают США не вводить широкие ограничения на open-weight модели в ответ на китайскую AI-конкуренцию

Открытые веса важны для локального inference, суверенных развёртываний и независимого fallback, поэтому regulatory risk вокруг них напрямую влияет на архитектуру агентов

techcrunch.com

🚀 Funding

Nvidia финансирует SSI

Nvidia, по данным Bloomberg, обязалась инвестировать $5 млрд в Safe Superintelligence Ильи Суцкевера

Крупные compute-поставщики всё сильнее связывают капитал и доступ к инфраструктуре, поэтому агентным платформам нужно избегать зависимости от одного GPU- и model-канала

bloomberg.com

🔧 Tools

Локальный agent inference

llmdev.guide собирает реальные бенчмарки устройств для локального запуска LLM-агентов, а AnythingLLM развивает пассивный персональный hybrid AI experience

Локальный и гибридный режимы становятся практической защитой от квот, приватностных рисков и провайдерных сбоев в агентной инфраструктуре

github.com · github.com

🏗 Infrastructure

TensorRT-LLM ускоряет GPU

NVIDIA TensorRT-LLM продолжает развивать оптимизации для эффективного inference LLM на NVIDIA GPU через Python API

Inference-стоимость и latency остаются базовой экономикой агентных систем, особенно при параллельных сессиях, routing и long-running workflows

github.com

ПоделитьсяTelegramX
Ещё из Infra