Trend Radar

INFRA · DAILY · 29 ИЮЛЯ

DeepSeek приостановила второй раунд после оценки $52 млрд на фоне вирусных комментариев о зависимости…

DeepSeek приостановила второй раунд после оценки $52 млрд на фоне вирусных комментариев о зависимости от Nvidia

AI-инфраструктура становится всё более геополитичной: капитал, чипы, модели и публичные нарративы напрямую влияют на устойчивость компаний. Технически рынок движется к агентным ОС, reusable architecture knowledge и мультимодальным моделям, которые объединяют текст, аудио, видео и действия

🧠 Model

Мультимодальность усложняется

Обзоры multimodal transformers показывают движение к any-to-any архитектурам, где новые модальности токенизируются и обучаются в единой модели

Агентам с экраном, голосом, видео и документами нужен единый контекстный слой, иначе orchestration распадается на хрупкие пайплайны между модальностями

arxiv.org · arxiv.org · arxiv.org

⚡ Big Labs

Mistral проверяет код

Leanstral 1.5 от Mistral использует Lean 4 для формальной проверки поведения программ и снижает стоимость критической верификации

Для coding-агентов следующий рубеж — не только писать код, но и доказывать корректность критичных изменений через формальные методы и проверяемые спецификации

medium.com · opendatascience.com

🚀 Funding

DeepSeek ставит паузу

DeepSeek приостановила второй раунд привлечения после первого раунда на $7,4 млрд при оценке $52 млрд и вирусных комментариев о зависимости от Nvidia

Даже сильные model-компании уязвимы к compute-зависимости и политическим нарративам, поэтому агентной инфраструктуре нужны мультипровайдерность, локальные fallback и контроль supply-chain рисков

bloomberg.com · caproasia.com

🔧 Tools

AIOS как агентная ОС

AIOS развивает концепцию LLM как операционной системы и агентов как приложений с поддержкой внешних tool calls

Агентной инфраструктуре нужен системный слой планирования, памяти, tool access, permissions и lifecycle management, а не набор разрозненных чат-ботов

github.com

ArchSpace для архитектур

InternLM ArchSpace собирает эксперименты по LLM-архитектурам в reusable knowledge для сообщества

Повторяемое знание об архитектурах помогает быстрее выбирать модели и оптимизации для агентных нагрузок вместо ручного перебора по слухам и бенчмаркам

github.com

ПоделитьсяTelegramX
Ещё из Infra