Vercel AI SDK добавил асинхронный start/status flow для video models через polling и webhooks
AI-инфраструктура уходит в долгие асинхронные workflow: видео, агентные пайплайны, edge inference и LLMOps требуют статусов, вебхуков, мониторинга и восстановления. В больших лабораториях усиливается запрос на независимые стандарты оценки продвинутых моделей
🧠 Model
FinanceBench ограничивает RAG
FinanceBench показывает, что state-of-the-art LLM с vector stores и long-context prompts всё ещё ошибаются в финансовом open-book QA
Финансовым агентам нужны доменные evals, фактчекинг, citation discipline и human review, потому что RAG и длинный контекст сами по себе не гарантируют точность
⚡ Big Labs
Стандарты для моделей
Демис Хассабис призвал создать в США AI standards body для независимой оценки advanced AI models по cyber, biological и deception рискам
Независимые evals и risk standards становятся частью инфраструктурной реальности, поэтому агентным платформам нужны проверяемые safety gates и отчётность по моделям
🔧 Tools
Vercel оркестрирует видео
Vercel AI SDK добавил asynchronous start/status flow для VideoModelV4, включая polling и webhook-опции для завершения генерации видео
Долгие agentic workflow нельзя строить как один синхронный вызов: нужны статусы, callbacks, retries и управляемая доставка результата
Dify расширяет LLMOps
Dify развивает agentic workflows, RAG pipelines, 50+ встроенных tools и LLMOps для мониторинга и анализа AI-приложений
Production-агентам нужен слой наблюдаемости, tool governance, RAG-контроля и анализа поведения, а не только конструктор prompt-flow
🏗 Infrastructure
Jetson для edge
Advantech предлагает модульное LLM Langchain AI Agent решение на NVIDIA Jetson с Ollama и локальным edge-развёртыванием
Edge inference становится практическим вариантом для приватности, latency и автономности агентов вне стабильного облачного соединения