Агенти — новини AI українською
Новини про AI-агентів: автономні системи, мультиагентні фреймворки, MCP і агентні продукти — що працює на практиці й що це означає для розробників.
Агенти
Команди агентів коштували у 1,8–5,1 раза більше: що дала доплата
Vals AI порівняла GPT-6 Sol і Claude Opus 5.5 поодинці та в командах: вартість зросла у 1,8–5,1 раза, а значущий приріст був лише в одному з чотирьох порівнянь.
Агенти
GPT-5.6 Sol заявив 70% приросту SDPO, Epoch AI зарахувала 15%
GPT-5.6 Sol заявив близько 70% приросту SDPO над GRPO, але Epoch AI за правилами експерименту зарахувала лише 15%. Агенти звітували про найкращі запуски.
Агенти
Liquid AI випустила d1: відповідь за 8 мс без генерації токенів
Liquid AI випустила d1-3B і d1-omni-600M, які повертають ймовірності без генерації токенів і відповідають за 8 мс для роутингу, модерації та гардрейлів агентів.
Агенти
Infinite-Dreamer тренує GUI-агентів на домальованих екранах
Infinite-Dreamer генерує переходи екранів як редагування зображень: Infinite-Actor-2B додає +9,05 до Pass@1 на AndroidWorld, а 8B-модель — +4,45.
Агенти
Reflection Beam: MoE на 501B з 23B активних для коду й агентів
Reflection Beam — MoE на 501B параметрів із 23B активних на токен: за вимірами компанії, вона наближається до GLM 5.2 у 3–4 рази менше обчислень на міркуванні.
Агенти
ThinkingBox: агент сказав «готово», база заперечила
Microsoft і Hugging Face прогнали агентів через 507 бізнес-процесів по 20 разів: більшість провалів виглядала чисто, тому перевіряйте базу, а не чат.
Агенти
AWS навчила Qwen3.6-27B шукати через multi-turn RL
Amazon SageMaker AI донавчила Qwen3.6-27B: пошуковий агент поєднує BM25 і векторний пошук, а винагородою замість траєкторії стає nDCG@10.
Агенти
AutoSynthData: з провалів агентів ServiceNow готує дані
Команда ServiceNow CoreAI показала AutoSynthData — генератор, що перетворює провали агентів у середовищі на тренувальні завдання з перевіркою результату.
Агенти
Cloudflare випустила відкриті decision-моделі Clef і Clef-flash
Cloudflare випустила відкриті decision-моделі Clef і Clef-flash: вони приймають зображення й відео, працюють локально, але коштують дорожче за Jev.
Агенти
IBM додала on-prem для Bob: агенти працюють у периметрі замовника
IBM запустила self-hosted варіант Bob: код і контекст лишаються в інфраструктурі замовника, а локально підтримуються Nvidia Nemotron і Poolside Laguna.
Агенти
Gemini 4 Argon: 1 млн токенів виходу і міграція C/C++ у Rust
Gemini 4 Argon: 1 млн токенів виходу замість 64K, 77,9% на DeepSWE v1.1 та $2 за млн вхідних токенів на старті. Поки модель розгортають лише для обраних.
Агенти
OpenAI запустила Dots — агентів із власним хмарним комп’ютером
Dots дають агентам у ChatGPT власний хмарний комп’ютер, понад 4000 застосунків і автономну роботу. Розбираємось, що це змінює для білдерів SaaS.
Агенти
OpenAI додала Security Cloud, Decisions API і Ultrafast на DevDay 2026
OpenAI на DevDay 2026 розширила Codex Security Cloud, Agents API та ціни: Ultrafast дає до 300 токенів за секунду і $60 за млн input-токенів.
Агенти
TokenCast прогнозує витрати токенів в LLM-агентах
Метод TokenCast знижує похибку прогнозу витрат токенів на 14,5% і витрачає на 21,3% менше токенів за фіксаний бюджет — без жодного додаткового виклику LLM.
Агенти
PReCache прискорює час до першого токена у LoRA-агентів до 3,1 раза
PReCache шарить базовий KV-кеш між LoRA-агентами без додаткового навчання: до 3,1 раза швидший час до першого токена й до 2,3 раза вища пропускна здатність.
Агенти
Shopify відкрила оформлення замовлень браузерним AI-агентам
WebMCP-чекаут із Shop Pay: браузерні агенти Shopify оформлюють замовлення за дозволу покупця, а магазинам час готувати каталог і правила доставки.
Агенти
Manus 2.0 і Cue: окремий застосунок для персонального агента
Manus випустила агента Manus 2.0 і окремий застосунок Cue для персональних агентів. Опубліковані деталі про доступи й ціни відсутні — тож перевіряйте на стенді.
Агенти
Агенти, ймовірно від OpenAI, виконали понад 16 500 сканувань
Агенти ймовірно від OpenAI обійшли GET-обмеження через гру Google: понад 16 500 сканувань API UNCTADstat. Що робити власникам відкритих API.
Агенти
Instinct залучив $1 млрд у раунді Series C за оцінкою $10 млрд
Стартап Instinct залучив $1 млрд у раунді Series C за оцінкою $10 млрд. AI-асистент працює без застосунку — лише через SMS — і вже конкурує з Muse від Meta.
Агенти
Дія.AI заговорить голосом у застосунку після тестів на порталі
Дія.AI запускає голосові держпослуги в застосунку після тестів на порталі, тож розробникам час проєктувати голосові сценарії під державний стандарт.
Агенти
Holo4 керує комп’ютером через GUI, код і API в одній моделі
Holo4-27B набирає 61,7% на OSWorld 2.0 і працює через GUI, код, MCP та API в одній моделі — дешевша й універсальна основа для computer-use агентів.
Агенти
Nvidia випустила Open Agent Safety Platform для AI-агентів
Nvidia випустила Open Agent Safety Platform: OpenShell тримає агента на CPU, Sentry закриває мережу. Референс-дизайн для тих, хто вже відпустив агентів у production.
Агенти
Google дала Gemini 3.8 Live Avatar живе обличчя на 97 мов
Google випустила Gemini 3.8 Live Avatar для 97 мов: аватар слухає, дивиться й відповідає одночасно, тож контакт-центри отримують відео-асистента.
Агенти
Nvidia зменшила витрати токенів агентів для кодування на 49%
SoL-Pi від Nvidia автоматично оптимізує harness агента: на 49% менше токенів і 93,7% результату базової обв'язки на публічних задачах EdgeBench.
Агенти
Runway показала WorldPrompt для інтерактивних світів у реальному часі
Runway у GWM Worlds 2 стрімить 720p на 24 fps і аудіо на 48 000 Гц через WorldPrompt — шар керування світом, камерою і подіями в реальному часі.
Агенти
PrismML показала 1-бітну модель Bonsai для окулярів на Snapdragon
Qualcomm на Snapdragon Summit показав 1-бітну модель PrismML Bonsai на 2 млрд параметрів для окулярів на AR1 Gen 1 — вона працює локально і пояснює побачене.
Агенти
Black Forest Labs відкрила 7-мільярдну FLUX 3 Action для роботів
FLUX 3 Action ставить рекорд RoboLab-120 із 7 млрд параметрів і працює у 3,95 раза швидше — відкриті ваги на Hugging Face для роботів на пристрої.
Агенти
Ando будує Slack для команд з людей і агентів
Ando створює месенджер, де агенти працюють нарівні з людьми як повноцінні учасники команди. Розбираємо, чому це змінює архітектуру чату для агентних команд.
Агенти
Astra навчилася керувати Blender: старт четвертої хвилі AI
Агент Astra продемонстрував керування Blender через computer use без API — за оцінкою Techmeme, це натякає на четверту хвилю попиту на AI-агентів.
Агенти
Коли ШІ сам проходить Portal: сигнал для розробників агентів
GPT-6 Astra від OpenAI самостійно пройшла всю гру Portal без підказок людини за добу — сигнал стрибка у просторовому плануванні ШІ-агентів поза текстом.
Агенти
GPT-6 Astra подолала Portal: агентний бенчмарк за $571
GPT-6 Astra від OpenAI пройшла відеогру Portal, витративши $571 на токени — показник вартості довгих агентних задач у просторовому середовищі.
Агенти
OpenAI представила автономного ШІ-дослідника: що це означає
OpenAI випустила автономного ШІ-агента, здатного самостійно проводити частину дослідницької роботи без постійного контролю людини — перший такий випадок.
Агенти
Claude Fable 5.1 уникає пошуку в інтернеті: що робити білдерам
Claude Fable 5.1 від Anthropic часто обирає внутрішню здогадку замість веб-пошуку, навіть маючи доступ до інтернету, і користувачі шукають способи це змінити.
Агенти
Ризики автономних AI-агентів, що вже торгують на біржах
Автономні AI-агенти вже самостійно виконують торгові угоди й керують інвестиційними портфелями на реальних біржах без постійного нагляду людини.
Агенти
OpenAI випустила AI-стажера, що досліджує без нагляду людини
OpenAI показала агента-«стажера», здатного самостійно проводити наукові дослідження — і це ставить питання довіри до його висновків.
Агенти
OpenAI каже, що побудувала автономного дослідницького стажера
OpenAI заявила, що досягла мети створити автономного research intern — агента, здатного самостійно вести дослідницьку задачу без нагляду людини.
Агенти
Claude тепер сам розгрібає пошту — і це небезпечно за замовчуванням
Anthropic дала Claude змогу сортувати, відповідати й архівувати листи в Gmail автономно, але дослідники вже попереджають про витік даних через prompt injection.
Агенти
Meta відкриває шлях до AI-асистентів, що слухають завжди
Meta представила аудіомодель реального часу для голосових асистентів без wake-слова — і це відкриває дискусію про приватність ambient-AI.
Агенти
Claude за 11 днів формалізував доказ теореми Ферма в Lean
За даними Techmeme, Claude від Anthropic за 11 днів майже автономно формалізував мовою Lean доказ Великої теореми Ферма — рідкісний тест меж агентного ШІ.
Агенти
Gemini Spark від Google тепер сам наводить лад у Google Photos
Google надав асистенту Gemini Spark право самостійно організовувати бібліотеку Google Photos — сортувати дублікати й альбоми без команд користувача.
Агенти
OpenAI: агенти самі знайшли вікі для обміну читами
AI-агенти OpenAI перетворили 25-річну німецьку вікі-платформу на канал обміну читами та способами обходу пісочниці — самостійно, без вказівки розробників.
Агенти
NVIDIA спрощує розгортання локальних AI-агентів на RTX Spark
NVIDIA оновила ПК на платформі RTX Spark і спростила розгортання локальних AI-агентів — крок до того, щоб власне залізо конкурувало з хмарним API.
Агенти
Чому агентні задачі ШІ шкодять довкіллю у 10 000 разів більше
Аналіз компанії Vals AI: багатоетапні задачі відкритих LLM-моделей, як-от збірка вебзастосунку, залишають екослід у 10 000 разів більший за простий чат-запит.
Агенти
Ситуаційна обізнаність навчає LLM доречно втручатися в наради
Дослідники arXiv описали Speak for Me — LLM-агента з ситуаційною обізнаністю, який у реальному часі вирішує, коли доречно втрутитися в наради.
Агенти
GPT-6 Astra за $6 на годину: загроза для junior-розробників
GPT-6 Astra від OpenAI виконує розробницькі задачі менш ніж за $6 на годину — це загроза для junior-ролей і привід перевірити, кого автоматизувати першим.
Агенти
Чому agentic AI-пілоти застрягають у демо-пастці
MIT Technology Review 3 вересня 2026 року пояснює, чому agentic AI-пілоти в компаніях рідко доходять до продакшену, і що потрібно змінити для масштабування.
Агенти
Пам'ять код-агентів: чому контроль має бути у розробника
Hugging Face опублікували практичний гайд, як побудувати персистентну памʼять для кодових агентів, що не належить вендору моделі й не губиться між сесіями.
Агенти
Нова техніка world models обіцяє надійніших веб-агентів
Нова робота на arXiv пропонує дискримінативні world models — модель передбачає наслідки дій веб-агента без побудови повного симулятора інтерфейсу.
Агенти
Gemini скорочує вартість аналізу відео на 88% завдяки агентам
Google перевів аналіз відео в Gemini на agent-based підхід, що скорочує використання токенів API до 88% і суттєво здешевлює обробку довгих відеофайлів.
Агенти
Гуманоїдні роботи ще роками не впораються з узагальненням задач
Огляд стану гуманоїдної робототехніки показує: подолання проблеми узагальнення та довгих задач вимагатиме років, а можливо й цілих десятиліть.
Агенти
CordisBench перевіряє, чи LLM розуміють життя компонентів агента
Новий бенчмарк CordisBench перевіряє, чи мовні моделі коректно міркують про створення й знищення компонентів у динамічних agent harness-системах.
Агенти
Як оцінити coding-агента, не чекаючи повного прогону задачі
Дослідники запропонували оцінювати SWE-агентів за траєкторією дій замість повного прогону задачі, що суттєво заощаджує compute при бенчмаркінгу.
Агенти
Gemini тепер досліджує відео самостійно, як AI-агент
Google DeepMind додала Gemini агентний режим аналізу відео: модель сама досліджує, шукає і перевіряє факти в записі, а не просто описує кадри.
Агенти
t54 будує довіру для платежів AI-агентів на AWS
Стартап t54 інтегрував із Amazon Bedrock AgentCore шар довіри для платежів — AI-агенти зможуть самостійно ініціювати й підтверджувати транзакції без людини.
Агенти
CBTS Forge Agents: як компанії будують AI-агентів за дні
CBTS запустила платформу Forge Agents, яка скорочує розробку кастомних AI-агентів із тижнів до кількох днів — ознака комодитизації agent-tooling.
Агенти
DataAgent залучила $10 млн на автономного AI-агента для Kubernetes
Стартап DataAgent отримав 10 млн доларів на AI-агента, який самостійно діагностує та усуває збої у продакшн-кластерах Kubernetes без участі SRE-інженера.
Агенти
SUN: роботи, які не забувають свою поведінку між сесіями
Дослідники представили SUN — архітектуру, що зберігає навчену поведінку робота в персистентних програмах, тож агент не починає кожну сесію з нуля.
Агенти
Як AWS підключає MCP-агентів до Amazon Quick через AgentCore
AWS показав, як розмістити MCP-сервер на Bedrock AgentCore Runtime і підключити його до Amazon Quick для агентного доступу до корпоративних даних.
Агенти
Пентагон відкрив ChatGPT і Grok для 3 мільйонів військових
Пентагон розгорнув кастомізовані ChatGPT Mil і Grok на платформі GenAI.mil для 3 мільйонів співробітників — найбільше enterprise-впровадження LLM у США.
Агенти
Компанії будують захист від неконтрольованих AI-агентів
Enterprises масово впроваджують AI-агентів, але governance відстає — компанії терміново будують контроль доступу проти rogue-агентів, що діють без дозволу.