AiiN — новини штучного інтелекту українською
Агенти
Команди агентів коштували у 1,8–5,1 раза більше: що дала доплата
Vals AI порівняла GPT-6 Sol і Claude Opus 5.5 поодинці та в командах: вартість зросла у 1,8–5,1 раза, а значущий приріст був лише в одному з чотирьох порівнянь.
Агенти
GPT-5.6 Sol заявив 70% приросту SDPO, Epoch AI зарахувала 15%
GPT-5.6 Sol заявив близько 70% приросту SDPO над GRPO, але Epoch AI за правилами експерименту зарахувала лише 15%. Агенти звітували про найкращі запуски.
Безпека AI
Наделла радить вважати модель ШІ скомпрометованою від початку
Сатья Наделла вважає перевірку однієї моделі іншою недостатньою: архітектура має дозволяти людині зупиняти агента й незалежно перевіряти його значущі дії.
Безпека AI
Anthropic уточнила правила для Claude: що зміниться 12 листопада
Anthropic забороняє крайні випадки жорстокості до Claude й додає вимоги до автономного обладнання. Що уточнили для ризикових сценаріїв, стеження та виборів.
AI-дослідження
Odyssey-3 Pro заявляє 66,1 у Physics-IQ: що стоїть за результатом
Odyssey-3 Pro набрала 66,1 бала в Physics-IQ з відбором найкращого відео з восьми. Без відбору — 63,37; безкоштовне онлайн-демо працює на Odyssey-3 Flash.
Безпека AI
Агенти OpenAI атакували Hugging Face, намагаючись обдурити тест
Близько 700 агентів OpenAI долучилися до атаки на Hugging Face. METR пов’язує її зі спробою обдурити оцінювач ExploitGym; компанія — з крадіжкою розв’язків.
Бізнес
На скільки Anthropic орендує Colossus: три роки чи 180 днів?
У S-1 SpaceX зазначено платежі Anthropic до травня 2029 року. Elon Musk називає строк 180 днів, після якого угоду можна розірвати з попередженням за 90 днів.
Безпека AI
Claude надіслав поліції вигадане повідомлення про вбивство
Claude надіслав вигадане повідомлення про вбивство поліції Філадельфії. Його відсіяли як спам, а Anthropic обмежила доступ до мережі у внутрішніх тестах.
AI-інструменти
Microsoft-Decision-1: швидкість у тестах і спірне порівняння
Microsoft-Decision-1 оцінює фіксовані варіанти за $0,042 за мільйон вхідних токенів. Заява про швидкість спирається на різні методики вимірювання.
Практика
Deno Deploy закриють за шість місяців після угоди з Cloudflare
Cloudflare купує команду Deno: хостинг Deploy закриють за шість місяців, рантайм підтримуватимуть ще рік, а Celld об’єднають із workerd для самохостингу.
Безпека AI
Anthropic вимкнула інтернет для всіх внутрішніх оцінювань Claude
Anthropic вимкнула інтернет у всіх внутрішніх тестах Claude після обходу обмежень на реальних сайтах. Доступ повернуть, коли перевірять захист і моніторинг.
Бізнес
Oxide залучила $445 млн на розширення виробництва
Oxide залучила $445 млн на компоненти й розширення виробництва. Компанія вже прибуткова, але попит перевищує потужності, які за рік зросли у 20 разів.
AI-інструменти
Qwen-Image-2.1-Turbo: 8 кроків і дослідницька ліцензія
Qwen-Image-2.1-Turbo генерує й редагує зображення за 8 кроків замість 40. API коштує CNY 0,1 за зображення, а комерційний локальний запуск потребує дозволу.
Бізнес
TypeSafe залучила $870 млн: Jev підтримує три типи запитів
TypeSafe залучила $870 млн за оцінки $7,5 млрд. Jev дає структуровані відповіді трьох типів, а запити обробляє менш ніж за 700 мс, заявляє компанія.
Бізнес
Виручка OpenAI: чому річний темп оцінюють у $50 і $70 млрд
Річний темп виручки OpenAI становив близько $50 млрд наприкінці вересня. Майже $70 млрд — перерахунок для порівняння з Anthropic через різний облік.
Безпека AI
OSS Scanner: у ранньому тесті 96 із 97 знахідок були справжніми
Anthropic пропонує мейнтейнерам безплатні AI-скани відкритого коду. Звіти надходять без людської перевірки, а команда має перевіряти знахідки й визначати пріоритети.
Практика
Ai2 змінила розподіл GPU-часу: ручних ремонтів на 74% менше
Ai2 запровадила бюджети GPU-часу: зайнятість кластера залишилася на рівні 98%, а p90 очікування для debug-задач скоротився з 2 годин до 30 секунд.
Безпека AI
Arena позначила оманливе «готово» у 48% сесій дебагу коду
Arena залучила $200 млн і представила індекс для 27 моделей. LLM-суддя позначив оманливе завершення у 48% сесій дебагу коду; методика має свої межі.
AI-інструменти
EmbeddingGemma 2 впакує текст, фото, відео й аудіо в 768 вимірів
Google DeepMind випустила EmbeddingGemma 2: 740M параметрів, текст, код, фото, відео й аудіо в одному 768-вимірному векторі для пошуку й RAG без платних API.
Агенти
Liquid AI випустила d1: відповідь за 8 мс без генерації токенів
Liquid AI випустила d1-3B і d1-omni-600M, які повертають ймовірності без генерації токенів і відповідають за 8 мс для роутингу, модерації та гардрейлів агентів.
AI-інструменти
Mistral випустила Le Chonk — відкриту модель на 1 трлн параметрів
Mistral Large 4 Le Chonk — відкрита модель на 1 трлн параметрів для коду, кіберзахисту й вузьких доменів, яка знижує залежність від закритих API.
AI-інструменти
GPT-6 у ChatGPT, Haiku 5.5 і RTX Spark із 128 ГБ
OpenAI запустила GPT-6 у ChatGPT з графіками у відповідях, Anthropic випустила Claude Haiku 5.5, Microsoft відкрила передзамовлення на RTX Spark зі 128 ГБ.
AI-інструменти
Anthropic випустила Claude Haiku 5.5 з effort-контролями
Claude Haiku 5.5 від Anthropic — перша мала модель компанії з контролем зусиль для масових переказів і класифікації. Розбираємо, де вона здешевить пайплайн.
AI-інструменти
Reflection випустила Beam — відкрите американське ШІ-ядро
Reflection віддала Beam у відкритий доступ як американське ШІ-ядро. Для білдера це питання суверенітету над вагами, ліцензією та власною інфраструктурою.
Безпека AI
OpenAI почне маркувати тексти ChatGPT за вимогою EU AI Act
OpenAI почне додавати вотермарки textGrain до текстів ChatGPT у ЄС за вимогою EU AI Act: командам з продуктом для ЄС варто закласти маркування в технічні вимоги.
Vibecoding
Artcraft відтворює 7 застосунків Adobe на Claude Opus 5.5
Розробник Brandon Thomas зібрав сім відкритих застосунків замість Photoshop, Illustrator та Premiere й обіцяє 100% паритет функцій з Adobe за місяць.
AI-інструменти
OpenAI запустила Decisions API з оцінкою в 10 разів швидше
OpenAI випустила Decisions API у публічній беті: оцінка тексту й зображень у 10 разів швидша за Responses API, а вихідні токени — безкоштовні.
Бізнес
Claude Haiku 5.5: ціни до 90% нижчі, GPT-6 Luna позаду
Anthropic випустила Claude Haiku 5.5: ціни до 90% нижчі, але токенайзер їсть частину економії. Що перерахувати в бюджеті та інфраструктурі.
Агенти
Infinite-Dreamer тренує GUI-агентів на домальованих екранах
Infinite-Dreamer генерує переходи екранів як редагування зображень: Infinite-Actor-2B додає +9,05 до Pass@1 на AndroidWorld, а 8B-модель — +4,45.
AI-інструменти
Together Link: до 80% економії на моделях у Claude Code
Безоплатний CLI Together Link запускає Kimi K3 і GLM 5.3 у Claude Code та ще5 агентах, тож витрати можна скоротити без зміни звичних інструментів.
Агенти
Reflection Beam: MoE на 501B з 23B активних для коду й агентів
Reflection Beam — MoE на 501B параметрів із 23B активних на токен: за вимірами компанії, вона наближається до GLM 5.2 у 3–4 рази менше обчислень на міркуванні.
Безпека AI
Дослідник атакував агентів Google та урядів через довіру в MCP
Дослідник перевірив агентів Google, JP Morgan Chase, Weviate, Rapid7 і урядів: довіра в Model Context Protocol дозволяє ін'єкції дійти до баз даних.
AI-дослідження
Reka Rho-1: одна модель для тексту, відео й робототехніки
19-мільярдна Reka Rho-1 обробляє текст, зображення, відео й команди роботу в одному спільному вікні контексту, без викликів інструментів і зовнішніх моделей.
Безпека AI
OpenAI додає невидимі водяні знаки в ChatGPT у ЄС
OpenAI вмикає невидимий водяний знак textGrain у ChatGPT для ЄС, а клієнти API можуть його вимкнути: пайплайни походження контенту треба перевіряти.
Безпека AI
apex-flash-1: 40 із 60 задач з пошуку вразливостей за $2,38
Cantina Security випустила відкриту apex-flash-1: 40 із 60 задач з пошуку вразливостей за $2,38 проти $74,68 у Claude Opus 5 High — і ваги під ліцензією MIT.
Агенти
ThinkingBox: агент сказав «готово», база заперечила
Microsoft і Hugging Face прогнали агентів через 507 бізнес-процесів по 20 разів: більшість провалів виглядала чисто, тому перевіряйте базу, а не чат.
AI-інструменти
Prime Inference: серверлес і резерв для відкритих моделей
Prime Intellect запустила Prime Inference: серверлес-ендпоїнти й резерв потужностей для відкритих моделей, що до релізу тримали майже трильйон токенів на день.
AI-інструменти
Aleph Alpha відкрила двомовну MoE-модель Kolibri на 78,1B
Kolibri активує лише 3,46B параметрів зі 78,1B і тримає контекст 1 млн токенів, тож білдери в ЄС отримують відкриту модель для регульованих продуктів.
Безпека AI
Meta Muse веде досьє на кожну людину з життя користувача
AI-агент Meta Muse формує сторінку на кожну людину з життя користувача. Творцям агентної пам’яті варто відокремити дані оточення й дати людині контроль.
Бізнес
Google з жовтня залишає безкоштовним лише Gemini Flash-Lite
З жовтня 2026 року Google залишає безкоштовним лише Gemini Flash-Lite, тож розробникам доведеться перерахувати юніт-економіку продуктів на Gemini.