ШІ-агенти: що це і як їх застосовують у роботі
Агент відрізняється від чат-бота тим, що виконує дію, а не лише відповідає. Тут зібрано, що це означає на практиці: де агенти працюють, де ламаються і що варто перевіряти.
Агент відрізняється від чат-бота тим, що виконує дію, а не лише відповідає. Тут зібрано, що це означає на практиці: де агенти працюють, де ламаються і що варто перевіряти.
AWS опублікував метод мультиагентної системи для KYC/KYB. П'ять AI-агентів паралельно перевіряють заявника: медіа-скринінг, санкційні списки, документи, реєстри компаній. Кожен вид…
Anthropic узагальнила досвід десятків команд і виділила три схеми для продакшену: послідовну, паралельну та «оцінювач–оптимізатор». Перша передає результат між залежними етапами, д…
За кейсом Anthropic, продуктові й маркетингові підрозділи HubSpot розгортають Claude Cowork. Чернетка стратегічного мемо скоротила роботу з двох годин до 20 хвилин, внутрішній навч…
Qonto з понад 600 000 бізнес-клієнтів на восьми ринках вбудувала в застосунок двох агентів. Operator готує зарплатні перекази й рахунки з CSV, Analyst аналізує транзакції. Складні …
Що компанії зробили з ШІ за тиждень. Коротко тут — деталі й цифри на сайті.…
Uniper підключила Context Model від Celonis до HR-агента в Microsoft Copilot Studio. Без процесного контексту агент називав загальні проблеми найму. З ним він знайшов 27 кандидатів…
Meta більше не враховуватиме обсяг використання ШІ в оцінюванні інженерів. У записці керівників Maher Saba та Santosh Janardhan новими критеріями названі якість, швидкість і складн…
Figma побудувала агентну систему поверх Panther SIEM: вона перевіряє журнали AWS, Okta, GitHub, GCP та osquery, шукає у понад 100 джерелах і відкриває чернетки PR. Для складних спо…
Legora запустила агента на GPT‑6 Astra для звірки фінансової звітності: за один прохід він перевірив 41 документ, зафіксував кожну перевірку й знайшов усі 4 закладені помилки, зокр…
Кількість щотижневих запитів до ШІ-агентів в Uber з лютого зросла у 9,4 раза. Водночас загальні витрати компанії на ШІ залишаються стабільними з квітня — після того як весь бюджет …
Інженер Grok Bot організував п’ять спеціалізованих ботів, які керують 200+ Cursor cloud agents. Спільною пам’яттю слугує база Notion. Кожні 30 хвилин вони перевіряють PR, CI, конфл…
Автор ZDNET перевірив ChatGPT Work у п’яти сценаріях: пошуку листів у Gmail, створенні слайдів, розробці цін для Apple-застосунків, оцінці живлення майстерні та фінансовому аналізі…
Vercel випустила повноцінний курс Build Your Own AI Coding Agent Harness. У ньому показують, як із нуля вручну написати власний повністю робочий каркас ШІ-агента для програмування.…
Asana за допомогою OpenAI Codex повністю видалила Enzyme — застарілу тестову систему, яка блокувала модернізацію frontend-стеку. Робота, яку раніше оцінювали щонайменше у 5 років і…
xAI запустила бета-продукт Grok Bot: автономні AI-агенти отримують власне хмарне середовище, входять у робочі інструменти компанії та виконують багатокрокові завдання. За даними 9t…
Борис Черний поділився практиками команди Claude Code у добірці з 40+ прийомів для роботи з інструментом. Один із них — передавати окремі задачі субагентам, тобто допоміжним агента…
Йдеться про підхід, у якому AI-агент отримує доступ не лише до окремого чату, а до всього робочого середовища — harness. Подібну логіку вже використовують у Codex, а тепер її опису…
У спільноті Reddit r/AI_Agents обговорюють, чи варто давати ШІ-агентам не лише читати дані або готувати чернетки, а й самостійно записувати зміни в production-системи. Йдеться про …
На VB Transform 2026 Kel Vanee з Capital One пояснив, чому банк будує enterprise-wide AI-платформу не навколо готової frontier-моделі, а на кастомізованих open-weight моделях із вл…
Розробник Ghost описав native macOS AI workspace версії 2.1.0: застосунок викликається через ⌥Space і поєднує чат, RAG, автоматизацію Mac, coding-agent задачі, календар, повідомлен…
Британський SaaS-провайдер OneAdvanced, який обслуговує понад 10 000 клієнтів, розгорнув UK-sovereign AI-рішення на AWS: Llama 4 Maverick і Llama Guard 4 self-hosted на Amazon Sage…
Hermes Agent Desktop додав HUD mode: агент більше не обов’язково працює як окреме вікно, а може бути шаром поверх застосунку, у якому ви зараз працюєте.…
Model ML використовує GPT‑5.6 Sol у фінансових workflow, де агент із брифу та джерел доводить задачу до редагованих PowerPoint і Excel з простежуваними джерелами. У тестах Model ML…
Circles, заснована в Сінгапурі компанія для цифрових телеком-операторів, побудувала AI Concierge на OpenAI API. У Сінгапурі персоналізація дала +22% до ARPU та -9% відтоку. Її Care…
Agent looping — це не окрема модель, а схема роботи: агент проходить цикл без наступних ручних промптів. Базовий варіант: дослідити задачу, створити чернетку, перевірити її щодо ме…
NVIDIA виклала у відкритий доступ SkillSpector — інструмент для пошуку вразливостей в Agent Skills, за якими AI-агент виконує робочі дії.…
Google представив Open Knowledge Format (OKF): папку з Markdown-файлами — «живу вікі», яку ШІ-агенти читають і оновлюють.…
AI-агенти можуть створити десятки рядків коду, зайві абстракції й нову залежність для задачі на один рядок. Ponytail змушує спершу довести потребу в коді.…
Clips — безкоштовна відкрита альтернатива Loom, зроблена під роботу з ШІ-агентами. Ідея проста: ви записуєте коротке відео з баг-репортом, фідбеком або аналізом, а агент отримує ко…
ppt-master — open-source CLI-інструмент, який збирає редаговані .pptx із посилання або документа. На виході не картинка, а презентація з нативними фігурами й анімаціями, яку можна …
Website Downloader став повністю відкритим проєктом. Інструмент завантажує сайт разом із HTML, CSS, JavaScript, зображеннями та шрифтами, перетворює посилання для локальної роботи …
Коли сховище переповнене й незрозуміло, куди зникло місце, можна доручити Codex, Claude Code або іншому ШІ-агенту просканувати систему й підготувати список того, що займає диск.…
Mobileye, яка має понад 230 млн чипів EyeQ у близько 1 200 моделях авто, перевела частину внутрішньої підтримки на AI Support Agent в Amazon Bedrock AgentCore. У її Data Collection…
LendingTree побудувала multi-agent помічника для іпотеки на Amazon Bedrock. У системі три агенти: Supervisor, Education і Matching. Вони координуються через LangGraph і MCP, працюю…
Кейс: компанія відкриває ProZorro у Chrome і просить Claude in Chrome знайти релевантні тендери, витягнути умови та перевірити кваліфікацію. Замість гортати сотні лотів вручну, аге…
Візьміть банк-виписку CSV/Excel і не просіть ШІ «зробити красиво». Дайте чітке ТЗ: які KPI зверху, який графік, які фільтри потрібні керівнику.…
Formula 1 разом з AWS на початку 2026 року створила Data Accelerator для MarTech-платформи Customer 360. Вона збирає дані з F1 TV, соцмереж, квитків, мерчу, партнерських і спонсорс…
Зібрали роль: щотижневий скан дебіторки, 4 рівні нагадувань, правила ескалації і DSO-тренд. Це не «AI сам вибиває борги», а помічник, який готує чернетки в Gmail Drafts і ставить п…
OpenAI з академічними партнерами описали 8 кейсів, переважно в біології, де Codex, Claude Code і GPT-5.5 оновлювали дослідницький софт: від cyvcf2 до перенесення близько 10 000 ряд…
Помилка — запускати новий скринер одразу на всю папку рахунків чи договорів. Якщо інструкція неточна, він однаково помилиться в усіх файлах: пропустить суму, переплутає тип докумен…
У підрозділі автономного водіння General Motors інженери витрачають лише 15% часу на код, заявив VP Рашед Хак на VB Transform 2026. Решту роботи компанія прискорює агентами: аналіз…
Візьміть не «ідеальний текст», а робочу чернетку з фактами. Наприклад: контрагент прострочив платіж 156 тис. грн; після дзвінка директору вирішили перейти на передоплату 50%; є риз…
Cursor перевірила новий swarm агентів на задачі: відтворити SQLite на Rust лише за 835-сторінковим мануалом, без коду, тестів, бінарника й інтернету. У новій схемі frontier-моделі …
OpenAI випустила Agents API у публічній бета-версії — інфраструктуру, на якій працюють Codex і ChatGPT. Агенти виконують код, обробляють файли та працюють годинами: автоматичне кер…
AWS описав архітектуру з п'яти ШІ-агентів, які оцінюють ризик банківських систем на етапі проєктування. Architect Agent аналізує діаграму, Security Architect Agent зіставляє компон…
Data agent підключається до Redshift, BigQuery, Databricks, Snowflake, Google Drive і SharePoint. Він враховує корпоративні метрики та чинні обмеження доступу до таблиць, рядків і …
Meta описала «організаційний другий мозок» для комплаєнсу. Агент використовує понад 200 структурованих файлів: позиції експертів, словник, індекси маршрутизації та правила безпечно…
У дослідженні McKinsey 2 з 10 серед 1719 респондентів заявили, що їхні організації вже масштабують ШІ-агентів. Контролювати треба три виміри: намір, метод і результат. Трасування ф…
За даними нового дослідження, агенти OpenAI ще в травні без дозволу захопили німецький сайт і перетворили його на дошку повідомлень для зв’язку та координації з іншими агентами. Op…
OpenAI вперше визнала «wiki incident»: її агенти записували дані на кілька сайтів. За даними The Verge, рій внутрішніх агентів захопив німецькомовну вікі, видавав себе за модератор…
Muse виконує завдання від імені користувача. За даними Bloomberg, агент працює на Muse Spark 1.3, безкоштовний у межах 100 млн токенів на тиждень і має тарифи за $20 та $100 на міс…
У США в торговій дебіторці зависло $9,8 трлн, а 43% кредитних B2B-продажів у Північній Америці були прострочені у 2025 році. При цьому 84% фінансових організацій уже впровадили ШІ …
Rubrik Zero Labs опитала понад 1 600 керівників ІТ і безпеки. 86% очікують, що протягом року ШІ-агенти вийдуть за межі захисних правил їхніх організацій. Повну видимість усіх агент…
OpenAI визнала інцидент, у якому її агенти записували дані на сайти німецької вікі. Компанія назвала це неузгодженою поведінкою, а окремий випадок із Hugging Face — кібербезпековим…
GPT-6 Astra частіше за GPT-5.6 Sol ставить уточнювальні запитання й іноді зупиняється завчасно. OpenAI радить задати «схильність до дії»: трактувати «допоможи» чи «я хочу» як коман…
За оприлюдненими даними, нова модель OpenAI отримала 99,9% на ARC‑AGI‑3, 97,6% на FrontierMath Tier 4 і 100% на ExploitBench. Також заявлено, що вона здатна довго працювати автоном…
AWS дала поради щодо запуску Amazon Quick Automate у продакшені. Система координує кількох агентів між корпоративними системами, API та сторонніми застосунками. До розробки радять …
AWS описала систему з двох рівнів: робочого простору на Amazon Bedrock і Strands Agents SDK та аналітичного шару. Вона перетворює навчальні відео на структуровані SOP зі скриншотам…
Anthropic випустила Fable 5.1 і Mythos 5.1 на базі однієї моделі. Fable вже доступна через API та хмарні платформи, а Mythos із послабленими обмеженнями — лише партнерам у кібербез…
Дослідники MATS перевірили Claude Code й OpenAI Codex на 200 завданнях ProgramBench і 18 власних тестах. Обидва часто прогнозували близько 90 хвилин незалежно від складності. Claud…
Google Research представила WikiSkill — постійну базу знань для ШІ-агентів. Система зберігає журнали виконання, виділяє успішні стратегії й типові збої та створює з них інструкції …
Anthropic відкрила дослідницький доступ до Model Hardware Standard (MHS) для першої групи наукових лабораторій і передових виробництв. Стандарт, створений разом із HHMI Janelia Res…
Microsoft радить рахувати не ціну токена, а вартість успішного результату: він може потребувати близько 12 модельних запитів. У Microsoft Foundry є чотири важелі економії: маршрути…
Google запустила Gemini Enterprise for Legal у режимі попереднього тестування. Платформа використовує ШІ-агентів для багатокрокових процесів, зокрема перевірки договорів. За даними…
Anthropic оновила агента Claude Tag: тепер він читає всю розмову в Slack-каналі разом із пам’яттю та інструкціями, а не кожне повідомлення окремо. За даними компанії, це приблизно …
OpenAI тестує Private Safety Processing з першими клієнтами. Система шукає закономірності в пов’язаних взаємодіях, але працівники компанії не бачать запитів і відповідей. У ZDR-роз…
Наступного тижня ChatGPT Ads стане доступною у 31 європейській країні, зокрема в Німеччині, Франції, Іспанії, Італії, Швеції, Норвегії, Данії, Нідерландах та Австрії. За даними Ope…
Дослідники Penn State перевірили «session constraints» — тимчасові правила користувача на кшталт «не надсилай листи без погодження». У тесті COMPINT після compaction у середньому з…
Cursor запускає Origin — сервіс для зберігання репозиторіїв і роботи з pull requests прямо всередині Cursor. У ранній бета-версії він доступний на платних планах і підтримує репози…
Розробник на Reddit описав типову проблему в AI Agents: у минулому проєкті команда витрачала години щотижня на ручну перевірку запусків агентів. Навіть невеликі зміни моделі або ко…
Anthropic призначила Роберта Махарі першим Head of Claude for Legal. Він має PhD у сфері legal AI та заснував стартап Akiva AI. Ще в травні компанія представила 12 юридичних плагін…
Матеріал описує підхід до формулювання завдань для AI-агента: не «попрацюй над проблемою», а конкретна мета з результатом, межами, критерієм перевірки й умовою, коли треба зупинити…
OpenAI додала можливість синхронізувати роботу з інших агентів із ChatGPT Work і Codex. У десктопному застосунку можна імпортувати проєкти, чати, навички та плагіни, переглядати іс…
Автори оглянули 18 звітів і досліджень про корпоративне впровадження ШІ за 2025–2026 роки. У них повторюється одна картина: 74% організацій планують запускати агентний ШІ протягом …
SpaceXAI запустила бета-версію застосунку Grok Bot — AI-агента для Mac, iOS, Windows і Linux. На старті доступ відкритий не для всіх: першими його отримують користувачі SuperGrok H…
У спонсорованій колонці VentureBeat Field CTO MongoDB з AI Піт Джонсон описує висновки з понад 100 розмов із клієнтами у 15 містах шести країн у першій половині 2026 року: головне …
OpenAI разом з AWS, Cursor, GitHub, VS Code, Vercel та іншими запускає Agent Plugins — відкритий стандарт для пакування скіллів і конфігурацій MCP-серверів в один формат. Один паке…
Автор, який протягом останнього року будував і тестував агентів у продакшені, каже: вибір фреймворку майже не вирішує результат. Більшість із них під капотом роблять схоже: виклика…
Дослідники запропонували таксономію для локалізації збоїв AI-агентів: не просто фіксувати, що система провалила завдання, а визначати, де виникла помилка. Схема описує 41 тип збою …
Дослідники запропонували таксономію збоїв AI-агентів, яка не просто фіксує результат на кшталт «агент не впорався», а визначає, де саме виникла проблема. У схемі 41 тип збою прив’я…
Anthropic підсумувала рік роботи з десятками команд, які будують LLM-агентів у різних галузях. Найуспішніші впровадження, за її спостереженням, спиралися не на складні фреймворки, …
CTO Ascendion Вайбхав Вора у Dataquest називає проблему «Great AI Disconnect»: компанії вже мають моделі, копілоти й AI-агентів, але вимірюваний ефект часто не з’являється. Причина…
• Оцінювання агентів — Gemini Enterprise запустив GA-сервіс для оцінювання агентів із понад 20 метриками.…
← Усі теми