
Компанія Hark, заснована цього року підприємцем та робототехніком Бреттом Адкоком, презентувала Handoff — «агента для використання комп’ютера» (CUA). За даними компанії, цей агент є одним з найкращих у світі у навігації відкритим вебом від імені користувача, самостійно замовляючи їжу через DoorDash, бронюючи авіаквитки на United та Delta, чи надсилаючи повідомлення кандидатам на LinkedIn.
Реєстрація для користувачів відкрита вже сьогодні на сайті hark.com, а повноцінний запуск програмної платформи Hark заплановано на кінець місяця.
Hark стверджує, що Handoff встановив новий рекорд продуктивності на Online-Mind2Web (OM2W) — незалежному бенчмарку для веб-агентів з рейтингом, що оцінюється людьми. Результат Handoff становить 97.7 балів, тоді як OpenAI GPT 5.4 отримав 92.8, Anthropic Claude Opus 4.8 — 84.1, а Google Gemini 2.5 Pro — 69 балів.

Компанія також заявляє, що вартість використання її моделі становить менше однієї десятої ціни за токен порівняно з конкурентними передовими моделями: 0,18 долара за мільйон вхідних токенів та 2,37 долара за мільйон вихідних токенів, тоді як для GPT 5.5 ці показники становлять 5 та 30 доларів відповідно. Затримка обробки запитів моделі становить 0,8 секунди.

Handoff створює для кожного запиту виділений віртуальний комп’ютер з власним браузером, файловою системою та терміналом. Користувачі можуть підключати свої облікові записи, щоб агент міг входити та діяти, використовуючи збережені адреси, платіжні методи та історію.
Дослідження Hark виявило, що хоча люди проводять 75% свого екранного часу в браузері, менше ніж 1% веб-сайтів мають загальнодоступні API, що ускладнює для ШІ-агентів виконання завдань.
У чотирихвилинному відеоролику, опублікованому на YouTube, Адкок звертається до Hark з проханням («давай трохи оживимо це місце… зробимо троянди, можливо, квіти вишні»), і Handoff демонструє навігацію веб-сайтом флориста для оформлення замовлення. Адкок зазначає, що на відміну від типового чат-бота, Handoff «завжди працює, він циклічний», і тепер він використовує його для «всіх своїх рекрутингових зусиль від початку до кінця». У блозі Hark представлено більше демонстрацій в реальному часі та прискореному режимі.
Однак, залишається багато відкритих питань щодо Handoff, особливо для потенційних корпоративних клієнтів та користувачів.
Високі результати бенчмарків… але проти моделей попереднього покоління
Важливо зазначити, що порівняння, надані Hark для їхнього ШІ-агента Handoff, зроблені проти GPT 5.5, GPT 5.4, Opus 4.8 та Gemini 2.5 Pro — моделей попереднього покоління. Лідери поточного покоління, OpenAI GPT-5.6 та Anthropic Opus 5, відсутні, як і потужні конкуренти з відкритим кодом, такі як DeepSeek V4, Kimi K3 та Qwen3.8-Max.
Ці новіші моделі не публікували результати на Online-Mind2Web, і жодна третя сторона не внесла їх до загальнодоступного рейтингу бенчмарку. Це означає, що твердження Hark про «найкращий результат в історії» наразі неможливо перевірити порівняно з найпотужнішими доступними системами.
Пропуск є помітним, оскільки найновіші передові моделі досягли найбільшого прогресу саме у використанні комп’ютерів: на OSWorld 2.0, пов’язаному бенчмарку, що охоплює повне керування комп’ютером, Opus 5 від Anthropic показує результат приблизно 70,6% порівняно з 55,7% для моделі Opus 4.8, яку Hark обрав як точку порівняння.
Порівняння затримки має подібні застереження: показники 6,8 та 6 секунд на запит, цитовані Hark для GPT 5.5 та Opus 4.8, були виміряні самою Hark у її власній системі, з конкуруючими моделями, встановленими на найвищий — і найповільніший — рівень міркувань. Незалежні вимірювання затримки відсутні.
На запитання VentureBeat, чи планує Hark опублікувати порівняння з новішими моделями, компанія не надала конкретної відповіді.
Навіть у межах вибраних Hark порівнянь, формулювання «найкращий» має примітку: на WebTailBench v2, одному з трьох бенчмарків у таблиці результатів Hark, GPT 5.5 показує 72,3 балів проти 68,6 у Handoff.
Два з трьох бенчмарків (WebTailBench та невизначена внутрішня оцінка) також проводилися всередині власної системи Hark, з коефіцієнтом проходження, обчисленим внутрішнім LLM-суддею компанії — умовами, які контролює Hark.
Цінова перевага Hark є значно очевиднішою: новіша модель Opus 5 від Anthropic має ту ж ціну за мільйон вхідних (5 доларів) та вихідних (25 доларів) токенів, що й її попередник. Таким чином, приблизно десятикратна економія коштів Hark буде актуальною навіть проти сучасних передових моделей — за умови, що її результати на бенчмарках також будуть конкурентоспроможними.
Навчання та доступ до файлів
У попередньому дослідженні Hark описано логічний конвеєр: контрольоване доналаштування, а потім асинхронне навчання з підкріпленням за алгоритмом GRPO, згідно з матеріалами, наданими VentureBeat до сьогоднішнього анонсу. Однак компанія визнає, що наразі вона проводила лише пост-тренування, а перед-тренування «заплановано на кінець цього року».
Це означає, що Handoff побудований на основі базової моделі, яку Hark не тренувала. Компанія поки що не уточнила, яка саме базова модель використовується, і на якому наборі даних (власних чи відкритих) навчався Handoff.
Ще одне важливе питання для корпоративних користувачів: хто матиме доступ до виділених віртуальних комп’ютерів та файлів, створених на них?
Речник Hark заявив: «Безпека та конфіденційність є головним пріоритетом, але це технічний попередній перегляд». Він додав, що компанія надасть більше інформації, коли продукт вийде на ринок наприкінці літа.
Історія Адкока перед заснуванням Hark
Hark — це четверта компанія Адкока. Раніше він був співзасновником ринку талантів Vettery (продано у 2018 році приблизно за 100 мільйонів доларів), виробника аеротаксі Archer Aviation та єдинорога робототехніки Figure AI.
У травні 2026 року Hark залучила 700 мільйонів доларів у рамках раунду Серії А з оцінкою у 6 мільярдів доларів. Раунд очолив Parkway Venture Capital за участю Nvidia, AMD, Intel Capital, Qualcomm Ventures, Salesforce Ventures та ARK Invest.
Адкок інвестував у компанію 100 мільйонів доларів власних коштів і залишається засновником та генеральним директором як Figure, так і Hark одночасно, що підтвердив представник компанії.
На запитання про взаємодію двох компаній, речник зазначив, що моделі Hark «тренуються на роботах Figure», але Адкок не планує їх об’єднувати.
Стиль просування Адкока викликав скептицизм. У квітні 2025 року журналіст Fortune Джейсон Дель Рей повідомив, що широко розрекламоване партнерство Figure з BMW було набагато скромнішим, ніж публічні заяви Адкока про «флот» роботів, що виконують «операції від початку до кінця»: представник BMW Стів Вілсон зазначив, що один робот Figure практикувався у піднятті деталей у неробочий час.
Однак партнерство розвивалося, і станом на червень 2026 року BMW заявила, що робот Figure 02 підтримував виробництво понад 30 000 автомобілів BMW X3 протягом 10 місяців, а робот наступного покоління Figure 03 розгортається на заводі для сортування деталей у логістиці.
У соціальній мережі X Адкок назвав цю статтю «спотворенням фактів і відвертою брехнею» та пригрозив судовим позовом про наклеп. Через два місяці TechCrunch повідомив, що Адкок пропустив обіцяну пряму демонстрацію на технологічній конференції та ухилився від відповідей на запитання про угоду з BMW на сцені.
Жодне з цих зауважень не означає, що цифри Handoff є невірними. Агент може бути чудовим, а ціноутворення — якщо воно збережеться — перевершить усі великі лабораторії.
Дізнатися більше на: venturebeat.com
