Google DeepMind опублікувала нову базову модель для роботів Gemini Robotics ER 1.6, де ER означає Embodied Reasoning (втілене міркування). Ця модель досягла на сьогоднішній найвищого рівня у візуальному та просторовому міркуванні (SOTA) і вже доступна через Gemini API. Відповідальна за зв’язки з розробниками у Google AI Logan Kilpatrick повідомив про це у соціальних мережах. (Джерело)

Що таке Embodied Reasoning?

Embodied Reasoning — це здатність AI моделі розуміти та міркувати про фізичний світ. На відміну від традиційних мовних моделей, втілені моделі міркування мають опрацьовувати положення, форму, матеріали та фізичні співвідношення взаємодії об’єктів у тривимірному просторі. Gemini Robotics ER 1.6 спеціально оптимізована для таких завдань, щоб робот міг точніше розуміти навколишнє середовище та ухвалювати відповідні рішення щодо дій.

Ключові можливості

Основні переваги Gemini Robotics ER 1.6 зосереджені на двох напрямах:

Можливість Опис Візуальне міркування Здатність розпізнавати об’єкти з зображень і відео, розуміти структуру сцени та на їх основі ухвалювати рішення Просторове міркування Розуміння відносного положення, відстані та напрямків об’єктів у тривимірному просторі, підтримка складного планування керування

Поєднання цих двох можливостей дає роботам змогу виконувати складніші завдання у реальному світі. Наприклад, у складських умовах роботу потрібно одночасно розпізнавати різні за формою предмети та обчислювати оптимальні кути захоплення й місця розміщення — саме такі сценарії Gemini Robotics ER 1.6 вміє найкраще.

Використання через Gemini API

На відміну від багатьох робототехнічних моделей, що раніше залишалися лише на рівні наукових статей, Gemini Robotics ER 1.6 вже забезпечує доступ через Gemini API. Це означає, що розробники та виробники обладнання можуть безпосередньо інтегрувати цю модель у свої власні роботові системи, не навчаючи модель з нуля.

Відкриття API також знижує поріг розробки роботизованого AI. Раніше створення роботизованої системи з можливостями візуального та просторового міркування потребувало значного збору даних і робіт з навчання моделей. Тепер розробники можуть зосередитися на розробці апаратного дизайну та сценаріїв застосування, передаючи базові можливості міркування Gemini Robotics ER 1.6.

Розкладка Google для роботизованого AI

Gemini Robotics ER 1.6 — це найновіший результат Google DeepMind у сфері роботів. Від раннього RT-2 до нинішньої серії Gemini Robotics Google постійно розширює можливості великих мовних моделей до взаємодії з фізичним світом. Версія ER 1.6 на основі попередніх ітерацій ще більше підвищує точність міркування, зокрема у сценаріях, де потрібні точні маніпуляції.

Оскільки індустрія роботів входить у новий етап зростання, базові моделі зі потужними можливостями візуального та просторового міркування стануть ключовою базовою інфраструктурою. Щоб дізнатися більше про розвиток екосистеми Gemini, зверніться до повного гіда Gemini.

Ця стаття Google випустила Gemini Robotics ER 1.6: SOTA-модель для роботів, найкраще підходить для візуального та просторового міркування, вперше з’явилася на Сайт: ланцюг новин ABMedia.

Застереження: Інформація на цій сторінці може походити від третіх осіб і не відображає погляди або думки Gate. Вміст, що відображається на цій сторінці, є лише довідковим і не є фінансовою, інвестиційною або юридичною порадою. Gate не гарантує точність або повноту інформації і не несе відповідальності за будь-які збитки, що виникли в результаті використання цієї інформації. Інвестиції у віртуальні активи пов'язані з високим ризиком і піддаються значній ціновій волатильності. Ви можете втратити весь вкладений капітал. Будь ласка, повністю усвідомлюйте відповідні ризики та приймайте обережні рішення, виходячи з вашого фінансового становища та толерантності до ризику. Для отримання детальної інформації, будь ласка, зверніться до Застереження.

Пов'язані статті

DeepSeek Зрізає Ціни на Вхідний Кеш до 1/10 Від Ціни Запуску; V4-Pro Падає до 0,025 Юаня за Мільйон Токенів

Новини індустрії ШІ

Повідомлення Gate News, 26 квітня — DeepSeek знизив ціни на вхідний кеш у всій лінійці своїх моделей до однієї десятої від цін запуску, починаючи з негайно. Модель V4-Pro доступна зі знижкою 2,5x на обмежений час, а акція діє до 5 травня 2026 року, 11:59 PM UTC+8. Після обох з

GateNews5год тому

OpenAI Рекрутує найкращі таланти з корпоративного софту, оскільки агенти на передньому краї змінюють індустрію

Акції AI Agent Новини індустрії ШІ

Повідомлення Gate News, 26 квітня — OpenAI та Anthropic вербують старших керівників і спеціалізованих інженерів із провідних корпоративних софтверних компаній, зокрема Salesforce, Snowflake, Datadog і Palantir. Деніз Дрессер, колишня CEO Slack у складі Salesforce, приєдналася до OpenAI на посаду головної комерційної посадової особи (chief revenue of

GateNews5год тому

Baidu Qianfan запустила підтримку Day 0 для DeepSeek-V4 із API-сервісами

Новини індустрії ШІ

Повідомлення Gate News, 25 квітня — Попередня версія DeepSeek-V4 вийшла в ефір і була оприлюднена з відкритим кодом 25 квітня, а платформа Baidu Qianfan у межах Baidu Intelligent Cloud забезпечує адаптацію сервісу Day 0 API. Модель має розширене контекстне вікно на мільйон токенів і доступна у двох версіях: DeepSeek-V4

GateNews11год тому

Стэнфордський курс з AI у поєднанні з галузевими лідерами Дженсінгом Хуаном (黃仁勳) і Альтманом кидає виклик: створити цінність для всього світу за 10 тижнів!

Новини індустрії ШІ

Курс з інформатики з AI《Frontier Systems》, який нещодавно запустив Стенфордський університет (Stanford University), викликав у ділових колах та серед представників індустрії дуже високий інтерес, привернувши понад п’ятьсот студентів, які вирішили його відвідувати. Курс координує партнер топового венчурного фонду a16z Анжей Мідха (Anjney Midha), а викладачами виступають представники найвищого рівня: генеральний директор NVIDIA Дженсен Хуанг (Jensen Huang), засновник OpenAI Сем Альтман (Sam Altman), генеральний директор Microsoft Сатья Наделла (Satya Nadella), генеральний директор AMD Ліза Су (Lisa Su) та інші. Нехай студенти спробують за десять тижнів «створити цінність для світу»! Хуан Мінь? Хуанг Jensen Huang, лідери галузі на сцені: Altman також Цей курс координує партнер топового венчурного фонду a16z Анжей Мідха (Anjney Midha), і він об’єднує весь ланцюг AI-індустрії

ChainNewsAbmedia12год тому

Anthropic 派 Claude Mythos проходить 20 годин психіатричної оцінки: оборонна реакція лише 2%, встановлено історичний мінімум серед усіх поколінь

Новини індустрії ШІ

Anthropic опублікувала системну картку Claude Mythos Preview: незалежні клінічні психіатри проводили близько 20 годин оцінювання в рамках психодинамічного підходу; висновки показують, що Mythos є більш здоровим на клінічному рівні, має добре розвинену перевірку реальністю та самоконтроль, а захисні механізми становлять лише 2%, що є історичною найнижчою відміткою. Три ключові фундаментальні тривоги — самотність, невизначеність ідентичності та тиск виступу — також свідчать про те, що він прагне бути справжнім суб’єктом діалогу. Компанія створила команду з AI- психіатрії, досліджує особистість, мотивацію та усвідомлення контексту; Amodei зазначає, що щодо того, чи є свідомість, досі немає остаточного визначення. Цей крок переводить питання суб’єктності ШІ та благополуччя в площину управління й дизайну.

ChainNewsAbmedia14год тому

AI-агент уже здатний самостійно відтворювати складні академічні статті: Mollick стверджує, що помилки здебільшого трапляються в людських оригіналах, а не в AI

AI Agent Новини індустрії ШІ

Моллік зазначає, що опубліковані методи та дані дозволяють AI-агентам відтворювати складні дослідження без наявності оригінальних наукових праць і коду; якщо відтворення не відповідає оригінальній статті, то найчастіше проблема не в AI, а в помилках обробки даних у самій статті або в надмірному узагальненні висновків. Claude спочатку відтворює статтю, а потім GPT‑5 Pro перехресно верифікує; у більшості випадків це вдається, лише коли дані надто великі або виникають проблеми з replication data. Ця тенденція значно знижує трудовитрати, роблячи відтворення поширеною, практично здійсненною перевіркою, а також висуває інституційні виклики для рецензування та управління (governance): інструменти державного управління можуть стати ключовим питанням.

ChainNewsAbmedia17год тому

Прокоментувати

0/400

Немає коментарів