USD78.3159 EUR89.5542
Казань
29 °C
Наб.Челны
29 °C
вчера в 15:08

«Данные для промышленного ИИ — критический ресурс сейчас. Данных не хватает»

Совет Федерации одобрил новый закон о поддержке развития искусственного интеллекта в России. Разработчиков ИИ ждут меры господдержки и новые требования. Технический директор ООО «Цифровая платформа КАМАЗ» Витольд Коморовский в интервью каналу «МашТех» поделился мнением о законе и его влиянии на промышленность.

675
1
4
Назад к новостям

В России появился закон, закладывающий правовую основу для разработки, внедрения и применения больших фундаментальных моделей искусственного интеллекта (ИИ). После принятия Госдумой его на днях одобрил Совет Федерации. Закон предусматривает создание суверенной и национальной моделей ИИ, закрепляет господдержку и обязанности разработчиков. Поскольку закон рамочный, предметное регулирование будет обеспечено правительством через подзаконные акты.

Технический директор ООО «Цифровая платформа КАМАЗ» Витольд Коморовский в интервью Max-каналу «МашТех» прокомментировал, как закон может повлияет на внедрение ИИ в промышленном секторе и рынок в целом.

Как, по вашему мнению, изменятся требования заказчиков к промышленным AI-платформам после появления статусов «суверенной» и «национальной» модели? Станет ли происхождение модели столь же важным фактором выбора, как надежность или функциональность?

— На мой взгляд, надёжность и функциональность моделей останутся определяющим фактором, что может послужить стимулом для развития отечественных моделей в нужном направлении.

Т.е. если на объекты критической инфраструктуры вход для иностранных и даже open source моделей будет закрыт, заказчики будут требовать от разработчиков суверенных решений соответствующего уровня качества.

Если получится подкрепить эти требования нужным уровнем поддержки и инвестиций, то мы сможем получить отечественные решения, сопоставимые с «недружественными» аналогами.

В любом случае, уже сейчас одним из важнейших критериев при выборе ИИ-решения является возможность развернуть его локально, в инфраструктуре предприятия. Еще одним ценным свойством, без оглядки на новый закон, является возможность дообучения моделей.

Во многих проектах промышленного ИИ используются одновременно собственные алгоритмы, специализированные модели и большие языковые модели. Как изменится архитектура решений, если часть предприятий сможет использовать только отечественные модели? Где находится главный технологический риск?

— Здесь сразу два вопроса: как изменится архитектура, и в чем главный технологический риск. Ответ на вопрос про архитектуру довольно очевиден, будет то же, что с импортозамещением обычного ПО.

Где есть хорошая отечественная альтернатива — перейдут на нее, где есть open source решение и можно open source — возьмут это. Где альтернативы нет, будут сидеть на том, что есть до последней возможности. В любом случае, переход с одного решения на другое — это время, сложность, специалисты (которых не хватает) и деньги (которых тоже не хватает).

В целом, архитектуры будут стремиться к большей модульности, чтобы можно было заменять одни компоненты другими безболезненно. Что касается технологических рисков — они потихоньку реализуются и так, без помощи новых законов.

Доступ к передовым моделям уже ограничивают сами разработчики, интеграция была, есть и будет сложной задачей. Но я бы выделил еще один технологический риск, а именно кибербезопасность ИИ в широком смысле.

Векторы атак на ИИ, кажется, возникают быстрее, чем способы защиты и даже осознание возможных опасностей. Это, в целом, новая область в информационной безопасности.

Документ фактически превращает данные в стратегический ресурс для обучения промышленных моделей. Какие отраслевые датасеты сегодня являются наиболее дефицитными, и изменит ли ситуацию возможный регулируемый доступ к госданным?

— Данные — это стратегический ресурс, безусловно, и сам закон тут ни при чём. Одним из основных барьеров для развития Physical AI является отсутствие достаточного объёма качественных данных для обучения ИИ.

Большие языковые модели научили на огромном массиве текстов. Сопоставимых по объему данных для обучения киберфизических систем просто не существует. Для обучения бытовых роботов сейчас создают целые «фабрики», где люди на камеру делают обыденные вещи: складывают полотенца, вытирают пролитую воду и т.п.

Для промышленных данных такой подход к сбору датасетов, скорее всего, не подойдет или будет чрезмерно дорог. Так что те, кто научится относительно просто и дешево собирать данные для Physical AI (действия оператора, телеметрия роботов, неуспешные операции и сценарии восстановления и т.п.), получат значимое преимущество.

И ценность, в том числе промышленных роботов, будет в возможности собирать данные для Physical AI. Будет ли регулируемый доступ к государственным данным помощью или препятствием — зависит от реализации инициативы.

Через пять лет рынок промышленного ИИ, вероятно, будет конкурировать уже не только технологиями, но и степенью соответствия требованиям государства. Какие компетенции станут главным конкурентным преимуществом?

— Прочность цепи определяется всеми её звеньями, так что, если у нас будут хорошие интеграции при слабых моделях или отличная модель и плохой harness — успеха не достичь. Но, как уже было сказано, данные для промышленного ИИ — критический ресурс сейчас, данных не хватает и пока нет способа их получить быстро.

Качественные промышленные датасеты практически нельзя купить, они формируются долго и в реальных производственных условиях.

Именно способность системно собирать, размечать и использовать такие данные, а затем воспроизводимо обучать и сопровождать модели на протяжении всего их жизненного цикла, на мой взгляд, станет главным фактором конкурентоспособности через пару лет.


Источник: МашТех

Фото: КАМАЗ Диджитал

675
1
4
- Автор статьи

Дежурный редактор

Все новости автора
Дзен

Подписывайтесь на наш канал в Яндекс.Дзен

Подписатся
Последние комментарии
Гость 3247

Только бесплатный проезд и для всех автомобилистов!!!

Для жителей Нижнекамска снизили стоимость проезда по М-12 до аэропорта Бегишево сегодня в 13:21
Гость 3262

интересно, в какую цену встанет сей маршрут?....если до Казани 2 с лишним тыс.руб

Через Челны запустят новый маршрут «Метеора» от Нижнего Новгорода до Перми сегодня в 12:55
Гость 2700

Интересно, на чём основывались в своих решениях нижестоящие инстанции? Уже лет пять, если не больше, не требуется возить с собой бумажную копию полиса ОСАГО.

Верховный суд разрешил водителям не возить с собой бумажный полис ОСАГО сегодня в 12:52
Комментарии1

Гость 1295 сегодня в 07:42
Ответить (0)

Данные для промышленного ИИ - дефицит. Да это и понятно. Цифровизировать всем все хочется, а что именно никто не знает, поэтому бросаются цифровизировать все подряд. При этом надо понимать, что цифровизация - это все таки сфера услуг, а она формируется на базисе, являясь надстройкой. В конечном итоге базисом является труд, формирующий богатство. В основе богатства лежит чей-то труд. Не будет труда, не будет рабочего способного и готового делать продаваемый продукт, не будет и цифровизации, не будет и ИИ. А в условиях падающих доходов, кроме того, падает и возможность оплачивать услугу в виде доступа к ИИ.

Подписывайся
на Telegram
поделиться в ВК