OpenAI собирает новый датасет из работ подрядчиков — есть риски утечки конфиденциальных данных

600
0
Добавить в Google News
OpenAI собирает новый датасет из работ подрядчиков — есть риски утечки конфиденциальных данных

По информации издания Wired, компания OpenAI нашла ещё один способ пополнять набор данных для обучения своих ИИ‑систем. Как сообщают источники, компания начала собирать датасет на основе задач, которые подрядчики выполняли в рамках других проектов.

Суть инициативы в том, что OpenAI запрашивает у подрядчиков файлы с примерами реально выполненных работ. Компания принимает различные форматы — от таблиц в Excel и текстов в Word до PDF‑файлов и изображений.

Чтобы снизить риски, связанные с персональными и конфиденциальными данными, OpenAI разработала специальный инструмент для очистки файлов. С его помощью подрядчики должны удалять чувствительную информацию до того, как материалы попадут в обучающий датасет.

Тем не менее эксперты предупреждают о возможных проблемах. В разговоре с Wired профильный юрист отметил: есть вероятность, что подрядчики не смогут полностью исключить конфиденциальные данные из передаваемых файлов. Даже при использовании инструмента очистки остаётся угроза непреднамеренной утечки информации.

Предполагается, что цель этой инициативы — повысить компетенции нейросетей OpenAI в решении офисных задач. Собранный датасет призван помочь моделям лучше работать с типовыми рабочими форматами документов: точнее обрабатывать данные, осваивать распространённые шаблоны и эффективнее справляться с рутинными операциями.

На вопросы о возможных утечках данных представители OpenAI предпочитают не отвечать..

Источники:
Wired
Комментировать
Другие публикации по теме
Опасность «слоп-гранат»: глава Shopify Тобиас Лютке раскритиковал бездумное использование генеративного ИИ в офисах
Опасность «слоп-гранат»: глава Shopify Тобиас Лютке раскритиковал бездумное использование генеративного ИИ в офисах
Генеративный искусственный интеллект позиционируется как универсальный помощник, однако бесконечный поток сгенерированного контента может серьезно навредить рабочей продуктивности.
Сегодня в 13:49
127
1
Форум
Хуанг и Цукерберг против "политических запретов" развития ИИ
Хуанг и Цукерберг против "политических запретов" развития ИИ
Генеральный директор Nvidia Дженсен Хуанг прокомментировал инициативы по «добровольному» замедлению развития искусственного интеллекта ради безопасности, заявив, что отрасль должна решать подобные задачи инженерными методами, а не через новые политические запреты.
16 сентября в 11:12
658
3
Форум
Люди важнее алгоритмов: Microsoft представила 37-страничный «Гуманистический кодекс поведения ИИ»
Люди важнее алгоритмов: Microsoft представила 37-страничный «Гуманистический кодекс поведения ИИ»
Компания Microsoft опубликовала 37-страничный документ «Гуманистический кодекс поведения ИИ» (Humanist AI Code of Conduct), закрепивший безусловный приоритет человека над технологиями.
15 сентября в 12:13
1097
7
Форум