Законодавство Нідерландів

Стаття 10

чинна

СИСТЕМИ ШТУЧНОГО ІНТЕЛЕКТУ З ВИСОКИМ РИЗИКОМ

Регламент (ЄС) 2024/1689 — Закон про штучний інтелект · Глава 3 · Редакція діє з None

Оригінал

Високоризикові системи штучного інтелекту, що використовують методи, які передбачають навчання моделей штучного інтелекту на даних, розробляються на основі наборів даних для навчання, валідації та тестування, які відповідають критеріям якості, зазначеним у частинах 2–5, кожного разу, коли такі набори даних використовуються.

2. Набори даних для навчання, валідації та тестування підлягають практикам у сфері управління даними, які відповідають цільовому призначенню системи штучного інтелекту з високим рівнем ризику. Ці практики, зокрема, стосуються:

а) відповідні варіанти розробки;

b) процеси збирання даних та походження даних, а у випадку персональних даних — первісна мета збирання даних;

c) відповідні операції з обробки для підготовки даних, такі як анотування, маркування, очищення, актуалізація, збагачення та агрегування;

d) складання припущень, зокрема стосовно інформації, яку дані мають вимірювати та відображати;

e) оцінка наявності, кількості та придатності наборів даних, які є необхідними;

f) оцінка з метою виявлення можливої упередженості, яка ймовірно матиме наслідки для здоров’я та безпеки осіб, спричинить негативний вплив на основоположні права або призведе до дискримінації, забороненої згідно з правом Союзу, особливо у випадках, коли вихідні дані впливають на вхідні дані для майбутніх операцій;

g) та відповідні заходи для виявлення, запобігання та обмеження можливих викривлень, встановлених відповідно до пункту f);

h) ідентифікація відповідних прогалин або недоліків у даних, що перешкоджають дотриманню цього регламенту, а також способи, у які ці прогалини та недоліки можуть бути усунені.

3. Набори даних для навчання, валідації та тестування є релевантними, достатньо репрезентативними, а також максимально вільними від помилок та повними з огляду на передбачувану мету. Крім того, набори даних мають відповідні статистичні характеристики, зокрема, де це доречно, стосовно осіб або груп осіб, щодо яких мають використовуватися високоризикові системи штучного інтелекту. Ці характеристики наборів даних можуть бути досягнуті на рівні окремих наборів даних або їх комбінації.

4. Стосовно наборів даних, наскільки це вимагається з огляду на їхню передбачувану мету, враховуються характеристики або елементи, які є специфічними для певного географічного, контекстуального, функціонального або поведінкового середовища, у якому має використовуватися система штучного інтелекту з високим рівнем ризику.

5. Оскільки це є суворо необхідним для забезпечення виявлення та виправлення упередженості стосовно систем штучного інтелекту з високим рівнем ризику відповідно до пункту 2, підпунктів f) та g) цієї статті, постачальники таких систем можуть у виняткових випадках обробляти особливі категорії персональних даних за умови забезпечення належних гарантій для основних прав і фундаментальних свобод фізичних осіб. Окрім положень Регламентів (ЄС) 2016/679 та (ЄС) 2018/1725 і Директиви (ЄС) 2016/680, для такої обробки мають бути виконані всі нижченаведені умови:

а) виявлення та виправлення упередженості не можуть бути ефективно здійснені шляхом обробки інших даних, включаючи синтетичні або анонімізовані дані;

b) спеціальні категорії персональних даних підлягають технічним обмеженням щодо повторного використання персональних даних, а також вдосконаленим заходам безпеки та захисту приватності, включаючи псевдонімізацію;

c) спеціальні категорії персональних даних підлягають заходам, спрямованим на забезпечення того, щоб оброблювані персональні дані були захищені та забезпечені належними гарантіями, включаючи суворий контроль та документування доступу до них, з метою запобігання зловживанням та забезпечення того, щоб доступ до таких персональних даних мали лише уповноважені особи, на яких поширюються належні зобов’язання щодо конфіденційності;

d) спеціальні категорії персональних даних не надсилаються, не передаються та не підлягають іншому ознайомленню з ними іншими сторонами;

e) особливі категорії персональних даних видаляються, як тільки викривлення буде виправлено або закінчиться строк зберігання персональних даних, залежно від того, що настане раніше;

f) реєстр операцій з обробки даних, ведений на підставі Регламентів (ЄС) 2016/679 та (ЄС) 2018/1725 і Директиви (ЄС) 2016/680, містить підстави, з яких обробка особливих категорій персональних даних була суворо необхідною для виявлення викривлень, а також причини, через які цієї мети неможливо було досягти шляхом обробки інших даних.

6. Для розробки систем штучного інтелекту з високим рівнем ризику, які не використовують методи навчання моделей, пункти 2–5 застосовуються виключно до наборів даних для тестування.

1. AI-systemen met een hoog risico die technieken gebruiken die het trainen van AI-modellen met data omvatten, worden ontwikkeld op basis van datasets voor training, validatie en tests die voldoen aan de in de leden 2 tot en met 5 bedoelde kwaliteitscriteria telkens wanneer dergelijke datasets worden gebruikt.

2. Datasets voor training, validatie en tests worden onderworpen aan praktijken op het gebied van databeheer die stroken met het beoogde doel van het AI-systeem met een hoog risico. Deze praktijken hebben in het bijzonder betrekking op:

a) de relevante ontwerpkeuzes;

b) processen voor dataverzameling en de oorsprong van de data en, in het geval van persoonsgegevens, het oorspronkelijke doel van de dataverzameling;

c) relevante verwerkingsactiviteiten voor datavoorbereiding, zoals annotatie, labelen, opschoning, actualisatie, verrijking en aggregatie;

d) het opstellen van aannames, met name met betrekking tot de informatie die de data moeten meten en vertegenwoordigen;

e) een beoordeling van de beschikbaarheid, kwantiteit en geschiktheid van de datasets die nodig zijn;

f) een beoordeling met het oog op mogelijke vooringenomenheid die waarschijnlijk gevolgen heeft voor de gezondheid en de veiligheid van personen, nadelige effecten heeft op de grondrechten, of leidt tot discriminatie die op grond van het Unierecht verboden is, vooral wanneer data-outputs invloed hebben op inputs voor toekomstige operaties;

g) en passende maatregelen om mogelijke overeenkomstig punt f) vastgestelde vertekeningen op te sporen, te voorkomen en te beperken;

h) het identificeren van relevante leemten of tekortkomingen in de data die naleving van deze verordening in de weg staan, en de manier waarop deze leemten en tekortkomingen kunnen worden aangepakt.

3. Datasets voor training, validatie en tests zijn relevant, voldoende representatief, en zoveel mogelijk foutenvrij en volledig met het oog op het beoogde doel. De datasets hebben bovendien de passende statistische kenmerken, onder meer, waar van toepassing, met betrekking tot de personen of groepen personen ten aanzien van wie de AI-systemen met een hoog risico moeten worden gebruikt. Deze kenmerken van de datasets kunnen op het niveau van de afzonderlijke datasets of combinatie daarvan worden verwezenlijkt.

4. Ten aanzien van datasets wordt, voor zover vereist gezien het beoogde doel hiervan, rekening gehouden met de eigenschappen of elementen die specifiek zijn voor een bepaalde geografische, contextuele, functionele of gedragsomgeving waarin het AI-systeem met een hoog risico moet worden gebruikt.

5. Voor zover dit strikt noodzakelijk is om de opsporing en correctie van vertekeningen te waarborgen in verband met de AI-systemen met een hoog risico overeenkomstig lid 2, punten f) en g), van dit artikel, mogen de aanbieders van dergelijke systemen uitzonderlijk bijzondere categorieën persoonsgegevens verwerken, mits passende waarborgen worden geboden voor de grondrechten en fundamentele vrijheden van natuurlijke personen. Naast de bepalingen van Verordeningen (EU) 2016/679 en (EU) 2018/1725 en Richtlijn (EU) 2016/680 moeten voor een dergelijke verwerking alle volgende voorwaarden van toepassing zijn vervuld:

a) de opsporing en correctie van vooringenomenheid kunnen niet doeltreffend worden vervuld door het verwerken van andere data, waaronder synthetische of geanonimiseerde data;

b) de bijzondere categorieën persoonsgegevens zijn onderworpen aan technische beperkingen voor het hergebruik van persoonsgegevens, en geavanceerde beveiligings- en privacybeschermingsmaatregelen, waaronder pseudonimisering;

c) de bijzondere categorieën persoonsgegevens zijn onderworpen aan maatregelen om ervoor te zorgen dat de verwerkte persoonsgegevens worden beveiligd, beschermd met passende waarborgen, waaronder strikte controles en documentatie van de toegang ertoe, om misbruik te voorkomen en ervoor te zorgen dat alleen personen die gemachtigd zijn toegang tot die persoonsgegevens hebben met passende vertrouwelijkheidsverplichtingen;

d) de bijzondere categorieën persoonsgegevens worden niet verzonden, doorgegeven of anderszins geraadpleegd door andere partijen;

e) de bijzondere categorieën persoonsgegevens worden verwijderd zodra de vertekening is gecorrigeerd of de periode van bewaring van de persoonsgegevens ten einde is gekomen, indien dit eerder is;

f) het register op grond van Verordeningen (EU) 2016/679 en (EU) 2018/1725 en Richtlijn (EU) 2016/680 van verwerkingsactiviteiten bevat de redenen waarom de verwerking van bijzondere categorieën persoonsgegevens strikt noodzakelijk was om vertekeningen op te sporen en waarom die doelstelling niet kon worden bereikt door de verwerking van andere data.

6. Voor de ontwikkeling van AI-systemen met een hoog risico die geen technieken voor de training van modellen gebruiken, zijn de leden 2 tot en met 5 uitsluitend van toepassing op de datasets voor tests.