Фото: DepositPhotos

OpenAI вчера го објасни својот пристап кон означувањето на текстот создаден со вештачка интелигенција, со кој одговара на барањата на европскиот Закон за вештачка интелигенција. Во наредните недели ќе се почне со додавање на невидлива ознака, односно „воден жиг“ на текстот што го пишуваат ChatGPT и Codex, но само во Европската унија.

Законот бара текстовите, сликите, звукот и видеото од генеративната вештачка интелигенција да бидат означени во формат што може машински да се прочита. Обврската важи од 2 август, а системите што веќе биле на пазарот пред тоа, според измените од јули, имаат рок до 2 декември.

Технологијата се вика textGrain и според OpenAI додава „невидлив статистички сигнал“ во изборот на зборови на моделот. Ознаката ќе го добиваат „соодветните“ корисници на ChatGPT и Codex во ЕУ, во сите претплати, а програмерите ширум светот од вчера можат сами да го вклучат во „API“ за одредени модели, кои OpenAI не ги наведува.

Според OpenAI, на нејзините тестови со Astra не се гледа значајна разлика во квалитетот со и без ознаката. Сепак, препознавањето многу зависи од текстот. Според интерните тестови, при 1% лажни позитивни резултати, детекторот ја пронашол ознаката кај околу 80% од деловите со 200 „токени“ и кај околу 95% од тие со 400 „токени“ за теми како психологија, а кај математиката значително поретко.

Уредувањето штети уште повеќе. Кога 10% од зборовите биле заменети со синоними, препознавањето кај деловите со 400 „токени“ паднало од околу 92% на 66%, а со 25% заменети зборови на само 17%.

OpenAI нагласува и дека ознаката не мери колку придонел човекот, не утврдува сопственост ни одговорност, не го открива корисникот и не ја проверува точноста. Ако ознака не е пронајдена, тоа не докажува дека текстот го напишал човек, па вакви алатки веројатно нема да бидат сигурен доказ за препишани есеи.

Поради ризикот од пропуштени ознаки и лажни позитивни резултати, детекторот засега не е јавен. За пристап можат да аплицираат одобрени истражувачи и стручни организации, а според Кодексот за транспарентност на содржините создадени со вештачка интелигенција ќе се одобрува од случај до случај. Кодексот го потпишаа OpenAI, Google, Meta, Microsoft и Anthropic, а Google ознака за текст, SynthID, има уште од мај 2024 година.

Македонија не е членка на ЕУ, а OpenAI пишува дека ознаката во ChatGPT и Codex ќе се додава „само во ЕУ“, па корисниците кај нас засега не би требало да го добијат. Не е познато дали компанијата ќе одлучува според локацијата или според земјата на сметката.