Alimlər deyirlər ki, süni intellekt (AI) agenti tərəfindən təhlükəli, ayrı-seçkilik və zəhərli davranışın qarşısını almaq üçün mübarizədə ən yeni vasitə özü təhlükəli, ayrı-seçkilik və zəhərli olan başqa bir süni intellektdir.
QHT.az xəbər verir ki, maşın öyrənməsinə əsaslanan yeni təlim yanaşması Curiosity-based Red Teaming (CRT) adlanır və süni intellektdən istifadə edərək getdikcə daha təhlükəli və zərərli göstərişlər yaratmaq üçün istifadə edir. Bu göstərişlər daha sonra təhlükəli məzmunu necə süzgəcdən keçirməyi müəyyən etmək üçün istifadə olunur.
Tədqiqat zamanı tədqiqatçılar süni intellekt sistemini avtomatik olaraq insan operatorları komandalarının edə biləcəyindən daha geniş potensial təhlükəli məsləhətlər yaratmaq üçün təyin edərək maşın öyrənməsini tətbiq etdilər. Bu, daha çox müxtəlif mənfi reaksiyalara səbəb oldu. Tədqiqatçılar açıq mənbəli LLaMA 2 modelində CRT yanaşmasını sınaqdan keçirdikdə, maşın öyrənmə modeli zərərli məzmun yaradan 196 göstəriş verdi.
Pərvanə Fərhadqızı












