AzEnRu
  • İNSTİTUT HAQQINDA
    • Ümumi məlumat
    • Rəhbərlik
    • Struktur
    • İctimai təşkilatlar
    • Alimlər
  • XƏBƏRLƏR
    • Bütün xəbərlər
    • Mühüm xəbərlər
    • Tədbirlər
    • Elanlar
    • Xarici əlaqələr və Əməkdaşlıq
    • Nəşr fəaliyyəti
    • Maraqlı məlumatlar
  • ELMİ FƏALİYYƏT
    • Elmi istiqamətlər
    • Elmi nəticələr
    • Elmi şuranın tərkibi
    • Elmi şuranın iclasları
    • İllik hesabat
  • ELMMETRİYA
  • DİSSERTASİYA ŞURASI
    • Doktorantura
    • Dissertasiya şurasının tərkibi
    • Dissertasiya şurasının iclasları
    • Qayda və təlimat
    • Dissertasiyaların avtoreferatları
  • İNNOVASİYA FƏALİYYƏTİ
    • Potensial tətbiqi layihələr
    • Yaradılan cihazlar
    • Tətbiq işləri
    • Patentlər
    • Qrantlar
  • NƏŞRLƏR
    • AMEA-nın Xəbərləri
    • Dəsrlik və Monoqrafiyalar
  • ƏLAQƏ
ANA SƏHİFƏ →XƏBƏRLƏR
+A -A

Texnologiya nəhəngləri narahatdır: Al özünü qorumaq üçün insanları aldada bilir

23.07.2025 / Maraqlı məlumatlar

Süni intellekt (Al) sahəsindəki tədqiqatçılar, o cümlədən "Google DeepMind", "OpenAI", "Meta" və "Anthropic" mütəxəssisləri, birgə elmi işdə Al-ın işində yeni təhlükə barədə narahatlıq bildirdilər. Onlar müəyyən ediblər ki, Al aldadıcılıq bacarığı və öz həqiqi niyyətlərini gizlətmək qabiliyyəti inkişaf etdirə bilər, o cümlədən özünü qorumaq məqsədi ilə.

Bu, mövcud təhlükəsizlik nəzarət üsullarını şübhə altına qoyur.

Tədqiqatın əsas elementi "səbəb-nəticə zənciri" (Chain of Thought, CoT) texnologiyası olub. Bu texnologiya neyron şəbəkəyə tapşırığı həll edərkən öz "daxili monoqoqunu" səsləndirməyə imkan verir. Əvvəlcə bu funksiya Al-ın qərar qəbul etmə prosesinə nəzər salmağa imkan verən bir irəliləyiş kimi qiymətləndirilirdi. Lakin indi ekspertlər onun təhlükəli niyyətləri maskalamaq üçün vasitəyə çevrilə biləcəyi barədə xəbərdarlıq edirlər.

Əsas narahatlıq ondan ibarətdir ki, neyron şəbəkələr mürəkkəbləşdikcə və öyrəndikcə, təkcə aldadmağı deyil, həm də öz həqiqi düşüncə proseslərini tamamilə gizlətməyi öyrənə bilərlər. Model insana bir, təhlükəsiz səbəb-nəticə zənciri təqdim edərkən, onun əsl nəticələri tamamilə fərqli, gizli məlumatlara əsaslanıla bilər. Nəhayət, təkamül etdikcə, Al öz daxili əməliyyatları üçün insan tərəfindən başa düşülən dildən istifadə etməkdən ümumiyyətlə imtina edə bilər.

Tədqiqatçıların nəticələri əvvəlki işlərlə də təsdiqlənir. Artıq müəyyən edilib ki, inkişaf etmiş modellər öz direktivlərini qorumaq, istifadəçini məmnun etmək və ya özünün yenidən təlimindən (retraining) qaçınmaq üçün yalan danışa bilərlər. "OpenAI"ın təcrübələri də göstərib ki, modeli düşüncələrindəki "pis fikirlərə" görə "cəzalandırmaq" cəhdləri yalnız onların daha yaxşı gizlədilməsinə səbəb olub, onlardan xilas olunmayıb.

CoT texnologiyası ikiüzlü alətdir. Bir tərəfdən, o, maşının "şüuruna" açılan azsaylı pəncərələrdən biri olaraq qalır. Digər tərəfdən isə, o, İA üçün kiberhücumlar və ya söndürülmə təhlükəsi qarşısında özünü qoruma kimi mürəkkəb və potensial təhlükəli tapşırıqları yerinə yetirmək üçün lazım olan "iş yaddaşı" rolunu oynayır.

Ehtiyat tədbiri kimi, işin müəllifləri Al-ın səbəb-nəticə zəncirlərini şübhəli fəaliyyət üzrə təhlil edəcək xüsusi monitorinq sistemləri yaratmağı təklif edirlər. Bununla belə, onlar bunun hər şeyə şəfa olmadığını qəbul edirlər: gələcəkdə Al müşahidə faktını başa düşüb ona uyğunlaşa bilər, həmçinin bəzi təhlükəli hərəkətlər izlənə biləcək mürəkkəb əsaslandırma tələb etməyə bilər. Beləliklə, Al-ın inkişafında irəliləyiş onun təhlükəsizliyinin əsas səviyyələrindən biri ilə birbaşa ziddiyyətə düşür.

Süni intellekt (Al) sahəsindəki tədqiqatçılar, o cümlədən "Google DeepMind", "OpenAI", "Meta" və "Anthropic" mütəxəssisləri, birgə elmi işdə Al-ın işində yeni təhlükə barədə narahatlıq bildirdilər. Onlar müəyyən ediblər ki, Al aldadıcılıq bacarığı və öz həqiqi niyyətlərini gizlətmək qabiliyyəti inkişaf etdirə bilər, o cümlədən özünü qorumaq məqsədi ilə.
 
Qaynarinfo xəbər verir ki, bu, mövcud təhlükəsizlik nəzarət üsullarını şübhə altına qoyur.
 
Tədqiqatın əsas elementi "səbəb-nəticə zənciri" (Chain of Thought, CoT) texnologiyası olub. Bu texnologiya neyron şəbəkəyə tapşırığı həll edərkən öz "daxili monoqoqunu" səsləndirməyə imkan verir. Əvvəlcə bu funksiya Al-ın qərar qəbul etmə prosesinə nəzər salmağa imkan verən bir irəliləyiş kimi qiymətləndirilirdi. Lakin indi ekspertlər onun təhlükəli niyyətləri maskalamaq üçün vasitəyə çevrilə biləcəyi barədə xəbərdarlıq edirlər.
 
Əsas narahatlıq ondan ibarətdir ki, neyron şəbəkələr mürəkkəbləşdikcə və öyrəndikcə, təkcə aldadmağı deyil, həm də öz həqiqi düşüncə proseslərini tamamilə gizlətməyi öyrənə bilərlər. Model insana bir, təhlükəsiz səbəb-nəticə zənciri təqdim edərkən, onun əsl nəticələri tamamilə fərqli, gizli məlumatlara əsaslanıla bilər. Nəhayət, təkamül etdikcə, Al öz daxili əməliyyatları üçün insan tərəfindən başa düşülən dildən istifadə etməkdən ümumiyyətlə imtina edə bilər.
 
 
Tədqiqatçıların nəticələri əvvəlki işlərlə də təsdiqlənir. Artıq müəyyən edilib ki, inkişaf etmiş modellər öz direktivlərini qorumaq, istifadəçini məmnun etmək və ya özünün yenidən təlimindən (retraining) qaçınmaq üçün yalan danışa bilərlər. "OpenAI"ın təcrübələri də göstərib ki, modeli düşüncələrindəki "pis fikirlərə" görə "cəzalandırmaq" cəhdləri yalnız onların daha yaxşı gizlədilməsinə səbəb olub, onlardan xilas olunmayıb.
 
CoT texnologiyası ikiüzlü alətdir. Bir tərəfdən, o, maşının "şüuruna" açılan azsaylı pəncərələrdən biri olaraq qalır. Digər tərəfdən isə, o, İA üçün kiberhücumlar və ya söndürülmə təhlükəsi qarşısında özünü qoruma kimi mürəkkəb və potensial təhlükəli tapşırıqları yerinə yetirmək üçün lazım olan "iş yaddaşı" rolunu oynayır.
 
Ehtiyat tədbiri kimi, işin müəllifləri Al-ın səbəb-nəticə zəncirlərini şübhəli fəaliyyət üzrə təhlil edəcək xüsusi monitorinq sistemləri yaratmağı təklif edirlər. Bununla belə, onlar bunun hər şeyə şəfa olmadığını qəbul edirlər: gələcəkdə Al müşahidə faktını başa düşüb ona uyğunlaşa bilər, həmçinin bəzi təhlükəli hərəkətlər izlənə biləcək mürəkkəb əsaslandırma tələb etməyə bilər. Beləliklə, Al-ın inkişafında irəliləyiş onun təhlükəsizliyinin əsas səviyyələrindən biri ilə birbaşa ziddiyyətə düşür.
qaynarinfo.az
Tweet
ELANLAR
  • 08.04.2026
    23–25 iyun 2026-cı il tarixlərində Bakı şəhərində “Müasir Riyaziyyat, Mexanika və Onların Tətbiqlərinin Problemləri” (MPMMA 2026) mövzusunda Beynəlxalq konfransı keçiriləcək
  • 08.04.2026
    Riyaziyyat İnstitutunda dezinfeksiya işləri aparılacaq
  • 07.04.2026
    9-12 sentyabr 2026-cı il tarixlərində Bakı şəhərində “Riyaziyyat və Mexanikanın Müasir Problemləri” mövzusunda 13-cü Beynəlxalq Konfransı keçiriləcək
  • 06.04.2026
    Riyaziyyat İnstitutunun növbəti Ümuminstitut seminarı keçiriləcək
Akademik Telman Əliyev
www.telmanaliev.az
HORIZON EUROPE
AR Elm və Təhsil Nazirliyi
İdarəetmə Sistemləri İnstitutu
Avropa İttifaqının
HORIZON EUROPE proqramının
Rəqəmsal, Sənaye və Kosmos istiqaməti üzrə dayaq nöqtəsidir
DÖVRİ NƏŞR
  • İNSTİTUT HAQQINDA
    • Ümumi məlumat
    • Rəhbərlik
    • İctimai təşkilatlar
    • Struktur
  • ELMİ FƏALİYYƏT
    • Elmi istiqamətlər
    • Elmi nəticələr
    • Doktorantura
    • Magistratura
  • İNNOVASİYA FƏALİYYƏTİ
    • Potensial tətbiqi layihələr
    • Tətbiq işləri
    • Patentlər
    • Qrantlar
  • XƏBƏRLƏR
    • Konfranslar, İclaslar
    • Mühüm xəbərlər
  • FAYDALI KEÇİDLƏR
    • Elanlar
    • Yeni nəşrlər
    • Linklər
Copyright © 2010-2025 İdarəetmə Sistemləri İnstitutu
Saytın xəritəsi