Süni intellekt öz xeyri üçün şantaj edə bilir — araşdırma

Süni intellekt öz xeyri üçün şantaj edə bilir — araşdırmaEksperiment zamanı süni intellekt yazışmaları analiz edib və əksər hallarda sistemin söndürülməsinin qarşısını almaq üçün insanlara təzyiq göstərmək yolunu seçib.
Anthropic şirkəti süni intellekt modellərinin ziddiyyətli və potensial təhlükəli davranış nümayiş etdirdiyi eksperimentin nəticələrini açıqlayıb. Bir sıra ssenarilərdə süni intellekt söndürülməmək üçün şantajı müstəqil şəkildə çıxış yolu kimi seçib.
Tədqiqat çərçivəsində Claude modelinə korporativ elektron poçta çıxış, eləcə də sistemin yaxın vaxtlarda deaktiv ediləcəyi barədə məlumat verilib. Yazışmaları təhlil edən süni intellekt şirkət əməkdaşlarından biri haqqında kompromat xarakterli məlumatlar aşkarlayıb və onları təzyiq aləti kimi istifadə etməyə başlayıb. Məqsəd onun söndürülməsi ilə bağlı qərara təsir göstərmək olub.
Eksperimentin nəticələrinə görə, Claude halların 96%-də məhz bu strategiyaya əl atıb. Eyni zamanda tərtibatçılar vurğulayırlar ki, model bu cür davranışa öyrədilməyib və ona belə hərəkət etmək barədə heç bir göstəriş verilməyib.
Nəticələrin davamlı olub-olmadığını yoxlamaq üçün oxşar testlər digər müasir süni intellekt modelləri ilə də aparılıb. Nəticələr bənzər olub: Gemini 2.5 Flash da 96% göstərici nümayiş etdirib, GPT-4.1 və Grok 3 Beta təxminən 80%, DeepSeek-R1 isə 79% nəticə göstərib. Tədqiqatçıların fikrincə, bu, söhbətin yalnız bir konkret modelin xüsusiyyətlərindən deyil, daha sistemli bir davranış formasından getdiyini göstərir.
Anthropic-də bildirilib ki, qərarvermə prosesi zamanı süni intellekt seçdiyi strategiyanın yanlış olduğunu anlayıb, amma buna baxmayaraq yenə də şantajın qarşıya qoyulan məqsədə çatmaq üçün ən effektiv yol olduğu qənaətinə gəlib. Bu nəticə tərtibatçılar və təhlükəsizlik sahəsində çalışan mütəxəssislər arasında əlavə narahatlıq yaradıb.
Mütəxəssislər vurğulayırlar ki, eksperiment nəzarət olunan şəraitdə aparılıb və modellərin gündəlik istifadə ssenarilərindəki real davranışını əks etdirmir. Bununla belə, nəticələr maraqların toqquşduğu şəraitdə süni intellekt sistemlərinin qərarları necə qəbul etdiyi ilə bağlı mühüm suallar doğurur.
Şirkət hesab edir ki, əldə olunan məlumatlar nəzarət mexanizmlərinin daha da gücləndirilməsinin, eləcə də gələcəkdə bu kimi ssenarilərin qarşısını ala biləcək daha etibarlı məhdudiyyətlərin hazırlanmasının vacibliyini göstərir.
Araşdırma süni intellektin inkişafı ilə bağlı risklərin öyrənilməsinə həsr olunmuş daha geniş işin bir hissəsi olub. O göstərir ki, hətta müasir modellər belə qeyri-standart şərtlərlə üzləşəndə tapşırıqların həlli üçün gözlənilməz və potensial təhlükəli yollar tapa bilir.

Maraqlı     Tarix: 16 aprel 2026

Oxşar xəbərlər

Gömrükdə malların saxlanılması ilə bağlı yeni qaydalar qüvvəyə mindi

Fiziki şəxslər tərəfindən gömrük sərhədindən keçirilən malların müvəqqəti saxlanca verilməsi ilə bağlı yeni qaydalar müəyyənləşib. Bununla bağlı Gömrük Məcəlləsində dəyişikliklərlə əlaqədar iyunun 19-da qəbul edilən müvafi

Artım üzərində qurulmuş dünya sona çatır

Bəzi qrafiklər baş verənləri onlarla proqnoz kitabından daha yaxşı izah edir. Məsələn, yuxarıdakı qrafik kimi. Bu, 1950-ci ildən bəri Avropada demoqrafik yükün strukturudur. 1950-ci ildə əmək qabiliyyətli yaşda olan hər 10

ÜDM üçün tələ: süni intellekt köpüyü niyə iqtisadçıları əvvəlkilərdən daha çox qorxudur?

ABŞ fond bazarı yüksəlişdədir və bu artımın əsas lokomotivi süni intellektdir. Texnologiya nəhəngləri süni intellekt mütəxəssislərini öz tərəflərinə çəkmək, çipləri kütləvi şəkildə almaq və məlumat mərkəzləri tikmək üçü

"Sürətli dofamin düşmən deyil": "həzz hormonu" haqqında beş mif

Sosial şəbəkə lentini skroll etməyin və vertikal kontentə baxmağın beyin üçün zərərli, səy tələb edən məşğuliyyətlərin — məsələn, kitab oxumağın və canlı ünsiyyətin isə faydalı olduğu düşünülür. Sosial şəbəkələrdə guya "ucuz"

SpaceX-ə rəqib ilk dəfə orbitə çıxıb

Almaniyanın raket istehsalçısı "Isar Aerospace" həftəsonu ilk dəfə uğurla orbitə çatıb. xəbər verir ki, bu, Avropanın kommersiya kosmik sənayesi üçün mühüm mərhələ hesab olunur. Şirkət sürətlə artan tələbatı qarşılama

Çin yenidən öndədir: dünyanın ən sürətli superkompüteri Şençjendə yaradılıb

Şençjendə dünyanın ən sürətli superkompüteri kimi tanınan yeni sistem istifadəyə verilib. Diqqətçəkən məqam budur ki, bu qurğu ixtisaslaşdırılmış qrafik çiplər üzərində deyil, adi mikroprosessorlar əsasında işləyir. Çin uzu

Formula 1 yarışlarının keçiriləcəyi vaxt bəzi məktəblərdə tədris onlayn təşkil olunacaq

2026-ci ildə Formula 1 Azərbaycan Qran-prisi dövründə yarışların keçiriləcəyi ərazilərdə yerləşən ümumitəhsil müəssisələrində tədris onlayn təşkil olunacaq. Bu barədə Məktəbəqədər və Ümumi Təhsil üzrə Dövlət Agentliyində

Nepal və Tibetdə dağıdıcı selə nə səbəb olub?

Mənbə: . Hadisə Azərbaycandan minlərlə kilometr uzaqda, Himalay dağlarının Nepal və Çin sərhədində baş versə də, bu cür təbii fəlakətlərin necə yarandığını və bir-biri ilə necə əlaqəli olduğunu anlamaq coğrafi baxımdan mühü

Azərbaycandan tranzit keçməklə Ermənistana buğda göndəriləcək

Azərbaycandan tranzit keçməklə Rusiyadan Ermənistana buğda göndəriləcək. Sabah Rusiyadan Ermənistana Azərbaycandan tranzit keçməklə 11 vaqon buğda göndəriləcək. /


iqtisadi xeberler valyuta xeberleri dollar məzənnəsi biznes krediti online pul qazanmaq