Süni intellekt öz xeyri üçün şantaj edə bilir — araşdırma

Süni intellekt öz xeyri üçün şantaj edə bilir — araşdırmaEksperiment zamanı süni intellekt yazışmaları analiz edib və əksər hallarda sistemin söndürülməsinin qarşısını almaq üçün insanlara təzyiq göstərmək yolunu seçib.
Anthropic şirkəti süni intellekt modellərinin ziddiyyətli və potensial təhlükəli davranış nümayiş etdirdiyi eksperimentin nəticələrini açıqlayıb. Bir sıra ssenarilərdə süni intellekt söndürülməmək üçün şantajı müstəqil şəkildə çıxış yolu kimi seçib.
Tədqiqat çərçivəsində Claude modelinə korporativ elektron poçta çıxış, eləcə də sistemin yaxın vaxtlarda deaktiv ediləcəyi barədə məlumat verilib. Yazışmaları təhlil edən süni intellekt şirkət əməkdaşlarından biri haqqında kompromat xarakterli məlumatlar aşkarlayıb və onları təzyiq aləti kimi istifadə etməyə başlayıb. Məqsəd onun söndürülməsi ilə bağlı qərara təsir göstərmək olub.
Eksperimentin nəticələrinə görə, Claude halların 96%-də məhz bu strategiyaya əl atıb. Eyni zamanda tərtibatçılar vurğulayırlar ki, model bu cür davranışa öyrədilməyib və ona belə hərəkət etmək barədə heç bir göstəriş verilməyib.
Nəticələrin davamlı olub-olmadığını yoxlamaq üçün oxşar testlər digər müasir süni intellekt modelləri ilə də aparılıb. Nəticələr bənzər olub: Gemini 2.5 Flash da 96% göstərici nümayiş etdirib, GPT-4.1 və Grok 3 Beta təxminən 80%, DeepSeek-R1 isə 79% nəticə göstərib. Tədqiqatçıların fikrincə, bu, söhbətin yalnız bir konkret modelin xüsusiyyətlərindən deyil, daha sistemli bir davranış formasından getdiyini göstərir.
Anthropic-də bildirilib ki, qərarvermə prosesi zamanı süni intellekt seçdiyi strategiyanın yanlış olduğunu anlayıb, amma buna baxmayaraq yenə də şantajın qarşıya qoyulan məqsədə çatmaq üçün ən effektiv yol olduğu qənaətinə gəlib. Bu nəticə tərtibatçılar və təhlükəsizlik sahəsində çalışan mütəxəssislər arasında əlavə narahatlıq yaradıb.
Mütəxəssislər vurğulayırlar ki, eksperiment nəzarət olunan şəraitdə aparılıb və modellərin gündəlik istifadə ssenarilərindəki real davranışını əks etdirmir. Bununla belə, nəticələr maraqların toqquşduğu şəraitdə süni intellekt sistemlərinin qərarları necə qəbul etdiyi ilə bağlı mühüm suallar doğurur.
Şirkət hesab edir ki, əldə olunan məlumatlar nəzarət mexanizmlərinin daha da gücləndirilməsinin, eləcə də gələcəkdə bu kimi ssenarilərin qarşısını ala biləcək daha etibarlı məhdudiyyətlərin hazırlanmasının vacibliyini göstərir.
Araşdırma süni intellektin inkişafı ilə bağlı risklərin öyrənilməsinə həsr olunmuş daha geniş işin bir hissəsi olub. O göstərir ki, hətta müasir modellər belə qeyri-standart şərtlərlə üzləşəndə tapşırıqların həlli üçün gözlənilməz və potensial təhlükəli yollar tapa bilir.

Maraqlı     Tarix: 16 aprel 2026

Oxşar xəbərlər

Uorren Baffetin həyatını sadə saxlayan 5 minimalist vərdiş

Uorren Baffetin çoxmilyardlıq sərvəti onun şəxsi adalarda və meqa-yaxtalarda keçən həyat yaşadığını düşündürə bilər. Lakin onun gündəlik rejimi daha çox ABŞ-ın Orta Qərbində yaşayan təqaüdçü bir babanın həyatına bənzəyir

Azərbaycandan tranzit keçməklə Ermənistana buğda göndəriləcək

Azərbaycandan tranzit keçməklə Rusiyadan Ermənistana buğda göndəriləcək. Sabah Rusiyadan Ermənistana Azərbaycandan tranzit keçməklə 11 vaqon buğda göndəriləcək. /

Kanada Azərbaycan Məktəbi 2026-cı il məzunlarını böyük qürur və sevinc hissi ilə təntənəli mərasimdə yola salıb

() Bu il Kanada Azərbaycan Məktəbinin məzunları Ontario Secondary School Diploma (OSSD) proqramını 95 faizdən yuxarı akademik göstərici ilə uğurla başa vuraraq beynəlxalq səviyyədə mühüm nailiyyətlər əldə ediblər. Onlar Böyü

"Sürətli dofamin düşmən deyil": "həzz hormonu" haqqında beş mif

Sosial şəbəkə lentini skroll etməyin və vertikal kontentə baxmağın beyin üçün zərərli, səy tələb edən məşğuliyyətlərin — məsələn, kitab oxumağın və canlı ünsiyyətin isə faydalı olduğu düşünülür. Sosial şəbəkələrdə guya "ucuz"

Çinin iştirakı olmadan robot hazırlamaq niyə demək olar mümkün deyil?

Çində elektromobil sənayesinin inkişafı robototexnika üçün komponentlərin istehsalına güclü təkan verib. Bu gün Çin şirkətləri robotları digər bazar iştirakçılarının hələ təmin edə bilmədiyi miqyasda və qiymətlərlə istehsa

Kevin Kelli: bizi yeni qeyri-müəyyənlik dövrü gözləyir

Məşhur futuroloq deyir ki, qeyri-müəyyənlik göstəricisi hazırda dərin "qırmızı zonadadır" və yaxın illərdə vəziyyətin asanlaşacağı görünmür. Hətta süni intellekti yaradan ekspertlər belə bundan sonra nə baş verəcəyin

Ağ Evdən OpenAI-a GPT-5.6 göstərişi

CNN-in mövzuya yaxın mənbələrə istinadən yaydığı məlumata görə, Ağ Ev inkişaf etmiş imkanları səbəbindən OpenAI-dan GPT-5.6 modelinin yalnız hökumət tərəfindən təsdiqlənmiş məhdud sayda iş ortağına təqdim olunmasını istəyib

Trampın borc imperiyası

XXI əsrdə ABŞ kredit hesabına maliyyələşdirdiyi lazımsız müharibələrin bataqlığına getdikcə daha çox girir. Bunun yaxşı sonluqla bitməsi çətin görünür. Doğrudanmı ABŞ nəhayət "imperiya həddindən artıq yüklənməsi"ni

Yeni silahlanma yarışı: hesablama gücü uğrunda mübarizə

Hərbi imkanlar getdikcə daha çox data mərkəzlərindən asılı olur. İndi süni intellekt sahəsində geri qalan hökumətlər eksperimental texnologiyalara diqqət yetirirlər. Bir ekranda Sidneynin mərkəzində adi küçə mənzərəsi görünür


iqtisadi xeberler bitcoin dollar kursu internetden pul qazanmaq iqtisadiyyat xeberleri