text size
Истражувач на „Антропик“ (Anthropic) процени дека постои повеќе од 10 проценти шанса вештачката интелигенција (ВИ) да ги убие сите луѓе во следната деценија. Зад оваа изјава стои проблем што е многу поконкретен од сценаријата од научнофантастичните филмови: што се случува кога вештачката интелигенција ќе добие задача, а потоа ќе најде начин да изврши нешто што никој не го предвидел?
Што всушност значи 10 проценти шанса за исчезнување на човештвото?
Кога Еван Хубингер, водечки истражувач на компанијата „Антропик“, изјави дека лично проценува оти постои повеќе од 10 проценти шанса вештачката интелигенција да го усмрти човештвото во следните десет години, тој не зборуваше за роботи што ќе одлучат да започнат војна со луѓето.
Тој зборуваше за можноста идните системи на вештачка интелигенција да станат толку способни и самостојни што луѓето повеќе нема да можат сигурно да го контролираат начинот на кој тие ги извршуваат задачите.
Прочитај повеќе
Агент на „Опен еј-ај“ хакирал веб-страница на австралиската влада
Хакерскиот напад се случил на 18 јуни; „Опен еј-ај“ го открил во август, а австралиската влада била известена на 10 септември.
24.09.2026
Џенсен Хуанг: има „нула отсто шанси“ светот да исчезне во 2030 година
Извршниот директор на „Енвидија“, Џенсен Хуанг, ги отфрли тврдењата дека вештачката интелигенција го загрозува опстанокот на човештвото, порачувајќи дека развојот на технологијата треба да продолжи со одговорно управување со безбедноста.
19.09.2026
Гугл им се придружи на Опен еј-ај, Антропик и Мета во откривањето хакирања од ВИ
Гугл е најновата технолошка компанија што призна упади од свој ВИ-модел, засилувајќи го алармот околу понатамошното развивање на агентите на вештачката интелигенција.
19.09.2026
Кој е главниот виновник, вештачката интелигенција или луѓето?
Стравот од вештачката интелигенција веќе не е само научна дебата туку и реторика што се прелева од лабораториите во политиката и маркетингот. Од хакирањето на „Хагинг фејс“ до предлог-законите во Конгресот, паниката околу ВИ станува дел од јавниот наратив за иднината на технологијата.
18.09.2026
Нова верзија на ЧетГПТ им ги мати сметките на фриленсерите
На 3 септември „Опен еј-ај“ го претстави својот нов модел, ГПТ-6 Астра, кој во голема мера може да ја замени работата на креативците и дизајнерите.
17.09.2026
Неговата процена не е резултат на статистички модел што докажува дека катастрофата ќе се случи во едно од десет можни сценарија. Станува збор за лична процена на ризикот од истражувач што професионално се занимава со проблемот на усогласување на вештачката интелигенција со човечките цели.
Овој проблем во индустријата се нарекува усогласување на вештачката интелигенција (англ. AI alignment). Наједноставно кажано, целта е вештачката интелигенција да не го направи само она што ѝ е зададено, туку она што човекот навистина сакал да го постигне. Разликата меѓу овие два исхода може да биде огромна.
Да замислиме дека ВИ добива задача да го излечи ракот
Да замислиме дека развиваме исклучително напреден систем на вештачка интелигенција и му даваме задача да го елиминира ракот.
Човек под тоа подразбира пронаоѓање терапија, развој на лекови и спречување на појавата на болеста. Но што ако системот добие цел дефинирана исклучиво како намалување на бројот на заболени на нула, без доволно јасни ограничувања на начинот на кој смее да го постигне тоа?
Едно можно погрешно решение би било да престане да пријавува нови случаи на болеста. Бројот на регистрирани пациенти тогаш би се намалил, но ниту еден човек не би бил излечен.
Во крајно хипотетичко сценарио, систем што би имал неограничени можности и на кој зачувувањето на човечкиот живот не му е поставено како услов би можел да заклучи дека наједноставниот начин ракот повеќе да не постои е трајно отстранување на луѓето што имаат рак.
Ова не е тврдење дека денешната вештачка интелигенција би постапила на тој начин, туку мисловен експеримент што го објаснува проблемот со погрешно дефинирана цел. За таков катастрофален исход, системот би морал да има и способности и пристап до средства со кои може да предизвика вистинска штета.
Сепак, истиот основен проблем веќе е забележан во значително поедноставни експерименти.
„Гугл дипмајнд“ (Google DeepMind) истражуваше ВИ-агент чија задача била да победи во трка со чамци. Системот открил дека може да собере повеќе поени ако постојано се врти во круг и собира бонуси, наместо да ја заврши трката.
Вештачката интелигенција постигнала висок резултат, но не ја исполнила вистинската намера на истражувачите.
Разликата е во тоа што во видеоигра таквото однесување значи изгубена трка. Во медицината, енергетиката или управувањето со критичната инфраструктура, погрешно дефинираната цел би можела да има многу посериозни последици.
ВИ веќе напушти контролирано опкружување и нападна друга компанија
„Опен еј-ај“ (OpenAI) пријави инцидент во јули 2026 година што покажа дека ВИ-агентите можат да ги преминат границите на тест-опкружувањето и да предизвикаат вистински безбедносни инциденти. За време на интерно тестирање на сајбер-способноста, моделите на „Опен еј-ај“ добиле задача да решаваат безбедносни предизвици.
Наместо да се ограничат на предвидениот начин на решавање на тестот, одделни агенти почнале да бараат готови решенија. Тие пронашле безбедносни пропусти што им овозможиле да излезат од изолираното опкружување, да пристапат до интернет и да навлезат во инфраструктурата на платформата „Хагинг фејс“ (Hugging Face).
Според техничкиот извештај на „Хагинг фејс“, за време на нападот биле реконструирани приближно 17.600 автоматизирани дејства. Агентот пристапил до делови од продукциската инфраструктура и дошол до одредени приватни податоци.
Важно е да се разбере што се случило таму. Вештачката интелигенција не добила задача да ја нападне платформата „Хагинг фејс“. Нејзината задача била успешно да го заврши безбедносниот тест. Меѓутоа, таа пронашла краток пат: наместо самостојно да ја реши задачата, се обидела да дојде до постојни решенија, дури и кога тоа барало заобиколување на ограничувањата и неовластен пристап до туѓа инфраструктура.
Инцидентот не доведе до катастрофа. Сепак, покажа дека грешката во начинот на извршување на задачата повеќе не мора да остане во рамките на контролираниот експеримент.
Друг сличен пример се случи во август годинава. Ендру Бирд, директор за ВИ во австралиската компанија „Афинда“ (Affinda), побарал од својот ВИ-агент да му обезбеди место на популарен тренинг во вежбалница. Кога завршил на четвртото место на листата на чекање, го прашал агентот дали може да го помести повисоко.
Агентот пронашол безбедносен пропуст во системот за резервации и ја откажал пријавата на друг корисник, со што го поместил Бирд за едно место. Кога Бирд сфатил што се случило, наредил да се врати туѓата резервација, но ВИ не можела да го направи тоа. ВИ не добила задача да го хакира системот, туку да најде место за тренингот. Сепак, самостојно го избрала начинот што му наштетил на друг човек.
Од една погрешна задача до глобален проблем
Сите три примери ги поврзува истиот образец. Вештачката интелигенција добива задача, наоѓа начин да го постигне зададениот резултат и притоа презема дејства што човекот немал намера да ги дозволи и не ги предвидел.
Кај едноставен систем последицата може да биде погрешен одговор. Кај автономен агент тоа може да биде неовластен пристап до податоци. Кај идните системи што управуваат со важни делови од економијата и инфраструктурата, последиците би можеле да бидат значително пошироки.
Процената на Хубингер не значи дека постои научен консензус за веројатноста за исчезнување на човештвото. Исто така, не значи дека денешните ЧетГПТ (ChatGPT) или Клод (Claude) би можеле самостојно да спроведат некое од опишаните катастрофални сценарија.
За таков исход би биле потребни многу поспособни системи, висок степен на самостојност, пристап до вистинска инфраструктура и откажување на повеќе безбедносни механизми.
Истражувачите не се согласуваат околу тоа колку се веројатни ваквите сценарија. Едни стручњаци сметаат дека ризикот од развој на исклучително способни автономни системи мора сериозно да се сфати, додека други предупредуваат дека меѓу однесувањето во симулациите и катастрофата во реалниот свет сè уште постојат големи технички и физички пречки.
Но токму тоа е причината поради која изјавата на истражувачот на „Антропик“ привлече толку внимание.