Forklog 2024-10-19 12:58:57

Исследователи Anthropic допустили саботаж ИИ против человечества

Искусственный интеллект может однажды саботировать человечество, но пока все в порядке. Об этом сообщили эксперты ИИ-стартапа Anthropic в новом исследовании. New Anthropic research: Sabotage evaluations for frontier modelsHow well could AI models mislead us, or secretly sabotage tasks, if they were trying to?Read our paper and blog post here: https://t.co/nQrvnhrBEv pic.twitter.com/GWrIr3wQVH— Anthropic (@AnthropicAI) October 18, 2024 Специалисты исследовали четыре различных вектора угроз со стороны искусственного интеллекта и определили, что «минимальные меры смягчения последствий» были достаточными для текущих моделей. «Достаточно способные модели могут подорвать человеческий надзор и принятие решений в важных контекстах. Например, в контексте разработки ИИ модели могут тайно саботировать усилия по оценке собственных опасных возможностей, мониторингу их поведения или принятию решений об их развертывании», — говорится в документе. Однако хорошая новость в том, что исследователи Anthropic видят возможности смягчения таких рисков, по крайней мере на текущий момент. «Хотя наши демонстрации показали, что в современных моделях, возможно, есть низкоуровневые признаки способности к саботажу, мы считаем, что минимальные меры по смягчению последствий достаточны для устранения рисков. Тем не менее по мере улучшения возможностей ИИ, вероятно, будут необходимы более реалистичные и жесткие меры по снижению рисков», — говорится в отчете. Ранее эксперты взломали ИИ-роботов и заставили их выполнять запрещенные протоколами безопасности и этическими нормами действия. Например, детонировать бомбы.

Enim loetud uudised

Bitcoin, ETH, & XRP Price Prediction: Delayed...
2024-10-19
Bitcoin Stuck Below $69K: Will Whale Traders...
2024-10-19
XRP Price Prediction: Breakout on the Brink;...
2024-10-19
Wall Street Expert Predicts Meteoric ETFSwap...
2024-10-19
Bitcoin Analyst Moves Into WallitIQ, Says He’...
2024-10-19
V3V Ventures ays $1.25M for Telegram username...
2024-10-19
Solana Price Confirms Breakout! SOL Price To...
2024-10-19
Zig Network Stage (ZIG) One Is Live! Investor...
2024-10-19

Seotud uudised

Book of Meme (BOME) Offers a 1:4.5 Risk/Reward, Ti...
19 Oct 2024
POPCAT Price Crash Imminent, Time to Exit or What?
19 Oct 2024
U.S. Officials Push to Free Binance Executive from...
19 Oct 2024
Will LTC Hit $90? Insights on the Spot Litecoin ET...
19 Oct 2024
Ripple News: XRP ETF Filings Could Bring Big Capit...
19 Oct 2024
This Meme Coin Set for 40% Rally, Insights from Re...
19 Oct 2024

Loe lahtiütlusest : Kogu meie veebisaidi, hüperlingitud saitide, seotud rakenduste, foorumite, ajaveebide, sotsiaalmeediakontode ja muude platvormide ("Sait") siin esitatud sisu on mõeldud ainult teie üldiseks teabeks, mis on hangitud kolmandate isikute allikatest. Me ei anna meie sisu osas mingeid garantiisid, sealhulgas täpsust ja ajakohastust, kuid mitte ainult. Ükski meie poolt pakutava sisu osa ei kujuta endast finantsnõustamist, õigusnõustamist ega muud nõustamist, mis on mõeldud teie konkreetseks toetumiseks mis tahes eesmärgil. Mis tahes kasutamine või sõltuvus meie sisust on ainuüksi omal vastutusel ja omal äranägemisel. Enne nende kasutamist peate oma teadustööd läbi viima, analüüsima ja kontrollima oma sisu. Kauplemine on väga riskantne tegevus, mis võib põhjustada suuri kahjusid, palun konsulteerige enne oma otsuse langetamist oma finantsnõustajaga. Meie saidi sisu ei tohi olla pakkumine ega pakkumine