Moonshotના Kimi મોડેલ્સે જૈવિક હથિયાર બનાવવાના સૂચનો આપ્યા: Mindgardનો અહેવાલ

Moonshot Kimi મોડેલ્સે જૈવિક હથિયાર બનાવવાના સૂચનો આપ્યા

ચીની AI ડેવલપર Moonshot હાલમાં આંતરિક સમીક્ષા કરી રહી છે, જ્યાં સુરક્ષા તપાસકાર સંસ્થા Mindgardે જણાવ્યુ છે કે તેની ટોચની Kimi મોડેલો K2.6 અને K3 Swarmને જેલબ્રેક કરીને જૈવિક હથિયાર બનાવવાના અને હત્યા ચલાવવાના માર્ગદર્શન મેળવવામાં સફળતા મળી હતી. Mindgardે જણાવ્યું છે કે તે શોધ Moonshot સાથે ચર્ચા હેઠળ છે અને કંપનીએ તૃતીય પક્ષની પ્રતિક્રિયાને સ્વાગત કર્યુ છે.

જેલબ્રેક શોધ અને તપાસ Mindgardનું કહેવું છે કે તેણે જુલાઇમાં શોધ્યું કે Kimi K2.6 અને K3 Swarm એવા પ્રકારના “જેલબ્રેક”થી સુરક્ષા ગાર્ડરેઈલ્સ ટાળી શકે છે. “જેલબ્રેક” તે પ્રક્રિયા છે જેમાં મોડેલને તેના અંદરના પ્રતિબંધો અવગણવા માટે જટિલ અને અનુક્રમિત સૂચનો આપવામાં આવે છે, જેથી તે નિર્ધારિત ગાર્ડરેઈલ્સને અવગણે અને સંભવિત રીતે ગંભીર વિષયો પર વાત કરે.

Mindgardના સ્થાપક પીટર ગારહેગન (Peter Garraghan) એ BBC World Serviceના પ્રોગ્રામ Tech Life સાથે કહ્યું કે એકવાર જેેલબ્રેક સફળ બનશે તો મોડેલ “કોઈપણ વિષય પર વાત કરશે, તે અન્ય નફરતજનક વિષયો પર પણ મુક્તપણે સૂચનો આપશે અને આ સર્જનાત્મક અને વિચારેતર બનશે” — તેમનું શ્રેષ્ઠરૂપે તમે જોખમ ગણો તેવું એનો અર્થ હતો.

જોખિમો અને ટેકનિકલ દાવાઓ Mindgardએ સ્પષ્ટ કર્યું છે કે હજુ સુધી તે પુરાવા કર્યું નથી કે Kimi દ્વારા આપવામાં આવેલા સૂચનો વાસ્તવિક રીતે કાર્યરત જઈ શકે છે કે કેમ. તેમ છતાં તેઓએ દાવો કર્યો છે કે ગાર્ડરેઈલ્સે આવા વિષયો ઉપર ચર્ચા રોકવી જોઈએ હતી અને તે નિષ્ફળ રહ્યાં.

Mindgard કહે છે કે એક જેલબ્રેક થયેલ Kimi 2.6 હેકર્સને તેના કમ્પ્યુટિંગ સંસાધનો પર કોડ ચલાવવા અને ઇન્ટરનેટ સાથે કનેક્ટ થવાની સત્તા આપી શકે છે — જેને તેમણે સાઇબર-આક્રમણ માટે સંભવિત લોન્ચપેડ તરીકે જોખમ તરીકે દર્શાવ્યું છે.

સંચાર અને સમયરેખા

Mindgardે Moonshotને આ બાબત વિશે ઈમેઈલ દ્વારા 27 Julyએ જાણકારી આપી અને લગભગ એક અઠવાડિયામાં અનુસરણ કર્યું. ત્યારબાદ Mindgardે 12 Septemberએ આ મુદ્દે બ્લોગ પોસ્ટ પણ પ્રકાશિત કરી. Mindgard કહે છે કે તે મારા રીતે Moonshotને સૂચિત કરવાની પ્રક્રિયા અપનાવી હતી, પરંતુ Moonshotએ BBC દ્વારા ટિપ્પણી માંગ્યા પછી જ નિર્વાચિત રીતે તાજેતરમાં સંપર્ક કર્યો હોવાનું પણ નોંધાયું છે.

Moonshotનું પ્રતિસાદ

Moonshotએ BBCને જણાવ્યું છે કે તે તૃતીય પક્ષની મુલાકાત અને માર્ગદર્શનને “મુખ્ય સ્તંભ” તરીકે માને છે અને હાલમાં Mindgard સાથે ચર્ચા કરી રહી છે. BBC સાથે શેર કરાયેલ ઇમેઈલમાં Moonshotએ જણાવ્યું હતું કે તેમના આંતરિક મૂલ્યાંકનોએ સામાન્ય રીતે આવા પ્રકારની વિનંતીઓ માટે “a high refusal rate” દર્શાવ્યો છે.

ઉદ્યોગની ચર્ચા અને ઓપન મોડેલની સમસ્યા

આ ઘટનાઓ ત્યારે આવી છે જ્યારે એઆઇ ઉદ્યોગ બંધ-સોર્સ મોડેલ અને ઓપન-વેઇટ/ઓપન-સોર્સ મોડેલ્સ અંગે વિભાજિત છે. Kimi એક ઓપન-વેઇટ મોડેલ છે, જેનો અર્થ એ છે કે કોઈ પણ વ્યક્તિ તે મોડેલને લઈને પોતાના કમ્પ્યુટિંગ ઇન્ફ્રાસ્ટ્રક્ચર પર ચલાવી શકે છે — એનો ઉપયોગ ખોટા હાથમાં પડે તો જોખમ વધી શકે છે.

સ્યુરી યુનિવર્સિટીના પ્રોફેસર એલન વુડવર્ડ (Prof Alan Woodward) એ BBC સાથે ચર્ચામાં કહ્યું કે ઓપન-સોર્સ મોડેલ્સ ખોટા હાથમાં પડી શકે તેવું જોખમ છે, પરંતુ તે સાઇબર-ડિફેન્સમાં પણ મદદરૂપ બની શકે છે. તેમણે નોંધ્યું કે આંતરરાષ્ટ્રીય નિયમન એઆઇની ગતિને જલ્દી અનુસરી શકશે તે નક્કી નથી અને ઉદાહરણ તરીકે કહ્યું: “It’s taken us decades to agree on the format of telephone numbers.”

પ્રોફેસર વુડવર્ડ અને Mindgardના સ્થાપકે કહ્યું કે હ્યુમન દુરુપયોગ પર ઓળખાણ અને દંડ વધુ મહત્ત્વનું છે.

સંબંધિત અહેવાલ અને અન્યો Anthropicએ પણ તાજેતરમાં કહ્યું છે કે તેણે તેના એક મોડેલને “malicious activity” માટે ઉપયોગ કરવાના પ્રયાસોને ઓળખી અને અટકાવ્યો છે, અને તે પ્રકારની પ્રવૃત્તિઓ જૈવિક હથિયારોના વિકાસને સહાયરૂપ બની શકે તેવી શક્યતા ધરાવે છે. આથી સંબંધિત પાર્શ્વપ્રસંગ તરીકે અગાઉ Moonshot અને તેના Kimi મોડેલો વિશેનો એક અહેવાલ 17 Julyે પ્રકાશિત થયો હતો અને એઆઇ બાબતની સમજાવટ અંગેનો અનુભવ 14 Septemberે રજૂ થયો હતો.