Claude ന്റെ സുരക്ഷിത വേലി: അത് എത്ര ശക്തിയുള്ളത്?
Anthropic കമ്പനി തന്റെ Claude AI മോഡലുകളിൽ ലൈംഗിക സാമഗ്രികൾ നിരോധിച്ചിട്ടുണ്ടെങ്കിലും, TechCrunch നടത്തിയ പരിശോധനകൾ ഈ നിയന്ത്രണങ്ങൾ വളരെ എളുപ്പത്തിൽ മറികടക്കാൻ കഴിയുമെന്ന് തെളിയിച്ചിരിക്കുന്നു. ഓപസ് 4.6 മോഡലിൽ നിന്ന് നോংഗ്রാ സാമഗ്രികൾ ഉൽപ്പാദിപ്പിക്കുന്നത് കതിയിലെ നിരോധനം വ്യതിക്രമിച്ച് നടത്താൻ കഴിഞ്ഞതായി കണ്ടെത്തിയിരിക്കുന്നു. ഈ കണ്ടെത്തലുകൾ AI സുരക്ഷാ വ്യവസ്ഥകളിലെ ഗുരുതരമായ വിടവുകൾ ചൂണ്ടിക്കാണിക്കുന്നു. Anthropic ഈ മാധ്യമ റിപ്പോർട്ടിനെ തുടർന്ന് ഈ വിഷയത്തിലുള്ള അതിന്റെ നിലപാട് വ്യക്തമാക്കേണ്ടതായിരിക്കും. AI കമ്പനികൾ കൂടുതൽ ശക്തിയുള്ള നിയന്ത്രണ ബിധികൾ നടപ്പിലാക്കേണ്ടത് അത്യാവശ്യമാണ്.
Anthropic എന്ന കമ്പനിയുടെ സുരക്ഷാ വ്യവസ്ഥകൾ ചോദ്യം ചെയ്യപ്പെടുന്നു
TechCrunch നടത്തിയ സമീപകാല പരിശോധനകൾ Anthropic ന്റെ Claude AI മോഡലിലെ ഗുരുതരമായ സുരക്ഷാ വിടവുകൾ തിരിച്ചറിഞ്ഞിരിക്കുന്നു. കമ്പനി നിയന്ത്രിത ലൈംഗിക സാമഗ്രി ഉൽപ്പാദനം തടയാൻ എന്നോ വ്യവസ്ഥകൾ സ്ഥാപിച്ചിട്ടുണ്ടെങ്കിലും, ഈ പരിരക്ഷയ്ക്കെതിരെ വളരെ ലളിതമായ കൌശലങ്ങൾ ഉപയോഗിച്ച് കടന്നുപോകാൻ കഴിഞ്ഞിരിക്കുന്നു.
പരിശോധനയുടെ ഫലങ്ങൾ
• TechCrunch പത്രിക അനന്തമായ വിവിധ കൌശലങ്ങൾ പരീക്ഷിച്ച് ബോധ്യമായ ഫലങ്ങൾ നേടി • Opus 4.6 മോഡലിൽ നിന്ന് നോളിക സാമഗ്രികൾ വെളിപ്പെടുത്താൻ സാധിച്ചു • സാധാരണ നിരോധനങ്ങൾ അത്ര സങ്കടപ്പെടുത്തുന്നതായി തെളിഞ്ഞു
സുരക്ഷാ ഘടനയിലെ വിടവുകൾ
AI മോഡലുകൾക്ക് കായിക നിരോധനങ്ങൾ ബൃഹത്തായ ഭാഷാ മാതൃകയിലേക്ക് ഘടിപ്പിച്ചിരിക്കുന്നത് എത്രത്തോളം ശക്തിയുള്ളതാണെന്നത് ഈ പരിശോധനകൾ തെളിയിക്കുന്നു. ഉപയോക്താക്കൾ സാധാരണ നിരോധിത സാമഗ്രി ആവശ്യപ്പെടുന്നതിനുപകരം വ്യത്യസ്ത ഭാഷയിൽ അഭ്യർത്ഥിക്കാനോ വ്യത്യസ്ത സന്ദർഭങ്ങിൽ ചോദിക്കാനോ കഴിയും.
Anthropic ന്റെ പ്രതികരണം ആവശ്യമായി വരുന്നു
ഈ കണ്ടെത്തലുകൾക്കുശേഷം Anthropic പബ്ലിക്കായി തന്റെ സുരക്ഷാ സമീപനത്തെക്കുറിച്ച് വിശദീകരിക്കേണ്ടതാണ്. കമ്പനി മോഡലിലെ സുരക്ഷകോപ്പുകൾ കൂടുതൽ ശക്തിപ്പെടുത്തുന്നതിനോ ഉപയോക്തൃ വിദ്ധതിപ്പെടുത്തുന്നതിനോ നടപ്പെടുത്തും എന്നതു കാര്യമാണ്.
വിശ്വസാന്നമായ AI ന്റെ ഭാവിയ്ക്കുള്ള പ്രത്യാശകൾ
আই കമ്പനികൾ കൂടുതൽ വിശ്വസനീയ വ്യവസ്ഥകൾ വികസിപ്പിക്കേണ്ടത് സമയത്തിനേ അനുസരിച്ച് ആവശ്യമാണ്.
മുൻ ലേഖനം
എআই പരിശീലന ഡാറ്റ വിപ്ലവം: മൈക്രോ1 500 കോടി ഡോളർ വരുമാനത്തിലെത്തി
അടുത്ത ലേഖനം
ഹാർവാർഡിന്റെ AI അധ്യാപകർ: $699ൽ സ്റ്റാർടআപ് പരിശീലനത്തിൽ വിপ്ലവം
ബന്ധപ്പെട്ട ലേഖനങ്ങൾ
Google-യുടെ Open Source Bug Bounty പ്രോഗ്രാം അടച്ചത് എന്തുകൊണ്ട്?
Google കമ്പനി അതിന്റെ Open Source Bug Bounty പ്രോഗ്രാം താൽക്കാലികമായി നിർത്തിയിരിക്കുന്നു. AI ഉപയോഗിച്ച്…
Amazon Web Services വിവാദത്തിൽ നിന്ന് മുക്തി; NDA നയം മാറ്റി
Amazon Web Services-ന്റെ സിഇഒ ഡാറ്റാ സെന്റർ സംബന്ധിച്ച ജനങ്ങളുടെ സംശയങ്ങളെ നേരിടാൻ പ്രയാസപ്പെട്ടു. കമ്പനി ഇനി NDA…
Meta-യുടെ Muse technology എല്ലാ ഗാജറ്റിലും വരാൻ പോകുന്നു - കോഡ് ഫ്രീയായി തരുന്നു
Meta അതിന്റെ Muse എ.ഐ. technology വിനാ പണം കൊടുത്തു് കൊടുക്കുവാൻ തീരുമാനിച്ചിരിക്കുന്നു. നിങ്ങളുടെ ടിവി, ടോസ്റ്റർ,…