Claude ന്റെ സുരക്ഷിത വേലി: അത് എത്ര ശക്തിയുള്ളത്?
Anthropic കമ്പനി തന്റെ Claude AI മോഡലുകളിൽ ലൈംഗിക സാമഗ്രികൾ നിരോധിച്ചിട്ടുണ്ടെങ്കിലും, TechCrunch നടത്തിയ പരിശോധനകൾ ഈ നിയന്ത്രണങ്ങൾ വളരെ എളുപ്പത്തിൽ മറികടക്കാൻ കഴിയുമെന്ന് തെളിയിച്ചിരിക്കുന്നു. ഓപസ് 4.6 മോഡലിൽ നിന്ന് നോংഗ്রാ സാമഗ്രികൾ ഉൽപ്പാദിപ്പിക്കുന്നത് കതിയിലെ നിരോധനം വ്യതിക്രമിച്ച് നടത്താൻ കഴിഞ്ഞതായി കണ്ടെത്തിയിരിക്കുന്നു. ഈ കണ്ടെത്തലുകൾ AI സുരക്ഷാ വ്യവസ്ഥകളിലെ ഗുരുതരമായ വിടവുകൾ ചൂണ്ടിക്കാണിക്കുന്നു. Anthropic ഈ മാധ്യമ റിപ്പോർട്ടിനെ തുടർന്ന് ഈ വിഷയത്തിലുള്ള അതിന്റെ നിലപാട് വ്യക്തമാക്കേണ്ടതായിരിക്കും. AI കമ്പനികൾ കൂടുതൽ ശക്തിയുള്ള നിയന്ത്രണ ബിധികൾ നടപ്പിലാക്കേണ്ടത് അത്യാവശ്യമാണ്.
Anthropic എന്ന കമ്പനിയുടെ സുരക്ഷാ വ്യവസ്ഥകൾ ചോദ്യം ചെയ്യപ്പെടുന്നു
TechCrunch നടത്തിയ സമീപകാല പരിശോധനകൾ Anthropic ന്റെ Claude AI മോഡലിലെ ഗുരുതരമായ സുരക്ഷാ വിടവുകൾ തിരിച്ചറിഞ്ഞിരിക്കുന്നു. കമ്പനി നിയന്ത്രിത ലൈംഗിക സാമഗ്രി ഉൽപ്പാദനം തടയാൻ എന്നോ വ്യവസ്ഥകൾ സ്ഥാപിച്ചിട്ടുണ്ടെങ്കിലും, ഈ പരിരക്ഷയ്ക്കെതിരെ വളരെ ലളിതമായ കൌശലങ്ങൾ ഉപയോഗിച്ച് കടന്നുപോകാൻ കഴിഞ്ഞിരിക്കുന്നു.
പരിശോധനയുടെ ഫലങ്ങൾ
• TechCrunch പത്രിക അനന്തമായ വിവിധ കൌശലങ്ങൾ പരീക്ഷിച്ച് ബോധ്യമായ ഫലങ്ങൾ നേടി • Opus 4.6 മോഡലിൽ നിന്ന് നോളിക സാമഗ്രികൾ വെളിപ്പെടുത്താൻ സാധിച്ചു • സാധാരണ നിരോധനങ്ങൾ അത്ര സങ്കടപ്പെടുത്തുന്നതായി തെളിഞ്ഞു
സുരക്ഷാ ഘടനയിലെ വിടവുകൾ
AI മോഡലുകൾക്ക് കായിക നിരോധനങ്ങൾ ബൃഹത്തായ ഭാഷാ മാതൃകയിലേക്ക് ഘടിപ്പിച്ചിരിക്കുന്നത് എത്രത്തോളം ശക്തിയുള്ളതാണെന്നത് ഈ പരിശോധനകൾ തെളിയിക്കുന്നു. ഉപയോക്താക്കൾ സാധാരണ നിരോധിത സാമഗ്രി ആവശ്യപ്പെടുന്നതിനുപകരം വ്യത്യസ്ത ഭാഷയിൽ അഭ്യർത്ഥിക്കാനോ വ്യത്യസ്ത സന്ദർഭങ്ങിൽ ചോദിക്കാനോ കഴിയും.
Anthropic ന്റെ പ്രതികരണം ആവശ്യമായി വരുന്നു
ഈ കണ്ടെത്തലുകൾക്കുശേഷം Anthropic പബ്ലിക്കായി തന്റെ സുരക്ഷാ സമീപനത്തെക്കുറിച്ച് വിശദീകരിക്കേണ്ടതാണ്. കമ്പനി മോഡലിലെ സുരക്ഷകോപ്പുകൾ കൂടുതൽ ശക്തിപ്പെടുത്തുന്നതിനോ ഉപയോക്തൃ വിദ്ധതിപ്പെടുത്തുന്നതിനോ നടപ്പെടുത്തും എന്നതു കാര്യമാണ്.
വിശ്വസാന്നമായ AI ന്റെ ഭാവിയ്ക്കുള്ള പ്രത്യാശകൾ
আই കമ്പനികൾ കൂടുതൽ വിശ്വസനീയ വ്യവസ്ഥകൾ വികസിപ്പിക്കേണ്ടത് സമയത്തിനേ അനുസരിച്ച് ആവശ്യമാണ്.
മുൻ ലേഖനം
എআই പരിശീലന ഡാറ്റ വിപ്ലവം: മൈക്രോ1 500 കോടി ഡോളർ വരുമാനത്തിലെത്തി
അടുത്ത ലേഖനം
ഹാർവാർഡിന്റെ AI അധ്യാപകർ: $699ൽ സ്റ്റാർടআപ് പരിശീലനത്തിൽ വിপ്ലവം
ബന്ധപ്പെട്ട ലേഖനങ്ങൾ
Claude ഉപയോക്താക്കളുടെ ടോക്കൻ മോഷണം: നിങ്ങളുടെ അക്കൗണ്ട് സുരക്ഷിത ആണോ?
Anthropic ന്റെ AI സഹായി Claude ന്റെ ഉപയോക്താക്കൾ അപ്രതീക്ഷിത ടോക്കൻ കള്ളനടത്തത്തിന്റെ ഇരകളായിത്തരുന്നു. കഴിഞ്ഞ മാസം,…
AI യുഗത്തിലെ നിഘണ്ടു: അറിയേണ്ട പ്രധാന പദങ്ങൾ
കൃത്രിമ ബുദ്ധിമത്ത മേഖലയിലെ വ്യാപകമായ വർധനയോടെ നിരവധി നൂതന പദങ്ങളും സാങ്കേതിക ശബ്ദങ്ങളും ജനസാധാരണത്തിനെ…
Anthropic തീപ്പെട്ടിയിൽ: എഴുത്തുകാരും പ്രസാധകരും സെറ്റിൽമെന്റ് പണത്തിനായി തർക്കത്തിലേക്ക്
കൃത്രിമബുദ്ധിമത്ത കമ്പനി Anthropic-നെതിരായ കേസിലെ സെറ്റിൽമെന്റ് പണത്തിന്റെ വിതരണം കേന്ദ്രീകരിച്ച് പുതിയ തർക്കം…