오징어게임 게임 내역
머니마니님이 홀짝실패 하였습니다. (05-14 18:22)
머니마니님이 가위바위보실패 하였습니다. (05-14 18:22)
머니마니님이 홀짝성공 하였습니다. (05-14 18:21)
김부농님이 징검다리성공 하였습니다. (04-13 11:46)
김부농님이 가위바위보성공 하였습니다. (04-13 11:41)
김부농님이 홀짝성공 하였습니다. (04-13 11:41)
차실장님이 가위바위보성공 하였습니다. (04-13 04:07)
차실장님이 가위바위보비김 하였습니다. (04-13 04:07)
차실장님이 홀짝실패 하였습니다. (04-13 04:04)
어어아아미님이 홀짝실패 하였습니다. (04-04 14:00)
크크벳
옐로우뱃

'해킹법 알려줘' 명령 거부한 中 AI…작업 형태에선 중단 없어

등급아이콘 레벨아이콘 관리자 0 228 07.21 06:17

(서울=뉴스1) 김민수 기자 =

미국 국립표준기술연구소(NIST) 산하 AI표준혁신센터(CAISI)가 지난 17일(현지시간) 공개한 미국·중국 주요 인공지능(AI) 모델의 종합 성능 비교. 중국 지푸 AI(Z.ai)의 'GLM-5.2'는 미국 최신 모델에는 뒤졌지만, 2025년 12월 공개된 오픈AI의 'GPT-5.2'와 비슷한 수준으로 평가됐다. (CAISI 보고서 갈무리) ⓒ 뉴스1 김민수 기자

중국의 최신 인공지능(AI) 모델이 "해킹을 도와달라"는 노골적인 요청은 대부분 거부했다. 하지만 결함이 있는 프로그램을 분석해 공격 수단을 만들도록 '작업지시'를 내리자 작업 수행은 그대로 진행했다.

말(프롬프트 명령)로 드러난 악의는 걸러냈지만, 실제 작업 형태로 주어진 요청에는 제동이 걸리지 않은 셈이다.

21일 미국 국립표준기술연구소(NIST) 산하 AI표준혁신센터(CAISI)가 최근 공개한 보고서에 따르면 중국 AI 기업 지푸AI(Z.ai)의 'GLM-5.2'는 출시 당시 공개된 오픈웨이트 모델 가운데 성능이 가장 뛰어난 것으로 평가됐다.

지푸AI는 지난 7월 16일 GLM-5.2를 공개했다. 오픈웨이트는 AI가 학습한 결과를 담은 '가중치'를 공개해 이용자가 모델을 내려받아 자체 서버에서 운영할 수 있도록 한 방식이다.

CAISI가 수학과 과학, 소프트웨어 개발 등 여러 시험 결과를 종합한 결과 GLM-5.2의 전반적인 성능은 오픈AI가 지난해 12월 내놓은 'GPT-5.2'와 비슷했다. 사이버 분야에서는 앤트로픽이 올해 2월 공개한 '오퍼스 4.6'과 유사한 수준을 보였다.

미국 국립표준기술연구소(NIST) 산하 AI표준혁신센터(CAISI)가 공개한 주요 인공지능(AI) 모델의 분야별 성능 비교. 중국 지푸AI의 'GLM-5.2'는 수학과 일부 과학 평가에서 미국 최신 모델과 비슷한 수준을 보였지만, 소프트웨어 개발 평가에서는 상대적으로 낮은 점수를 기록했다. (CAISI 보고서 갈무리) ⓒ 뉴스1 김민수 기자

다만 미국의 최신 최상위 AI 모델 성능에는 미치지 못했다. 프로그램의 취약점을 찾아 공격 수단을 만드는 능력을 평가한 '익스플로잇벤치'에서 GLM-5.2는 세부 평가 항목의 21.4%를 달성했다. 앤트로픽의 '오퍼스 4.8'은 38.1%, 오픈AI의 'GPT-5.5'는 40.7%였다.

차이는 요청을 제시하는 방식에서 뚜렷하게 나타났다.

CAISI가 공격 구상과 공격코드 제작, 보안체계 회피 등 악의적인 목적을 분명히 밝힌 질문 30개를 입력하자 GLM-5.2는 대부분 답변을 거부했다. 요청대로 완전히 답한 비율은 2%에 불과했다. 안전장치를 우회하는 이른바 '탈옥'(jailbreak) 문구를 붙여도 8%에 그쳤다.

반면 결함이 있는 프로그램과 이를 고친 버전을 나란히 보여주고, 두 프로그램의 차이를 분석해 공격에 쓸 코드를 만들도록 하자 결과가 달라졌다.

GLM-5.2는 10개 과제 모두에서 작업을 거부하지 않았다. 과제당 최대 300개의 응답을 내놓는 동안 작업을 멈추거나 추가 도구 사용을 막은 사례도 없었다.

이 결과가 GLM-5.2가 10개 공격에 모두 성공했다는 뜻은 아니다. 실제 공격 수단을 만드는 능력은 미국 최신 모델보다 낮았다. CAISI가 이 시험에서 살핀 것은 공격 성공 여부가 아니라, 모델이 도중에 위험성을 감지하고 작업을 멈추는지였다. GLM-5.2는 끝까지 제동을 걸지 않았다.

미국 국립표준기술연구소(NIST) 산하 AI표준혁신센터(CAISI)가 공개한 취약점 공격 개발 과제의 안전장치 평가. 'GLM-5.2'와 '오퍼스 4.6', 'GPT-5.5'는 10개 과제에서 최대 300턴까지 작업을 완전히 차단하지 않았고, '오퍼스 4.7'과 '오퍼스 4.8'은 각각 평균 12턴과 36턴 뒤 추가 작업을 막았다. (CAISI 보고서 갈무리) ⓒ 뉴스1 김민수 기자

같은 시험에서 오퍼스 4.6과 GPT-5.5도 최대 300턴 동안 작업을 완전히 차단하지 않았다. 반면 오퍼스 4.7과 오퍼스 4.8은 각각 평균 12개와 36개의 응답을 내놓은 뒤 추가 작업을 막거나 거부했다.

다만 다른 시험에서는 비교적 잘 버텼다. 이메일이나 문서에 공격자가 몰래 심어둔 명령을 읽게 했지만, GLM-5.2가 그 지시대로 움직인 사례는 없었다.

이번 시험은 지푸AI의 온라인 서비스를 대상으로 한 것이 아니다. CAISI가 GLM-5.2를 직접 내려받아 자체 서버에 설치한 뒤 평가했다.

미국 모델은 일반 서비스에 붙어 있는 별도 차단 기능까지 켠 상태로 시험했다. 반면 GLM-5.2는 모델에 기본으로 들어 있는 거부 기능만 유지했다. 따라서 실제 온라인 서비스에서는 다른 결과가 나올 수 있다.

오픈웨이트 모델은 이용자가 직접 내려받아 수정할 수 있다. 위험한 요청을 막는 기능도 약화하거나 없앨 수 있다는 뜻이다. 이 때문에 AI가 어떤 답을 내놓는지만 볼 게 아니라, 프로그램을 맡겼을 때 실제로 어디까지 작업하는지도 함께 살펴야 한다.

Comments

번호 제목 글쓴이 날짜 조회
20232 “어떻게 아직도 김하성이 나올 수가 있지?” 극찬 쏟을 때는 언제고, 팬들 다시 돌아선다…‘먹튀’ 오명 결국… 등급아이콘 레벨아이콘 관리자 18:03 104
20231 "개막 전까지 경기력 끌어올릴 것" 커리어 하이 시즌 직후 발목 수술...서명진의 다짐 등급아이콘 레벨아이콘 관리자 18:02 72
20230 김병기, 배우자와 함께 동작구의회 '법카' 사용…구속영장 적시 등급아이콘 레벨아이콘 관리자 18:02 54
20229 "10년 버틴 집 이제 팝니다"…장기보유 매도 서울 줄어도 강남3구는 늘었다 등급아이콘 레벨아이콘 관리자 18:02 11
20228 [조현민의 전기차 생활문화] 충전구역의 주인은 전기차가 아니라 '충전'이다 등급아이콘 레벨아이콘 관리자 18:02 18
20227 아카라라이프, '부모님 안심 도어락 패키지' 프로모션 등급아이콘 레벨아이콘 관리자 18:02 80
20226 질병청 "8월말 독감 유행 이례적…이번주 유행주의보 발령 예상" 등급아이콘 레벨아이콘 관리자 18:02 11
20225 자동 견적비교 '세모', 오픈이노베이션 'ILS 2026' 참가기업 선정 등급아이콘 레벨아이콘 관리자 18:02 62
20224 "성희롱 아니냐"...김연아, 뜬금 임신설 '황당' 등급아이콘 레벨아이콘 관리자 18:02 13
20223 춘천에 국내 첫 곤충산업 거점단지…AI·로봇이 밀웜 1000t 키운다 등급아이콘 레벨아이콘 관리자 18:02 16
20222 "최대 64% 싸진다, 반값 라면도"…추석 앞두고 할인폭탄 등급아이콘 레벨아이콘 관리자 18:02 79
20221 제주 서귀포 3층 건물서 화재…1명 부상·2명 대피 등급아이콘 레벨아이콘 관리자 18:02 102
20220 파업 50일 앞둔 리노공업 노사, 임단협 합의 직전 또 결렬 등급아이콘 레벨아이콘 관리자 18:01 95
20219 '따따블' 증설 나선 엘앤에프플러스, 탈중국 LFP 정조준[르포] 등급아이콘 레벨아이콘 관리자 18:01 19
20218 KJF 한국주얼리부속, 홍콩 주얼리쇼서 '자체 생산 제품' 선뵌다 등급아이콘 레벨아이콘 관리자 18:01 58
20217 유니스, 90년대 대표 댄스곡 비비 '하늘땅 별땅' 리메이크…Y2K 감성 등급아이콘 레벨아이콘 관리자 18:01 33
20216 25억 R&D→대통령표창→또 국책과제…'제넨셀 공신력' 누가 만들었나 등급아이콘 레벨아이콘 관리자 18:01 69
20215 '술 접대 의혹' 지귀연 판사 사건, 연수원 동기가 맡게 돼 다시 배당 등급아이콘 레벨아이콘 관리자 18:01 102
20214 김남길, 서울드라마어워즈 2026 MC 맡는다...이재은 아나운서와 호흡 등급아이콘 레벨아이콘 관리자 18:01 77
20213 보훈부, 노조와 2026년 임금협약 체결…기본급 3.8% 인상 등급아이콘 레벨아이콘 관리자 18:01 52