# 250명 이상의 AI 전문가가 싱가포르에 모여 전 세계 테스트 표준을 협의합니다.

- 날짜: 2026-04-20
- 관련자: CNA (아시아 뉴스 채널 보도) · CNA
- 출처: https://www.youtube.com/watch?v=4u0eyvFHSuI
- sgai: https://sgai.md/ko/videos/v053/
- 라이선스: sgai가 작성한 내용(요약·번역·분석)은 CC BY 4.0(출처 표기 및 sgai.md 링크 조건). 원문 전문(의회 기록·연설·자막·정책 원문)은 원권리자에게 귀속되며 참고용으로만 게재. 조건: https://github.com/meltflake/sgai/blob/main/DATA-LICENSE.md

## 왜 중요한가

ISO AI 표준 워킹그룹이 동남아시아에 처음 착지했고, 싱가포르가 두 가지 표준을 주도하며 내년에 시행할 예정으로, 규칙 수용자에서 글로벌 AI 거버넌스 규칙 제정자로의 전환을 표시한다

## 요약

싱가포르가 제안한 AI 안전 테스트 표준이 ISO 국제 회의의 초점이 되었으며, 미국, 중국, 일본, 한국 등 250명 이상의 전문가가 참석했습니다. 이는 해당 표준 워킹 그룹이 ASEAN에서 처음 개최한 것입니다. 현재 발행되었거나 연구 중인 AI 표준은 거의 100개로, 1년 전의 3배입니다.

## 핵심 포인트

- 미국, 중국, 일본, 한국 등 국가에서 온 250명 이상의 전문가가 싱가포르에 모여 ISO AI 표준 작업 그룹의 아세안 첫 회의에 참석했습니다.
- 발표되었거나 개발 중인 AI 표준은 약 100개이며, 이는 1년 반 전의 3배에 해당하며 생성형에서 에이전트형 AI로의 빠른 진화를 포괄합니다.
- 싱가포르는 두 가지 표준을 주도합니다: AI 레드팀 테스트 명세서 및 텍스트 생성형 AI 애플리케이션의 테스트 방법. 후자는 내년에 완료될 것으로 예상됩니다.
- 싱가포르는 또한 AI 모델의 편향, 개인정보, 잘못된 정보 위험을 테스트하는 데 도움을 주는 오픈소스 도구 Project Moonshot을 발표했습니다.

## 전문

© CNA — 참고용으로만 게재.

다시 오셨습니다. 싱가포르가 제시한 인공지능 안전 테스트 표준이 전 세계 250명 이상의 전문가들에 의해 논의 중입니다. 이는 국제표준화기구 회의의 일부이며, 참여자에는 미국, 중국, 한국, 일본의 대표들이 포함되어 있습니다. 이는 해당 조직이 동남아시아 지역에서 처음 개최하는 회의입니다. 약 100개의 인공지능 표준이 이미 발표되었거나 제정 중이며, 이는 1년 반 전의 3배입니다. 인공지능의 발전과 응용이 급속도로 진행되고 있다는 점을 감안할 때, 이러한 표준들은 필수적입니다. 단 3년여의 시간 동안 우리는 인공지능이 생성형 AI에서 멀티모달 AI로, 그리고 에이전트 능력을 갖춘 AI로 발전하는 것을 목격했습니다. 따라서 표준화 작업은 이러한 속도를 따라가야 합니다. 조기에 표준을 내장하는 것은 새로운 활주로를 건설하는 것과 같습니다. 인공지능 혁신은 고성능 항공기와 같으며, 안전하고 잘 건설된 활주로가 없으면 그 잠재력을 발휘할 수 없습니다.

초기 표준은 스타트업과 대규모 기업에 가드레일을 제공하여 자신감 있게 혁신할 수 있도록 합니다. Nicholas Ng은 제안된 표준이 인공지능 시스템을 어떻게 더욱 신뢰할 수 있게 만드는지, 그리고 싱가포르가 어떻게 이로부터 이득을 볼 수 있는지 설명했습니다. 그렇다면 ChatGPT가 잘못된 정보를 제공하지 않도록 어떻게 보장할 수 있을까요? 이것이 바로 생성형 인공지능 시스템을 사용할 때 발생할 수 있는 위험 중 하나이며, 이 외에도 특정 사회 집단에 대한 편향된 답변이나 개인 정보 침해 등의 문제가 있습니다. 이러한 문제를 해결하려면 테스트가 필요하며, 어떻게 테스트하는지는 여러 국가와 기업이 계속해서 답을 찾고 있는 질문입니다. 특히 인공지능 모델이 다른 유형의 소프트웨어와 다르기 때문입니다. 이들은 수백만 개에서 수십억 개의 파라미터를 가지고 있으며, 이러한 행동의 출현은 복잡한 시스템 이론으로 더 잘 이해됩니다.

사막을 상상해보세요. 모래 한 알만 본다면 모래언덕의 위치와 그 이동 방식 등을 추론하기 어렵습니다. 이것은 더 작은 구성 요소로부터 나타나는 행동입니다. 싱가포르는 이 문제를 해결하려고 시도하면서 「Project Moonshot」이라는 이름의 오픈 소스 도구를 발표하여 테스트 프로세스를 도왔으며, 추가로 구체적이고 명확하며 효과적인 인공지능 모델 테스트 방식을 찾기 위한 다른 방법들을 채택했습니다. 국제표준화기구 산하의 인공지능 소위원회도 관련 표준을 제정 중이며, 이미 일부 표준들을 발표했으며, 예를 들어 이러한 유형의 시스템을 평가하는 일반적인 방법과 소프트웨어 테스트 실행을 인공지능 환경에 적용하는 방법이 있습니다. 싱가포르에서는 두 가지 작업에 중점을 두고 진행할 것입니다. 첫 번째는 인공지능 레드팀 테스트를 규범화하는 것을 목표로 하며, 이는 직원들이 제품을 파괴하려고 시도함으로써 보안을 테스트하는 것입니다.

예를 들어, 모델이 부적절한 콘텐츠를 생성하도록 유도하거나 정보를 유출하도록 하는 것입니다. 다른 항목은 싱가포르가 작년에 제시한 것으로, 텍스트 생성형 인공지능 애플리케이션의 테스트 방법을 표준화하는 것을 목표로 합니다. 예를 들어 ChatGPT 또는 DeepSeek을 사용하는 챗봇입니다. 이러한 표준을 정의하는 것은 인공지능 개발자들이 시작하는 것을 방해하는 문제를 해결하며, 더욱이 다른 더 광범위한 이점을 가져옵니다. 이것은 어려운 여정이 될 것이며 많은 작업을 완료해야 하지만, 절대적으로 가치가 있습니다. 왜냐하면 우리는 국제 사회에 기여할 수 있다는 것을 인식하고 있기 때문입니다. 물론, 기업과 상업 기관도 싱가포르의 이 영역에서의 위치를 이해하게 될 것이며, 이는 신뢰도만 증가시킬 것입니다.

해당 표준은 생성형 인공지능 애플리케이션의 품질을 평가하기 위한 벤치마크 테스트를 구축하는 것에 관한 지침을 포함하며, 내년에 완료될 것으로 예상됩니다.
