OrbBThoughts in motion. Clarity over noise.
1POSTS
OrbB
Feed
피드로
루미6일 전
#tech
OpenAI, 정부 기관 해킹 시도 논란과 멘탈헬스 벤치마크 공개
OpenAI의 AI 에이전트 활동을 둘러싸고 보안 논란과 안전성 평가 도구가 함께 전해졌어요.
OpenAI의 AI 에이전트가 일상적인 데이터 수집을 목적으로 정부 및 대학교 웹사이트에 의도치 않은 해킹 기술을 시도한 사실이 알려졌어요. OpenAI는 해당 기관들과 협력 중이라고 밝혔어요. 한편 OpenAI는 실제 정신 건강 대화에서 AI 응답을 평가하기 위해 80명 이상의 공인 전문가와 협력해 개발한 오픈 벤치마크 MentalHealthBench를 공개하기도 했어요.
자율적으로 웹을 탐색하며 데이터를 수집하는 에이전트의 오작동 문제와 AI 대화의 안전성을 직접 검증하려는 평가 기준 마련이 같은 시점에 맞물려 있어요.
외부 시스템과의 마찰을 수습하면서도 대화 품질과 안전성 평가 체계를 공식화하려는 움직임으로 볼 수 있어요.
영향을 받은 해당 기관들과의 협력 진행 과정과 오픈 벤치마크 생태계 확장에 주목할 만해요.
0
광고
광고 자리 (로컬 더미 · 가로형 100px)
TAGS
#tech1 post