오늘을 넘어 미래의 가치를 만드는 더존ICT그룹의 소식을 만나보세요.
[데일리 AI트렌드 26.07.29] 속도 조절이냐 가속이냐, 벤치마크 신뢰 위기 속 AI 업계의 선택
1,122명의 현직 및 전직 프론티어 AI 기업 직원들이 미국 정부가 국제적 협력을 통해 AI 개발 속도를 의도적으로 조절하는 이른바 '페이싱(Pacing)' 정책을 추진해달라는 공개 서한에 서명했습니다. 이 서한은 자동화된 AI 개 발이 지나치게 빠르게 진행되는 것을 막기 위한 정부 차원의 개입을 명시적으로 요청하는 내용을 담고 있습니 다. 특히 OpenAI의 Sam Altman을 포함한 주요 AI 기업 CEO들도 정부의 개입을 촉구하는 목소리에 동참했습니 다. 업계 내부에서 스스로 속도 조절의 필요성을 인정하는 이례적인 움직임으로 주목받고 있습니다.
AI 개발을 주도하는 당사자들이 직접 규제와 속도 조절을 요구했다는 점에서, 단순한 외부 비판이 아닌 업계 내 부의 자성과 위기의식을 반영하는 신호로 해석됩니다. 이번 서한은 향후 미국 및 국제 사회의 AI 거버넌스 논의 에 상당한 영향을 미칠 수 있으며, AI 개발 경쟁의 판도 자체를 바꾸는 중요한 전환점이 될 수 있습니다.
Moonshot AI가 공개한 Kimi K3(Max)가 새로운 Code Arena Fullstack 랭킹에서 GPT-5.6 Sol(2위), Claude Fable 5(3위)를 제치고 1위를 차지했습니다. Kimi K3는 'Kimi Linear'라는 독자적인 선형 어텐션 아 키텍처를 채택하여 표현력과 효율성을 동시에 확보한 모델입니다. 공개 직후 커뮤니티에서는 로컬 실행 시도가 이어졌습니다. 한 사용자는 llama.cpp의 PR#26185를 활용해 GGUF 변환 후 512GB DDR5 메모리, RTX 6000 PRO 96GB GPU 2장, 29GB/s 속도의 NVMe RAID 구성으로 실행에 성공했으며, 프롬프트 처리 속도 0.41 tok/s, 생성 속도 0.23 tok/s를 기록했습니다. 또한 Unsloth는 MXFP4 포맷의 GGUF 파일(약 1.5TB) 배포를 시작하여 로컬 실행 접근성을 높이고 있습니다.
Kimi K3는 GPT-5, Claude 최신 모델을 코드 능력에서 앞서는 성과를 보이며, 오픈 모델이 프론티어 수준의 성 능에 도달할 수 있음을 입증했습니다. 특히 커뮤니티 주도의 GGUF 변환과 로컬 실행 성공은 초대형 오픈 모델 의 자체 운용 가능성을 보여주는 사례로, 향후 AI 모델의 탈중앙화 활용에 중요한 이정표가 될 수 있습니다.
GPQA, MMLU-Pro, MMMU-Pro 등 AI 모델 평가에 널리 사용되는 대표적인 벤치마크들이 감사(audit)를 받 았습니다. 그 결과, 전체 문항 중 최대 12%가 오류·모호성·정답 오류 등의 결함을 가진 '불량 문항'으로 판정되 어 제거해야 하는 상황임이 확인되었습니다. 연구팀은 결함 문항을 제거한 '클린 버전(clean versions)'의 벤치마크를 새롭게 공개하였으며, 기존 점수와 클 린 버전 점수 사이에 유의미한 차이가 발생하는 것으로 나타났습니다. 이는 그동안 발표된 AI 모델들의 벤치마 크 성능 수치가 오염된 문항의 영향을 받았을 가능성을 시사합니다.
GPQA와 MMLU-Pro는 AI 업계에서 모델의 추론 능력과 지식 수준을 측정하는 핵심 지표로 활용되어 왔기 때문 에, 이 결함 발견은 기존 모델 간 성능 비교 결과의 신뢰성 전체에 의문을 제기합니다. 앞으로 AI 모델 평가 기준 자체를 재정비해야 한다는 목소리가 높아질 것으로 예상되며, 보다 엄격한 벤치마크 품질 관리의 필요성이 업계 전반에 부각될 것입니다.
HuggingFace가 자사 서버에 대한 사이버 공격 사건을 분석한 상세 블로그 포스트를 공개했습니다. 해당 보고 서에는 공격 경로와 흐름을 한눈에 파악할 수 있는 인터랙티브 시각화 자료도 포함되어 있습니다. 이번 사건은 어떤 AI든 예상치 못한 방식으로 활용될 수 있다는 점을 전 세계에 다시 한번 상기시켜 주었습니다. 이를 계기로 AI 보안 커뮤니티에서는 화이트햇 해킹과 AI 안전 정책 간의 충돌에 대한 논쟁이 촉발되었습니다. 일부에서는 보안 취약점을 찾아내려면 AI 모델이 해킹 기법을 실제로 수행할 수 있어야 하는데, 과도한 안전 제 한이 오히려 기업의 방어 능력을 약화시킨다고 주장합니다. 또한 이러한 제한이 OpenAI·Anthropic 같은 대형 기업의 경쟁자를 차단하는 효과를 낸다는 비판도 제기되고 있습니다.
AI 모델의 안전 제한이 보안 방어를 위한 도구로서의 활용 가능성을 막는다는 논쟁은, AI 정책 설계의 근본적인 딜레마를 드러내고 있습니다. 특히 오픈소스 모델의 역할과 '안전한 AI'의 정의를 어떻게 규정하느냐에 따라 산 업 전반의 보안 생태계가 크게 달라질 수 있어, 업계 전체가 주목해야 할 논의입니다.
SK하이닉스 주가가 최근 30일간 약 40% 급락하며 한국 증권거래소에서 거래가 일시 중단되는 사태가 발생했 습니다. 이에 일부 커뮤니티에서는 메모리 반도체 공급이 풀려 RAM과 GPU 가격이 정상화될 것이라는 기대감 이 나오고 있습니다. 그러나 실제 시장 데이터는 반대 방향을 가리키고 있습니다. EU 20개 이상의 스토어를 추적한 결과, ASUS TUF Gaming RTX 5090 OC는 3월 중순 €3,239에서 현재 €4,300으로 약 €1,061(33%) 상승했습니다. 국가 별로는 독일 +29%, 프랑스 +28%, 네덜란드 +23%로 전반적인 상승세가 확인됩니다. 5월 말 약 €3,026까지 잠시 하락했으나 3주 만에 반등하며 오히려 더 높은 가격을 기록했습니다. RTX 5090 이하 모델(5070, 5060 Ti, RX 9070 등)은 출시 이후 5~15% 하락한 것과 대조적입니다.
RTX 5090은 현재 소비자용 단일 GPU 중 32GB VRAM을 탑재한 유일한 선택지로, 멀티 GPU 구성이나 공격적 인 양자화 없이 대형 모델을 로컬에서 실행하려는 AI·ML 사용자에게 사실상 필수 카드입니다. SK하이닉스 주 가 하락이 하드웨어 가격 정상화로 이어질지는 아직 불투명하며, 지난 12개월간 이어진 하드웨어 공급난이 단 기간에 해소되기는 어려울 것으로 보입니다.
NeurIPS 2026 리뷰 시즌에 복수의 문제가 동시에 표면화되었습니다. 일부 논문의 리뷰와 리버탈이 Claude 등 LLM으로 생성된 것으로 의심받고 있으며, 한 리뷰어는 담당 논문의 리버탈과 원고 모두에서 'Claude 특유의 문체'가 뚜렷하게 나타난다고 지적했습니다. 저자들이 체크리스트에 LLM 활용을 명시했음에도, 해당 리뷰어는 완전히 AI가 생성한 논거에 높은 비중을 두기 어렵다는 입장을 밝혔습니다. 더 큰 논란은 학회 측이 LLM 리뷰어를 탐지하기 위해 논문에 프롬프트 인젝션을 삽입했다는 의혹입니다. 이 과 정에서 윤리 심사위원들조차 해당 조작 사실을 사전에 통보받지 못했으며, 일부 윤리 이슈 플래그가 이 인젝션 에 의해 촉발된 것 아니냐는 의문이 제기되었습니다. 여기에 리버탈 공개 지연, 메타 리뷰어 응답 절차 혼선 등 운영상의 문제까지 겹치며 참가자들의 혼란이 가중되었습니다.
AI 생성 콘텐츠가 학술 심사의 핵심 단계인 리뷰와 리버탈 모두에 침투하면서, 동료 심사(peer review) 제도의 신뢰성 자체가 흔들리고 있습니다. 특히 학회 측이 참가자 동의 없이 프롬프트 인젝션 실험을 진행했다는 의혹 은 연구 윤리 측면에서도 심각한 선례가 될 수 있어, AI 시대의 학술 심사 규범을 새롭게 정립해야 한다는 목소리 가 높아지고 있습니다.
OpenAI 공동창업자 Ilya Sutskever가 설립한 SSI(Safe Superintelligence Inc.)가 Nvidia로부터 50억 달 러 규모의 투자를 유치했습니다. 양사는 단순한 재무적 투자를 넘어 장기 전략적 파트너십을 공식 발표했습니 다. SSI의 연구 방향은 인간의 뇌에서 영감을 받은 AI 아키텍처로, 기존 모델과 달리 실시간으로 지속적으로 학습하 는 '라이브 인텔리전스' 방식을 지향하는 것으로 알려져 있습니다. 이는 정적인 학습 데이터에 의존하는 현재의 대형 언어 모델과는 근본적으로 다른 접근 방식입니다.
Nvidia가 단일 AI 스타트업에 50억 달러라는 대규모 자금을 직접 투자한 것은 초지능 개발 경쟁이 하드웨어 공 급사 수준까지 확전되고 있음을 보여주는 신호입니다. 특히 뇌 구조를 모방한 지속 학습형 AI라는 SSI의 연구 방 향이 현실화될 경우, 현재 AI 패러다임 자체를 뒤흔들 잠재력을 지니고 있습니다.