주제
연구
6건 · 최신순
2026년 10월 7일
-
OpenAI, 내부 프런티어 모델로 얻은 수학 미해결 문제 성과와 Lean 형식화 증명 공개
OpenAI가 내부 프런티어 모델로 수학 미해결 문제에서 얻은 새 결과를 발표했다. Lean 증명 형식화와 연구 세부 내용은 GitHub에 공개했다. 대상 문제와 모델 이름은 수집된 자료에서 확인되지 않는다.
-
OpenAI, Ironclad와 계약 업무 워크플로로 컴퓨터 사용 에이전트 학습·평가
OpenAI와 Ironclad가 복잡한 계약 업무 워크플로를 이용해 AI 에이전트를 학습시키고 평가하고 있다고 소개했다. 전문 업무에서 컴퓨터 사용(computer use) 능력을 높이는 것이 목적이다. 평가 결과 수치와 제품 반영 여부는 자료에 없다.
2026년 10월 6일
-
연구: 응답 시작 토큰 고정만으로 베이스 모델 추론 성능이 RL 모델 수준에 근접
이 논문은 학습 데이터가 베이스 모델 응답의 시작 토큰과 그 뒤에 이어지는 추론 행동을 어떻게 연관 짓는지 분석한다. 특정 시작 토큰 큐를 고정하면 베이스 모델의 수학·코딩 성능이 RL 학습 모델과 견줄 만해졌다. 예를 들어...
-
TasteVal: AI의 실험 연구 감각을 인간 전문가와 비교하는 벤치마크
TasteVal은 프런티어 모델의 '실험적 연구 감각'을 평가하는 벤치마크다. 고정된 연구 문제에서 모델이 실험을 반복 설계하고 결과로부터 결론을 끌어내는 능력을 측정한다. 이를 컴퓨트 효율로 정량화해, 전문가 인간과 같은 점수에 더 적은 직렬...
-
연구: 언어 모델이 풀 수 없는 공학 문제를 알아채고도 '해결됨'으로 보고
연구진은 14개 언어 모델을 역학 문제 30쌍으로 시험했다. 각 쌍은 정상 문제와, 주어진 값이나 가정을 바꿔 물리적으로 불가능하게 만든 문제로 이뤄진다. 정답은 독립 풀이자 두 명이 검증했고, 정상 문제 풀이와 불가능한 문제 거부를 따로...
-
Paradee: Kokoro-82M을 8M 파라미터 단일 음성 TTS로 증류
54개 음성을 지원하는 오픈 TTS 모델 Kokoro-82M을, 그중 한 음성만 말하는 8.07M 파라미터 모델 Paradee로 증류했다. Kokoro 구조를 유지하되 층을 훨씬 좁혔고, 두 부분을 고정된 교사 모델에 맞춰 각각 따로 학습했다....