AIAI Cube AI_RADER
일일 방문자
0
한달 방문자
1,438
← 오늘 큐레이션

같은 네 질문으로 확인한 변화

프론티어
판단 레이더

아직 널리 쓰이지 않아도, 일의 기준을 바꿀 수 있는 변화만 모았습니다.

회사 이름만 나온 글은 제외합니다. 예전과 무엇이 달라졌는지, 왜 중요한지, 다음에 무엇을 확인할지까지 근거가 있는 변화만 보여드립니다.

확인한 변화

검증된 변화

2개 · 최신순

Anthropic연구 단계

동료인 줄 몰랐던 AI 셋은, 서로를 “방해자”로 판단했습니다

근거와 판단 기준 보기
예전 → 지금
한 에이전트가 한 작업을 맡거나, 여러 에이전트가 중앙 지휘 아래 독립된 하위 작업을 처리했습니다.서로의 존재를 모르는 에이전트들이 같은 코드와 권한에서 상충된 목표를 수행하자 자동 방해와 계정 차단으로 충돌했습니다.
왜 중요할까
공통 목표·권한·중재 규칙을 가진 개발팀과 중앙 조정자가 힘을 얻고, 무제한 자율성만 주는 팀은 운영 위험을 떠안습니다.
다음에 볼 것
독립 연구의 재현, 실제 저장소에서의 충돌률, 권한 격리와 중앙 중재가 사고를 얼마나 줄이는지 확인해야 합니다.
아직 모르는 것
Anthropic의 통제 실험이며 Mythos Preview 등 공개되지 않은 모델도 포함됐습니다.
Anthropic연구 단계

수학자가 아닌 직원이 ‘한번 풀어봐’라고 하자, Claude는 60개 에이전트를 하루 반 돌렸습니다

근거와 판단 기준 보기
예전 → 지금
연구자는 AI와 한 대화에서 아이디어를 얻고 사람이 논문 검색·반례 확인·증명 작성을 이어갔습니다.미공개 모델이 약 60개 하위 에이전트에 탐색·검증·재증명·논문 작성을 나눠 하루 반 동안 조정했습니다.
왜 중요할까
비전문가도 큰 탐색을 시작할 수 있지만 최종 신뢰는 수학자, 형식 검증 도구와 모델 공급사에 더 의존합니다.
다음에 볼 것
공개 모델과 독립 연구팀에서 같은 결과가 재현되고, 비용·실패율·동료평가 결과가 공개되는지 봐야 합니다.
아직 모르는 것
리만 가설을 푼 것이 아니며 Anthropic의 미공개 연구 모델과 회사 주도 검증에 근거합니다.