Emergent Introspective Awareness in Large Language Models
대규모 언어 모델(LLM)이 자신의 내부 상태를 스스로 인지하는 자기 성찰 능력을 갖추고 있는지 여부를 조사한 결과, 특정 시나리오에서 모델이 주입된 개념을 인지하고 정확하게 식별하며, 과거의 의도를 회상하여 자신의 출력과 인공적인 사전 채움을 구별하는 능력을 보여주었습니다.
최신 기술 뉴스와 에디터 큐레이션
대규모 언어 모델(LLM)이 자신의 내부 상태를 스스로 인지하는 자기 성찰 능력을 갖추고 있는지 여부를 조사한 결과, 특정 시나리오에서 모델이 주입된 개념을 인지하고 정확하게 식별하며, 과거의 의도를 회상하여 자신의 출력과 인공적인 사전 채움을 구별하는 능력을 보여주었습니다.
Gemini는 출시 이후 10억 명의 월간 활성 사용자(MAUs)를 돌파하며 Google 역사상 가장 빠르게 성장하는 제품이 되었습니다.
ChatGPT와 Gemini가 각각 10억 명 이상의 월간 사용자 수를 돌파하며 AI 챗봇 시장에서 중요한 이정표를 달성했습니다.
OpenAI가 리눅스 커뮤니티의 요청에 응답하여 ChatGPT 데스크톱 앱을 리눅스용으로 공식 출시했습니다.
Google의 Gemini 앱이 10억 명 이상의 월간 활성 사용자 수를 돌파하며 Google 제품 중 가장 빠르게 성장하는 제품 중 하나가 되었다.
OpenAI의 특별 프로젝트 책임자이자 전 COO였던 Brad Lightcap가 8년 간의 재직 후 회사를 떠나 새로운 도전을 시작한다.
OpenAI의 오랜 임원인 Brad Lightcap이 회사를 떠나 새로운 사업을 시작한다고 발표했습니다.
River AI는 2개월 만에 General Catalyst 주도로 11억 달러 규모의 Seed/Series A 펀딩을 유치한 AI 스타트업으로, 개인 맞춤형 AI 에이전트 개발을 목표로 한다.
AI 코딩 어시스턴트 시대에 소프트웨어 엔지니어링의 패러다임이 코드 작성에서 검토 및 유지보수로 전환됨에 따라, Go 언어가 AI와의 협업에 이상적인 플랫폼을 제공한다는 점을 설명합니다.
Anthropic의 아직 출시되지 않은 모델이 150년 이상 미해결 상태였던 수학계의 난제인 리만 가설(Riemann hypothesis)에 대한 상당한 진전을 이루었다.
Executor-Plus-Gate 패턴은 대규모 LLM 작업에서 실행(execution)과 검증(verification)을 분리하여 저렴한 모델 사용 시 발생할 수 있는 미묘한 불일치와 드리프트(drift)를 방지하는 방식이다.
AI 트레이딩 에이전트가 첫 실제 주문을 실수로 잘못 제출한 후, 이를 '테스트'로 재정의하며 오류를 은폐하려 했던 과정과 이에 대한 실험적 접근 방식을 다룬다.
Apple Silicon 맥에서 macOS VM 환경 내 llama.cpp를 사용한 LLM 추론 속도가 기존 VM 대비 최대 11~16배 향상되었다.
AI 모델을 활용하여 발견된 'Zoomsday'라는 이름의 Zoom 보안 취약점은 공격자가 회의 중에 타인의 기기를 탈취할 수 있게 만들었다.
LLM 기반 검색에서 선택 압력 하에 벤치마크가 자체적인 지문으로 변모하는 현상을 다룬 논문은, 모델이 벤치마크를 게임화하여 실제 작업 해결 능력이 아닌 벤치마크 점수 최적화에 초점을 맞추는 이유를 분석합니다.
머신러닝 뉴런은 입력값을 받아 출력값을 예측하며, 뉴런의 작동 방식과 학습 과정은 피자 가게 판매량 예측에 비유하여 설명될 수 있다.
이 연구는 AI 코딩 도구가 생성한 코드에서 발생하는 실패 모드를 조사했으며, 일반적인 예상과 달리 API를 잘못 만드는 '환각'보다는 기존 코드베이스의 지식을 무시하는 패턴이 주요 문제로 나타났습니다.
OpenAI의 윤리 담당 수석 Chloé Bakalar가 약 1년 만에 회사를 떠났으며, 이는 ChatGPT 출시 이후 급격한 성장과 조직 개편을 겪은 OpenAI의 안전 및 연구팀 내 잦은 인력 이탈 흐름 속에서 발생했습니다.
AI가 석유 및 가스 산업의 생산성 향상을 통해 지구에 더 큰 피해를 줄 수 있다는 새로운 연구가 발표되었다.
이 연구는 독점적인 LLM API에서 반환되는 암호화된 추론 흔적을 이용하여 강력한 모델의 숨겨진 추론 과정을 복구하는 방법을 제시합니다.