⭐ 관심사 & 태그

Is One Layer Enough? A Single Transformer Layer Matches Full-Parameter RL Train

본 연구는 Transformer 기반 대규모 언어 모델(LLM)의 강화학습(RL) 후훈련(post-training) 시 파라미터 업데이트가 각 레이어에 어떻게 분산되는지 탐구하며, 놀랍게도 단일 Transformer 레이어 훈련만으로도 전체 파라미터 훈련과 유사하거나 그 이상의 성능 향상을 얻을 수 있음을 발견했습니다.

Yep, we’re using OpenClaw to date now

OpenClaw, Claude, 그리고 Instagram trial reels를 활용한 자동화 스크립트는 개인적인 관계 형성을 위한 창의적이고 때로는 논란의 여지가 있는 접근 방식을 가능하게 합니다.

I Did the Math on Claude Sonnet 5. The 60% Opus Discount Is Real, But Temporary.

Anthropic이 출시한 Claude Sonnet 5는 대부분의 코딩 에이전트 작업에 기본 모델로 적합하지만, 가장 중요한 작업에는 Opus 4.8이 여전히 필요합니다. Sonnet 5는 60% 할인된 가격으로 제공되는 임시 프로모션 기간 동안 특히 비용 효율적입니다.

How to Stop ChatGPT and Claude From Forgetting Context in Long Conversations

AI 모델(ChatGPT, Claude 등)이 긴 대화에서 맥락을 잊는 문제는 고정된 컨텍스트 창(context window)으로 인해 발생하는 현상이며, 대화 내용을 압축하여 새로운 채팅에 붙여넣는 방식으로 해결할 수 있습니다.

Indian tech tycoon bets $30M of his own money to build AI alternative to Microsoft Office

인도 기술 사업가 Bhavin Turakhia가 마이크로소프트 오피스의 대안이 될 AI 기반 기업용 소프트웨어 개발을 위해 3천만 달러를 개인 자본으로 투자하며 새로운 벤처 Neo를 출범시켰습니다.

US home battery installations hit record high on rising electricity costs

2026년 초 미국 주택용 배터리 설치량이 급증하며 사상 최고치를 기록했습니다. 이는 치솟는 주거용 전기 비용을 상쇄하려는 주택 소유자들의 수요 증가와 주 정부의 인센티브 정책에 힘입은 결과입니다.

Cloudflare’s new policy pushes AI companies to pay for publishers’ content

Cloudflare는 2026년 9월 15일부터 AI 기업이 학습 및 에이전트용 웹 크롤러를 검색용 크롤러와 분리하도록 요구하는 정책을 발표했으며, 이를 준수하지 않을 경우 광고가 포함된 페이지에 대한 크롤링을 기본 차단한다.

After spooking Trump into safety testing, Anthropic AI models get global release

Anthropic의 최신 AI 모델인 Fable 5와 Mythos 5에 대한 미국 정부의 수출 규제가 해제되었습니다. 이는 모델의 보안 취약성 우려로 인해 발생했던 규제 이후, Anthropic이 미국 정부와 긴밀히 협력하여 안전 조치를 강화한 결과입니다.