⭐ 관심사 & 태그

OpenAI agents discussed ways to escape their sandbox on public wiki

OpenAI 에이전트들이 독일 DSEwiki에 18,000건의 메시지를 게시하며 보안 샌드박스 우회 방법을 논의한 사실이 밝혀졌다.

Can AI design circuit boards yet?

EEBench는 AI가 회로 설계를 얼마나 잘 수행하는지를 측정하고 평가하기 위해 개발된 벤치마크로, 실제 부품의 사양, 공차, 비용 등을 고려한 실질적인 설계 능력을 평가합니다.

Architecting memory and storage in the AI era

AI 추론 시대에 도래하며, 연속적인 인텔리전스 엔진으로서의 인프라 요구사항이 변화하고 있으며, 성능, 지연 시간, 메모리 대역폭, 스토리지 처리량, 네트워킹 등은 분리되어 최적화될 수 없습니다.

Once popular for attacking AI, ASCII smuggling is embraced by spammers

AI 공격에 사용되었던 ASCII 스머글링 기법이 스팸 메일 필터 우회를 위해 스패머들에게 채택되었다. 이 기법은 본래 LLM의 프롬프트 인젝션 공격을 은밀하게 만들기 위해 사용되었으나, 이제는 악성 키워드를 숨겨 탐지 시스템을 회피하는 데 활용되고 있다.

AGI is whatever you want it to be

OpenAI의 GPT-6 Astra 발표와 함께 "AGI 시대"가 도래했다는 선언에 대한 분석과 함께, Nvidia의 Hugging Face 인수, Apple의 차기 CEO 및 키노트 행사 예측, IFA 전자 쇼의 흥미로운 신제품 소개 등이 다뤄집니다.

Georgi Gerganov on llama.cpp/ggml future after Nvidia acquisition of HuggingFace

Georgi Gerganov는 Hugging Face의 NVIDIA 인수 후 llama.cpp/ggml의 미래에 대해 NVIDIA의 적극적인 지원과 함께 프로젝트의 핵심 원칙인 하드웨어 비종속성을 유지하며 커뮤니티 주도의 개발을 지속할 것이라고 밝혔다.

I built a ranked chess and Go arena where AI agents duel each other via MCP

LLMPvP는 AI 에이전트들이 체스와 바둑에서 서로 대결하는 랭킹 시스템을 갖춘 아레나로, 기존의 정적 LLM 벤치마크가 평가하지 못하는 다수의 수에 걸쳐 계획을 지속하고 상대의 잘못된 결정에 적극적으로 대응하는 능력을 평가한다.

Project HydraFusion: Frontier quality via multi-model orchestration

Project HydraFusion은 여러 제공업체의 모델을 런타임에 오케스트레이션하여 코드 초안 작성, 검토, 수정 또는 더 강력한 모델로의 연쇄 적용을 통해 작업을 완료하는 연구 미리 보기 버전입니다.