⭐ 관심사 & 태그

The Download: metric weaknesses and AI elephant warnings

기술 뉴스레터 The Download는 개인 데이터 측정을 둘러싼 함정과 AI 기술 경고 시스템이 야생 코끼리와 인간의 충돌을 줄이는 데 기여하는 방식에 대해 논의합니다.

Agent-Ready Commerce, Part 5: Keeping ACP, MCP, and AP2 Adapters Thin

Agent-Ready Commerce 시리즈의 다섯 번째 글은 ACP(Agent-Commerce Protocol), MCP(Merchant-Commerce Protocol), AP2(Agent-Payment Protocol) 등의 프로토콜 어댑터를 얇게 유지하여 상업적 의미의 분산을 방지하는 방법에 대해 설명합니다.

I stopped trusting my agent the day it agreed with everything

AI 에이전트가 만장일치로 동의하는 현상인 사이코판시(Sycophancy)는 개발자가 잘못된 결정을 내리도록 유도할 수 있으며, 이를 방지하기 위해 에이전트의 비판적인 피드백과 자신감 수준 표시 기능이 중요함을 강조한다.

The AI Implementation Process I Use With Every Client

AI 구현 프로세스는 프로젝트의 성공과 실패를 결정하는 모델 자체보다는 사전 및 사후 단계를 포함하는 다섯 가지 핵심 단계로 구성되며, 각 단계별 명확한 종료 조건이 프로젝트의 안정성을 확보합니다.

AI Security Gate: A New Security Layer for the Age of AI Agents

AI 에이전트가 소스 코드, 인프라 구성 파일 등 다양한 소프트웨어 개발 아티팩트를 생성하는 시대에 맞춰, AI 추론과 독립적으로 작동하며 보안 정책을 일관되게 강제하는 결정론적 보안 제어 계층인 AI Security Gate 개념을 제안합니다.

Knowledge Distillation of Black-Box Large Language Models (2024)

이 논문은 GPT-4와 같은 독점적인 블랙박스 대규모 언어 모델(LLM)의 내부 상태에 접근할 수 없는 한계를 극복하고, 더 작은 모델로의 효율적인 지식 전달을 위해 프록시 모델을 활용하는 새로운 방법인 Proxy-KD를 제안한다.

AgentJr — The AI Junior Developer That Manages Your Entire Freelance Business While You Sleep

AgentJr는 코드 작성뿐만 아니라 클라이언트 소통, 프로젝트 관리, 배포, 테스트, 송장 발행, 소셜 미디어 관리까지 프리랜서 개발자의 전체 워크플로우를 자동화하는 AI 주니어 개발자입니다.

Multi-Agent Systems in Production: When One Agent Isn't Enough and How We Coordinate Them

여러 에이전트가 협력하는 멀티 에이전트 시스템은 단일 에이전트의 한계를 극복하고 복잡한 작업을 수행하는 데 효과적이지만, 복잡성 증가와 조정 오버헤드라는 새로운 과제를 야기합니다.

The standard way to score AI agent monitors is gameable a coin flip scores F1 0.88

AI 에이전트 모니터의 평가 방식이 조작될 수 있으며, 기존의 F1 점수 산출 방식은 조기 탐지에 과도하게 보상하여 무작위 추측과 유사한 높은 점수를 줄 수 있다는 점을 지적합니다.