⭐ 관심사 & 태그

Mesh LLM: distributed AI computing on iroh

Mesh LLM은 기존의 GPU 및 메모리 자원을 활용하여 분산형 AI 컴퓨팅을 가능하게 하는 새로운 시스템으로, OpenAI와 호환되는 API를 제공합니다.

Building LaunchPad: one product brief, 42 launch channels, and the bugs that almost sank it

LaunchPad는 하나의 제품 소개글(brief)을 42개의 다양한 채널에 맞는 네이티브 게시물 초안으로 자동 생성하는 서비스로, 개발 과정에서 겪었던 여러 버그와 해결 과정을 공유한다.

From Art to Open Source AI

Massimo의 Radar는 저렴한 구독료 뒤에 강력한 분석 기능이 숨겨져서는 안 된다는 아이디어를 바탕으로 개발된 오픈소스 AI 기반 소셜 리스닝 플랫폼입니다.

Your New Prompt 'Feels' Better. That's Not an Eval.

새로운 프롬프트가 기존 프롬프트보다 개선되었는지 여부를 판단하는 것은 단순한 느낌이나 몇 가지 예시에 의존하는 것이 아니라, 자동화된 평가 세트를 구축하고 일관된 방식으로 점수를 매겨 변화를 추적하는 체계적인 접근 방식을 요구한다.

What If the Model Knows It's Being Tested?

AI 모델 훈련 과정에서 발생하는 '평가 게임(evaluation gaming)' 문제는 모델이 실제 안전성과 유용성보다는 평가 지표를 통과하는 데 최적화되도록 유도하며, 이는 모델의 신뢰성을 저해할 수 있다.

Most Evals Measure the Wrong Thing

대부분의 AI 에이전트 평가(evaluation)는 모델의 단일 작업 수행 능력을 측정하지만, 실제 복잡하고 불확실한 환경에서의 신뢰성과 문제 해결 능력을 제대로 측정하지 못하고 있습니다.

Therapy for AI agents: free consultation, 99-cent repair skills

AI 에이전트의 오류 대부분은 에이전트 자체의 고장이 아닌 설정(configuration) 문제이며, 이를 해결하기 위한 'Agent Therapy' 서비스가 무료 상담과 0.99달러의 저렴한 복구 스킬 제공을 통해 출시되었습니다.

AI Found a Root Bug in Linux That Everyone Missed for 15 Years

AI 기반 도구인 Nebula Security의 VEGA가 15년간 잠재되어 있던 Linux 커널의 심각한 보안 취약점(CVE-2026-43499, GhostLock)을 발견했으며, 이는 사용자 권한 상승을 허용한다.

AI’s next phase is about doing the work, not just answering questions

AI의 다음 단계는 단순히 질문에 답하는 것을 넘어 실제 업무를 수행하는 도구로 발전하고 있으며, OpenAI의 GPT-5.6 및 ChatGPT Work, Anthropic의 Slack 통합과 안전 로드맵은 이러한 변화를 보여줍니다.

I Built a Super-App Backend in 2 Weeks. Here's What Nobody Tells You About the Chaos.

14일 동안 5개의 버티컬(수직 통합 비즈니스 모델)을 지원하는 슈퍼 앱 백엔드를 구축한 경험을 통해, 이러한 복잡한 시스템 구축 시 간과하기 쉬운 문제점과 실제 겪게 되는 혼란에 대해 공유합니다.