⭐ 관심사 & 태그

Humanising LLM Outputs Is Dumb

LLM(Large Language Model)의 출력을 인간적으로 만들기 위해 프롬프트 단계를 수정하는 것은 비효율적인 접근 방식이며, 대신 최종 출력 단계에서 변환하는 것이 더 나은 방법이다.

Mistral Patent for "Code implemented tool calls"

Mistral AI가 출원한 "Code implemented tool calls" 관련 특허는 대규모 언어 모델(LLM)이 도구 호출(tool calls)을 코드 블록으로 생성하고, 이를 샌드박스 환경에서 실행하며, 클라이언트와의 상호작용을 통해 도구 실행 결과를 LLM에 전달하는 방법을 제시한다.

Peer review is overwhelmed—can it survive in the AI era?

과학 연구의 신뢰성을 보장하는 핵심 과정인 동료 심사(peer review)는 출판물 증가와 AI 기술의 등장으로 인해 심각한 과부하에 직면해 있으며, 기존 시스템의 지속 가능성에 대한 의문을 제기하고 있습니다.

AI for science needs reasoning, not just data

AI의 발전으로 과학적 발견의 가속화가 기대되지만, AlphaFold와 같은 데이터 중심 방식의 한계가 드러나고 있으며, 대신 AI 에이전트 기반의 추론 및 도구 활용 방식이 과학 연구의 미래를 이끌 것으로 전망됩니다.

Debugging is also clicking 🖱️

기술 콘텐츠는 AI 에이전트가 데스크톱 애플리케이션을 디버깅할 때 화면 픽셀을 보는 대신 UI 트리를 직접 읽어 상호작용하는 새로운 접근 방식에 대해 논한다.

My Commit-Message Script Has 8 Assertions in --selftest. None of Them Touch the Code That Can Actually Fail.

git_commit.py 스크립트의 테스트 커버리지 분석 결과, 기존 8개의 assertion이 실제 코드의 실패 경로를 테스트하지 못하는 문제점을 발견했으며, 이는 다른 파일들의 테스트 방식과 비교하여 불충분함을 보여준다.

The Security Gap in MCP Tool Servers (And What I Built to Fix It)

MCP(Model Context Protocol)는 AI 에이전트가 도구와 연결하는 방식이나, 현재 보안 모델이 부재하여 발생하는 취약점을 해결하기 위해 개발된 Heddle 런타임은 정의된 정책을 바탕으로 도구 호출을 검증하고 강화하는 솔루션을 제공한다.

Show HN: Voice driven murder mystery, Interview AI suspects with your voice

Voice driven murder mystery는 음성으로 용의자들과 인터뷰하며 사건의 진실을 파헤치는 대화형 게임이다. Blackwood Manor에서 벌어진 독살 사건을 배경으로, 플레이어는 음성을 통해 용의자들의 알리바이를 추궁하고 모순점을 찾아내야 한다.