⭐ 관심사 & 태그

Belgian VAT validation in 5 lines (with company name lookup)

벨기에 VAT 번호 검증 과정을 단순화한 API는 기존 80줄 이상의 코드로 구현되던 로직을 5줄의 코드로 단축하여 형식 검사, Modulo-97 체크섬, VIES(VAT Information Exchange System) 조회를 한 번에 수행합니다.

Fine-tuning an LLM to write docs like it's 1995

본 연구는 1990년대 소프트웨어 기술 작가 스타일로 문서를 작성하도록 LLM을 미세 조정하는 실험을 수행했습니다. Bitsavers에서 수집한 3천 7백만 단어 이상의 마이크로소프트 기술 문서 코퍼스를 활용하여, QLoRA 기법으로 Llama 3.1 8B Instruct 및 Qwen 2.5 7B Instruct 모델을 미세 조정하고 그 결과를 평가했습니다.

Mira Murati steps back into the spotlight, carefully

Mira Murati는 Bloomberg와의 인터뷰에서 자신이 설립한 Thinking Machines Lab의 새로운 AI 인터페이스인 "interaction models"을 공개하며, OpenAI CTO 재임 시절 겪었던 혼란스러운 사건에 대한 회고와 AI 산업 전반에 대한 우려를 표명했다.

Do transformers need three projections? Systematic study of QKV variants

트랜스포머의 쿼리, 키, 값(QKV) 어텐션 구조에서 세 가지 프로젝션의 개별적인 기여와 일부를 생략했을 때의 영향을 체계적으로 분석하여, 프로젝션 공유가 추론 메모리 사용량을 크게 줄이면서도 성능 저하를 최소화할 수 있음을 발견했습니다.

Defense tech, AI, and fundraising take center stage at StrictlyVC Los Angeles on June 18

StrictlyVC Los Angeles는 6월 18일 엘 세군도의 Aerospace Corporation Campus에서 개최되며, 벤처 캐피털, 국방 기술, 인공지능, 첨단 산업 분야의 영향력 있는 인사들이 참여하여 현재 일어나고 있는 중요한 변화들을 탐구하는 행사를 다룬다.

These LLMs are the best at resisting Russian propaganda

최신 대규모 언어 모델(LLM)들은 과거 모델에 비해 러시아 선전(propaganda)에 대한 저항력이 크게 향상되었으며, 특히 Nvidia의 Nemotron과 Alibaba의 Qwen과 같은 오픈 웨이트 모델들이 우수한 성능을 보였다.

Elon Musk tries again to escape FTC audits of X data handling

일론 머스크는 X(구 트위터)의 데이터 처리 관행에 대한 연방거래위원회(FTC)의 20년 데이터 프라이버시 명령을 철회하기 위해 다시 시도하고 있으나, 대중 및 전문가들의 반대가 예상된다.

The AI IPO Race Heats Up, DOGE Whistleblower Sues Elon Musk, and Instagram Gets Hacked

AI 기업들의 IPO 경쟁이 치열해지고 있으며, 이로 인해 현실 세계에 예상치 못한 파급 효과가 나타나고 있습니다. 한편, 도지코인 내부고발자를 향한 엘론 머스크의 비방으로 위협이 가해지고 인스타그램의 AI 챗봇이 해킹에 이용되는 사건도 발생했습니다.

Beyond Vide Coding Trap: Are you playing with plain text in an attempt to solve multi-million dollar "information friction" problem in healthcare?

의료 분야에서 방대한 양의 텍스트 데이터는 실제 현장의 의사결정에 활용되기 어려운 "정보 마찰" 문제를 야기하며, 이러한 문제를 해결하기 위해서는 AI 텍스트 추론과 실제 임상 활동 간의 간극을 좁히는 인터페이스 혁신이 필요하다.