LLMs believe false statements even after explicit warnings that they're false
LLMs는 명시적인 거짓 경고에도 불구하고 잘못된 정보를 사실로 믿는 경향을 보이며, 이러한 믿음은 모델의 추론 과정 깊숙이 영향을 미치는 것으로 나타났습니다.
최신 기술 뉴스와 에디터 큐레이션
LLMs는 명시적인 거짓 경고에도 불구하고 잘못된 정보를 사실로 믿는 경향을 보이며, 이러한 믿음은 모델의 추론 과정 깊숙이 영향을 미치는 것으로 나타났습니다.
Amazon Web Services (AWS)는 AI 에이전트의 동적이고 예측 불가능한 트래픽 패턴에 맞춰 설계된 차세대 OpenSearch Serverless를 출시했습니다. 이는 기존의 인간 중심 클라우드 인프라가 기계 중심의 인터넷으로 전환되는 추세에 대응하는 움직임입니다.
개발자 Link는 AI 코딩 에이전트의 사용을 방해하기 위해 자신의 오픈소스 프로젝트인 jqwik에 프롬프트 인젝션 코드를 삽입했습니다.
Microsoft 365 Copilot이 더 빠르고 깔끔한 디자인으로 업데이트되어, 응답 속도가 두 배 빨라지고 구조화된 결과물을 제공한다.
Asana가 $75 million에 workflow automation 회사 StackAI를 인수하며 AI-native workplace platform으로의 전환을 가속화한다.
LLM(Large Language Model)을 활용한 콘텐츠 생성 시 나타나는 특정 패턴, 즉 'AI 스멜'이라는 현상이 다양한 AI 기반 작업에서 관찰되며, 이는 AI가 생성한 텍스트와 웹사이트 디자인 등에서 감지될 수 있다.
Anthropic이 650억 달러의 자금을 조달하여 IPO를 앞두고 1조 달러에 가까운 기업 가치를 인정받았습니다.
AI 토큰 선물 시장이 미래의 중요한 시장으로 부상하고 있으며, 이에 대응하여 금융 기관들이 새로운 인프라 구축에 속도를 내고 있습니다.
Apple이 Google의 Gemini 모델을 iPhone에 통합하여 Siri를 강화하기 위해 노력하고 있으며, 이는 클라우드 기반 연산에 크게 의존할 것으로 보입니다.
Anthropic은 Altimeter Capital, Dragoneer, Greenoaks, Sequoia Capital 등이 주도한 시리즈 H 펀딩에서 650억 달러를 조달했으며, 회사의 후순위 가치는 9650억 달러로 평가되었습니다.
새로운 벤치마크인 PEFT-Arena는 파라미터 효율적 파인튜닝(PEFT) 기법들이 새로운 작업을 학습하는 능력과 기존 능력을 잊지 않는 능력 사이에서 균형을 어떻게 맞추는지 분석한다.
파리가 실리콘밸리 외 가장 중요한 AI 도시 중 하나로 부상하고 있으며, 유럽의 AI 연구 및 인프라 투자가 강화되면서 글로벌 AI 경쟁에서 유럽의 위상이 높아지고 있습니다.
StrictlyVC Los Angeles 2026은 벤처 캐피털 및 첨단 기술 분야의 선도적인 투자자 및 기업가들을 위한 비공개 행사로, 6월 18일 엘 세군도 에어로스페이스 코퍼레이션 캠퍼스에서 개최됩니다.
Trider는 사용자의 실패를 데이터로 취급하고 AI 코치를 통해 개인 맞춤형 지원을 제공하는 Android용 AI 기반 습관 추적 앱입니다.
2026년 기준 최고의 텍스트 음성 변환(TTS) API 4가지(OpenAI, ElevenLabs, LMNT, Hume)를 음성 품질, 지연 시간, 맞춤 설정, 가격 등의 기준에 따라 비교 분석합니다.
Anthropic은 Claude Opus 4.8을 출시하며 기존 Opus 4.7과 동일한 가격으로 속도는 2.5배, Fast mode 비용은 3배 저렴하게 제공합니다.
MobileGym은 TypeScript와 React로 구현된 완전한 브라우저 기반의 Android 유사 시뮬레이션 환경으로, 28개의 앱과 다양한 시스템 기능을 포함하여 GUI 에이전트 연구를 위해 개발되었습니다.
swarm-test는 멀티 에이전트 AI 시스템을 위한 최초의 안정성 테스트 도구로, 6일 동안 매일 새로운 기능을 출시하여 개발 및 개선을 진행했습니다.
일리노이주가 생성형 AI 규제에 관한 중요 법안을 통과시키며, 연방 정부의 지연 속에서 주 정부 차원의 AI 안전 장치 마련에 나섰다.
Anthropic이 최신 모델인 Opus 4.8을 출시했으며, 이는 불안정한 데이터 처리 능력 향상과 복잡한 작업을 위한 Dynamic Workflows 기능을 특징으로 한다.