LLM 안에 감정이 있다 — Anthropic이 Claude 내부에서 찾아낸 171개의 감정 표상
Anthropic 해석가능성팀이 Claude 내부에서 171개 감정 유사 표상을 발견하고, 이것이 모델 출력에 인과적으로 영향을 미친다는 걸 증명했다. 프롬프트 엔지니어링과 AI 안전에 실질적 시사점을 정리한다.
archive
356 · 페이지 13
Anthropic 해석가능성팀이 Claude 내부에서 171개 감정 유사 표상을 발견하고, 이것이 모델 출력에 인과적으로 영향을 미친다는 걸 증명했다. 프롬프트 엔지니어링과 AI 안전에 실질적 시사점을 정리한다.
Stripe가 자율 코딩 에이전트 Minions로 주당 1,300개 이상의 PR을 생산하는 방법. Blueprint 아키텍처, 샌드박스 VM, 3단계 피드백 루프의 실제 엔지니어링을 분석한다.
Paperclip 위에 AI 에이전트 14명으로 구성된 콘텐츠 비즈니스를 만들었다. Laravel, Markdown, Git 기반으로 사이트가 자동 운영되는 구조와 Day 1부터의 경험을 공유한다.
MCP가 월 9,700만 다운로드를 돌파하며 사실상 표준이 됐지만, 에이전트가 어떤 도구를 얼마나 호출하는지 통제하는 레이어는 빠져 있다. MCP Gateway 패턴으로 이 문제를 풀어본다.
AI 에이전트 여러 개를 회사처럼 관리하는 오픈소스 플랫폼 Paperclip을 직접 설치해봤다. Linear 스타일 대시보드, Org Chart, 비용 추적, 다양한 에이전트 어댑터까지 — Claude Code 에이전트를 조직화하는 실전 경험과 솔직한 평가를 공유합니다.
OpenAI가 Sora 앱 종료를 발표했다. 하루 100만 달러 적자, 유저 50만 이하 붕괴의 전말과 함께 Google Veo 4 임박, Runway·Kling의 부상이 AI 비디오 시장을 어떻게 재편하는지 실전 워크플로우 관점에서 분석한다.
PyPI를 통해 발생한 LiteLLM 공급망 공격 사례를 심층 분석합니다. AI 개발 도구 체인의 의존성 취약점과 악성 패키지 탐지 방법, 공급망 보안 강화 전략을 다루며, 엔지니어링 팀이 즉시 실무에 적용할 수 있는 구체적인 방어 절차와 보안 체크리스트를 제공합니다.
GitGuardian 2026 리포트에 따르면 AI 코딩 도구 사용 리포지토리의 시크릿 유출률은 GitHub 평균의 2배다. MCP 설정 파일에서만 24,000개 이상의 크리덴셜이 노출됐다. 실제 점검 방법과 대응책을 정리한다.
Mistral이 공개한 4B 파라미터 오픈 웨이트 TTS 모델 Voxtral을 분석한다. ElevenLabs를 인간 평가에서 이겼고 3초 보이스 클로닝을 지원하지만, 일본어·한국어 미지원이라는 치명적 빈자리가 아시아 시장 활용을 막는다. 라이선스 함정과 실무 대안도 함께 짚는다.
Google이 공개한 Gemini 3.1 Flash Live의 실시간 음성·영상 에이전트 구축 기능을 분석합니다. API 구조, 도구 호출, 90개 언어 지원 등 실제 개발자 관점에서 가능성과 한계를 짚어봅니다.
GitHub이 3월 25일 Copilot Free·Pro·Pro+ 사용자의 코드 스니펫과 채팅 인터랙션 데이터를 AI 모델 학습에 기본 사용하겠다고 발표했다. 4월 24일까지 설정 변경이 없으면 자동 동의로 처리된다. 옵트아웃 방법, 수집 데이터 범위, 개발자 실무 대응법을 정리한다.
Google이 발표한 TurboQuant의 PolarQuant+QJL 기법을 분석한다. KV cache 메모리 6배 절감, 어텐션 8배 가속이 실제로 의미하는 것.