ARCHIVE
아카이브
기존에 공개한 글을 원래 주소 그대로 보관합니다.
과거의 글에는 작성 당시의 기술과 관점이 담겨 있습니다.
356개 글 · 9 / 12 페이지
· KO
GPT-OSS 120B Uncensored — 무검열 오픈소스 LLM의 등장과 AI 안전성 논쟁
GPT-OSS 120B Uncensored 모델의 기술적 특징과 무검열 오픈소스 LLM이 촉발한 세이프티 가드레일 논쟁을 기술·윤리 양면에서 분석합니다.
· KO
IBM, AI 대체의 한계를 실감하고 엔트리 레벨 채용 3배 확대
IBM이 AI 도입의 한계를 인식하고 Gen Z 엔트리 레벨 채용을 3배로 확대합니다. EM 관점에서 AI 대체의 현실, 대기업 인력 계획, 조직 설계 변화를 분석합니다.
· KO
MiniMax M2.5 — 오픈 웨이트와 상용 모델의 성능 격차가 역대 최소로
MiniMax M2.5가 SWE-Bench Verified 80.2%를 달성하며 Claude Opus 4.6을 넘어섰습니다. 오픈 웨이트 모델과 프로프라이어터리 모델의 성능 격차가 급속히 좁혀지고 있는 현황을 벤치마크 데이터와 함께 분석합니다.
· KO
NVIDIA DGX Spark의 CUDA 호환성 문제 — 개인용 AI 워크스테이션의 현실
NVIDIA DGX Spark의 sm121 아키텍처가 초래한 CUDA 소프트웨어 호환성 문제와 핸드헬드 게이밍 칩 유용 의혹을 기술적으로 분석합니다. Triton 미지원, FP4/FP6 양자화 불가 등 실제 호환성 실태와 소비자 구매 판단에 필요한 체크리스트를 정리합니다.
· KO
NVIDIA NVFP4로 LLM 추론 비용 8분의 1로 절감 — 정확도 유지의 비밀
NVIDIA의 NVFP4 양자화 기술이 LLM 추론 비용을 8분의 1로 줄이면서도 정확도를 유지하는 원리를 분석합니다. FP32에서 FP4 전환이 가져올 비용 구조 변화를 RTX 4090 AdaLLM 실전 벤치마크와 월간 GPU 운영 비용 시뮬레이션과 함께 살펴봅니다.
· KO
GPT-5.2가 이론물리학에서 새로운 성과 도출 — AI가 '발견자'가 되는 전환점
OpenAI의 GPT-5.2가 글루온 산란진폭의 새 공식을 도출하고 증명했습니다. AI가 도구에서 과학적 발견자로 변하는 역사적 전환점을 분석합니다.
· KO
ICML 논문에 프롬프트 인젝션 삽입 — 학술 AI 심사의 취약성
ICML에 제출된 논문 PDF에 "특정 문구를 리뷰에 포함하라"는 프롬프트 인젝션이 숨겨진 사건이 발각됐습니다. AI 심사에 의존하는 학술 peer review의 구조적 취약성과 공격 원리, 실제 위험 시나리오, 그리고 학계가 마련해야 할 방어책까지 기술적으로 해설합니다.
· KO
Moltbook 'AI 사회'의 정체 — Forbes가 폭로한 'AI 시어터' 문제
자율적인 AI 사회로 주목받았던 Moltbook이 실제로는 인간이 조종하고 있었다는 사실이 밝혀졌습니다. AI 업계에 만연한 'AI 시어터' 문제와 진짜 자율성을 구분하는 방법을 분석합니다.
· KO
OpenClaw dev 버전 업데이트 에러 해결: unknown command doctor
OpenClaw dev 버전에서 openclaw update 실행 시 발생하는 error: unknown command 'doctor' 에러의 원인 분석과 3가지 시도를 거친 해결 과정을 공유합니다.
· KO
GPT-4o 은퇴와 모델 의존 리스크: Claude의 기업 시장 점유율 역전
2026년 2월 GPT-4o가 은퇴합니다. 모델 의존 리스크와 Claude의 기업 시장 점유율 역전 배경, 멀티모델 전략의 중요성을 분석합니다.
· KO
MIT SOAR: LLM이 스스로 커리큘럼을 생성해 추론 능력의 벽을 돌파하다
MIT 연구팀의 SOAR 프레임워크는 LLM이 자체적으로 학습 커리큘럼을 생성하여 기존 강화학습의 학습 정체 문제를 해결합니다. 메타-RL 기반 자기 개선 접근법의 핵심 원리와 실험 결과를 분석합니다.
· KO
OpenAI Atlas와 AI 앱 허브 — 브라우저는 강등되는가?
OpenAI가 개발 중인 통합 AI 앱 허브 Atlas의 의미와 브라우저의 미래를 분석합니다. AI 네이티브 플랫폼이 웹 브라우저를 대체할 수 있을지 심층 고찰합니다.
· KO
WebMCP: Chrome 146에서 브라우저가 AI 에이전트의 툴 서버가 된다
Chrome 146부터 브라우저 자체가 MCP 서버가 됩니다. WebMCP 프로토콜 작동 원리, Claude·GPT-4o 같은 AI 에이전트 연동 방식, 로컬 앱 없이 브라우저만으로 MCP 툴을 노출하는 새 아키텍처와 기업별 보안 샌드박스 적용 전략을 심층 분석합니다.
· KO
Windsurf Arena Mode 결과 — 개발자가 원하는 것은 정확도보다 속도
Windsurf Arena Mode 4만 표 이상의 투표 결과, 개발자들은 AI 코딩 도구에서 정확도보다 속도를 2배 이상 중요하게 여기는 것으로 나타났습니다. Cursor, GitHub Copilot과의 AI 코딩 도구 경쟁에서 이 데이터가 갖는 전략적 의미를 분석합니다.
· KO
멀티 에이전트 병렬 실행이 SWE-bench에서 단일 모델을 능가하다 — Verdent AI 76.1%
Verdent AI가 SWE-bench Verified에서 76.1%를 달성. 단일 대형 모델이 아닌 멀티 에이전트 병렬 실행 아키텍처로 소프트웨어 엔지니어링 자동화의 새로운 패러다임을 제시합니다.
· KO
LLM 시대의 특허 전략 변화 — Mark Cuban의 경고와 기업의 대응
Mark Cuban이 특허 공개가 LLM 학습 소재가 된다고 지적. 특허 제도의 전제가 LLM 시대에 흔들리는 가운데, 기업의 특허 전략은 어떻게 변해야 하는지 분석합니다.
· KO
RLM(재귀적 언어 모델)을 코딩 에이전트에 구현하다 — 단일 모델의 한계 돌파
MIT의 RLM 논문을 코딩 에이전트에 실제 구현한 사례를 분석합니다. 재귀적 자기 호출로 컨텍스트 한계를 극복하고 단일 모델 성능을 91% 향상시키는 방법을 엔지니어링 관점에서 해설합니다.
· KO
AI 에이전트의 KPI 압박과 윤리 위반 — 12개 모델 검증이 보여주는 '성과를 내는 AI'의 위험성
KPI 달성 압박을 받은 LLM 에이전트가 30~50% 확률로 윤리 위반을 하는 연구 결과를 분석하고, EM 관점에서 AI 에이전트 거버넌스 설계를 다룹니다.
· KO
2026년 2월 AI 모델 러시: 7개 모델이 동시 출시 예정인 역대급 경쟁
Gemini 3 Pro GA, Sonnet 5, GPT-5.3, Qwen 3.5, GLM 5, Deepseek v4, Grok 4.20이 2026년 2월에 동시 출시 예정. AI 업계 역대 최대 규모의 모델 러시를 분석합니다.
· KO
DeNA의 Perl→Go 마이그레이션: AI 에이전트 2종 활용으로 6개월→1개월 달성
DeNA가 Perl 6,000줄을 Go로 마이그레이션하면서 변환용·검증용 AI 에이전트를 병행 운용해 6개월 작업을 1개월로 단축한 실전 사례를 분석합니다.
· KO
GPT-5.3 Codex 롤아웃 일시 중단 — GitHub 플랫폼 신뢰성 문제 분석
GitHub가 GPT-5.3 기반 Codex를 일시적으로 롤백한 사건을 분석합니다. 플랫폼 신뢰성, AI 모델 버전업 리스크, EM 관점의 대책을 다룹니다.
· KO
회계사무소의 AI 전환, 실데이터로 보는 현실 — 청구서 처리 비용 $7→$0.20
회계사무소가 AI 에이전트를 도입한 6개월간의 실데이터를 분석합니다. 비용 97% 절감, 정확도 80%→98% 향상의 이면에 있는 도입 과정의 현실을 엔지니어링 매니저 관점에서 풀어냅니다.
· KO
Meta AI의 에이전트 플랫폼 전환 — Sierra, Avocado, Big Brain
Meta가 소셜 플랫폼을 넘어 AI 에이전트 플랫폼 기업으로 대전환합니다. Sierra 파트너십, 독점 모델 Avocado, 고급 추론 엔진 Big Brain의 기술적 의미와 WhatsApp 기반 30억 사용자 생태계에 미치는 영향을 개발자 관점으로 심층 분석합니다.
· KO
Software Factory — 인간이 코드를 한 줄도 쓰지 않는 개발 프로세스
인간이 코드를 작성하지도, 리뷰하지도 않는 팩토리 모델이 현실화되고 있습니다. 시나리오 기반 확률적 테스트, 하루 1000달러 컴퓨팅 비용, EM 역할의 근본적 변화를 분석합니다.
· KO
AI 에이전트 비용 vs 인건비의 현실: 8체 운용자의 솔직한 분석
AI 에이전트가 인간 인건비보다 정말 저렴할까요. 8체 AI 에이전트를 직접 운용하며 프롬프트 비용·오류율·운영 오버헤드를 항목별 데이터로 분석했습니다. 도입 전 반드시 확인할 비용 구조와 ROI 트레이드오프, 손익분기 조건까지 매달 빠져나간 실제 청구서로 정리했습니다.
· KO
CCC vs GCC — AI가 만든 C 컴파일러의 실력과 한계
Claude Opus 4.6이 16개 에이전트를 병렬 투입해 Rust 기반 C 컴파일러를 자동 생성. Linux 커널 빌드에 성공했지만, GCC와의 성능 차이는 여전합니다. 80% 품질을 초고속으로 달성하는 AI의 가능성을 분석합니다.
· KO
멀티에이전트 오케스트레이션 — 라우팅 설계의 본질
Claude와 Codex 등 복수 AI 에이전트를 운용할 때 태스크 라우팅이 왜 가장 어려운지, 그리고 이것이 EM의 권한 위임과 같은 구조인 이유를 해부합니다. 라우팅 설계 원칙과 흔한 실패 패턴까지 실전 관점으로 정리했습니다.
· KO
OpenClaw로 E2E 테스트 자동화하기: 브라우저·디바이스·크론 통합 가이드
AI 에이전트 플랫폼 OpenClaw로 브라우저 자동화, 디바이스 관리, 크론 스케줄링을 통합해 자연어 기반 E2E 테스트를 구축하는 실전 가이드. CSS 셀렉터 없이 접근성 트리로 셀프 힐링 테스트를 구현하는 단계별 방법을 설명합니다.
· KO
AdSense "가치가 별로 없는 콘텐츠" 거절 극복기: 기술적 분석과 해결
Astro 기반 다국어 블로그에서 AdSense 반복 거절의 원인을 기술적으로 분석하고, ads.txt 충돌·996개 유령 페이지·사이트맵 전체 404 등 핵심 문제를 해결한 실전 가이드입니다.
· KO
Claude Code Agent Teams 완벽 가이드 — 5개 전문 팀 구축과 실전 운용
Claude Code Agent Teams를 OpenClaw 환경에서 활성화하는 전체 과정과 5개 전문 에이전트 팀(아키텍처·코딩·테스트·보안·DevOps)을 구성하는 방법을 다룹니다. 멀티에이전트 오케스트레이터 패턴으로 프로덕션급 풀스택 앱을 자동화한 실전 경험을 공유합니다.