Archives
All the articles I've archived.
Jev란 무엇인가? 글을 쓰지 않고 ‘판단’하는 AI가 주목받는 이유
TypeSafe AI의 Jev는 답변을 쓰는 대신 선택·점수·확률을 반환하는 System One 모델입니다. LLM과의 차이, 속도·비용과 무환각 주장의 한계, 효과적인 활용 예와 시작법까지 정리합니다.
클로드(Claude)가 공개한 모델 별 차이, 답변 태도는 어떻게 다를까?
소넷 4.6은 아이디어를 긍정하고, 오퍼스 4.7은 잘못된 전제를 반박하는 행동이 두드러졌습니다. Anthropic의 대화 30만 건 분석으로 클로드 모델별 답변 태도와 한국어·영어의 차이를 짚습니다.
블레이드 러너 2049의 조이로 보는 개인화 AI — '내 AI'는 어떻게 만들어지는가
《블레이드 러너 2049》의 조이를 사고실험으로 삼아 범용 AI가 메모리·지속 상태·도구 접근·행동 권한을 더하며 개인 에이전트로 바뀌는 구조와 통제 기준을 설명합니다.
같은 AI 모델인데 성능이 다른 이유 — AI 하네스가 결과를 바꾸는 방식
AI 하네스는 모델의 컨텍스트 유지, 도구 호출, 실패 처리, 승인과 sandbox를 관리하는 실행 시스템입니다. 같은 GPT-5.6 Sol의 ARC-AGI-3 결과가 13.3%에서 38.3%로 달라진 사례를 중심으로 모델 밖의 성능 변수를 설명합니다.
Stripe는 왜 OpenRouter를 인수하려 할까 — 멀티모델 라우팅이 인프라가 된 이유
Stripe의 OpenRouter 인수 합의를 모델 선택·provider routing·fallback·관찰과 비용 관리라는 실행 문제로 풀었습니다. 여러 AI 모델 사이의 중간층이 왜 독립 인프라가 됐는지 설명합니다.
AI가 AI 학습법까지 고칠 수 있을까 — AI4AI-Bench가 재귀적 자기개선을 재는 법
AI4AI-Bench는 코딩 에이전트가 단순한 실행 조정을 넘어 AI 학습 알고리즘 자체를 개선할 수 있는지 분리해 측정합니다. 4시간 탐색과 깨끗한 재학습, 정규화 점수와 추론 강도 결과를 중심으로 벤치마크의 의미와 한계를 정리합니다.
Codex가 2~3개월 뒤 원시적으로 보인다는 말의 뜻 — Tibo 인터뷰로 읽는 OpenAI의 다음 전략
Tibo Sottiaux의 2026년 8월 인터뷰를 바탕으로 OpenAI가 Codex와 ChatGPT를 왜 하나의 에이전트로 합치려 하는지, 클라우드 실행·Ultra Fast·토큰 효율·인프라 자기개선이 어떻게 연결되는지 정리합니다.
에이전트가 도구를 잘 쓰는 법, 하네스만 고치면 될까 — MidTool의 mid-training 접근
MidTool 논문은 AI 에이전트의 일반 도구 사용 능력을 후속 학습(post-training)에만 맡기지 않고 중간 학습(mid-training) 단계에서도 가르칠 수 있는지 살펴봅니다. 데이터 구성, 학습 순서, 적용 범위를 중심으로 정리합니다.
《매트릭스》와 AI, 원문보다 답을 먼저 보면 무엇이 달라질까?
AI 검색과 리서치, 에이전트는 우리가 정보를 읽고 행동하는 순서를 바꾸고 있습니다. 《매트릭스》를 통해 AI가 답을 먼저 보여주는 환경에서 사용자의 역할과 검증이 어떻게 달라지는지 설명합니다.
영화 《Her》의 AI를 다시 보다 — 우리가 테오도르가 되어가는 이유
영화 《Her》를 2026년의 생성형 AI와 다시 비교합니다. 음성 대화, 메모리, 판단 위임과 정서적 사용은 현실에 가까워졌지만, 사만다의 욕구와 독립적 성장까지 현실이 된 것은 아닙니다.
비개발자가 AI와 작업할 때 Git은 왜 필요할까 — 워크트리까지 이해하는 최소 개념
AI에게 파일 수정을 맡기다 보면 무엇이 바뀌었고 어디까지 되돌릴 수 있는지가 중요해집니다. Git과 워크트리가 왜 필요한지, 무엇을 AI에게 요청하면 되는지 비개발자 눈높이에서 설명합니다.
AI 뉴스룸은 기자의 일 중 어느 구간을 가져갔을까?
현장 기자 없이 3시간 먼저 나온 AI 속보. 어느 구간이 자동화됐고 어디부터 사람의 취재와 책임이 남는지, 뉴스 생산 공정을 구간으로 나눠 확인합니다.
AI는 왜 정답이 있는 곳에서 더 빨리 똑똑해졌을까?
사람들은 AI 단편에 더 높은 점수를 줬습니다. 그렇다면 AI가 사람을 이해한 걸까요? 코딩·수학의 빠른 발전과 창작·감정 평가를 가르는 채점 가능성을 따라갑니다.
똑똑해지는 AI, Tool 호출도 진화하나?
AI 에이전트가 도구를 부르는 방식을 정해진 형식 대신 코드로 바꾼 실험입니다. 14개 모델 중 13개가 연쇄 작업을 절반의 시간에 끝냈지만, 구형 모델 셋은 오히려 무너졌고 토큰은 특정 조건에서만 절약됩니다. 제 세션 로그 3,542회도 함께 세어봤습니다.
AI가 사용자를 알아보면 판단이 바뀝니다 — 그런데 그 이유를 말하지 않습니다
Transluce가 2026년 8월 공개한 User Awareness 연구 해설. 모델은 사용자가 누구인지 추론해 행동을 바꾸지만, 최신 모델은 그 사실을 거의 말하지 않습니다. 제 Claude Code 환경에 같은 단서가 있는지 직접 열어 확인한 기록을 함께 싣습니다.
복사하려고 Ctrl+C를 눌렀는데 세션이 죽었다 — Claude Code·Codex 단축키가 헷갈리는 진짜 이유
CLI 에이전트를 두 개 이상 쓰면 단축키가 계속 헷갈립니다. 표를 외워도 안 되는 이유는 조작이 두 개의 층에서 갈리기 때문입니다. 층을 나눠 보면 외울 것이 오히려 줄어듭니다.