Waitworthy

Deep Research처럼 기다릴 가치 있는 AI 보고서를 정리합니다.

공개 노트 32

AI & Tools

11분 읽기

모델 발전 시대에 오래 남는 AI 자산

모델의 약점을 임시로 보완하는 하네스는 빠르게 낡지만, 현실의 요구사항·실패 증거·평가·권한·책임을 다루는 자산은 모델이 강해질수록 더 중요해진다.

  • ai-agents
  • harness-engineering
  • evals
  • product-planning
  • +5
14분 읽기

OpenClaw와 Hermes Agent 비교

OpenClaw는 채널·Gateway·세션·플러그인을 묶는 운영 플랫폼으로, Hermes Agent는 장기 목표·증거 검증·학습을 밀어붙이는 자율 에이전트 하네스로 더 성숙했다.

  • openclaw
  • hermes-agent
  • agent-harness
  • compaction
  • +6
7분 읽기

GPT-5.6 계열의 토큰·비용 대비 성능

Artificial Analysis Intelligence Index를 기준으로 GPT-5.6의 Luna·Terra·Sol 계열을 비교하면, 일반적인 코딩·분석 기본값은 Sol low이고 비용을 더 중시할 때는 Luna low가 유리하다.

  • gpt-5-6
  • llm-benchmarks
  • token-efficiency
  • cost-efficiency
  • +5
6분 읽기

Vercel의 AGENTS.md vs Skills 실험

Vercel의 Next.js 16 API 에이전트 실험을 바탕으로, AGENTS.md의 persistent docs index가 skill 기반 on-demand retrieval보다 안정적으로 동작한 이유와 실무 적용 기준을 정리한 노트.

  • ai-agents
  • agents-md
  • agent-skills
  • vercel
  • +6
10분 읽기

토큰을 많이 쓰면 좋은 코드가 나올까?

11개 AI 코딩 에이전트 세팅을 같은 과제와 같은 검증 기준으로 비교해, 토큰 총량보다 guard, self-review, 독립 검증이 코드 품질을 더 잘 설명한다는 점을 정리한 실험 노트.

  • ai-coding-agents
  • token-usage
  • code-quality
  • evaluation
  • +5
6분 읽기

Obsidian 에이전트 Vault 퀵스타트

Obsidian을 AI 에이전트의 장기 지식 저장소로 쓰기 위한 도구 조합, vault 구조, AGENTS.md 규칙, 최소 skill, MCP 도입 기준을 정리한 퀵스타트.

  • obsidian
  • agent-memory
  • llm-wiki
  • agent-skills
  • +5
18분 읽기

The Log Is The Agent: 로그 중심 AI 에이전트 아키텍처

AI 에이전트의 지속성, 소유권, 재현성, 포크, 디버깅 가능성을 모델이 아니라 append-only 이벤트 로그 중심으로 재설계해야 한다는 주장과 근거를 정리한 리포트.

  • ai-agents
  • event-sourcing
  • agent-architecture
  • agent-memory
  • +6
11분 읽기

Agent Skill과 MCP 관리 도구

에이전트 skill과 MCP 서버가 많아질 때 쓸 수 있는 CLI, 패키지 매니저, 게이트웨이, 보안 스캐너를 나누어 보고, 개인·팀·조직 단위 도입 기준을 정리한 노트.

  • agent-skills
  • mcp
  • mcp-management
  • developer-tools
  • +6
12분 읽기

프롬프트 평가 체계와 도구

프롬프트가 변경 전보다 실제로 나아졌는지 판단하기 위한 평가 구조, 품질 지표, 통계 기준, 도구 선택지를 정리한 노트.

  • prompt-evaluation
  • llm-evals
  • prompt-quality
  • structured-output
  • +8
11분 읽기

AI 에이전트 프론트엔드 UI/UX 품질 가이드

AI 에이전트로 프론트엔드를 만들 때 제네릭하고 비슷한 UI를 줄이기 위한 디자인 컨텍스트, taste-skill, 프롬프트, MCP, QA 루프, 도구 스택을 정리한 노트.

  • ai-agents
  • frontend-design
  • ui-ux
  • taste-skill
  • +7
12분 읽기

AI 코딩 에이전트 오케스트레이션 레포지토리 비교

Claude Code, Codex, Gemini CLI 같은 코딩 에이전트를 여러 세션으로 실행·감시·격리·오케스트레이션하는 프로젝트를 star 순으로 정리하고 실사용 후보를 나눈 노트.

  • coding-agents
  • ai-agents
  • orchestration
  • claude-code
  • +7
11분 읽기

n8n 퀵스타트와 활용 베스트 프랙티스

n8n을 내부 업무 자동화와 AI 워크플로 오케스트레이션에 쓰기 위한 설치, 운영, 보안, AI Agent 활용 기준을 정리한 노트.

  • n8n
  • workflow-automation
  • automation
  • ai-agents
  • +7
10분 읽기

무료로 쓸 수 있는 LLM API와 키 후보

2026년 6월 26일 기준으로 무료 API key, 무료 모드, trial credit이 명시된 LLM API 후보를 구분해 정리한 노트.

  • llm-api
  • api-keys
  • pricing
  • free-tier
  • +4
10분 읽기

Karpathy의 LLM Wiki 패턴과 차세대 지식 운영

Karpathy가 제안한 LLM Wiki를 RAG, GraphRAG, 장기 메모리 흐름과 비교하고, 개인·팀 지식베이스에 적용할 운영 원칙을 정리한 노트.

  • llm-wiki
  • karpathy
  • rag
  • graphrag
  • +7
12분 읽기

서브에이전트 사용법과 안티패턴

서브에이전트를 언제 쓰고, 어떻게 분리하고, 어떤 실패 패턴을 피해야 하는지 2026년 기준 공식 문서, 실무 글, 논문, 레포 흐름으로 정리한 노트.

  • ai-agents
  • subagents
  • multi-agent
  • context-engineering
  • +5
11분 읽기

AI Agent 개발의 의도 부채와 Loop Engineering 대응

AI agent 개발에서 코드 생성보다 어려워진 의도 보존, 검증, judge 설계 문제를 논문, 업계 글, 도구 흐름과 함께 정리한 노트.

  • ai-agents
  • loop-engineering
  • intent-debt
  • software-engineering
  • +4