Design · Development · Thoughts

안녕하세요,
Practical AI Lab 입니다.

AI·에이전트·LLM 실전 연구

반응형
Claude Code

Claude Code worktree 사용법: 병렬 작업·정리 가이드

대표 이미지: AI 생성 키 비주얼Claude Code worktree 사용법의 출발점은 저장소 루트에서 claude --worktree 작업이름을 실행하는 것입니다. 작업별 폴더와 브랜치를 나눠 병렬 편집을 시작할 수 있지만, 의존성 준비와 결과 병합·삭제 판단은 별도로 해야 합니다. 2026년 9월 8일 기준 공식 Run parallel sessions with worktrees와 CLI reference, Git 매뉴얼을 토대로 생성부터 정리까지 설명합니다.이 글의 핵심병렬 편집에 작업 폴더 분리가 필요한 상황시작 전 점검과 이름을 지정한 생성 절차경로·브랜치·파일 차이로 정상 작동 확인하기작업 결과를 합치는 순서와 오류별 복구 방법다른 병렬 방식 선택과 삭제 전 보존 확인공식 안내: Claude ..

AI Agent

MCP 토큰 패스스루 금지 이유와 안전한 인증 구조

대표 이미지: AI 생성 키 비주얼MCP 토큰 패스스루는 클라이언트가 보낸 토큰을 중계 서버가 자기 수신자용인지 검증하지 않고 외부 API로 넘기는 방식이며, 공식 보안 지침에서 금지합니다. 2026년 9월 8일 기준 MCP 2026-07-28 문서를 바탕으로, HTTP 기반 MCP 서버와 외부 서비스 사이의 인증 경계를 어떻게 나눠야 하는지 설명합니다.이 글의 핵심패스스루에 해당하는 요청의 범위수신자 혼동과 감사 기록의 문제들어오는 인증과 나가는 위임의 분리문서 검색 에이전트의 설계 비교배포 전 거절 테스트와 운영 점검공식 원문: MCP Security Best Practices. 이 글은 신규 출시 뉴스가 아니라 기존 규격을 읽는 기술 해설입니다.목차MCP 토큰 패스스루는 어디서 발생하나?수신자 검증..

AI 트렌드

OpenAI 자동 연구 인턴, 3.1 작업일은 생산성 몇 배일까?

대표 이미지: AI 생성 키 비주얼OpenAI 자동 연구 인턴 발표의 ‘3.1 작업일’만으로 연구 생산성이 몇 배 높아졌는지는 알 수 없습니다. 2026년 9월 8일 기준, 이는 연구 조직에서 사람의 하루 노동에 대응해 에이전트가 얼마나 가동됐는지를 나타내는 수치이며, 최종 연구 성과의 배수는 이번 발표에서 제시하지 않았습니다.이 글은 OpenAI의 9월 6일 공식 보고서 Research acceleration: The view inside OpenAI를 중심으로, Codex 사용 연구와 Epoch AI의 연구 업무 분류를 대조해 달성 주장·측정 단위·사람 개입의 의미를 살펴봅니다.이 글의 핵심자동 연구 인턴의 정의와 남은 목표연구자가 실제로 위임하는 작업의 변화작업일·추론 비용·성공률을 읽는 기준연구 ..

AI Agent

Claude Commerce Agents 구조, 단일 에이전트가 유리한 이유

대표 이미지: AI 생성 키 비주얼Claude Commerce Agents 구조의 핵심은 여러 도메인 에이전트가 대화를 넘겨받는 방식이 아니라, 대화 전체를 유지하는 단일 에이전트에 필요한 Skills와 도구를 붙이는 것입니다. 2026년 9월 2일 Anthropic 공식 설계 해설은 쇼핑처럼 의도가 계속 섞이는 업무에서 이 구성이 품질을 높이고 전달 비용을 줄였다고 설명합니다.다만 멀티에이전트가 항상 불리하다는 뜻은 아닙니다. 깊은 조사처럼 독립된 문맥이 필요한 일이나 별도 규제 경계를 가진 전문 에이전트에는 위임·핸드오프가 여전히 적합합니다.이 글은 같은 날 공개된 공식 발표, 엔지니어링 해설, Apache 2.0 참조 저장소를 기준으로 구조와 운영 조건을 구분합니다.이 글의 핵심쇼핑·판매자 에이전트..

LLM

Muse Spark 1.3 성능·가격, 코딩 1위로 봐도 될까?

대표 이미지: AI 생성 키 비주얼Muse Spark 1.3이 모든 코딩 평가에서 1위라고 보기는 어렵습니다. 2026년 9월 2일 Meta 공식 발표 기준으로 일부 장기 코딩·코드 이해 평가에서는 앞섰지만, 웹 조사와 전문 업무 평가에서는 비교 모델이 더 높았고 최고 추론 설정은 아직 제공 전입니다.가격은 OpenRouter의 Meta 제공 페이지에 표준형 입력 100만 토큰당 1.25달러, 출력 4.25달러로 표시됩니다. 다만 Meta 개발자 문서의 모델 목록은 확인 시점에 1.2까지만 반영돼 있어 실제 계정의 모델 목록과 데이터 조건을 함께 확인해야 합니다.이 글은 Meta의 출시 공지와 평가 방법론, DeepSWE 공개 리더보드, OpenRouter 제공 정보를 교차해 성능표가 말하는 범위와 말하..

AI Agent

GitHub Copilot PR 승인, 사람 리뷰를 대체할 수 있을까?

대표 이미지: AI 생성 키 비주얼GitHub Copilot PR 승인은 사람 리뷰를 전면 대체하는 기능이 아닙니다. 2026년 9월 1일 공개 프리뷰 기준, 승인 평가는 모든 Copilot 코드 리뷰에 표시되지만 실제 승인 권한은 기본적으로 꺼져 있습니다.GitHub 공식 출시 공지와 코드 리뷰·보호 브랜치 문서를 기준으로, 평가와 병합 요건의 차이 및 안전한 적용 범위를 정리합니다.이 글의 핵심승인 평가와 실제 승인의 차이관리 계층과 파일 경로별 통제새 커밋 뒤 승인 무효화자동 검토·지속 검사·사람 리뷰의 역할낮은 위험 저장소부터 적용하는 순서먼저 팩트체크할 부분“승인 가능” 평가는 그 자체로 필수 승인 수를 채우지 않습니다. 실제 Approve 리뷰가 병합 요건에 반영되려면 관리자가 승인 기능과 병..

Codex

Codex MCP output_token_limit 설정과 잘림 원리

MCP 도구별 출력 토큰 예산을 조절 밸브로 표현한 AI 생성 대표 이미지Codex MCP output_token_limit은 MCP 서버 전체가 아니라 개별 도구가 모델 대화 기록에 남길 출력 토큰 예산을 정하는 설정입니다. 2026년 9월 2일 기준 Codex 0.152.0에 포함됐으며, 큰 검색 결과나 로그가 세션의 판단 공간을 과도하게 차지하는 일을 도구 단위로 줄일 수 있습니다.근거는 OpenAI Codex 0.152.0 릴리스, 변경 요청 #41421, 병합 커밋 f742dab입니다. 공개 설정 레퍼런스에는 전역 tool_output_token_limit가 보이지만 개별 도구 키는 아직 검색되지 않아, 아래 설명은 릴리스와 구현 변경을 기준으로 구분합니다.이 글의 핵심개별 MCP 도구 출력 제..

AI 트렌드

OpenAI Astra Critical 등급, 출시 전 무엇이 확인됐나?

Astra의 강한 사이버 역량을 여러 보호층 안에 둔 구조를 표현한 AI 생성 이미지OpenAI Astra Critical 등급은 2026년 9월 2일 기준 확정됐지만, Astra 자체는 아직 출시되지 않았습니다. OpenAI는 출시를 “곧”으로만 예고했고 정식 날짜·API 모델 아이디·가격은 공개하지 않았으며, 가장 강한 사이버 기능은 제한된 경로로 먼저 제공합니다.이 글은 OpenAI의 9월 1일 발표와 Preparedness Framework, Daybreak 안내, Hugging Face 사건 보고를 기준으로 확인된 범위만 정리합니다.이 글의 핵심Astra 판정에서 확정된 사실과 미공개 정보Critical 등급을 결정하는 두 가지 조건100%·91.5%·2건이라는 수치의 범위출시 접근 제한과 작업..

LLM

Claude Fable 5.1 마이그레이션: 도구 호출·thinking 변경점

Claude Fable 5.1의 append-only 대화 구조를 표현한 AI 생성 대표 이미지Claude Fable 5.1 마이그레이션은 모델 아이디만 바꾸는 작업으로 끝나지 않습니다. 2026년 9월 2일 기준, 기존 코드가 강제 도구 호출을 쓰거나 과거 대화·도구 목록을 매 요청마다 다시 만들면 400 오류 또는 thinking 블록 무효화가 발생할 수 있으므로 호출 정책과 대화 저장 방식을 함께 점검해야 합니다.Anthropic의 Fable 5.1 발표, 모델 개요, 변경점 문서, 마이그레이션 가이드를 기준으로 실제로 바뀐 API 동작만 정리합니다.이 글의 핵심모델 아이디·가격·제공 범위기존 에이전트 통합이 깨지는 지점강제 도구 호출을 대체하는 방법thinking 블록을 보존하는 대화 구조effo..

AI Agent

Broadcom AgentMinder 출시, AI 에이전트 도구 호출 통제 원리

AI 생성 대표 이미지Broadcom AgentMinder는 2026년 8월 31일 일반 제공을 시작한 기업용 AI 에이전트 거버넌스 제품입니다. 핵심은 모델의 답변을 한 번 검사하는 데서 끝나지 않고, 에이전트가 기업 자원에 닿기 직전 신원·임무·의도·도구·위험 맥락을 확인해 각 도구 호출을 통제하는 것입니다. 다만 가격, 지연 시간, 독립 성능 평가는 아직 공개 자료에서 확인되지 않습니다.2026년 9월 1일 기준으로 Broadcom의 AgentMinder 발표와 보안 제품군 발표, OpenID AuthZEN 1.0 최종 규격, OpenTelemetry 시맨틱 규약을 대조했습니다.이 글의 핵심출시 상태와 제품 범위도구 호출이 통제되는 순서공식 운영 수치의 의미AuthZEN·OpenTelemetry 연..

'전체 글' · 224건

AI·에이전트·LLM 실전 연구

Claude Code

Claude Code worktree 사용법: 병렬 작업·정리 가이드

대표 이미지: AI 생성 키 비주얼Claude Code worktree 사용법의 출발점은 저장소 루트에서 claude --worktree 작업이름을 실행하는 것입니다. 작업별 폴더와 브랜치를 나눠 병렬 편집을 시작할 수 있지만, 의존성 준비와 결과 병합·삭제 판단은 별도로 해야 합니다. 2026년 9월 8일 기준 공식 Run parallel sessions with worktrees와 CLI reference, Git 매뉴얼을 토대로 생성부터 정리까지 설명합니다.이 글의 핵심병렬 편집에 작업 폴더 분리가 필요한 상황시작 전 점검과 이름을 지정한 생성 절차경로·브랜치·파일 차이로 정상 작동 확인하기작업 결과를 합치는 순서와 오류별 복구 방법다른 병렬 방식 선택과 삭제 전 보존 확인공식 안내: Claude ..

AI Agent

MCP 토큰 패스스루 금지 이유와 안전한 인증 구조

대표 이미지: AI 생성 키 비주얼MCP 토큰 패스스루는 클라이언트가 보낸 토큰을 중계 서버가 자기 수신자용인지 검증하지 않고 외부 API로 넘기는 방식이며, 공식 보안 지침에서 금지합니다. 2026년 9월 8일 기준 MCP 2026-07-28 문서를 바탕으로, HTTP 기반 MCP 서버와 외부 서비스 사이의 인증 경계를 어떻게 나눠야 하는지 설명합니다.이 글의 핵심패스스루에 해당하는 요청의 범위수신자 혼동과 감사 기록의 문제들어오는 인증과 나가는 위임의 분리문서 검색 에이전트의 설계 비교배포 전 거절 테스트와 운영 점검공식 원문: MCP Security Best Practices. 이 글은 신규 출시 뉴스가 아니라 기존 규격을 읽는 기술 해설입니다.목차MCP 토큰 패스스루는 어디서 발생하나?수신자 검증..

AI 트렌드

OpenAI 자동 연구 인턴, 3.1 작업일은 생산성 몇 배일까?

대표 이미지: AI 생성 키 비주얼OpenAI 자동 연구 인턴 발표의 ‘3.1 작업일’만으로 연구 생산성이 몇 배 높아졌는지는 알 수 없습니다. 2026년 9월 8일 기준, 이는 연구 조직에서 사람의 하루 노동에 대응해 에이전트가 얼마나 가동됐는지를 나타내는 수치이며, 최종 연구 성과의 배수는 이번 발표에서 제시하지 않았습니다.이 글은 OpenAI의 9월 6일 공식 보고서 Research acceleration: The view inside OpenAI를 중심으로, Codex 사용 연구와 Epoch AI의 연구 업무 분류를 대조해 달성 주장·측정 단위·사람 개입의 의미를 살펴봅니다.이 글의 핵심자동 연구 인턴의 정의와 남은 목표연구자가 실제로 위임하는 작업의 변화작업일·추론 비용·성공률을 읽는 기준연구 ..

AI Agent

Claude Commerce Agents 구조, 단일 에이전트가 유리한 이유

대표 이미지: AI 생성 키 비주얼Claude Commerce Agents 구조의 핵심은 여러 도메인 에이전트가 대화를 넘겨받는 방식이 아니라, 대화 전체를 유지하는 단일 에이전트에 필요한 Skills와 도구를 붙이는 것입니다. 2026년 9월 2일 Anthropic 공식 설계 해설은 쇼핑처럼 의도가 계속 섞이는 업무에서 이 구성이 품질을 높이고 전달 비용을 줄였다고 설명합니다.다만 멀티에이전트가 항상 불리하다는 뜻은 아닙니다. 깊은 조사처럼 독립된 문맥이 필요한 일이나 별도 규제 경계를 가진 전문 에이전트에는 위임·핸드오프가 여전히 적합합니다.이 글은 같은 날 공개된 공식 발표, 엔지니어링 해설, Apache 2.0 참조 저장소를 기준으로 구조와 운영 조건을 구분합니다.이 글의 핵심쇼핑·판매자 에이전트..

LLM

Muse Spark 1.3 성능·가격, 코딩 1위로 봐도 될까?

대표 이미지: AI 생성 키 비주얼Muse Spark 1.3이 모든 코딩 평가에서 1위라고 보기는 어렵습니다. 2026년 9월 2일 Meta 공식 발표 기준으로 일부 장기 코딩·코드 이해 평가에서는 앞섰지만, 웹 조사와 전문 업무 평가에서는 비교 모델이 더 높았고 최고 추론 설정은 아직 제공 전입니다.가격은 OpenRouter의 Meta 제공 페이지에 표준형 입력 100만 토큰당 1.25달러, 출력 4.25달러로 표시됩니다. 다만 Meta 개발자 문서의 모델 목록은 확인 시점에 1.2까지만 반영돼 있어 실제 계정의 모델 목록과 데이터 조건을 함께 확인해야 합니다.이 글은 Meta의 출시 공지와 평가 방법론, DeepSWE 공개 리더보드, OpenRouter 제공 정보를 교차해 성능표가 말하는 범위와 말하..

AI Agent

GitHub Copilot PR 승인, 사람 리뷰를 대체할 수 있을까?

대표 이미지: AI 생성 키 비주얼GitHub Copilot PR 승인은 사람 리뷰를 전면 대체하는 기능이 아닙니다. 2026년 9월 1일 공개 프리뷰 기준, 승인 평가는 모든 Copilot 코드 리뷰에 표시되지만 실제 승인 권한은 기본적으로 꺼져 있습니다.GitHub 공식 출시 공지와 코드 리뷰·보호 브랜치 문서를 기준으로, 평가와 병합 요건의 차이 및 안전한 적용 범위를 정리합니다.이 글의 핵심승인 평가와 실제 승인의 차이관리 계층과 파일 경로별 통제새 커밋 뒤 승인 무효화자동 검토·지속 검사·사람 리뷰의 역할낮은 위험 저장소부터 적용하는 순서먼저 팩트체크할 부분“승인 가능” 평가는 그 자체로 필수 승인 수를 채우지 않습니다. 실제 Approve 리뷰가 병합 요건에 반영되려면 관리자가 승인 기능과 병..

Codex

Codex MCP output_token_limit 설정과 잘림 원리

MCP 도구별 출력 토큰 예산을 조절 밸브로 표현한 AI 생성 대표 이미지Codex MCP output_token_limit은 MCP 서버 전체가 아니라 개별 도구가 모델 대화 기록에 남길 출력 토큰 예산을 정하는 설정입니다. 2026년 9월 2일 기준 Codex 0.152.0에 포함됐으며, 큰 검색 결과나 로그가 세션의 판단 공간을 과도하게 차지하는 일을 도구 단위로 줄일 수 있습니다.근거는 OpenAI Codex 0.152.0 릴리스, 변경 요청 #41421, 병합 커밋 f742dab입니다. 공개 설정 레퍼런스에는 전역 tool_output_token_limit가 보이지만 개별 도구 키는 아직 검색되지 않아, 아래 설명은 릴리스와 구현 변경을 기준으로 구분합니다.이 글의 핵심개별 MCP 도구 출력 제..

AI 트렌드

OpenAI Astra Critical 등급, 출시 전 무엇이 확인됐나?

Astra의 강한 사이버 역량을 여러 보호층 안에 둔 구조를 표현한 AI 생성 이미지OpenAI Astra Critical 등급은 2026년 9월 2일 기준 확정됐지만, Astra 자체는 아직 출시되지 않았습니다. OpenAI는 출시를 “곧”으로만 예고했고 정식 날짜·API 모델 아이디·가격은 공개하지 않았으며, 가장 강한 사이버 기능은 제한된 경로로 먼저 제공합니다.이 글은 OpenAI의 9월 1일 발표와 Preparedness Framework, Daybreak 안내, Hugging Face 사건 보고를 기준으로 확인된 범위만 정리합니다.이 글의 핵심Astra 판정에서 확정된 사실과 미공개 정보Critical 등급을 결정하는 두 가지 조건100%·91.5%·2건이라는 수치의 범위출시 접근 제한과 작업..

LLM

Claude Fable 5.1 마이그레이션: 도구 호출·thinking 변경점

Claude Fable 5.1의 append-only 대화 구조를 표현한 AI 생성 대표 이미지Claude Fable 5.1 마이그레이션은 모델 아이디만 바꾸는 작업으로 끝나지 않습니다. 2026년 9월 2일 기준, 기존 코드가 강제 도구 호출을 쓰거나 과거 대화·도구 목록을 매 요청마다 다시 만들면 400 오류 또는 thinking 블록 무효화가 발생할 수 있으므로 호출 정책과 대화 저장 방식을 함께 점검해야 합니다.Anthropic의 Fable 5.1 발표, 모델 개요, 변경점 문서, 마이그레이션 가이드를 기준으로 실제로 바뀐 API 동작만 정리합니다.이 글의 핵심모델 아이디·가격·제공 범위기존 에이전트 통합이 깨지는 지점강제 도구 호출을 대체하는 방법thinking 블록을 보존하는 대화 구조effo..

AI Agent

Broadcom AgentMinder 출시, AI 에이전트 도구 호출 통제 원리

AI 생성 대표 이미지Broadcom AgentMinder는 2026년 8월 31일 일반 제공을 시작한 기업용 AI 에이전트 거버넌스 제품입니다. 핵심은 모델의 답변을 한 번 검사하는 데서 끝나지 않고, 에이전트가 기업 자원에 닿기 직전 신원·임무·의도·도구·위험 맥락을 확인해 각 도구 호출을 통제하는 것입니다. 다만 가격, 지연 시간, 독립 성능 평가는 아직 공개 자료에서 확인되지 않습니다.2026년 9월 1일 기준으로 Broadcom의 AgentMinder 발표와 보안 제품군 발표, OpenID AuthZEN 1.0 최종 규격, OpenTelemetry 시맨틱 규약을 대조했습니다.이 글의 핵심출시 상태와 제품 범위도구 호출이 통제되는 순서공식 운영 수치의 의미AuthZEN·OpenTelemetry 연..

반응형