Design · Development · Thoughts

안녕하세요,
Practical AI Lab 입니다.

AI·에이전트·LLM 실전 연구

반응형
AI Agent

MCP 코드 실행으로 토큰 줄이기: 작동 원리와 도입 조건

대표 이미지: AI 생성 키 비주얼MCP 코드 실행으로 토큰 줄이기는 도구 목록과 중간 데이터를 모델에 얼마나 보여 줄지 바꾸는 설계입니다. 필요한 도구 정의만 읽고 실행 환경에서 데이터를 걸러 반환하면 컨텍스트 사용량을 줄일 수 있지만, 샌드박스 운영 비용까지 함께 따져야 합니다.2026년 9월 8일 기준 Anthropic의 Code execution with MCP와 도구·컨텍스트 설계 문서를 바탕으로 작동 원리와 도입 조건을 분석합니다. 새 제품 출시 소식이나 이 블로그의 성능 측정 결과를 소개하는 글은 아닙니다.이 글의 핵심코드 실행 계층과 MCP 프로토콜의 역할 구분도구 정의·중간 결과가 차지하는 두 가지 비용도구 탐색부터 필터링까지 이어지는 실행 흐름직접 호출과 코드 실행을 선택하는 비교 기준..

LLM

DeepSeek V4 Flash Vision 이미지 인식, 성능·제약 정리

대표 이미지: AI 생성 키 비주얼DeepSeek V4 Flash Vision 이미지 인식은 공식 API와 공개 모델 카드에서 확인할 수 있습니다. 2026년 9월 8일 기준 모델 이름은 deepseek-v4-flash-vision-exp이며, 이미지와 텍스트를 함께 입력하는 실험 모델입니다. 이 글은 DeepSeek의 모델 카드와 Vision 문서를 기준으로 지원 범위, 공개 성능표, 호출 제약을 살펴봅니다.이 글의 핵심실험 모델의 공개 범위와 기존 모델의 관계세 가지 이미지 전달 경로와 파일 형식벤치마크 수치를 비교할 때 필요한 조건시각 인식과 에이전트 실행 사이의 책임 경계호출 전에 확인할 크기·해상도·메시지 제한먼저 팩트체크할 부분아래 성능 수치는 개발사가 공개한 모델 카드의 결과입니다. 이번 글..

Claude Code

Claude Code worktree 사용법: 병렬 작업·정리 가이드

대표 이미지: AI 생성 키 비주얼Claude Code worktree 사용법의 출발점은 저장소 루트에서 claude --worktree 작업이름을 실행하는 것입니다. 작업별 폴더와 브랜치를 나눠 병렬 편집을 시작할 수 있지만, 의존성 준비와 결과 병합·삭제 판단은 별도로 해야 합니다. 2026년 9월 8일 기준 공식 Run parallel sessions with worktrees와 CLI reference, Git 매뉴얼을 토대로 생성부터 정리까지 설명합니다.이 글의 핵심병렬 편집에 작업 폴더 분리가 필요한 상황시작 전 점검과 이름을 지정한 생성 절차경로·브랜치·파일 차이로 정상 작동 확인하기작업 결과를 합치는 순서와 오류별 복구 방법다른 병렬 방식 선택과 삭제 전 보존 확인공식 안내: Claude ..

AI Agent

MCP 토큰 패스스루 금지 이유와 안전한 인증 구조

대표 이미지: AI 생성 키 비주얼MCP 토큰 패스스루는 클라이언트가 보낸 토큰을 중계 서버가 자기 수신자용인지 검증하지 않고 외부 API로 넘기는 방식이며, 공식 보안 지침에서 금지합니다. 2026년 9월 8일 기준 MCP 2026-07-28 문서를 바탕으로, HTTP 기반 MCP 서버와 외부 서비스 사이의 인증 경계를 어떻게 나눠야 하는지 설명합니다.이 글의 핵심패스스루에 해당하는 요청의 범위수신자 혼동과 감사 기록의 문제들어오는 인증과 나가는 위임의 분리문서 검색 에이전트의 설계 비교배포 전 거절 테스트와 운영 점검공식 원문: MCP Security Best Practices. 이 글은 신규 출시 뉴스가 아니라 기존 규격을 읽는 기술 해설입니다.목차MCP 토큰 패스스루는 어디서 발생하나?수신자 검증..

AI 트렌드

OpenAI 자동 연구 인턴, 3.1 작업일은 생산성 몇 배일까?

대표 이미지: AI 생성 키 비주얼OpenAI 자동 연구 인턴 발표의 ‘3.1 작업일’만으로 연구 생산성이 몇 배 높아졌는지는 알 수 없습니다. 2026년 9월 8일 기준, 이는 연구 조직에서 사람의 하루 노동에 대응해 에이전트가 얼마나 가동됐는지를 나타내는 수치이며, 최종 연구 성과의 배수는 이번 발표에서 제시하지 않았습니다.이 글은 OpenAI의 9월 6일 공식 보고서 Research acceleration: The view inside OpenAI를 중심으로, Codex 사용 연구와 Epoch AI의 연구 업무 분류를 대조해 달성 주장·측정 단위·사람 개입의 의미를 살펴봅니다.이 글의 핵심자동 연구 인턴의 정의와 남은 목표연구자가 실제로 위임하는 작업의 변화작업일·추론 비용·성공률을 읽는 기준연구 ..

AI Agent

Claude Commerce Agents 구조, 단일 에이전트가 유리한 이유

대표 이미지: AI 생성 키 비주얼Claude Commerce Agents 구조의 핵심은 여러 도메인 에이전트가 대화를 넘겨받는 방식이 아니라, 대화 전체를 유지하는 단일 에이전트에 필요한 Skills와 도구를 붙이는 것입니다. 2026년 9월 2일 Anthropic 공식 설계 해설은 쇼핑처럼 의도가 계속 섞이는 업무에서 이 구성이 품질을 높이고 전달 비용을 줄였다고 설명합니다.다만 멀티에이전트가 항상 불리하다는 뜻은 아닙니다. 깊은 조사처럼 독립된 문맥이 필요한 일이나 별도 규제 경계를 가진 전문 에이전트에는 위임·핸드오프가 여전히 적합합니다.이 글은 같은 날 공개된 공식 발표, 엔지니어링 해설, Apache 2.0 참조 저장소를 기준으로 구조와 운영 조건을 구분합니다.이 글의 핵심쇼핑·판매자 에이전트..

LLM

Muse Spark 1.3 성능·가격, 코딩 1위로 봐도 될까?

대표 이미지: AI 생성 키 비주얼Muse Spark 1.3이 모든 코딩 평가에서 1위라고 보기는 어렵습니다. 2026년 9월 2일 Meta 공식 발표 기준으로 일부 장기 코딩·코드 이해 평가에서는 앞섰지만, 웹 조사와 전문 업무 평가에서는 비교 모델이 더 높았고 최고 추론 설정은 아직 제공 전입니다.가격은 OpenRouter의 Meta 제공 페이지에 표준형 입력 100만 토큰당 1.25달러, 출력 4.25달러로 표시됩니다. 다만 Meta 개발자 문서의 모델 목록은 확인 시점에 1.2까지만 반영돼 있어 실제 계정의 모델 목록과 데이터 조건을 함께 확인해야 합니다.이 글은 Meta의 출시 공지와 평가 방법론, DeepSWE 공개 리더보드, OpenRouter 제공 정보를 교차해 성능표가 말하는 범위와 말하..

AI Agent

GitHub Copilot PR 승인, 사람 리뷰를 대체할 수 있을까?

대표 이미지: AI 생성 키 비주얼GitHub Copilot PR 승인은 사람 리뷰를 전면 대체하는 기능이 아닙니다. 2026년 9월 1일 공개 프리뷰 기준, 승인 평가는 모든 Copilot 코드 리뷰에 표시되지만 실제 승인 권한은 기본적으로 꺼져 있습니다.GitHub 공식 출시 공지와 코드 리뷰·보호 브랜치 문서를 기준으로, 평가와 병합 요건의 차이 및 안전한 적용 범위를 정리합니다.이 글의 핵심승인 평가와 실제 승인의 차이관리 계층과 파일 경로별 통제새 커밋 뒤 승인 무효화자동 검토·지속 검사·사람 리뷰의 역할낮은 위험 저장소부터 적용하는 순서먼저 팩트체크할 부분“승인 가능” 평가는 그 자체로 필수 승인 수를 채우지 않습니다. 실제 Approve 리뷰가 병합 요건에 반영되려면 관리자가 승인 기능과 병..

Codex

Codex MCP output_token_limit 설정과 잘림 원리

MCP 도구별 출력 토큰 예산을 조절 밸브로 표현한 AI 생성 대표 이미지Codex MCP output_token_limit은 MCP 서버 전체가 아니라 개별 도구가 모델 대화 기록에 남길 출력 토큰 예산을 정하는 설정입니다. 2026년 9월 2일 기준 Codex 0.152.0에 포함됐으며, 큰 검색 결과나 로그가 세션의 판단 공간을 과도하게 차지하는 일을 도구 단위로 줄일 수 있습니다.근거는 OpenAI Codex 0.152.0 릴리스, 변경 요청 #41421, 병합 커밋 f742dab입니다. 공개 설정 레퍼런스에는 전역 tool_output_token_limit가 보이지만 개별 도구 키는 아직 검색되지 않아, 아래 설명은 릴리스와 구현 변경을 기준으로 구분합니다.이 글의 핵심개별 MCP 도구 출력 제..

AI 트렌드

OpenAI Astra Critical 등급, 출시 전 무엇이 확인됐나?

Astra의 강한 사이버 역량을 여러 보호층 안에 둔 구조를 표현한 AI 생성 이미지OpenAI Astra Critical 등급은 2026년 9월 2일 기준 확정됐지만, Astra 자체는 아직 출시되지 않았습니다. OpenAI는 출시를 “곧”으로만 예고했고 정식 날짜·API 모델 아이디·가격은 공개하지 않았으며, 가장 강한 사이버 기능은 제한된 경로로 먼저 제공합니다.이 글은 OpenAI의 9월 1일 발표와 Preparedness Framework, Daybreak 안내, Hugging Face 사건 보고를 기준으로 확인된 범위만 정리합니다.이 글의 핵심Astra 판정에서 확정된 사실과 미공개 정보Critical 등급을 결정하는 두 가지 조건100%·91.5%·2건이라는 수치의 범위출시 접근 제한과 작업..

'전체 글' · 226건

AI·에이전트·LLM 실전 연구

AI Agent

MCP 코드 실행으로 토큰 줄이기: 작동 원리와 도입 조건

대표 이미지: AI 생성 키 비주얼MCP 코드 실행으로 토큰 줄이기는 도구 목록과 중간 데이터를 모델에 얼마나 보여 줄지 바꾸는 설계입니다. 필요한 도구 정의만 읽고 실행 환경에서 데이터를 걸러 반환하면 컨텍스트 사용량을 줄일 수 있지만, 샌드박스 운영 비용까지 함께 따져야 합니다.2026년 9월 8일 기준 Anthropic의 Code execution with MCP와 도구·컨텍스트 설계 문서를 바탕으로 작동 원리와 도입 조건을 분석합니다. 새 제품 출시 소식이나 이 블로그의 성능 측정 결과를 소개하는 글은 아닙니다.이 글의 핵심코드 실행 계층과 MCP 프로토콜의 역할 구분도구 정의·중간 결과가 차지하는 두 가지 비용도구 탐색부터 필터링까지 이어지는 실행 흐름직접 호출과 코드 실행을 선택하는 비교 기준..

LLM

DeepSeek V4 Flash Vision 이미지 인식, 성능·제약 정리

대표 이미지: AI 생성 키 비주얼DeepSeek V4 Flash Vision 이미지 인식은 공식 API와 공개 모델 카드에서 확인할 수 있습니다. 2026년 9월 8일 기준 모델 이름은 deepseek-v4-flash-vision-exp이며, 이미지와 텍스트를 함께 입력하는 실험 모델입니다. 이 글은 DeepSeek의 모델 카드와 Vision 문서를 기준으로 지원 범위, 공개 성능표, 호출 제약을 살펴봅니다.이 글의 핵심실험 모델의 공개 범위와 기존 모델의 관계세 가지 이미지 전달 경로와 파일 형식벤치마크 수치를 비교할 때 필요한 조건시각 인식과 에이전트 실행 사이의 책임 경계호출 전에 확인할 크기·해상도·메시지 제한먼저 팩트체크할 부분아래 성능 수치는 개발사가 공개한 모델 카드의 결과입니다. 이번 글..

Claude Code

Claude Code worktree 사용법: 병렬 작업·정리 가이드

대표 이미지: AI 생성 키 비주얼Claude Code worktree 사용법의 출발점은 저장소 루트에서 claude --worktree 작업이름을 실행하는 것입니다. 작업별 폴더와 브랜치를 나눠 병렬 편집을 시작할 수 있지만, 의존성 준비와 결과 병합·삭제 판단은 별도로 해야 합니다. 2026년 9월 8일 기준 공식 Run parallel sessions with worktrees와 CLI reference, Git 매뉴얼을 토대로 생성부터 정리까지 설명합니다.이 글의 핵심병렬 편집에 작업 폴더 분리가 필요한 상황시작 전 점검과 이름을 지정한 생성 절차경로·브랜치·파일 차이로 정상 작동 확인하기작업 결과를 합치는 순서와 오류별 복구 방법다른 병렬 방식 선택과 삭제 전 보존 확인공식 안내: Claude ..

AI Agent

MCP 토큰 패스스루 금지 이유와 안전한 인증 구조

대표 이미지: AI 생성 키 비주얼MCP 토큰 패스스루는 클라이언트가 보낸 토큰을 중계 서버가 자기 수신자용인지 검증하지 않고 외부 API로 넘기는 방식이며, 공식 보안 지침에서 금지합니다. 2026년 9월 8일 기준 MCP 2026-07-28 문서를 바탕으로, HTTP 기반 MCP 서버와 외부 서비스 사이의 인증 경계를 어떻게 나눠야 하는지 설명합니다.이 글의 핵심패스스루에 해당하는 요청의 범위수신자 혼동과 감사 기록의 문제들어오는 인증과 나가는 위임의 분리문서 검색 에이전트의 설계 비교배포 전 거절 테스트와 운영 점검공식 원문: MCP Security Best Practices. 이 글은 신규 출시 뉴스가 아니라 기존 규격을 읽는 기술 해설입니다.목차MCP 토큰 패스스루는 어디서 발생하나?수신자 검증..

AI 트렌드

OpenAI 자동 연구 인턴, 3.1 작업일은 생산성 몇 배일까?

대표 이미지: AI 생성 키 비주얼OpenAI 자동 연구 인턴 발표의 ‘3.1 작업일’만으로 연구 생산성이 몇 배 높아졌는지는 알 수 없습니다. 2026년 9월 8일 기준, 이는 연구 조직에서 사람의 하루 노동에 대응해 에이전트가 얼마나 가동됐는지를 나타내는 수치이며, 최종 연구 성과의 배수는 이번 발표에서 제시하지 않았습니다.이 글은 OpenAI의 9월 6일 공식 보고서 Research acceleration: The view inside OpenAI를 중심으로, Codex 사용 연구와 Epoch AI의 연구 업무 분류를 대조해 달성 주장·측정 단위·사람 개입의 의미를 살펴봅니다.이 글의 핵심자동 연구 인턴의 정의와 남은 목표연구자가 실제로 위임하는 작업의 변화작업일·추론 비용·성공률을 읽는 기준연구 ..

AI Agent

Claude Commerce Agents 구조, 단일 에이전트가 유리한 이유

대표 이미지: AI 생성 키 비주얼Claude Commerce Agents 구조의 핵심은 여러 도메인 에이전트가 대화를 넘겨받는 방식이 아니라, 대화 전체를 유지하는 단일 에이전트에 필요한 Skills와 도구를 붙이는 것입니다. 2026년 9월 2일 Anthropic 공식 설계 해설은 쇼핑처럼 의도가 계속 섞이는 업무에서 이 구성이 품질을 높이고 전달 비용을 줄였다고 설명합니다.다만 멀티에이전트가 항상 불리하다는 뜻은 아닙니다. 깊은 조사처럼 독립된 문맥이 필요한 일이나 별도 규제 경계를 가진 전문 에이전트에는 위임·핸드오프가 여전히 적합합니다.이 글은 같은 날 공개된 공식 발표, 엔지니어링 해설, Apache 2.0 참조 저장소를 기준으로 구조와 운영 조건을 구분합니다.이 글의 핵심쇼핑·판매자 에이전트..

LLM

Muse Spark 1.3 성능·가격, 코딩 1위로 봐도 될까?

대표 이미지: AI 생성 키 비주얼Muse Spark 1.3이 모든 코딩 평가에서 1위라고 보기는 어렵습니다. 2026년 9월 2일 Meta 공식 발표 기준으로 일부 장기 코딩·코드 이해 평가에서는 앞섰지만, 웹 조사와 전문 업무 평가에서는 비교 모델이 더 높았고 최고 추론 설정은 아직 제공 전입니다.가격은 OpenRouter의 Meta 제공 페이지에 표준형 입력 100만 토큰당 1.25달러, 출력 4.25달러로 표시됩니다. 다만 Meta 개발자 문서의 모델 목록은 확인 시점에 1.2까지만 반영돼 있어 실제 계정의 모델 목록과 데이터 조건을 함께 확인해야 합니다.이 글은 Meta의 출시 공지와 평가 방법론, DeepSWE 공개 리더보드, OpenRouter 제공 정보를 교차해 성능표가 말하는 범위와 말하..

AI Agent

GitHub Copilot PR 승인, 사람 리뷰를 대체할 수 있을까?

대표 이미지: AI 생성 키 비주얼GitHub Copilot PR 승인은 사람 리뷰를 전면 대체하는 기능이 아닙니다. 2026년 9월 1일 공개 프리뷰 기준, 승인 평가는 모든 Copilot 코드 리뷰에 표시되지만 실제 승인 권한은 기본적으로 꺼져 있습니다.GitHub 공식 출시 공지와 코드 리뷰·보호 브랜치 문서를 기준으로, 평가와 병합 요건의 차이 및 안전한 적용 범위를 정리합니다.이 글의 핵심승인 평가와 실제 승인의 차이관리 계층과 파일 경로별 통제새 커밋 뒤 승인 무효화자동 검토·지속 검사·사람 리뷰의 역할낮은 위험 저장소부터 적용하는 순서먼저 팩트체크할 부분“승인 가능” 평가는 그 자체로 필수 승인 수를 채우지 않습니다. 실제 Approve 리뷰가 병합 요건에 반영되려면 관리자가 승인 기능과 병..

Codex

Codex MCP output_token_limit 설정과 잘림 원리

MCP 도구별 출력 토큰 예산을 조절 밸브로 표현한 AI 생성 대표 이미지Codex MCP output_token_limit은 MCP 서버 전체가 아니라 개별 도구가 모델 대화 기록에 남길 출력 토큰 예산을 정하는 설정입니다. 2026년 9월 2일 기준 Codex 0.152.0에 포함됐으며, 큰 검색 결과나 로그가 세션의 판단 공간을 과도하게 차지하는 일을 도구 단위로 줄일 수 있습니다.근거는 OpenAI Codex 0.152.0 릴리스, 변경 요청 #41421, 병합 커밋 f742dab입니다. 공개 설정 레퍼런스에는 전역 tool_output_token_limit가 보이지만 개별 도구 키는 아직 검색되지 않아, 아래 설명은 릴리스와 구현 변경을 기준으로 구분합니다.이 글의 핵심개별 MCP 도구 출력 제..

AI 트렌드

OpenAI Astra Critical 등급, 출시 전 무엇이 확인됐나?

Astra의 강한 사이버 역량을 여러 보호층 안에 둔 구조를 표현한 AI 생성 이미지OpenAI Astra Critical 등급은 2026년 9월 2일 기준 확정됐지만, Astra 자체는 아직 출시되지 않았습니다. OpenAI는 출시를 “곧”으로만 예고했고 정식 날짜·API 모델 아이디·가격은 공개하지 않았으며, 가장 강한 사이버 기능은 제한된 경로로 먼저 제공합니다.이 글은 OpenAI의 9월 1일 발표와 Preparedness Framework, Daybreak 안내, Hugging Face 사건 보고를 기준으로 확인된 범위만 정리합니다.이 글의 핵심Astra 판정에서 확정된 사실과 미공개 정보Critical 등급을 결정하는 두 가지 조건100%·91.5%·2건이라는 수치의 범위출시 접근 제한과 작업..

반응형