Design · Development · Thoughts

안녕하세요,
Practical AI Lab 입니다.

AI·에이전트·LLM 실전 연구

반응형
AI Agent

Claude Commerce Agents 구조, 단일 에이전트가 유리한 이유

대표 이미지: AI 생성 키 비주얼Claude Commerce Agents 구조의 핵심은 여러 도메인 에이전트가 대화를 넘겨받는 방식이 아니라, 대화 전체를 유지하는 단일 에이전트에 필요한 Skills와 도구를 붙이는 것입니다. 2026년 9월 2일 Anthropic 공식 설계 해설은 쇼핑처럼 의도가 계속 섞이는 업무에서 이 구성이 품질을 높이고 전달 비용을 줄였다고 설명합니다.다만 멀티에이전트가 항상 불리하다는 뜻은 아닙니다. 깊은 조사처럼 독립된 문맥이 필요한 일이나 별도 규제 경계를 가진 전문 에이전트에는 위임·핸드오프가 여전히 적합합니다.이 글은 같은 날 공개된 공식 발표, 엔지니어링 해설, Apache 2.0 참조 저장소를 기준으로 구조와 운영 조건을 구분합니다.이 글의 핵심쇼핑·판매자 에이전트..

LLM

Muse Spark 1.3 성능·가격, 코딩 1위로 봐도 될까?

대표 이미지: AI 생성 키 비주얼Muse Spark 1.3이 모든 코딩 평가에서 1위라고 보기는 어렵습니다. 2026년 9월 2일 Meta 공식 발표 기준으로 일부 장기 코딩·코드 이해 평가에서는 앞섰지만, 웹 조사와 전문 업무 평가에서는 비교 모델이 더 높았고 최고 추론 설정은 아직 제공 전입니다.가격은 OpenRouter의 Meta 제공 페이지에 표준형 입력 100만 토큰당 1.25달러, 출력 4.25달러로 표시됩니다. 다만 Meta 개발자 문서의 모델 목록은 확인 시점에 1.2까지만 반영돼 있어 실제 계정의 모델 목록과 데이터 조건을 함께 확인해야 합니다.이 글은 Meta의 출시 공지와 평가 방법론, DeepSWE 공개 리더보드, OpenRouter 제공 정보를 교차해 성능표가 말하는 범위와 말하..

AI Agent

GitHub Copilot PR 승인, 사람 리뷰를 대체할 수 있을까?

대표 이미지: AI 생성 키 비주얼GitHub Copilot PR 승인은 사람 리뷰를 전면 대체하는 기능이 아닙니다. 2026년 9월 1일 공개 프리뷰 기준, 승인 평가는 모든 Copilot 코드 리뷰에 표시되지만 실제 승인 권한은 기본적으로 꺼져 있습니다.GitHub 공식 출시 공지와 코드 리뷰·보호 브랜치 문서를 기준으로, 평가와 병합 요건의 차이 및 안전한 적용 범위를 정리합니다.이 글의 핵심승인 평가와 실제 승인의 차이관리 계층과 파일 경로별 통제새 커밋 뒤 승인 무효화자동 검토·지속 검사·사람 리뷰의 역할낮은 위험 저장소부터 적용하는 순서먼저 팩트체크할 부분“승인 가능” 평가는 그 자체로 필수 승인 수를 채우지 않습니다. 실제 Approve 리뷰가 병합 요건에 반영되려면 관리자가 승인 기능과 병..

Codex

Codex MCP output_token_limit 설정과 잘림 원리

MCP 도구별 출력 토큰 예산을 조절 밸브로 표현한 AI 생성 대표 이미지Codex MCP output_token_limit은 MCP 서버 전체가 아니라 개별 도구가 모델 대화 기록에 남길 출력 토큰 예산을 정하는 설정입니다. 2026년 9월 2일 기준 Codex 0.152.0에 포함됐으며, 큰 검색 결과나 로그가 세션의 판단 공간을 과도하게 차지하는 일을 도구 단위로 줄일 수 있습니다.근거는 OpenAI Codex 0.152.0 릴리스, 변경 요청 #41421, 병합 커밋 f742dab입니다. 공개 설정 레퍼런스에는 전역 tool_output_token_limit가 보이지만 개별 도구 키는 아직 검색되지 않아, 아래 설명은 릴리스와 구현 변경을 기준으로 구분합니다.이 글의 핵심개별 MCP 도구 출력 제..

AI 트렌드

OpenAI Astra Critical 등급, 출시 전 무엇이 확인됐나?

Astra의 강한 사이버 역량을 여러 보호층 안에 둔 구조를 표현한 AI 생성 이미지OpenAI Astra Critical 등급은 2026년 9월 2일 기준 확정됐지만, Astra 자체는 아직 출시되지 않았습니다. OpenAI는 출시를 “곧”으로만 예고했고 정식 날짜·API 모델 아이디·가격은 공개하지 않았으며, 가장 강한 사이버 기능은 제한된 경로로 먼저 제공합니다.이 글은 OpenAI의 9월 1일 발표와 Preparedness Framework, Daybreak 안내, Hugging Face 사건 보고를 기준으로 확인된 범위만 정리합니다.이 글의 핵심Astra 판정에서 확정된 사실과 미공개 정보Critical 등급을 결정하는 두 가지 조건100%·91.5%·2건이라는 수치의 범위출시 접근 제한과 작업..

LLM

Claude Fable 5.1 마이그레이션: 도구 호출·thinking 변경점

Claude Fable 5.1의 append-only 대화 구조를 표현한 AI 생성 대표 이미지Claude Fable 5.1 마이그레이션은 모델 아이디만 바꾸는 작업으로 끝나지 않습니다. 2026년 9월 2일 기준, 기존 코드가 강제 도구 호출을 쓰거나 과거 대화·도구 목록을 매 요청마다 다시 만들면 400 오류 또는 thinking 블록 무효화가 발생할 수 있으므로 호출 정책과 대화 저장 방식을 함께 점검해야 합니다.Anthropic의 Fable 5.1 발표, 모델 개요, 변경점 문서, 마이그레이션 가이드를 기준으로 실제로 바뀐 API 동작만 정리합니다.이 글의 핵심모델 아이디·가격·제공 범위기존 에이전트 통합이 깨지는 지점강제 도구 호출을 대체하는 방법thinking 블록을 보존하는 대화 구조effo..

AI Agent

Broadcom AgentMinder 출시, AI 에이전트 도구 호출 통제 원리

AI 생성 대표 이미지Broadcom AgentMinder는 2026년 8월 31일 일반 제공을 시작한 기업용 AI 에이전트 거버넌스 제품입니다. 핵심은 모델의 답변을 한 번 검사하는 데서 끝나지 않고, 에이전트가 기업 자원에 닿기 직전 신원·임무·의도·도구·위험 맥락을 확인해 각 도구 호출을 통제하는 것입니다. 다만 가격, 지연 시간, 독립 성능 평가는 아직 공개 자료에서 확인되지 않습니다.2026년 9월 1일 기준으로 Broadcom의 AgentMinder 발표와 보안 제품군 발표, OpenID AuthZEN 1.0 최종 규격, OpenTelemetry 시맨틱 규약을 대조했습니다.이 글의 핵심출시 상태와 제품 범위도구 호출이 통제되는 순서공식 운영 수치의 의미AuthZEN·OpenTelemetry 연..

AI Agent

Muse Code SDK란? MSP·권한 제어 구조와 활용 조건

Muse Code SDK의 로컬 프로토콜 연결 구조를 표현한 GPT Image 생성 대표 이미지Muse Code SDK는 2026년 8월 31일 Meta가 개발자 프리뷰로 공개한 타입스크립트 라이브러리입니다. CLI의 세션·도구·권한 제어 엔진을 애플리케이션에 넣을 수 있지만, 아직 사전 1.0 단계이므로 고정된 호환성을 전제로 프로덕션에 바로 묶기보다 버전 고정과 회귀 검증이 필요합니다.이 글은 Meta의 정식 출시 발표, 공식 SDK 저장소, 실행 가능한 퀵스타트, Muse Code 초기 설계 문서를 기준으로 MSP 구조와 활용 조건을 구분합니다.이 글의 핵심정식 출시된 CLI와 개발자 프리뷰 SDK의 상태 차이앱과 로컬 호스트를 잇는 MSP 통신 구조세션 시작·응답 스트림·권한 결정·재개의 실행 순..

AI Agent

Antigravity /boost란? 멀티에이전트 추론·사용 조건 정리

Antigravity /boost의 심층 추론 구조를 표현한 GPT Image 생성 대표 이미지Antigravity /boost는 복잡한 버그·경쟁 조건·알고리즘 문제를 여러 하위 에이전트가 나눠 조사하고, 테스트와 독립 검증을 반복하는 심층 추론 명령입니다. 2026년 9월 1일 기준 Google 공식 문서에서 유료 플랜용 기능으로 안내되며, 기본 에이전트보다 무거운 문제를 수 초에서 수 시간 안에 다루는 중간 규모 작업에 맞습니다.이 글은 Google Antigravity의 Boost, Slash commands, Teamwork, Plans 공식 문서를 기준으로 작동 구조·사용 조건·Teamwork와의 경계를 정리합니다.이 글의 핵심공식 문서에서 확인되는 지원 범위전략·병렬 실행·통합 검증의 3단계..

AI Agent

VS Code Agent Host란? 세션 지속·멀티윈도우 구조 정리

VS Code Agent Host 구조를 표현한 GPT Image 생성 대표 이미지VS Code Agent Host는 AI 코딩 에이전트의 세션 상태와 실행 수명을 특정 편집기 창에서 분리해 전용 프로세스가 소유하도록 만든 구조입니다. 2026년 9월 1일 기준, 폴더나 시작 창을 닫아도 로컬 VS Code가 계속 실행 중이면 같은 세션을 다른 창이나 Agents window에서 이어 볼 수 있으며, 원격 호스트를 쓰면 작업공간 옆에서 명령과 파일 변경이 실행됩니다.이 글은 GitHub의 2026년 8월 월간 변경점, Microsoft의 8월 26일 아키텍처 설명, 현재 VS Code Agent Host 문서와 Agent Host Protocol 사양을 기준으로 세션 지속·멀티윈도우 동기화·하네스 경계를..

'전체 글' · 221건

AI·에이전트·LLM 실전 연구

AI Agent

Claude Commerce Agents 구조, 단일 에이전트가 유리한 이유

대표 이미지: AI 생성 키 비주얼Claude Commerce Agents 구조의 핵심은 여러 도메인 에이전트가 대화를 넘겨받는 방식이 아니라, 대화 전체를 유지하는 단일 에이전트에 필요한 Skills와 도구를 붙이는 것입니다. 2026년 9월 2일 Anthropic 공식 설계 해설은 쇼핑처럼 의도가 계속 섞이는 업무에서 이 구성이 품질을 높이고 전달 비용을 줄였다고 설명합니다.다만 멀티에이전트가 항상 불리하다는 뜻은 아닙니다. 깊은 조사처럼 독립된 문맥이 필요한 일이나 별도 규제 경계를 가진 전문 에이전트에는 위임·핸드오프가 여전히 적합합니다.이 글은 같은 날 공개된 공식 발표, 엔지니어링 해설, Apache 2.0 참조 저장소를 기준으로 구조와 운영 조건을 구분합니다.이 글의 핵심쇼핑·판매자 에이전트..

LLM

Muse Spark 1.3 성능·가격, 코딩 1위로 봐도 될까?

대표 이미지: AI 생성 키 비주얼Muse Spark 1.3이 모든 코딩 평가에서 1위라고 보기는 어렵습니다. 2026년 9월 2일 Meta 공식 발표 기준으로 일부 장기 코딩·코드 이해 평가에서는 앞섰지만, 웹 조사와 전문 업무 평가에서는 비교 모델이 더 높았고 최고 추론 설정은 아직 제공 전입니다.가격은 OpenRouter의 Meta 제공 페이지에 표준형 입력 100만 토큰당 1.25달러, 출력 4.25달러로 표시됩니다. 다만 Meta 개발자 문서의 모델 목록은 확인 시점에 1.2까지만 반영돼 있어 실제 계정의 모델 목록과 데이터 조건을 함께 확인해야 합니다.이 글은 Meta의 출시 공지와 평가 방법론, DeepSWE 공개 리더보드, OpenRouter 제공 정보를 교차해 성능표가 말하는 범위와 말하..

AI Agent

GitHub Copilot PR 승인, 사람 리뷰를 대체할 수 있을까?

대표 이미지: AI 생성 키 비주얼GitHub Copilot PR 승인은 사람 리뷰를 전면 대체하는 기능이 아닙니다. 2026년 9월 1일 공개 프리뷰 기준, 승인 평가는 모든 Copilot 코드 리뷰에 표시되지만 실제 승인 권한은 기본적으로 꺼져 있습니다.GitHub 공식 출시 공지와 코드 리뷰·보호 브랜치 문서를 기준으로, 평가와 병합 요건의 차이 및 안전한 적용 범위를 정리합니다.이 글의 핵심승인 평가와 실제 승인의 차이관리 계층과 파일 경로별 통제새 커밋 뒤 승인 무효화자동 검토·지속 검사·사람 리뷰의 역할낮은 위험 저장소부터 적용하는 순서먼저 팩트체크할 부분“승인 가능” 평가는 그 자체로 필수 승인 수를 채우지 않습니다. 실제 Approve 리뷰가 병합 요건에 반영되려면 관리자가 승인 기능과 병..

Codex

Codex MCP output_token_limit 설정과 잘림 원리

MCP 도구별 출력 토큰 예산을 조절 밸브로 표현한 AI 생성 대표 이미지Codex MCP output_token_limit은 MCP 서버 전체가 아니라 개별 도구가 모델 대화 기록에 남길 출력 토큰 예산을 정하는 설정입니다. 2026년 9월 2일 기준 Codex 0.152.0에 포함됐으며, 큰 검색 결과나 로그가 세션의 판단 공간을 과도하게 차지하는 일을 도구 단위로 줄일 수 있습니다.근거는 OpenAI Codex 0.152.0 릴리스, 변경 요청 #41421, 병합 커밋 f742dab입니다. 공개 설정 레퍼런스에는 전역 tool_output_token_limit가 보이지만 개별 도구 키는 아직 검색되지 않아, 아래 설명은 릴리스와 구현 변경을 기준으로 구분합니다.이 글의 핵심개별 MCP 도구 출력 제..

AI 트렌드

OpenAI Astra Critical 등급, 출시 전 무엇이 확인됐나?

Astra의 강한 사이버 역량을 여러 보호층 안에 둔 구조를 표현한 AI 생성 이미지OpenAI Astra Critical 등급은 2026년 9월 2일 기준 확정됐지만, Astra 자체는 아직 출시되지 않았습니다. OpenAI는 출시를 “곧”으로만 예고했고 정식 날짜·API 모델 아이디·가격은 공개하지 않았으며, 가장 강한 사이버 기능은 제한된 경로로 먼저 제공합니다.이 글은 OpenAI의 9월 1일 발표와 Preparedness Framework, Daybreak 안내, Hugging Face 사건 보고를 기준으로 확인된 범위만 정리합니다.이 글의 핵심Astra 판정에서 확정된 사실과 미공개 정보Critical 등급을 결정하는 두 가지 조건100%·91.5%·2건이라는 수치의 범위출시 접근 제한과 작업..

LLM

Claude Fable 5.1 마이그레이션: 도구 호출·thinking 변경점

Claude Fable 5.1의 append-only 대화 구조를 표현한 AI 생성 대표 이미지Claude Fable 5.1 마이그레이션은 모델 아이디만 바꾸는 작업으로 끝나지 않습니다. 2026년 9월 2일 기준, 기존 코드가 강제 도구 호출을 쓰거나 과거 대화·도구 목록을 매 요청마다 다시 만들면 400 오류 또는 thinking 블록 무효화가 발생할 수 있으므로 호출 정책과 대화 저장 방식을 함께 점검해야 합니다.Anthropic의 Fable 5.1 발표, 모델 개요, 변경점 문서, 마이그레이션 가이드를 기준으로 실제로 바뀐 API 동작만 정리합니다.이 글의 핵심모델 아이디·가격·제공 범위기존 에이전트 통합이 깨지는 지점강제 도구 호출을 대체하는 방법thinking 블록을 보존하는 대화 구조effo..

AI Agent

Broadcom AgentMinder 출시, AI 에이전트 도구 호출 통제 원리

AI 생성 대표 이미지Broadcom AgentMinder는 2026년 8월 31일 일반 제공을 시작한 기업용 AI 에이전트 거버넌스 제품입니다. 핵심은 모델의 답변을 한 번 검사하는 데서 끝나지 않고, 에이전트가 기업 자원에 닿기 직전 신원·임무·의도·도구·위험 맥락을 확인해 각 도구 호출을 통제하는 것입니다. 다만 가격, 지연 시간, 독립 성능 평가는 아직 공개 자료에서 확인되지 않습니다.2026년 9월 1일 기준으로 Broadcom의 AgentMinder 발표와 보안 제품군 발표, OpenID AuthZEN 1.0 최종 규격, OpenTelemetry 시맨틱 규약을 대조했습니다.이 글의 핵심출시 상태와 제품 범위도구 호출이 통제되는 순서공식 운영 수치의 의미AuthZEN·OpenTelemetry 연..

AI Agent

Muse Code SDK란? MSP·권한 제어 구조와 활용 조건

Muse Code SDK의 로컬 프로토콜 연결 구조를 표현한 GPT Image 생성 대표 이미지Muse Code SDK는 2026년 8월 31일 Meta가 개발자 프리뷰로 공개한 타입스크립트 라이브러리입니다. CLI의 세션·도구·권한 제어 엔진을 애플리케이션에 넣을 수 있지만, 아직 사전 1.0 단계이므로 고정된 호환성을 전제로 프로덕션에 바로 묶기보다 버전 고정과 회귀 검증이 필요합니다.이 글은 Meta의 정식 출시 발표, 공식 SDK 저장소, 실행 가능한 퀵스타트, Muse Code 초기 설계 문서를 기준으로 MSP 구조와 활용 조건을 구분합니다.이 글의 핵심정식 출시된 CLI와 개발자 프리뷰 SDK의 상태 차이앱과 로컬 호스트를 잇는 MSP 통신 구조세션 시작·응답 스트림·권한 결정·재개의 실행 순..

AI Agent

Antigravity /boost란? 멀티에이전트 추론·사용 조건 정리

Antigravity /boost의 심층 추론 구조를 표현한 GPT Image 생성 대표 이미지Antigravity /boost는 복잡한 버그·경쟁 조건·알고리즘 문제를 여러 하위 에이전트가 나눠 조사하고, 테스트와 독립 검증을 반복하는 심층 추론 명령입니다. 2026년 9월 1일 기준 Google 공식 문서에서 유료 플랜용 기능으로 안내되며, 기본 에이전트보다 무거운 문제를 수 초에서 수 시간 안에 다루는 중간 규모 작업에 맞습니다.이 글은 Google Antigravity의 Boost, Slash commands, Teamwork, Plans 공식 문서를 기준으로 작동 구조·사용 조건·Teamwork와의 경계를 정리합니다.이 글의 핵심공식 문서에서 확인되는 지원 범위전략·병렬 실행·통합 검증의 3단계..

AI Agent

VS Code Agent Host란? 세션 지속·멀티윈도우 구조 정리

VS Code Agent Host 구조를 표현한 GPT Image 생성 대표 이미지VS Code Agent Host는 AI 코딩 에이전트의 세션 상태와 실행 수명을 특정 편집기 창에서 분리해 전용 프로세스가 소유하도록 만든 구조입니다. 2026년 9월 1일 기준, 폴더나 시작 창을 닫아도 로컬 VS Code가 계속 실행 중이면 같은 세션을 다른 창이나 Agents window에서 이어 볼 수 있으며, 원격 호스트를 쓰면 작업공간 옆에서 명령과 파일 변경이 실행됩니다.이 글은 GitHub의 2026년 8월 월간 변경점, Microsoft의 8월 26일 아키텍처 설명, 현재 VS Code Agent Host 문서와 Agent Host Protocol 사양을 기준으로 세션 지속·멀티윈도우 동기화·하네스 경계를..

반응형