Design · Development · Thoughts

안녕하세요,
Practical AI Lab 입니다.

AI·에이전트·LLM 실전 연구

반응형
AI Agent

MCP Elicitation 작동 원리: 입력 요청과 URL 승인 차이

MCP Elicitation은 에이전트 작업 도중 서버가 클라이언트를 통해 사용자에게 추가 입력을 요청하는 기능입니다. 폼 모드는 일반 정보를 클라이언트 안에서 전달하고, URL 모드는 비밀정보 입력이나 외부 서비스 승인을 별도 웹 흐름으로 분리합니다. 2026년 9월 13일 확인한 MCP 2025-11-25 규격을 기준으로, 두 모드의 요청·응답과 자동화 재개 조건을 설명합니다.이 글은 새 출시 소식이나 특정 앱의 지원 안내가 아닌 프로토콜 분석입니다. 근거는 공식 Elicitation·Tools·Security Best Practices 문서이며, 구현 권고는 규격상 의무와 구분합니다.이 글의 핵심Elicitation이 도구 호출 중 맡는 역할모드 지원 선언과 요청 메시지의 구성URL 동의 이후 완료..

AI Agent

Cursor Projects 출시, 코디네이터·공유 문맥·사용 조건

Cursor Projects는 기능 개발·마이그레이션처럼 여러 작업으로 이어지는 목표를 코디네이터에게 맡기는 베타 기능입니다. 2026년 9월 13일 기준, 공식 발표는 9월 10일부터 전체 사용자 대상으로 순차 제공한다고 밝히지만, 기반이 되는 Cloud Agents 문서는 유료 플랜과 사용량 과금을 요구합니다.이 글은 Cursor의 「Introducing Projects」와 공식 변경 이력·Cloud Agents 문서를 바탕으로 역할 분담, 공유 문맥, 발표 수치와 사용 조건을 구분합니다.이 글의 핵심출시일과 베타 제공 범위코디네이터·실행 에이전트의 역할PR 증가 수치의 해석 조건공유 문맥과 반복 작업의 변화도입 전 계정·환경·비용 점검먼저 팩트체크할 부분‘수천 에이전트’는 출시 글의 기능 설명이며 ..

Claude Code

Claude Code 비용 제한 설정: 예산·턴·시간 제어법

Claude Code 비용 제한은 비대화형 -p 실행에 --max-budget-usd와 --max-turns를 함께 지정하고, 실행 시간은 호출하는 스크립트에서 별도로 제한하는 방식으로 구성합니다. 2026년 9월 12일 확인 결과, 달러 예산은 청구액이 한도를 절대로 넘지 않는 선결제 차단 장치가 아닙니다. 아래에서는 작은 읽기 전용 실험으로 정상 종료와 예산 초과를 확인하고, 실패 시 후속 작업을 막는 예제를 제공합니다.기준 자료는 Anthropic의 CLI reference, Run Claude Code programmatically, Manage costs effectively이며, 실험 환경은 Linux의 Claude Code 2.1.265입니다. 최신 발표 소개가 아니라 현재 문서와 로컬 실행..

AI 트렌드

Fugu Max·Ultra v2 출시, 가격·성능·선택 조건 정리

Fugu Max·Ultra v2는 Sakana AI가 여러 모델을 조율해 하나의 API로 제공하는 에이전트 서비스입니다. 2026년 9월 12일 기준, Max는 비용 대비 성능을, Ultra v2는 어려운 작업의 답변 품질을 우선합니다.Sakana Fugu 공식 제품 페이지와 기술 보고서를 대조했습니다. 논문은 구조 설명, 제품 페이지는 최신 가격·성능의 근거로 사용합니다.이 글의 핵심Max와 Ultra v2가 새로 제공하는 선택지학습된 조율기와 고정 모델 풀의 작동 방식문맥 길이에 따른 가격과 벤치마크 해석기존 에이전트에 연결할 때 달라지는 운영 책임도입 시험과 데이터 정책 확인 항목먼저 팩트체크할 부분공식 페이지의 성능 수치는 공급사가 보고한 결과입니다. 이를 독립 검증이나 모든 업무의 우위로 표현하..

Claude Code

Claude Code 되돌리기 범위: 체크포인트와 Git 차이

Claude Code 되돌리기는 파일 편집 도구가 추적한 변경과 대화를 선택적으로 복원하는 기능입니다. Bash로 바꾼 파일이나 외부 서비스 작업까지 모두 취소하는 기능은 아니므로, Git에 저장된 버전과 복구 범위를 나눠 봐야 합니다. 2026년 9월 11일 기준 Claude Code 공식 Checkpointing 문서와 Git restore 문서를 바탕으로 경계를 설명합니다.이 글의 핵심프롬프트별 체크포인트가 기록하는 대상대화와 코드 복원 선택에 따른 차이같은 파일이라도 수정 도구에 따라 달라지는 복구 범위Git 복원 기준과 체크포인트 보관 한계복구 전후 확인할 파일·테스트·외부 작업 기록공식 설명: Claude Code Checkpointing. 이 글은 신규 출시 속보가 아닌 기존 기능의 기술 해..

AI Agent

OpenAI Agents API 출시, 기능·비용·도입 조건 정리

OpenAI Agents API는 Codex의 에이전트 실행 하네스를 애플리케이션에서 이용하는 관리형 API입니다. 2026년 9월 11일 기준, 전날 공개 베타가 시작됐으며 API 자체의 추가 이용료 대신 모델·도구·실행 환경의 사용 요금을 확인해야 합니다. OpenAI가 작업 흐름을 운영하더라도 데이터 보관 조건과 외부 도구의 접근 권한까지 자동으로 해결되는 것은 아닙니다.이 글은 OpenAI의 Introducing the Agents API와 개발자 문서를 바탕으로 출시 범위, 과금 항목, 도입 전 조건을 정리합니다. 실제 API를 호출해 성능을 측정한 후기가 아니라 공식 발표·문서에 대한 해설입니다.이 글의 핵심공개 베타로 제공되는 제품의 정확한 범위하네스와 샌드박스가 나눠 맡는 기능비용 항목과 ..

Claude Code

Claude Code 알림 훅 설정: 승인 대기·작업 완료 확인법

Claude Code 알림 훅 설정은 Notification으로 승인 대기와 입력 대기를 알리고, Stop으로 응답 종료를 알리도록 나누면 됩니다. 2026년 9월 10일 기준 공식 Hooks 가이드·레퍼런스를 바탕으로 Linux 설정 방법과 실제 명령 확인 결과를 설명합니다. 다만 응답 종료 알림은 테스트 통과나 작업의 정확성을 보증하지 않습니다.이 글의 핵심알림 목적에 맞는 이벤트와 대기 시간 선택Linux 데스크톱에서 확인할 실행 환경기존 설정을 보존하면서 훅 추가하기알림 명령과 Claude 이벤트를 나누어 검증하기중복 알림·SSH 환경의 문제 해결공식 문서: Automate actions with hooks · Hooks reference목차Claude Code 알림 훅은 어떤 이벤트를 골라야 할..

AI Agent

Muse AI 에이전트 보안, Sentinel 승인 구조와 한계

Muse AI 에이전트 보안의 핵심은 작업을 수행하는 모델과 실행을 허가하는 Sentinel을 분리하는 데 있습니다. 2026년 9월 10일 기준 Meta의 출시 기술 문서에 따르면, 에이전트는 실제 인증 토큰 대신 대체 토큰을 사용하며 외부 요청은 별도 권한 검사를 거칩니다. 다만 이 구조가 프롬프트 인젝션을 완전히 해결하거나 Meta의 운영상 데이터 접근까지 차단한다는 뜻은 아닙니다.이 글은 9월 8일 공개된 How We Built Safety Into Muse와 제품 설계 글 How We Designed Muse를 바탕으로 승인 경계가 어디에 놓이는지 분석합니다. 아래 동작 설명은 공식 설계에 대한 해설이며, Muse 계정을 연결해 보안을 실험한 후기는 아닙니다.이 글의 핵심실행 영역과 보안 서비스..

Claude Code

Claude Code JSON 출력 방법: 스키마 검증·자동화 가이드

Claude Code JSON 출력 방법은 --output-format json으로 실행 결과를 받고, 고정된 필드가 필요하면 --json-schema를 함께 지정하는 것입니다. 2026년 9월 9일 기준 공식 문서에서 스키마 데이터는 structured_output 필드로 제공되며, 이 글에서는 설치된 Claude Code 2.1.265로 두 방식을 직접 실행하고 저장 전 검증까지 확인합니다.출처는 Claude Code 프로그램 방식 실행 가이드와 CLI·Agent SDK 공식 문서입니다. 신규 출시 소식은 아닙니다.이 글의 핵심1장에서 실행 결과 JSON과 스키마 데이터의 역할을 구분합니다.3장에서 스키마 작성과 재현 명령을 확인합니다.4장에서 저장 전 검증 스크립트를 실행합니다.5장에서 자동화에 넣..

LLM

MiniCPM5-2B 공개, 로컬 에이전트 성능과 제약 정리

MiniCPM5-2B 공개로 로컬 에이전트에 사용할 수 있는 소형 언어 모델의 선택지가 늘었습니다. 2026년 9월 9일 기준 OpenBMB는 가중치와 배포 문서를 공개했으며, 자체 비교표에서 평균 53.9를 제시합니다. 다만 이 점수는 실제 업무 성공률이 아니며, 한국어 도구 호출과 장기 작업의 안정성은 별도 검증이 필요합니다.이 글은 OpenBMB의 9월 7일 변경 이력, Hugging Face 모델 카드와 설정 파일을 바탕으로 공개 범위·성능 수치·로컬 에이전트 적용 조건을 살펴봅니다. 직접 모델을 추론하거나 벤치마크를 재현한 사용기는 아닙니다.이 글의 핵심공개 날짜와 최종 모델·중간 체크포인트의 구분파라미터·문맥 길이·라이선스의 정확한 의미벤치마크 평균과 개별 코딩 작업 점수를 읽는 방법학습 과정..

'전체 글' · 236건

AI·에이전트·LLM 실전 연구

AI Agent

MCP Elicitation 작동 원리: 입력 요청과 URL 승인 차이

MCP Elicitation은 에이전트 작업 도중 서버가 클라이언트를 통해 사용자에게 추가 입력을 요청하는 기능입니다. 폼 모드는 일반 정보를 클라이언트 안에서 전달하고, URL 모드는 비밀정보 입력이나 외부 서비스 승인을 별도 웹 흐름으로 분리합니다. 2026년 9월 13일 확인한 MCP 2025-11-25 규격을 기준으로, 두 모드의 요청·응답과 자동화 재개 조건을 설명합니다.이 글은 새 출시 소식이나 특정 앱의 지원 안내가 아닌 프로토콜 분석입니다. 근거는 공식 Elicitation·Tools·Security Best Practices 문서이며, 구현 권고는 규격상 의무와 구분합니다.이 글의 핵심Elicitation이 도구 호출 중 맡는 역할모드 지원 선언과 요청 메시지의 구성URL 동의 이후 완료..

AI Agent

Cursor Projects 출시, 코디네이터·공유 문맥·사용 조건

Cursor Projects는 기능 개발·마이그레이션처럼 여러 작업으로 이어지는 목표를 코디네이터에게 맡기는 베타 기능입니다. 2026년 9월 13일 기준, 공식 발표는 9월 10일부터 전체 사용자 대상으로 순차 제공한다고 밝히지만, 기반이 되는 Cloud Agents 문서는 유료 플랜과 사용량 과금을 요구합니다.이 글은 Cursor의 「Introducing Projects」와 공식 변경 이력·Cloud Agents 문서를 바탕으로 역할 분담, 공유 문맥, 발표 수치와 사용 조건을 구분합니다.이 글의 핵심출시일과 베타 제공 범위코디네이터·실행 에이전트의 역할PR 증가 수치의 해석 조건공유 문맥과 반복 작업의 변화도입 전 계정·환경·비용 점검먼저 팩트체크할 부분‘수천 에이전트’는 출시 글의 기능 설명이며 ..

Claude Code

Claude Code 비용 제한 설정: 예산·턴·시간 제어법

Claude Code 비용 제한은 비대화형 -p 실행에 --max-budget-usd와 --max-turns를 함께 지정하고, 실행 시간은 호출하는 스크립트에서 별도로 제한하는 방식으로 구성합니다. 2026년 9월 12일 확인 결과, 달러 예산은 청구액이 한도를 절대로 넘지 않는 선결제 차단 장치가 아닙니다. 아래에서는 작은 읽기 전용 실험으로 정상 종료와 예산 초과를 확인하고, 실패 시 후속 작업을 막는 예제를 제공합니다.기준 자료는 Anthropic의 CLI reference, Run Claude Code programmatically, Manage costs effectively이며, 실험 환경은 Linux의 Claude Code 2.1.265입니다. 최신 발표 소개가 아니라 현재 문서와 로컬 실행..

AI 트렌드

Fugu Max·Ultra v2 출시, 가격·성능·선택 조건 정리

Fugu Max·Ultra v2는 Sakana AI가 여러 모델을 조율해 하나의 API로 제공하는 에이전트 서비스입니다. 2026년 9월 12일 기준, Max는 비용 대비 성능을, Ultra v2는 어려운 작업의 답변 품질을 우선합니다.Sakana Fugu 공식 제품 페이지와 기술 보고서를 대조했습니다. 논문은 구조 설명, 제품 페이지는 최신 가격·성능의 근거로 사용합니다.이 글의 핵심Max와 Ultra v2가 새로 제공하는 선택지학습된 조율기와 고정 모델 풀의 작동 방식문맥 길이에 따른 가격과 벤치마크 해석기존 에이전트에 연결할 때 달라지는 운영 책임도입 시험과 데이터 정책 확인 항목먼저 팩트체크할 부분공식 페이지의 성능 수치는 공급사가 보고한 결과입니다. 이를 독립 검증이나 모든 업무의 우위로 표현하..

Claude Code

Claude Code 되돌리기 범위: 체크포인트와 Git 차이

Claude Code 되돌리기는 파일 편집 도구가 추적한 변경과 대화를 선택적으로 복원하는 기능입니다. Bash로 바꾼 파일이나 외부 서비스 작업까지 모두 취소하는 기능은 아니므로, Git에 저장된 버전과 복구 범위를 나눠 봐야 합니다. 2026년 9월 11일 기준 Claude Code 공식 Checkpointing 문서와 Git restore 문서를 바탕으로 경계를 설명합니다.이 글의 핵심프롬프트별 체크포인트가 기록하는 대상대화와 코드 복원 선택에 따른 차이같은 파일이라도 수정 도구에 따라 달라지는 복구 범위Git 복원 기준과 체크포인트 보관 한계복구 전후 확인할 파일·테스트·외부 작업 기록공식 설명: Claude Code Checkpointing. 이 글은 신규 출시 속보가 아닌 기존 기능의 기술 해..

AI Agent

OpenAI Agents API 출시, 기능·비용·도입 조건 정리

OpenAI Agents API는 Codex의 에이전트 실행 하네스를 애플리케이션에서 이용하는 관리형 API입니다. 2026년 9월 11일 기준, 전날 공개 베타가 시작됐으며 API 자체의 추가 이용료 대신 모델·도구·실행 환경의 사용 요금을 확인해야 합니다. OpenAI가 작업 흐름을 운영하더라도 데이터 보관 조건과 외부 도구의 접근 권한까지 자동으로 해결되는 것은 아닙니다.이 글은 OpenAI의 Introducing the Agents API와 개발자 문서를 바탕으로 출시 범위, 과금 항목, 도입 전 조건을 정리합니다. 실제 API를 호출해 성능을 측정한 후기가 아니라 공식 발표·문서에 대한 해설입니다.이 글의 핵심공개 베타로 제공되는 제품의 정확한 범위하네스와 샌드박스가 나눠 맡는 기능비용 항목과 ..

Claude Code

Claude Code 알림 훅 설정: 승인 대기·작업 완료 확인법

Claude Code 알림 훅 설정은 Notification으로 승인 대기와 입력 대기를 알리고, Stop으로 응답 종료를 알리도록 나누면 됩니다. 2026년 9월 10일 기준 공식 Hooks 가이드·레퍼런스를 바탕으로 Linux 설정 방법과 실제 명령 확인 결과를 설명합니다. 다만 응답 종료 알림은 테스트 통과나 작업의 정확성을 보증하지 않습니다.이 글의 핵심알림 목적에 맞는 이벤트와 대기 시간 선택Linux 데스크톱에서 확인할 실행 환경기존 설정을 보존하면서 훅 추가하기알림 명령과 Claude 이벤트를 나누어 검증하기중복 알림·SSH 환경의 문제 해결공식 문서: Automate actions with hooks · Hooks reference목차Claude Code 알림 훅은 어떤 이벤트를 골라야 할..

AI Agent

Muse AI 에이전트 보안, Sentinel 승인 구조와 한계

Muse AI 에이전트 보안의 핵심은 작업을 수행하는 모델과 실행을 허가하는 Sentinel을 분리하는 데 있습니다. 2026년 9월 10일 기준 Meta의 출시 기술 문서에 따르면, 에이전트는 실제 인증 토큰 대신 대체 토큰을 사용하며 외부 요청은 별도 권한 검사를 거칩니다. 다만 이 구조가 프롬프트 인젝션을 완전히 해결하거나 Meta의 운영상 데이터 접근까지 차단한다는 뜻은 아닙니다.이 글은 9월 8일 공개된 How We Built Safety Into Muse와 제품 설계 글 How We Designed Muse를 바탕으로 승인 경계가 어디에 놓이는지 분석합니다. 아래 동작 설명은 공식 설계에 대한 해설이며, Muse 계정을 연결해 보안을 실험한 후기는 아닙니다.이 글의 핵심실행 영역과 보안 서비스..

Claude Code

Claude Code JSON 출력 방법: 스키마 검증·자동화 가이드

Claude Code JSON 출력 방법은 --output-format json으로 실행 결과를 받고, 고정된 필드가 필요하면 --json-schema를 함께 지정하는 것입니다. 2026년 9월 9일 기준 공식 문서에서 스키마 데이터는 structured_output 필드로 제공되며, 이 글에서는 설치된 Claude Code 2.1.265로 두 방식을 직접 실행하고 저장 전 검증까지 확인합니다.출처는 Claude Code 프로그램 방식 실행 가이드와 CLI·Agent SDK 공식 문서입니다. 신규 출시 소식은 아닙니다.이 글의 핵심1장에서 실행 결과 JSON과 스키마 데이터의 역할을 구분합니다.3장에서 스키마 작성과 재현 명령을 확인합니다.4장에서 저장 전 검증 스크립트를 실행합니다.5장에서 자동화에 넣..

LLM

MiniCPM5-2B 공개, 로컬 에이전트 성능과 제약 정리

MiniCPM5-2B 공개로 로컬 에이전트에 사용할 수 있는 소형 언어 모델의 선택지가 늘었습니다. 2026년 9월 9일 기준 OpenBMB는 가중치와 배포 문서를 공개했으며, 자체 비교표에서 평균 53.9를 제시합니다. 다만 이 점수는 실제 업무 성공률이 아니며, 한국어 도구 호출과 장기 작업의 안정성은 별도 검증이 필요합니다.이 글은 OpenBMB의 9월 7일 변경 이력, Hugging Face 모델 카드와 설정 파일을 바탕으로 공개 범위·성능 수치·로컬 에이전트 적용 조건을 살펴봅니다. 직접 모델을 추론하거나 벤치마크를 재현한 사용기는 아닙니다.이 글의 핵심공개 날짜와 최종 모델·중간 체크포인트의 구분파라미터·문맥 길이·라이선스의 정확한 의미벤치마크 평균과 개별 코딩 작업 점수를 읽는 방법학습 과정..

반응형