Design · Development · Thoughts

안녕하세요,
Practical AI Lab 입니다.

AI·에이전트·LLM 실전 연구

반응형
AI 트렌드

GPT-Live-1 API 가격·기능, 음성 에이전트 도입 조건

GPT-Live-1 API 가격은 2026년 9월 17일 공식 모델 문서 기준 음성 세션 분당 0.05달러이며, 초 단위로 과금됩니다. 동시에 듣고 말하는 음성 에이전트를 만들 수 있지만, 추론을 맡는 백엔드 모델과 도구 사용료는 별도입니다. 이 글은 현재 제공 기능과 전체 비용을 계산하는 방법, 도입 전에 확인할 조건을 다룹니다.이 글의 핵심API 제공 범위와 입력·출력 제한음성 모델·백엔드·앱이 나누는 책임세션 요금 계산과 동시 접속 한도기존 에이전트를 연결하는 두 가지 선택지대화·업무·중단·비용을 나눈 도입 점검먼저 팩트체크할 부분발표에서 말하는 자연스러운 대화와 업무 처리 성능은 같은 평가 항목이 아닙니다. 아래에서는 지원 기능, 계산 예시, 작성자의 운영 권고를 구분합니다.공식 원문: GPT-L..

ML & DL

Recurrent Looped Transformer란? RLT 구조·실행 결과

Recurrent Looped Transformer(RLT)는 토큰이 바뀔 때마다 디코더의 마지막 은닉 상태와 슬라이딩 윈도우 KV 캐시를 다음 토큰으로 넘기는 새 트랜스포머 구조입니다. 2026년 9월 16일 기준 공식 기술 보고서는 초기 실험 결과까지 공개했으며, 비공식 PyTorch 구현은 CPU에서도 기본 경로의 순전파·역전파·생성이 작동했습니다. 다만 기존 Transformer를 대체한다고 결론 내리기에는 실험 규모와 구현 성숙도가 아직 부족합니다.이 글은 9월 12일 공개되고 9월 15일 개정된 RLT 기술 보고서[2], 공식 프로젝트 저장소[3], RLT-pytorch 구현[4]을 기준으로 작성했습니다.이 글의 핵심RLT가 고정 깊이 Transformer와 달라지는 지점인과적 인코더·전역 메..

LLM

DeepSeek V4 Pro 종료 철회, 유지 요금·Flash 차이

DeepSeek V4 Pro 종료 철회 여부를 확인하면, 2026년 9월 15일 기준 공식 안내는 9월 14일 이후에도 V4 Pro API를 제공하며 기존 과금 방식을 유지한다는 내용입니다. 따라서 Pro 요청이 모두 Flash로 바뀌고 Flash 요금이 적용된다는 이전 안내를 현재 정책으로 받아들이면 안 됩니다.이 글은 DeepSeek의 Your First API Call과 Models & Pricing 원문을 직접 확인해 서비스 유지 범위와 요금 차이를 정리합니다.이 글의 핵심9월 14일 이후 적용되는 공식 공지의 범위Pro와 구형 Flash 요청 이름의 차이캐시·시간대별 API 가격 읽는 법모델 변경 여부와 에이전트 품질의 관계운영 설정과 청구 내역 점검 순서먼저 팩트체크할 부분검색 결과나 웹 추출..

Claude Code

Claude Code 읽기 전용 설정: 도구 제한·검증 방법

Claude Code 읽기 전용 설정은 --tools Read로 내장 도구를 제한하고, 외부 MCP와 훅을 별도로 통제하는 방식으로 시작할 수 있습니다. 2026년 9월 14일 기준, --allowedTools Read만 지정해서는 다른 도구를 제외할 수 없습니다. 이 글은 공식 Permissions·CLI reference·Settings 문서와 로컬 CLI 실험을 바탕으로 설정 방법과 검증 범위를 설명합니다.이 글의 핵심검토용 세션에 필요한 준비물과 샘플 파일내장 도구·MCP·훅을 분리해서 제한하는 명령읽기 요청과 수정 요청을 나눈 실행 검증자동화에서 확인할 오류와 결과 상태Plan 모드·권한 규칙·OS 격리의 선택 기준공식 기준: Claude Code CLI reference와 Configure p..

AI Agent

Claude Smart reports 비용·권한·분석 범위 정리

Claude Smart reports는 팀의 Claude 대화 표본을 분석해 업무별 비용과 작업이 막히는 원인을 정리하는 Enterprise 베타 기능입니다. 2026년 9월 14일 기준 조직당 월 10회까지 추가 비용 없이 보고서를 만들 수 있으며, 활성화에는 Owner 또는 Primary Owner 권한이 필요합니다. 이 글은 분석 범위, 비용 조건, 관리자 권한과 개인정보 설정을 구분해 설명합니다.공식 발표일은 2026년 9월 10일입니다. Claude Help Center의 Release notes와 Get started with smart reports를 기준으로 정리했으며, 실제 Enterprise 관리자 화면을 사용한 체험기는 아닙니다.이 글의 핵심출시된 기능과 과장해서 읽기 쉬운 표현보고서..

AI Agent

MCP Elicitation 작동 원리: 입력 요청과 URL 승인 차이

MCP Elicitation은 에이전트 작업 도중 서버가 클라이언트를 통해 사용자에게 추가 입력을 요청하는 기능입니다. 폼 모드는 일반 정보를 클라이언트 안에서 전달하고, URL 모드는 비밀정보 입력이나 외부 서비스 승인을 별도 웹 흐름으로 분리합니다. 2026년 9월 13일 확인한 MCP 2025-11-25 규격을 기준으로, 두 모드의 요청·응답과 자동화 재개 조건을 설명합니다.이 글은 새 출시 소식이나 특정 앱의 지원 안내가 아닌 프로토콜 분석입니다. 근거는 공식 Elicitation·Tools·Security Best Practices 문서이며, 구현 권고는 규격상 의무와 구분합니다.이 글의 핵심Elicitation이 도구 호출 중 맡는 역할모드 지원 선언과 요청 메시지의 구성URL 동의 이후 완료..

AI Agent

Cursor Projects 출시, 코디네이터·공유 문맥·사용 조건

Cursor Projects는 기능 개발·마이그레이션처럼 여러 작업으로 이어지는 목표를 코디네이터에게 맡기는 베타 기능입니다. 2026년 9월 13일 기준, 공식 발표는 9월 10일부터 전체 사용자 대상으로 순차 제공한다고 밝히지만, 기반이 되는 Cloud Agents 문서는 유료 플랜과 사용량 과금을 요구합니다.이 글은 Cursor의 「Introducing Projects」와 공식 변경 이력·Cloud Agents 문서를 바탕으로 역할 분담, 공유 문맥, 발표 수치와 사용 조건을 구분합니다.이 글의 핵심출시일과 베타 제공 범위코디네이터·실행 에이전트의 역할PR 증가 수치의 해석 조건공유 문맥과 반복 작업의 변화도입 전 계정·환경·비용 점검먼저 팩트체크할 부분‘수천 에이전트’는 출시 글의 기능 설명이며 ..

Claude Code

Claude Code 비용 제한 설정: 예산·턴·시간 제어법

Claude Code 비용 제한은 비대화형 -p 실행에 --max-budget-usd와 --max-turns를 함께 지정하고, 실행 시간은 호출하는 스크립트에서 별도로 제한하는 방식으로 구성합니다. 2026년 9월 12일 확인 결과, 달러 예산은 청구액이 한도를 절대로 넘지 않는 선결제 차단 장치가 아닙니다. 아래에서는 작은 읽기 전용 실험으로 정상 종료와 예산 초과를 확인하고, 실패 시 후속 작업을 막는 예제를 제공합니다.기준 자료는 Anthropic의 CLI reference, Run Claude Code programmatically, Manage costs effectively이며, 실험 환경은 Linux의 Claude Code 2.1.265입니다. 최신 발표 소개가 아니라 현재 문서와 로컬 실행..

AI 트렌드

Fugu Max·Ultra v2 출시, 가격·성능·선택 조건 정리

Fugu Max·Ultra v2는 Sakana AI가 여러 모델을 조율해 하나의 API로 제공하는 에이전트 서비스입니다. 2026년 9월 12일 기준, Max는 비용 대비 성능을, Ultra v2는 어려운 작업의 답변 품질을 우선합니다.Sakana Fugu 공식 제품 페이지와 기술 보고서를 대조했습니다. 논문은 구조 설명, 제품 페이지는 최신 가격·성능의 근거로 사용합니다.이 글의 핵심Max와 Ultra v2가 새로 제공하는 선택지학습된 조율기와 고정 모델 풀의 작동 방식문맥 길이에 따른 가격과 벤치마크 해석기존 에이전트에 연결할 때 달라지는 운영 책임도입 시험과 데이터 정책 확인 항목먼저 팩트체크할 부분공식 페이지의 성능 수치는 공급사가 보고한 결과입니다. 이를 독립 검증이나 모든 업무의 우위로 표현하..

Claude Code

Claude Code 되돌리기 범위: 체크포인트와 Git 차이

Claude Code 되돌리기는 파일 편집 도구가 추적한 변경과 대화를 선택적으로 복원하는 기능입니다. Bash로 바꾼 파일이나 외부 서비스 작업까지 모두 취소하는 기능은 아니므로, Git에 저장된 버전과 복구 범위를 나눠 봐야 합니다. 2026년 9월 11일 기준 Claude Code 공식 Checkpointing 문서와 Git restore 문서를 바탕으로 경계를 설명합니다.이 글의 핵심프롬프트별 체크포인트가 기록하는 대상대화와 코드 복원 선택에 따른 차이같은 파일이라도 수정 도구에 따라 달라지는 복구 범위Git 복원 기준과 체크포인트 보관 한계복구 전후 확인할 파일·테스트·외부 작업 기록공식 설명: Claude Code Checkpointing. 이 글은 신규 출시 속보가 아닌 기존 기능의 기술 해..

'전체 글' · 241건

AI·에이전트·LLM 실전 연구

AI 트렌드

GPT-Live-1 API 가격·기능, 음성 에이전트 도입 조건

GPT-Live-1 API 가격은 2026년 9월 17일 공식 모델 문서 기준 음성 세션 분당 0.05달러이며, 초 단위로 과금됩니다. 동시에 듣고 말하는 음성 에이전트를 만들 수 있지만, 추론을 맡는 백엔드 모델과 도구 사용료는 별도입니다. 이 글은 현재 제공 기능과 전체 비용을 계산하는 방법, 도입 전에 확인할 조건을 다룹니다.이 글의 핵심API 제공 범위와 입력·출력 제한음성 모델·백엔드·앱이 나누는 책임세션 요금 계산과 동시 접속 한도기존 에이전트를 연결하는 두 가지 선택지대화·업무·중단·비용을 나눈 도입 점검먼저 팩트체크할 부분발표에서 말하는 자연스러운 대화와 업무 처리 성능은 같은 평가 항목이 아닙니다. 아래에서는 지원 기능, 계산 예시, 작성자의 운영 권고를 구분합니다.공식 원문: GPT-L..

ML & DL

Recurrent Looped Transformer란? RLT 구조·실행 결과

Recurrent Looped Transformer(RLT)는 토큰이 바뀔 때마다 디코더의 마지막 은닉 상태와 슬라이딩 윈도우 KV 캐시를 다음 토큰으로 넘기는 새 트랜스포머 구조입니다. 2026년 9월 16일 기준 공식 기술 보고서는 초기 실험 결과까지 공개했으며, 비공식 PyTorch 구현은 CPU에서도 기본 경로의 순전파·역전파·생성이 작동했습니다. 다만 기존 Transformer를 대체한다고 결론 내리기에는 실험 규모와 구현 성숙도가 아직 부족합니다.이 글은 9월 12일 공개되고 9월 15일 개정된 RLT 기술 보고서[2], 공식 프로젝트 저장소[3], RLT-pytorch 구현[4]을 기준으로 작성했습니다.이 글의 핵심RLT가 고정 깊이 Transformer와 달라지는 지점인과적 인코더·전역 메..

LLM

DeepSeek V4 Pro 종료 철회, 유지 요금·Flash 차이

DeepSeek V4 Pro 종료 철회 여부를 확인하면, 2026년 9월 15일 기준 공식 안내는 9월 14일 이후에도 V4 Pro API를 제공하며 기존 과금 방식을 유지한다는 내용입니다. 따라서 Pro 요청이 모두 Flash로 바뀌고 Flash 요금이 적용된다는 이전 안내를 현재 정책으로 받아들이면 안 됩니다.이 글은 DeepSeek의 Your First API Call과 Models & Pricing 원문을 직접 확인해 서비스 유지 범위와 요금 차이를 정리합니다.이 글의 핵심9월 14일 이후 적용되는 공식 공지의 범위Pro와 구형 Flash 요청 이름의 차이캐시·시간대별 API 가격 읽는 법모델 변경 여부와 에이전트 품질의 관계운영 설정과 청구 내역 점검 순서먼저 팩트체크할 부분검색 결과나 웹 추출..

Claude Code

Claude Code 읽기 전용 설정: 도구 제한·검증 방법

Claude Code 읽기 전용 설정은 --tools Read로 내장 도구를 제한하고, 외부 MCP와 훅을 별도로 통제하는 방식으로 시작할 수 있습니다. 2026년 9월 14일 기준, --allowedTools Read만 지정해서는 다른 도구를 제외할 수 없습니다. 이 글은 공식 Permissions·CLI reference·Settings 문서와 로컬 CLI 실험을 바탕으로 설정 방법과 검증 범위를 설명합니다.이 글의 핵심검토용 세션에 필요한 준비물과 샘플 파일내장 도구·MCP·훅을 분리해서 제한하는 명령읽기 요청과 수정 요청을 나눈 실행 검증자동화에서 확인할 오류와 결과 상태Plan 모드·권한 규칙·OS 격리의 선택 기준공식 기준: Claude Code CLI reference와 Configure p..

AI Agent

Claude Smart reports 비용·권한·분석 범위 정리

Claude Smart reports는 팀의 Claude 대화 표본을 분석해 업무별 비용과 작업이 막히는 원인을 정리하는 Enterprise 베타 기능입니다. 2026년 9월 14일 기준 조직당 월 10회까지 추가 비용 없이 보고서를 만들 수 있으며, 활성화에는 Owner 또는 Primary Owner 권한이 필요합니다. 이 글은 분석 범위, 비용 조건, 관리자 권한과 개인정보 설정을 구분해 설명합니다.공식 발표일은 2026년 9월 10일입니다. Claude Help Center의 Release notes와 Get started with smart reports를 기준으로 정리했으며, 실제 Enterprise 관리자 화면을 사용한 체험기는 아닙니다.이 글의 핵심출시된 기능과 과장해서 읽기 쉬운 표현보고서..

AI Agent

MCP Elicitation 작동 원리: 입력 요청과 URL 승인 차이

MCP Elicitation은 에이전트 작업 도중 서버가 클라이언트를 통해 사용자에게 추가 입력을 요청하는 기능입니다. 폼 모드는 일반 정보를 클라이언트 안에서 전달하고, URL 모드는 비밀정보 입력이나 외부 서비스 승인을 별도 웹 흐름으로 분리합니다. 2026년 9월 13일 확인한 MCP 2025-11-25 규격을 기준으로, 두 모드의 요청·응답과 자동화 재개 조건을 설명합니다.이 글은 새 출시 소식이나 특정 앱의 지원 안내가 아닌 프로토콜 분석입니다. 근거는 공식 Elicitation·Tools·Security Best Practices 문서이며, 구현 권고는 규격상 의무와 구분합니다.이 글의 핵심Elicitation이 도구 호출 중 맡는 역할모드 지원 선언과 요청 메시지의 구성URL 동의 이후 완료..

AI Agent

Cursor Projects 출시, 코디네이터·공유 문맥·사용 조건

Cursor Projects는 기능 개발·마이그레이션처럼 여러 작업으로 이어지는 목표를 코디네이터에게 맡기는 베타 기능입니다. 2026년 9월 13일 기준, 공식 발표는 9월 10일부터 전체 사용자 대상으로 순차 제공한다고 밝히지만, 기반이 되는 Cloud Agents 문서는 유료 플랜과 사용량 과금을 요구합니다.이 글은 Cursor의 「Introducing Projects」와 공식 변경 이력·Cloud Agents 문서를 바탕으로 역할 분담, 공유 문맥, 발표 수치와 사용 조건을 구분합니다.이 글의 핵심출시일과 베타 제공 범위코디네이터·실행 에이전트의 역할PR 증가 수치의 해석 조건공유 문맥과 반복 작업의 변화도입 전 계정·환경·비용 점검먼저 팩트체크할 부분‘수천 에이전트’는 출시 글의 기능 설명이며 ..

Claude Code

Claude Code 비용 제한 설정: 예산·턴·시간 제어법

Claude Code 비용 제한은 비대화형 -p 실행에 --max-budget-usd와 --max-turns를 함께 지정하고, 실행 시간은 호출하는 스크립트에서 별도로 제한하는 방식으로 구성합니다. 2026년 9월 12일 확인 결과, 달러 예산은 청구액이 한도를 절대로 넘지 않는 선결제 차단 장치가 아닙니다. 아래에서는 작은 읽기 전용 실험으로 정상 종료와 예산 초과를 확인하고, 실패 시 후속 작업을 막는 예제를 제공합니다.기준 자료는 Anthropic의 CLI reference, Run Claude Code programmatically, Manage costs effectively이며, 실험 환경은 Linux의 Claude Code 2.1.265입니다. 최신 발표 소개가 아니라 현재 문서와 로컬 실행..

AI 트렌드

Fugu Max·Ultra v2 출시, 가격·성능·선택 조건 정리

Fugu Max·Ultra v2는 Sakana AI가 여러 모델을 조율해 하나의 API로 제공하는 에이전트 서비스입니다. 2026년 9월 12일 기준, Max는 비용 대비 성능을, Ultra v2는 어려운 작업의 답변 품질을 우선합니다.Sakana Fugu 공식 제품 페이지와 기술 보고서를 대조했습니다. 논문은 구조 설명, 제품 페이지는 최신 가격·성능의 근거로 사용합니다.이 글의 핵심Max와 Ultra v2가 새로 제공하는 선택지학습된 조율기와 고정 모델 풀의 작동 방식문맥 길이에 따른 가격과 벤치마크 해석기존 에이전트에 연결할 때 달라지는 운영 책임도입 시험과 데이터 정책 확인 항목먼저 팩트체크할 부분공식 페이지의 성능 수치는 공급사가 보고한 결과입니다. 이를 독립 검증이나 모든 업무의 우위로 표현하..

Claude Code

Claude Code 되돌리기 범위: 체크포인트와 Git 차이

Claude Code 되돌리기는 파일 편집 도구가 추적한 변경과 대화를 선택적으로 복원하는 기능입니다. Bash로 바꾼 파일이나 외부 서비스 작업까지 모두 취소하는 기능은 아니므로, Git에 저장된 버전과 복구 범위를 나눠 봐야 합니다. 2026년 9월 11일 기준 Claude Code 공식 Checkpointing 문서와 Git restore 문서를 바탕으로 경계를 설명합니다.이 글의 핵심프롬프트별 체크포인트가 기록하는 대상대화와 코드 복원 선택에 따른 차이같은 파일이라도 수정 도구에 따라 달라지는 복구 범위Git 복원 기준과 체크포인트 보관 한계복구 전후 확인할 파일·테스트·외부 작업 기록공식 설명: Claude Code Checkpointing. 이 글은 신규 출시 속보가 아닌 기존 기능의 기술 해..

반응형