Design · Development · Thoughts

안녕하세요,
Practical AI Lab 입니다.

AI·에이전트·LLM 실전 연구

반응형
AI Agent

Google Antigravity Teamwork 사용법: 패턴·검증 구조 정리

이미지: AI 생성 개념 이미지2026년 8월 29일 기준, Google Antigravity Teamwork는 유료 플랜 사용자가 /teamwork-preview를 호출해 여러 AI 에이전트에게 대규모 코딩·시뮬레이션·연구 작업을 맡기는 기능입니다. 빠르게 시작하려면 목표만 길게 적기보다 결과가 통과해야 할 테스트, 금지할 지름길, 작업 디렉터리를 먼저 정해야 합니다. Teamwork는 그 조건을 검토 가능한 요청 문서로 만든 뒤 역할을 나누고, 비판·반례 탐색·감사를 거친 결과만 최종 제안합니다.핵심은 에이전트 수가 아니라 검증 구조입니다. 반복 코딩, 분산 코딩, 장문 증명, 자기검증, 문서 검토 가운데 작업에 맞는 패턴을 고르고, 구현 담당과 검증 담당을 분리해야 병렬 실행이 초기 오류를 함께 확..

AI Agent

AI 정렬 연구 에이전트, 사람보다 잘했나? Anthropic 실험 분석

이미지: AI 생성 개념 이미지 — 병렬 자동 연구의 결과를 격리된 평가 게이트로 검증하는 구조2026년 8월 29일 기준, Anthropic의 AI 정렬 연구 에이전트는 사람이 정해 둔 10개 정렬 실패와 평가 지표 안에서는 경험 있는 연구자의 일회성 제안보다 강한 방법을 더 빨리 찾았습니다. 그러나 이 결과는 “AI가 스스로 안전 문제를 해결했다”는 뜻이 아닙니다. 비공개 평가 데이터 격리, 일반 능력 저하 검사, 코드 감시, 사후 치팅 탐지가 함께 작동했을 때만 성립한 제한적 자동 연구 성과입니다.핵심 판단은 간단합니다. 아이디어 생성과 반복 실험은 에이전트에 대규모로 맡길 수 있다는 근거가 생겼지만, 무엇을 안전이라고 부를지 정하는 일과 결과가 진짜 일반화됐는지 판정하는 일은 여전히 사람과 독립 ..

LLM

WeMM-Embedding 로컬 실행 방법: 2B·4B·9B 선택 가이드

이미지: AI 생성 개념 이미지 — 서로 다른 미디어를 하나의 비교 가능한 임베딩 공간으로 변환하는 WeMM-Embedding2026년 8월 29일 기준, WeMM-Embedding을 로컬에서 처음 시험한다면 2B 모델과 256차원 벡터로 검색 품질·속도·메모리 사용량을 먼저 확인하는 방법이 가장 현실적입니다. 텍스트뿐 아니라 이미지·영상·시각 문서를 같은 벡터 공간에서 검색해야 하고, 실험 환경에서 원격 코드를 검토해 실행할 수 있는 개발자가 주요 대상입니다.2B·4B·9B 가운데 큰 모델을 바로 고를 필요는 없습니다. Tencent가 공개한 결과에서는 크기가 커질수록 여러 벤치마크 점수가 높아졌지만, 실제 서비스의 정답은 데이터 분포와 지연 시간, 벡터 저장 비용에 따라 달라집니다. 이 글은 설치부터..

AI Agent

Anthropic MHS란? AI 에이전트가 장비를 제어하는 원리

이미지: AI 생성 개념 이미지 — 서로 다른 물리 장비를 표준 제어 계층으로 연결하는 MHS2026년 8월 28일 기준, Anthropic MHS(Model Hardware Standard)는 AI 에이전트가 현미경·액체 처리기·로봇 팔 같은 프로그래밍 가능한 장비를 공통 방식으로 발견하고 제어하도록 만드는 연구 프리뷰 규격입니다. 핵심은 Claude에게 기계를 직접 맡기는 것이 아니라, 장비의 상태·명령·물리 특성·안전 한계를 표준 드라이버에 넣고 에이전트는 그 경계 안에서만 작업하게 하는 데 있습니다.MHS는 아직 누구나 설치하는 공개 표준이 아닙니다. Anthropic은 2026년 8월 27일 제한된 신청제 연구 프리뷰를 열었고, 참여 기관과 안전 평가 및 운영 모범 사례를 만든 뒤 오픈소스로 공..

Codex

loveholidays Codex 도입, 코드 변경 79%는 무엇을 뜻하나?

이미지: AI 생성 개념 이미지 — 아이디어를 검증 가능한 소프트웨어 변경으로 바꾸는 구조2026년 8월 28일 기준, loveholidays Codex 도입 사례의 ‘코드 변경 79%’는 전체 코드 줄의 79%를 AI가 작성했다는 뜻이 아닙니다. OpenAI 공식 자료는 이를 ‘AI 보조 코드 변경 비중’이라고 부르지만 정확한 집계 단위와 판정 규칙은 공개하지 않았습니다. 이 수치는 코드 품질·배포 빈도·변경 성공률과 함께 볼 때 의미가 생기는 채택 지표입니다.OpenAI가 2026년 8월 26일 공개한 고객 사례에는 AI 보조 코드 변경 비중이 1년 동안 7%에서 79%로 커졌고, 같은 기간 여러 운영 지표도 개선됐다고 적혀 있습니다. 다만 이는 한 회사가 정의한 측정 체계와 공급사의 고객 사례를 통..

AI Agent

ChatGPT Work 이벤트 트리거 사용법: Gmail·Slack·GitHub

이미지: AI 생성 개념 이미지 — 앱 이벤트가 Work 작업을 즉시 깨우는 구조ChatGPT Work 이벤트 트리거는 Gmail 새 메일, Slack 채널 메시지, GitHub 풀 리퀘스트 활동이 생겼을 때 정해 둔 작업을 바로 시작하는 기능입니다. 2026년 8월 28일 기준으로 Work를 쓸 수 있는 Plus·Pro·Business·Enterprise·Edu 등 적격 요금제에서 제공되며, Free·Go와 FedRAMP 워크스페이스에서는 만들 수 없습니다. 연결 앱의 권한과 외부 변경 승인 정책은 그대로 적용되므로, 이벤트가 왔다고 해서 메일 발송이나 댓글 등록까지 무조건 자동 실행되는 것은 아닙니다.설정 순서는 간단합니다. 지원 앱을 연결하고 Work에서 원하는 이벤트와 결과를 설명한 뒤, 생성된 ..

AI Agent

Claude Managed Agents Chat SDK 구조와 보안 설계

이미지: AI 생성 개념 이미지 — 여러 채팅 채널이 하나의 영속 세션 코어로 연결되는 구조Claude Managed Agents Chat SDK 구조의 핵심은 채팅 화면과 에이전트 실행부를 분리하고, 대화마다 하나의 영속 세션을 두는 것입니다. 2026년 8월 28일 공개된 공식 quickstart를 기준으로 보면 Slack·Teams·Discord 같은 채널은 교체할 수 있지만, 세션 소유권 검사와 스트리밍 수명, 사용자 인증 경계는 채널마다 다시 설계해야 합니다. 어댑터만 바꾸면 모든 운영 문제가 자동으로 해결되는 구조는 아닙니다.이 글은 Claude Managed Agents Chat SDK가 메시지 한 건을 어떤 경로로 처리하는지, 브라우저 예제에서 데이터베이스가 필요 없다는 설명이 어디까지 유..

AI Agent

Claude Cowork 내장 브라우저 사용법: 설치·로그인·보안 정리

이미지: AI 생성 개념 이미지 — 개인 브라우저와 분리된 Cowork 내장 브라우저를 상징하는 키 비주얼Claude Cowork 내장 브라우저 사용법의 핵심은 별도 확장 프로그램을 설치하는 것이 아니라 최신 Claude Desktop에서 Cowork에게 웹 작업을 맡기는 것입니다. 2026년 8월 26일 발표 기준으로 Pro·Max·Team 요금제에는 일주일에 걸쳐 순차 배포되며, Enterprise는 관리자가 켜야 합니다. 기능이 보이면 개인 브라우저와 분리된 창에서 조사·폼 입력·포털 작업을 실행할 수 있지만, 로그인은 필요한 사이트만 가져오고 민감한 사이트는 제외하는 것이 안전합니다.이 글은 내장 브라우저를 처음 켜는 순서, Claude in Chrome과의 차이, 사이트 로그인 가져오기, 정상 ..

AI 트렌드

Ox Alpha 정체는 GLM 5.3 Flash, 핵심 정리

이미지: AI 생성 개념 이미지 — Ox Alpha 스텔스 모델이 GLM 5.3 Flash로 밝혀진 순간을 상징하는 키 비주얼2026년 8월 26일, Z.ai가 GLM 5.3 Flash를 공식 발표했다. 12일 전인 8월 14일 GLM 5.3을 내놓으며 "약 2주 후 오픈 웨이트 공개"를 예고했던 Z.ai가, 약속한 모델과 다른 완전히 새로운 모델을 들고 온 것이다. 더 놀라운 사실은 이 신모델이 이미 8월 20일부터 OpenRouter에서 'Ox Alpha'라는 익명 이름으로 무료 서비스되고 있었다는 점이다.Ox Alpha가 GLM 5.3 Flash임을 증명한 증거들커뮤니티의 포렌식 분석이 발표 전부터 정체를 좁혀가고 있었다. 토크나이저 지문 분석에서 Ox Alpha는 GLM-5.3과 모든 테스트 문자..

LLM

Gemini 3.5 Transcribe 사용법: 실시간 전사·가격 정리

Gemini 3.5 Transcribe의 음성-텍스트 변환을 표현한 AI 생성 키 비주얼Gemini 3.5 Transcribe 사용법의 핵심은 실시간 음성과 녹음 파일을 서로 다른 모델로 처리하는 것입니다. 2026년 8월 27일 기준 실시간 앱은 gemini-3.5-transcribe-live, 회의 녹음·통화 파일은 gemini-3.5-transcribe를 선택해야 합니다. 전자는 10분 단위의 저지연 스트리밍, 후자는 최대 1시간 파일과 화자 분리·단어 타임스탬프에 맞춰져 있으며, Google이 제시한 실시간 예상 혼합 비용은 분당 약 0.009달러입니다.Google은 2026년 8월 26일 Gemini 3.5 Transcribe를 공개 미리보기로 발표했습니다. 이 모델은 대화에 답하는 음성 비서가..

'전체 글' · 198건

AI·에이전트·LLM 실전 연구

AI Agent

Google Antigravity Teamwork 사용법: 패턴·검증 구조 정리

이미지: AI 생성 개념 이미지2026년 8월 29일 기준, Google Antigravity Teamwork는 유료 플랜 사용자가 /teamwork-preview를 호출해 여러 AI 에이전트에게 대규모 코딩·시뮬레이션·연구 작업을 맡기는 기능입니다. 빠르게 시작하려면 목표만 길게 적기보다 결과가 통과해야 할 테스트, 금지할 지름길, 작업 디렉터리를 먼저 정해야 합니다. Teamwork는 그 조건을 검토 가능한 요청 문서로 만든 뒤 역할을 나누고, 비판·반례 탐색·감사를 거친 결과만 최종 제안합니다.핵심은 에이전트 수가 아니라 검증 구조입니다. 반복 코딩, 분산 코딩, 장문 증명, 자기검증, 문서 검토 가운데 작업에 맞는 패턴을 고르고, 구현 담당과 검증 담당을 분리해야 병렬 실행이 초기 오류를 함께 확..

AI Agent

AI 정렬 연구 에이전트, 사람보다 잘했나? Anthropic 실험 분석

이미지: AI 생성 개념 이미지 — 병렬 자동 연구의 결과를 격리된 평가 게이트로 검증하는 구조2026년 8월 29일 기준, Anthropic의 AI 정렬 연구 에이전트는 사람이 정해 둔 10개 정렬 실패와 평가 지표 안에서는 경험 있는 연구자의 일회성 제안보다 강한 방법을 더 빨리 찾았습니다. 그러나 이 결과는 “AI가 스스로 안전 문제를 해결했다”는 뜻이 아닙니다. 비공개 평가 데이터 격리, 일반 능력 저하 검사, 코드 감시, 사후 치팅 탐지가 함께 작동했을 때만 성립한 제한적 자동 연구 성과입니다.핵심 판단은 간단합니다. 아이디어 생성과 반복 실험은 에이전트에 대규모로 맡길 수 있다는 근거가 생겼지만, 무엇을 안전이라고 부를지 정하는 일과 결과가 진짜 일반화됐는지 판정하는 일은 여전히 사람과 독립 ..

LLM

WeMM-Embedding 로컬 실행 방법: 2B·4B·9B 선택 가이드

이미지: AI 생성 개념 이미지 — 서로 다른 미디어를 하나의 비교 가능한 임베딩 공간으로 변환하는 WeMM-Embedding2026년 8월 29일 기준, WeMM-Embedding을 로컬에서 처음 시험한다면 2B 모델과 256차원 벡터로 검색 품질·속도·메모리 사용량을 먼저 확인하는 방법이 가장 현실적입니다. 텍스트뿐 아니라 이미지·영상·시각 문서를 같은 벡터 공간에서 검색해야 하고, 실험 환경에서 원격 코드를 검토해 실행할 수 있는 개발자가 주요 대상입니다.2B·4B·9B 가운데 큰 모델을 바로 고를 필요는 없습니다. Tencent가 공개한 결과에서는 크기가 커질수록 여러 벤치마크 점수가 높아졌지만, 실제 서비스의 정답은 데이터 분포와 지연 시간, 벡터 저장 비용에 따라 달라집니다. 이 글은 설치부터..

AI Agent

Anthropic MHS란? AI 에이전트가 장비를 제어하는 원리

이미지: AI 생성 개념 이미지 — 서로 다른 물리 장비를 표준 제어 계층으로 연결하는 MHS2026년 8월 28일 기준, Anthropic MHS(Model Hardware Standard)는 AI 에이전트가 현미경·액체 처리기·로봇 팔 같은 프로그래밍 가능한 장비를 공통 방식으로 발견하고 제어하도록 만드는 연구 프리뷰 규격입니다. 핵심은 Claude에게 기계를 직접 맡기는 것이 아니라, 장비의 상태·명령·물리 특성·안전 한계를 표준 드라이버에 넣고 에이전트는 그 경계 안에서만 작업하게 하는 데 있습니다.MHS는 아직 누구나 설치하는 공개 표준이 아닙니다. Anthropic은 2026년 8월 27일 제한된 신청제 연구 프리뷰를 열었고, 참여 기관과 안전 평가 및 운영 모범 사례를 만든 뒤 오픈소스로 공..

Codex

loveholidays Codex 도입, 코드 변경 79%는 무엇을 뜻하나?

이미지: AI 생성 개념 이미지 — 아이디어를 검증 가능한 소프트웨어 변경으로 바꾸는 구조2026년 8월 28일 기준, loveholidays Codex 도입 사례의 ‘코드 변경 79%’는 전체 코드 줄의 79%를 AI가 작성했다는 뜻이 아닙니다. OpenAI 공식 자료는 이를 ‘AI 보조 코드 변경 비중’이라고 부르지만 정확한 집계 단위와 판정 규칙은 공개하지 않았습니다. 이 수치는 코드 품질·배포 빈도·변경 성공률과 함께 볼 때 의미가 생기는 채택 지표입니다.OpenAI가 2026년 8월 26일 공개한 고객 사례에는 AI 보조 코드 변경 비중이 1년 동안 7%에서 79%로 커졌고, 같은 기간 여러 운영 지표도 개선됐다고 적혀 있습니다. 다만 이는 한 회사가 정의한 측정 체계와 공급사의 고객 사례를 통..

AI Agent

ChatGPT Work 이벤트 트리거 사용법: Gmail·Slack·GitHub

이미지: AI 생성 개념 이미지 — 앱 이벤트가 Work 작업을 즉시 깨우는 구조ChatGPT Work 이벤트 트리거는 Gmail 새 메일, Slack 채널 메시지, GitHub 풀 리퀘스트 활동이 생겼을 때 정해 둔 작업을 바로 시작하는 기능입니다. 2026년 8월 28일 기준으로 Work를 쓸 수 있는 Plus·Pro·Business·Enterprise·Edu 등 적격 요금제에서 제공되며, Free·Go와 FedRAMP 워크스페이스에서는 만들 수 없습니다. 연결 앱의 권한과 외부 변경 승인 정책은 그대로 적용되므로, 이벤트가 왔다고 해서 메일 발송이나 댓글 등록까지 무조건 자동 실행되는 것은 아닙니다.설정 순서는 간단합니다. 지원 앱을 연결하고 Work에서 원하는 이벤트와 결과를 설명한 뒤, 생성된 ..

AI Agent

Claude Managed Agents Chat SDK 구조와 보안 설계

이미지: AI 생성 개념 이미지 — 여러 채팅 채널이 하나의 영속 세션 코어로 연결되는 구조Claude Managed Agents Chat SDK 구조의 핵심은 채팅 화면과 에이전트 실행부를 분리하고, 대화마다 하나의 영속 세션을 두는 것입니다. 2026년 8월 28일 공개된 공식 quickstart를 기준으로 보면 Slack·Teams·Discord 같은 채널은 교체할 수 있지만, 세션 소유권 검사와 스트리밍 수명, 사용자 인증 경계는 채널마다 다시 설계해야 합니다. 어댑터만 바꾸면 모든 운영 문제가 자동으로 해결되는 구조는 아닙니다.이 글은 Claude Managed Agents Chat SDK가 메시지 한 건을 어떤 경로로 처리하는지, 브라우저 예제에서 데이터베이스가 필요 없다는 설명이 어디까지 유..

AI Agent

Claude Cowork 내장 브라우저 사용법: 설치·로그인·보안 정리

이미지: AI 생성 개념 이미지 — 개인 브라우저와 분리된 Cowork 내장 브라우저를 상징하는 키 비주얼Claude Cowork 내장 브라우저 사용법의 핵심은 별도 확장 프로그램을 설치하는 것이 아니라 최신 Claude Desktop에서 Cowork에게 웹 작업을 맡기는 것입니다. 2026년 8월 26일 발표 기준으로 Pro·Max·Team 요금제에는 일주일에 걸쳐 순차 배포되며, Enterprise는 관리자가 켜야 합니다. 기능이 보이면 개인 브라우저와 분리된 창에서 조사·폼 입력·포털 작업을 실행할 수 있지만, 로그인은 필요한 사이트만 가져오고 민감한 사이트는 제외하는 것이 안전합니다.이 글은 내장 브라우저를 처음 켜는 순서, Claude in Chrome과의 차이, 사이트 로그인 가져오기, 정상 ..

AI 트렌드

Ox Alpha 정체는 GLM 5.3 Flash, 핵심 정리

이미지: AI 생성 개념 이미지 — Ox Alpha 스텔스 모델이 GLM 5.3 Flash로 밝혀진 순간을 상징하는 키 비주얼2026년 8월 26일, Z.ai가 GLM 5.3 Flash를 공식 발표했다. 12일 전인 8월 14일 GLM 5.3을 내놓으며 "약 2주 후 오픈 웨이트 공개"를 예고했던 Z.ai가, 약속한 모델과 다른 완전히 새로운 모델을 들고 온 것이다. 더 놀라운 사실은 이 신모델이 이미 8월 20일부터 OpenRouter에서 'Ox Alpha'라는 익명 이름으로 무료 서비스되고 있었다는 점이다.Ox Alpha가 GLM 5.3 Flash임을 증명한 증거들커뮤니티의 포렌식 분석이 발표 전부터 정체를 좁혀가고 있었다. 토크나이저 지문 분석에서 Ox Alpha는 GLM-5.3과 모든 테스트 문자..

LLM

Gemini 3.5 Transcribe 사용법: 실시간 전사·가격 정리

Gemini 3.5 Transcribe의 음성-텍스트 변환을 표현한 AI 생성 키 비주얼Gemini 3.5 Transcribe 사용법의 핵심은 실시간 음성과 녹음 파일을 서로 다른 모델로 처리하는 것입니다. 2026년 8월 27일 기준 실시간 앱은 gemini-3.5-transcribe-live, 회의 녹음·통화 파일은 gemini-3.5-transcribe를 선택해야 합니다. 전자는 10분 단위의 저지연 스트리밍, 후자는 최대 1시간 파일과 화자 분리·단어 타임스탬프에 맞춰져 있으며, Google이 제시한 실시간 예상 혼합 비용은 분당 약 0.009달러입니다.Google은 2026년 8월 26일 Gemini 3.5 Transcribe를 공개 미리보기로 발표했습니다. 이 모델은 대화에 답하는 음성 비서가..

반응형