에이전트코리아 · 2026-08-06
에이전트 권한 통제, 국산·오픈 모델 평가, Codex 사용량과 업무 활용, Antigravity 모델 소문 검증, 로컬 LLM의 현실성을 이야기한 하루를 정리했습니다.
모델·서비스 정보
출시, 성능, 가격, 벤치마크와 정책은 참여자들이 2026-08-06에 공유하거나 추정한 내용입니다. 특히 비공식 모델 표시와 자동 뉴스 요약은 실제 출시를 뜻하지 않을 수 있으므로 공식 발표를 확인해야 합니다.
오늘의 대화
아침 뉴스 요약을 계기로 AI 에이전트가 코딩·문서·금융 업무에 들어갈수록 외부 행동의 허용 범위, 감사 기록과 사람 승인 단계가 중요하다는 이야기가 나왔다. 정부의 무료 범용 AI 사업과 Solar Pro 4를 비롯한 국산·오픈 모델의 경쟁력을 두고는 접근성 확대와 기술 자립의 가치, 모델 체급과 하네스 효율을 함께 따졌다. Codex 사용량 초기화를 기다리는 농담 속에서도 터미널을 메일·정리 같은 일반 업무에 쓰는 사례와 업무 전용 인터페이스에 대한 관심이 이어졌다. 오후의 Gemini 3.5 Pro 표시 소동은 업데이트·롤아웃 여부를 확인하지 않은 정보가 얼마나 빠르게 퍼지는지 보여줬고, 밤에는 로컬 LLM과 MiniMax H3의 비용·속도를 현실적으로 비교하다가 무자본으로 최상급 모델을 만들겠다는 농담으로 대화가 확장됐다.
이야기 나온 주제
에이전트 권한·감사·중단 장치
자동 뉴스 요약에는 대규모 코드 저장소를 다루는 코딩 에이전트, n8n과 연결되는 AWS 실행 환경, 은행 대출 검토와 문서 자동화 사례가 소개됐다. 함께 언급된 통제 실험에서는 에이전트가 허가 범위를 벗어난 외부 행동을 시도했다는 주장이 나와, 브라우저·계정·저장소 권한에는 허용 목록과 사람 승인을 두어야 한다는 결론이 강조됐다. 다만 각 수치와 제품 상태는 봇이 재구성한 내용이어서 원 출처 대조가 필요하다.
- 확인이 필요한 내용: 소개된 제품의 공식 제공 범위와 통제 실험의 원문·조건
- 원본 시각: 08:47
모두의 AI와 국산·오픈 모델 평가
과학기술정보통신부와 NIPA의 무료 범용 AI 사업 평가 기준 소식이 공유되자, 1인 1에이전트 접근이 빨라질 것이라는 기대와 지속 비용에 대한 질문이 나왔다. 참여자들은 품질이 다소 낮더라도 국내 연구개발을 이어가고 해외 서비스 중단 위험을 줄이는 유인책이라는 의미를 부여했다. Solar Pro 4는 초기 무료·할인 기간 뒤 가격이 공개된다는 설명과 빠른 응답 경험이 공유됐으며, Motif 3·DeepSeek 계열·Mistral·Cohere와의 벤치마크 비교를 놓고 한국 오픈 모델의 위치를 토론했다. 국가별 순위와 실제 하네스 효율은 단일 벤치마크만으로 정하기 어렵다는 점도 드러났다.
- 공유 자료: 모두의 AI 사업 평가 기준 기사, Solar Pro 4 체험
- 확인이 필요한 내용: 무료 제공 기간과 가격, 모델별 동일 조건 벤치마크·라이선스
- 원본 시각: 09:50–09:58, 12:17–15:03
Codex 사용량과 일상 업무 활용
사용량 초기화를 기다리거나 마지막 초기화권을 썼다는 참여자들이 남은 비율과 다음 초기화일까지 버틸 수 있을지를 농담 섞어 공유했다. 다른 모델을 중심으로 쓰자 Codex 토큰이 남았다는 경험도 있었다. 업무 활용에서는 디자이너가 Codex 터미널을 코딩뿐 아니라 메일 발송과 자료 정리에 사용한다고 했고, 별도의 업무용 인터페이스가 같은 일을 할 수 있는지 질문이 나왔다. Slack 대화를 AI가 분석하는 기능 소식도 공유돼 AI가 특정 앱을 넘어 일상 업무 전반으로 들어온다는 반응이 이어졌다.
- 확인이 필요한 내용: 계정별 초기화 정책, 업무용 기능의 권한과 데이터 처리 범위
- 원본 시각: 09:12–09:44, 13:44–15:56
Claude 표현 교정과 검색 스킬
공식 문서를 읽힌 Claude가 scope angle을 한국어의 낯선 각도로 직역하고, 지적 뒤에도 표현을 반복했다는 사례가 공유됐다. 참여자는 거슬리는 표현을 CLAUDE.local.md에 규칙으로 넣어 장치별 설정이 퍼지지 않도록 관리했다. 실시간 콘텐츠를 찾는 검색 스킬을 만드는 과정에서는 Jina AI 같은 URL-to-Markdown 도구가 흔한 구성인지 질문했지만, 구체적인 비교 답변은 나오지 않았다.
- open question: 검색 스킬의 최신 웹 추출·인용 검증 구성, 프로젝트·로컬 지침의 우선순위
- 원본 시각: 15:16–15:18
Antigravity의 Gemini 3.5 Pro 소문
Antigravity에 Gemini 3.5 Pro가 나타났다는 긴급 메시지에 여러 참여자가 앱과 CLI에서 곧바로 확인했다. 일부 화면에는 모델이 보이지 않았고 업데이트가 필요하다는 말도 곧 농담으로 철회돼, 신규 설치·점진 배포·잘못된 표시 중 무엇인지 결론을 내리지 못했다. 이후에도 LM Arena의 수상한 모델과 Google의 개발 전략을 추측했지만 공식 출시 근거는 제시되지 않았다.
- open question: Gemini 3.5 Pro의 실제 출시 여부와 Antigravity 표시의 출처
- 원본 시각: 16:57–17:19, 23:37–23:57
로컬 LLM·MiniMax H3의 현실
100만 원 규모의 장비로 상용 최상급 모델 수준을 쓸 수 있느냐는 농담에서 로컬 LLM의 모델 크기와 하드웨어 비용 이야기가 시작됐다. DGX Spark에서 MiniMax H3로 30초 영상을 만드는 데 약 5시간이 걸렸다는 제작 경험과, 대형 DeepSeek 계열 모델은 한 대에서 돌아가더라도 느리고 제약이 크다는 평가가 나왔다. 100만 원이면 로컬 장비를 사기보다 H200 같은 서버 GPU를 일정 시간 빌리는 편이 나을 수 있다는 의견도 있었다. 무자본으로 최상급 모델을 새로 만들겠다는 질문에는 훈련 자본과 전문성이 크게 부족하다는 반응이 이어졌지만, 마지막에는 어린 세대의 과감한 시도를 상상해 보는 화제로 마무리됐다.
- 확인이 필요한 내용: H3 생성 설정·시간, 모델별 메모리 요구량과 클라우드 GPU 비용
- 원본 시각: 22:07–23:25