블로그 자동화 · 강의 없이 · 추가 비용 0원

확장 프로그램 아님 · 독립 브라우저
내 로그인 세션 상속
분 · 시간 단위 장기 작업
조작 화면 그대로 노출

| 방식 | 입력 | 특성 |
|---|---|---|
| 컴퓨터 유즈 | 스크린샷 · 좌표 | 고비용 · 저정확도 |
| Aside 주력 | 접근성 트리 (텍스트) | 저비용 · 고정확도 · 자체 축소 70% |
| Aside 보조 | 스크린샷 | DOM 제어 불가 화면 한정 |
도구 목록 호출 → ✕ 조종 코드 직접 생성 → ○
코딩 에이전트
Playwright JavaScript
브라우저 내장 REPL
다단계 조작 일괄 처리

크롬 · 엣지 · 웨일의 공통 뼈대
전체 복제 후 내부 개조
에이전트용 훅 · 봇 감지 대응
「일부 추출」 아님

없음
GPT · 클로드 등 외부 연결
하네스 (마구)
기존 구독 · API 키 → 추가 0원

Thought → Action → Observation → Thought …
2022 · 에이전트 공통 구조
| 항목 | 내용 |
|---|---|
| 기관 · 연도 | OpenAI · 2021 |
| 정식 제목 | Browser-assisted question-answering with human feedback |
| 한 일 | GPT-3 에 텍스트 브라우징 환경 부여 — 검색 · 링크 이동 · 인용 |
| 훈련 | 행동 복제 + 보상모델 기반 강화학습 |
| 결과 | 사람 평가 선호 56% (시연자 대비) · 69% (레딧 상위 답변 대비) |
| 오늘과의 연결 | 브라우저 에이전트 계보의 출발점 |
| 항목 | 내용 |
|---|---|
| 기관 · 연도 | 프린스턴 · 구글 · 2022 |
| 정식 제목 | Synergizing Reasoning and Acting in Language Models |
| 한 일 | 추론(Reasoning)과 행동(Acting)을 번갈아 수행하는 형식 정립 |
| 효과 | 계획 수립 · 추적 · 갱신 · 예외 처리 · 외부 정보원 접근 |
| 오늘과의 연결 | 현재 모든 에이전트가 도는 루프의 이름 |
Thought → Action → Observation → Thought …
| 항목 | 내용 |
|---|---|
| 기관 · 연도 | 오하이오주립대 (OSU NLP) · 2023 · NeurIPS Spotlight |
| 정식 제목 | Towards a Generalist Agent for the Web |
| 규모 | 실제 사이트 137곳 · 31개 분야 · 과제 2,000+ |
| 특징 | 모의 환경이 아닌 실제 웹 · 사람 조작 기록 수집 |
| 오늘과의 연결 | Aside 가 99.0% 를 주장한 기준 (Online-Mind2Web) |
arxiv 는 /abs/ 를 /pdf/ 로 바꾸면 PDF 가 바로 열립니다
| 항목 | 값 |
|---|---|
| 측정 주체 | Aside 자체 (제3자 검증 아님) |
| 측정 방법 | 기술 블로그 공개 |
| 사용 모델 | GPT 5.5 · Kimi K2.6 |

| 구분 | 내용 |
|---|---|
| 연결 시 | 사용료 0원 · 데이터 외부 전송 없음 |
| 소형 모델 가능 | 단일 단계 — 선별 · 요약 |
| 소형 모델 한계 | 다단계 조작 — 초안 작성 등 |
| 원인 | 단계 증가 → 문맥 유지 부담 |
연결 절차 · 실습 시연
초안까지 · 사람 검수 후 게시
내 계정으로 실행 · 타인 계정 금지
초기 실행은 화면 확인

내 손 없이 화면 진행
기존 구독 연결
접근성 트리 · 코드 실행 · 하네스 · ReAct 루프
Connect AI LAB · AI CITY BUILDERS