태그: #computer-use
GPU·LLM·MLOps·쿠버네티스, 그리고 마음가짐에 관한 글 · 2 편
브라우저·컴퓨터를 조작하는 AI 에이전트, 지금 어디까지 왔나 — 벤치마크 숫자가 실제로 재는 것
"컴퓨터 유즈 에이전트가 OSWorld에서 83.5%를 찍었다"와 "가장 강한 에이전트도 20.6%밖에 못 끝낸다"는 둘 다 2026년에 나온 사실이고, 둘 다 맞습니다. 앞은 OSWorld 1.0, 뒤는 같은 팀이 만든 OSWorld 2.0입니다. 이 글은 그 간극이 어디서 오는지를 원 논문과 벤치마크 저자들의 자체 측정으로 따라갑니다. OSWorld 과제의 절반 가까이는 GUI를 거의 쓰
2026-07-17 · 46 분 읽기 #ai#computer-use#browser-agents#benchmark#prompt-injection브라우저·컴퓨터 유즈 에이전트 실전 가이드: 2026년 팀이 바로 도입할 수 있는 아키텍처, 안전장치, 체크리스트
브라우저와 가상 컴퓨터를 직접 조작하는 에이전트가 왜 지금 중요해졌는지, 어떤 아키텍처로 설계해야 하는지, 어디까지 자동화하고 어디서 멈춰야 하는지 실무 기준으로 정리한다.
2026-04-12 · 17 분 읽기 #ai-platform#ai-agent#browser-agent#computer-use#automation