Gemini 3.5 Flash에 컴퓨터 사용 기능 통합

Google DeepMind가 Gemini 3.5 Flash에 컴퓨터 사용(Computer Use) 기능을 통합했다. 이제 개발자들은 브라우저, 모바일, 데스크톱 환경에서 작동하는 AI 에이전트를 구축할 수 있으며, 장기적인 자동화 작업과 엔터프라이즈 수준의 업무 자동화가 가능해졌다.

 

관련 이미지

 

 

Gemini 3.5 Flash의 컴퓨터 사용 기능이란

그동안 컴퓨터 사용 기능은 독립형 Gemini 2.5 모델로만 제공되었으나, 이번 업데이트로 Gemini 3.5 Flash의 메인 모델에 네이티브로 통합되었다. 이는 개발자들이 함수 호출(function calling), Search 및 Maps 그라운딩 같은 기존 내장 도구들과 함께 컴퓨터 사용 기능을 활용할 수 있다는 의미다. 개발자는 Gemini API와 Gemini Enterprise Agent Platform을 통해 즉시 이 기능을 사용할 수 있다.

 

AI 에이전트가 할 수 있는 작업

Gemini 3.5 Flash는 “보고, 추론하고, 행동하는” 능력으로 브라우저, 모바일, 데스크톱 환경을 넘나들며 작동한다. 예시로는 지속적인 소프트웨어 테스팅, 전문 애플리케이션 기반의 지식 작업 자동화 등 장기 수평 및 엔터프라이즈 자동화 작업이 포함된다. Google의 데모에서는 Gemini 앱을 분석해 카테고리별 기능 목록을 반환하거나, 자체 문서를 감시해 접근성 문제를 찾아내는 것으로 능력을 입증했다.

 

보안: 프롬프트 주입 공격 방어

라이브 환경에서 작동하는 에이전트의 프롬프트 주입 위험을 완화하기 위해 Google은 Gemini 3.5 Flash의 컴퓨터 사용 기능에 대해 목표 지정 적대적 훈련(targeted adversarial training)을 적용했다. 추가로 엔터프라이즈 고객을 위한 선택적 세이프가드 시스템 2가지를 출시했다. 첫 번째는 민감하거나 되돌릴 수 없는 작업에 대해 명시적인 사용자 확인을 요구하는 기능이고, 두 번째는 간접 프롬프트 주입이 탐지되면 작업을 자동으로 중단하는 기능이다. Google은 “심층 방어(defense-in-depth)” 접근 방식을 권장하며, 개발자들이 안전한 샌드박싱, 인간 개입 검증, 엄격한 접근 제어와 함께 이러한 기능들을 결합할 것을 권고했다.

 

의의 및 전망

컴퓨터 사용 기능이 Gemini 3.5 Flash에 통합됨으로써 AI 에이전트의 실제 도입 장벽이 낮아질 것으로 예상된다. 기존에는 전문화된 모델이 필요했다면, 이제는 더 높은 처리량과 낮은 지연시간을 자랑하는 Flash 모델에서 같은 능력을 제공받을 수 있다. Google은 이미 이 기능으로 가치를 창출하는 고객들을 보고 있다고 밝혔으며, 개발자들은 테스트 환경에서의 데모부터 시작해 점진적으로 프로덕션 환경에 배포할 수 있다.

📅 원문 날짜: 2026년 6월 24일 | 출처: Google DeepMind Blog