AI 대화 창, 업무 문서, 이메일 사이를 자주 전환하는 사용자의 문제점을 해결하기 위해 Google은 최근 macOS Gemini 애플리케이션에 대한 주요 업데이트를 출시했습니다. 이는 보다 원활한 교차 애플리케이션 데스크톱 오피스 환경을 만드는 것을 목표로 합니다.

이전 버전에서는 Gemini macOS 클라이언트가 부동 창을 불러오는 단축키와 즉각적인 화면 공유 기능으로 많은 주목을 받았습니다. 이번 업데이트에서 Google은 새로운 음성 및 화면 인식 상호 작용을 도입했습니다. 사용자는 Mac 키보드에서 Fn 키를 길게 눌러 전역 음성 모드를 빠르게 활성화하고 "스마트 받아쓰기" 기능을 켜면 됩니다.

기존의 단어 대 단어 받아쓰기 모드와 달리, 이 기능은 말하는 사람이 말을 잃을 때 "음, 아"와 같은 일시정지 단어와 말실수를 자동으로 필터링하고, 현재 활성 상태인 Slack, Apple Notes, Mail 등의 창에 깔끔하고 명확하게 표현된 텍스트를 직접 입력할 수 있는 휴대용 실시간 편집기와 같습니다.

또한 사용자는 애플리케이션 설정에서 "Gemini Inference" 스위치를 수동으로 켤 수도 있습니다. 일단 켜지면 Gemini는 현재 화면 내용을 감지할 수 있습니다. 사용자는 데스크탑에서 여러 PDF, 이미지 또는 로컬 문서를 직접 선택할 수 있으며 음성 명령을 사용하여 주요 정보를 추출하고 요약 이메일을 작성할 수 있습니다. 또한 모든 애플리케이션에서 텍스트를 강조 표시하고 2차 다듬질을 요청하거나 화면의 이미지를 가리켜 미세 조정 및 변형 생성을 직접 시작할 수도 있습니다.

현재 이 음성 및 애플리케이션 간 협업 기능은 전 세계 macOS Gemini 사용자에게 점진적으로 출시되었습니다. 초기에는 영어를 지원하며 앞으로 더 많은 언어로 확장될 예정입니다. Mac 사용자는 Google의 공식 채널로 직접 이동하여 다음을 다운로드하고 경험할 수 있습니다.

http://gemini.google/mac