Case 05 · 서아 / Athena

대화가 이어지고,
일이 정리되는 비서.

일정·할 일·리서치를 음성과 화면의 한 경험으로 연결한 개인용 Mac 비서입니다. 저는 사용 경험을 설계하고, 다섯 개 AI 개발 작업을 조율해 하나의 앱으로 통합했습니다.1

개인 프로젝트기능 통합 후 개선 중
음성 입력에서 일정과 할 일, 사용자 확인으로 이어지는 개인 비서 경험의 개념도
사용 경험 개념도 · 실제 앱 화면이나 세부 구현 구조도가 아닙니다.
내 역할
문제 정의 · 대화 경험 설계 · AI 개발 지휘 · 통합·검증
협업 방식
AI가 역할별 구현을 수행하고, 저는 범위·우선순위·완성 기준을 결정
이미 쓰는 정보와 연결
iPhone ↔ Mac기존 캘린더·미리알림 활용
말과 결과를 함께
음성 + 화면짧게 묻고, 눈으로 확인하며 진행
하나의 제품으로
개인용 Mac 앱흩어진 기능을 하나의 사용 경험으로
Product experience

처음부터 다시
설명하지 않도록.

부르는 순간부터 다음 행동을 고를 때까지. 기능 하나보다, 그 사이에서 대화가 끊기지 않는 경험에 집중했습니다.

01

방금 본 결과에서,
다음 질문으로

한 번 부른 뒤 이어서 말하고, 앞서 찾은 장소나 정보에 대해 더 묻습니다. 바꾸고 싶은 내용이 생기면 현재 초안에서 수정할 수 있습니다.

같은 맥락을 매번 다시 입력하는 부담을 줄이는 흐름

02

말은 짧게,
자세한 내용은 화면에

일정 목록이나 변경 초안을 길게 읽는 대신, 필요한 안내만 말하고 결과를 함께 보여줍니다. 사용자는 듣는 동안에도 내용을 살펴볼 수 있습니다.

음성의 편리함과 화면의 확인 가능성을 함께 설계

03

확인한 정보에서,
다음 할 일까지

오늘의 일정과 할 일을 함께 보고, 필요한 정보를 조사합니다. 선택한 결과는 일정이나 할 일의 변경 초안으로 이어집니다.

조회·조사·변경을 오가는 작업을 한곳에 연결

Design decisions

편한 대화 뒤에는,
분명한 판단이 있습니다.

기능을 더하는 것만큼, 사용자가 무엇을 이해하고 결정할 수 있어야 하는지를 정했습니다.

01

문장 하나보다,
사용자의 맥락

짧은 후속 질문을 별개의 명령으로 처리하면 대화가 끊겼습니다. 앞선 결과와 남아 있는 초안을 함께 고려하고, 무엇을 이해했는지 보여 주는 방향으로 바꿨습니다.

02

‘없음’과
‘확인 못 함’의 구분

가져오지 못한 정보를 빈 결과처럼 보여 주면 사용자의 판단이 틀어집니다. 조회 실패나 동기화 상태를 드러내, 결과가 없는 것과 확인할 수 없는 것을 구분했습니다.

03

의도는 유연하게,
변경은 분명하게

자연스러운 말은 AI가 해석하되, 중요한 외부 변경은 검토할 초안과 확인을 거치게 했습니다. 무엇을 바꾸는지 알고 진행할 수 있는 흐름이 기준입니다.

Development direction

여러 구현을,
한 제품으로.

개발 작업을 나누는 것과 제품을 완성하는 것은 별개의 일입니다. 공유 화면과 기능의 접점을 조율하고, 합친 결과를 같은 기준으로 확인했습니다.

Phosynd · 판단과 조율

문제·범위·통합 기준

먼저 검증할 가정을 고르고, 작업의 주인과 합칠 순서를 정했습니다. 사용자의 경험과 전체 완성도는 제가 책임지는 범위였습니다.

AI · 역할별 개발 지원

분리된 구현과 수정

기능 구현과 별도 검토를 나눠 진행했습니다. 각 작업의 결과를 검토하고 수정하는 과정을 거쳐 전체 앱에 연결했습니다.

  1. 문제 정의
  2. 역할 분리
  3. 통합
  4. 전체 검증
Evidence

작동 여부와
사용 경험을 따로 확인.

자동 테스트로 기능의 연결을 확인하고, 실제 기기에서 일상 기능을 점검했습니다. 호출어는 별도의 녹음 비교로 다듬었습니다.2

자동 기능 테스트 476개 통과
저장된 품질 검증 기록입니다. 실제 모델 호출과 개인 데이터 변경을 분리한 테스트로, 일정·할 일·대화·확인 흐름을 점검했습니다.
실제 기기 점검 일상 흐름 확인
브리핑, 음성으로 확인한 일정 반영, 말 끊기, 폰에서 등록한 할 일과 우선순위 표시가 기능 확인 문서에 완료로 기록되어 있습니다.
호출어 조정 실험 절충 검토
같은 녹음에서 헛호출은 32/63 → 0/63으로 줄었고, 실제 호출 인정도 139/192 → 125/192로 감소했습니다. 오작동 감소와 호출 누락을 함께 비교했습니다.
녹음 비교의 범위

저장된 실험에서 소음·잡담 녹음 63개와 실제 호출 녹음 192개를 각각 동일한 녹음 묶음으로 비교했습니다. 해당 녹음 묶음의 결과이며, 앱 전체의 정확도나 일상 환경의 무오탐을 뜻하지 않습니다.

What I bring
AI가 만든 조각을,
사용자가 쓰는 제품으로.

서아는 제가 문제를 정의하고, 서로 다른 구현을 연결하고, 완성 기준에 맞춰 검증한 작업입니다. 기능을 만드는 능력과 하나의 경험으로 완성하는 판단을 함께 담았습니다.

  • 제품 문제 정의
  • 대화 UX
  • AI 개발 조율
  • 통합·검증
출처와 범위
  1. 개인 프로젝트의 제품 설계·개발 조율·기능 확인 기록. 다섯 개는 기능 구현과 별도 검토를 나눈 개발 작업 기준이며, 앱에서 실행되는 비서 수가 아닙니다. 일정·할 일·조사의 구현 범위와 완료된 사용자 기능 확인을 구분했습니다.
  2. 저장된 품질 검증 문서, 자동 테스트 정의, 호출어 개선 비교 기록. 자동 기능 테스트·실제 기기 기능 확인·녹음 비교는 서로 다른 검증입니다. 각 결과는 기능 연결, 확인한 사용자 흐름, 해당 녹음 묶음의 범위에 한정됩니다.