AI 영어회화 연습 (말하기, 베타) (무료)
카페 주문, 길 묻기, 면접 같은 상황을 고르고 마이크로 말하면 AI 튜터가 그 역할을 맡아 영어로 대답해 줘요. 음성 인식과 대화 AI 모두 이 브라우저 안에서 돌아가고, 내 목소리와 대화 내용은 기기 밖으로 나가지 않아요.
도구를 불러오는 중이에요...
영어 회화는 혼자 공부하면 실제로 말해 볼 상대가 없어서 입이 잘 안 떨어지는 경우가 많아요. 이 도구는 브라우저 안에서 돌아가는 음성 인식 AI(Whisper 영어 전용 모델)로 내 말을 글로 바꾸고, 대화 생성 AI(이 브라우저가 WebGPU를 지원하면 더 똑똑한 Qwen3-0.6B, 지원하지 않으면 작은 Qwen2.5-0.5B-Instruct를 자동으로 골라요)가 상황에 맞는 역할을 맡아 짧은 영어로 대답해요. 마치 간단한 영어 롤플레이 상대가 항상 옆에 있는 것과 비슷해요.
어떻게 동작하나요
먼저 연습할 상황(시나리오)과 난이도를 고르면, 그 상황에 맞는 역할(바리스타, 호텔 직원 등)을 맡은 AI 튜터가 준비돼요. 마이크 버튼을 눌러 말하면 이 기기 안에서 16kHz로 오디오를 처리하고, Whisper 음성 인식 모델이 글로 바꿔서 입력칸에 보여줘요. 이 글은 보내기 전에 자유롭게 고칠 수 있고, 아예 타이핑만 해도 괜찮아요. "보내기"를 누르면 작은 언어모델이 짧은 영어 대답과 질문 하나를 만들어서 돌려줘요. 대답이 길지 않은 이유는 짧고 단순한 문장일수록 영어 학습에 더 도움이 되고, 모델이 더 안정적으로 동작하기 때문이에요. 매 턴마다 "피드백"에서는 방금 내가 한 말을 더 자연스러운 영어로 바꾼 예시와 한국어 팁을 보여주고, 모델 출력이 이상한 형식이면 조용히 숨겨서 억지로 틀린 피드백을 보여주지 않아요. "추천 답변 보기"를 누르면 다음에 뭐라고 대답하면 좋을지 AI가 예시를 제안해요.
이럴 때 쓰세요
- 여행 전에 카페 주문, 호텔 체크인, 길 묻기 같은 상황을 영어로 미리 연습하고 싶을 때
- 면접이나 자기소개를 영어로 준비하면서 짧게 질문-답변을 주고받아 보고 싶을 때
- 말할 상대 없이 혼자서도 영어로 입을 떼는 연습을 하고 싶을 때
- 내가 한 말이 더 자연스러운 표현으로 어떻게 바뀌는지 보면서 표현을 늘리고 싶을 때
- 특정 주제 없이 자유 대화로 부담 없이 영어 말하기 감을 유지하고 싶을 때
사용 방법
- 연습할 시나리오(카페 주문, 길 묻기, 호텔 체크인, 자기소개·면접, 쇼핑, 병원 예약, 자유 대화)와 난이도(초급·중급)를 고르고 "대화 시작"을 눌러요.
- 🎙 버튼을 눌러 말하거나, 입력칸에 직접 타이핑해요. 음성으로 말하면 AI가 알아들은 글이 입력칸에 나오니 확인하고 고쳐도 돼요.
- "보내기"를 누르면 AI 튜터가 역할에 맞는 짧은 영어 대답과 질문을 보여줘요. "AI 대답 자동으로 듣기"를 켜 두면 기기 음성으로 바로 들려줘요.
- 대답 아래 "피드백"에서 더 자연스러운 표현과 한국어 팁을 확인하고, "추천 답변 보기"로 다음 대답 예시도 참고해요.
- 대화를 몇 번 주고받은 뒤 "대화 종료 및 요약 보기"를 누르면 턴 수, 말한 단어 수, 새로 배운 표현을 보고 .txt로 저장할 수 있어요.
지원 형식과 한계
- 시나리오 7종(카페 주문·길 묻기·호텔 체크인·자기소개·면접·쇼핑·병원 예약·자유 대화) × 난이도 2종(초급·중급)
- 음성 인식 모델: 영어 전용 Whisper 모델 2종(기본 base.en 약 77MB, 가벼운 tiny.en 약 41MB)
- 대화 생성 모델: 이 브라우저가 WebGPU를 지원하면 onnx-community/Qwen3-0.6B-ONNX(약 570MB)를, 지원하지 않으면 onnx-community/Qwen2.5-0.5B-Instruct(약 300~500MB)를 자동으로 선택해요. 둘 다 처음 한 번만 다운로드해요
- 고품질 대화 모델(Qwen3-0.6B)은 WebGPU를 지원하는 최신 브라우저와 그래픽 드라이버가 필요해요. 지원하지 않는 기기에서는 자동으로 기본 모델(WASM)로 바뀌어요
- 듣기(TTS): 브라우저의 음성 합성 기능을 그대로 써요. 기기에 설치된 음성에 따라 품질이 달라요
- 녹음 길이는 최대 20초로 제한돼요. 모델이 작은 편이라(0.5B~0.6B) 길고 복잡한 문장, 전문적인 주제에는 약할 수 있어요
- AI는 가끔 문법이 어색하거나 상황과 안 맞는 대답을 할 수 있어요 (베타)
더 잘 쓰는 팁
- 처음에는 쉬운 시나리오(카페 주문, 자유 대화)로 익숙해진 뒤 면접·병원 예약처럼 어려운 상황으로 넘어가 보세요.
- 조용한 곳에서 마이크에 가까이 대고 또박또박 말하면 음성 인식이 더 정확해져요.
- AI의 대답이 이상하면 당황하지 말고 다시 말하거나 타이핑으로 바꿔서 대화를 이어가 보세요.
- 피드백에 나온 "더 자연스러운 표현"을 다음 문장에서 바로 써 보면 기억에 잘 남아요.
- 휴대폰에서는 음성 인식 모델을 가벼운 모델(tiny.en)로 쓰고, 가능하면 PC와 Wi-Fi 환경에서 써 보세요.
문제 해결
- 마이크 권한 창이 뜨지 않으면 주소창 왼쪽 자물쇠 아이콘에서 마이크 권한을 허용해 주세요. 마이크가 안 돼도 타이핑으로 계속 쓸 수 있어요.
- 모델 다운로드가 오래 걸리면 네트워크 상태를 확인하고 기다려 주세요. 특히 대화 AI(약 300~500MB, WebGPU 지원 기기는 약 570MB)는 처음에 시간이 걸려요. 한 번 받으면 다음부터는 바로 불러와요.
- AI 대답이 너무 늦거나 멈추면 페이지를 새로고침하고 다시 시도해 주세요. 휴대폰이라면 PC로 시도해 보는 것도 방법이에요.
- "듣기"가 안 되면 이 기기에 영어 음성이 설치돼 있는지 운영체제 설정에서 확인해 보세요.
- 피드백이 계속 안 보이면 모델이 형식에 안 맞는 답을 준 경우예요. 대화를 몇 턴 더 이어가면 다시 나타날 수 있어요.
사용한 오픈소스
음성 인식에는 OpenAI의 Whisper 영어 전용(.en) 모델을 Hugging Face Xenova 계정이 ONNX로 변환한 버전을 쓰고, 모델 카드 기준 라이선스는 Apache-2.0이에요. 대화 생성에는 이 브라우저가 WebGPU를 지원하면 Qwen의 Qwen3-0.6B(Apache-2.0)를, 지원하지 않으면 onnx-community의 Qwen2.5-0.5B-Instruct(Apache-2.0)를 자동으로 선택해서 써요. Qwen2.5 모델은 Transformers.js 4.3.0(Apache-2.0, Hugging Face)과 그 안에 포함된 ONNX Runtime Web(MIT, Microsoft)으로 WebAssembly로 실행되고, Qwen3 모델은 Transformers.js 3.7.2(Apache-2.0, Hugging Face)로 WebGPU 위에서 실행돼요. 음성 인식 모델도 같은 Transformers.js 계열로 WebAssembly로 실행돼요. 자세한 고지와 저작권 표시 전문은 오픈소스·모델 고지 페이지에 있어요.
자주 묻는 질문
내 목소리와 대화 내용이 서버로 전송되나요?
아니요. 음성 인식(Whisper)과 대화 AI(이 브라우저가 WebGPU를 지원하면 Qwen3-0.6B, 지원하지 않으면 Qwen2.5-0.5B) 모두 이 브라우저 안에서 처리돼요. 처음 한 번만 모델 파일을 내려받고, 그 뒤로는 기기 밖으로 아무것도 나가지 않아요.
AI가 항상 정확하고 자연스러운 대답을 하나요?
아니요. WebGPU를 지원하는 기기는 더 똑똑한 Qwen3-0.6B 모델을 써서 더 자연스럽지만, 지원하지 않는 기기는 작은 0.5B(5억 개 파라미터) 모델을 쓰기 때문에 가끔 문법이 어색하거나 상황에 안 맞는 대답을 할 수 있어요. 베타 기능이니 참고용으로 편하게 연습하는 데 써 주세요.
처음에 뭘 내려받나요? 용량이 얼마나 되나요?
처음 한 번만 음성 인식 모델(약 77MB, 가벼운 모델은 약 41MB)과 대화 AI 모델을 내려받아요. 이 기기가 WebGPU를 지원하면 더 똑똑한 대화 AI(약 570MB)를, 지원하지 않으면 기본 대화 AI(약 300~500MB)를 받아요. Wi-Fi에서 받는 걸 추천하고, 한 번 받으면 브라우저에 저장되어 다음부터는 다시 받지 않아요.
마이크 없이도 쓸 수 있나요?
네. 마이크로 말하는 대신 입력칸에 직접 타이핑해서 AI와 대화할 수 있어요. 마이크 권한이 막혀 있어도 타이핑으로 전체 기능을 쓸 수 있어요.
휴대폰에서도 잘 되나요?
PC를 권장해요. 휴대폰은 메모리와 처리 속도가 부족해 모델을 불러오는 데 오래 걸리거나 느릴 수 있어요. 휴대폰에서는 가벼운 음성 인식 모델(tiny.en)을 자동으로 추천해요.
더 알아보기
혼자서 영어 말하기를 연습하는 전체적인 방법은 혼자 영어 말하기 연습하는 법 가이드에서, 발음을 따로 다듬고 싶다면 영어 발음 연습·체크 도구를 함께 써 보세요.