'오픈에이아이 음성 텍스트 변환(OpenAI Speech To Text, STT)' 이벤트 아이템은 오픈에이아이(OpenAI)의 Whisper 모델로 오디오 파일을 텍스트로 변환·전사·받아쓰기 합니다.
AI 음성 인식, 오디오 전사, 회의나 인터뷰 기록 생성, 음성 명령 처리, 자막 접근성에 사용합니다.



- 모델 유형(Model Type)
- 사용할 OpenAI 모델을 선택합니다 (예: gpt-5.4, gpt-5.4-mini). 사용 가능한 모델은 API 키에 따라 달라집니다. 콤보 목록에서 선택하거나 모델명을 직접 입력할 수 있습니다.
- 엔드포인트(End Point)
- 사용자 정의 API 엔드포인트 URL을 입력합니다. 비워두면 기본 OpenAI 엔드포인트가 사용됩니다. Azure OpenAI 또는 호환 프록시 사용 시 활용합니다.
- 오디오 입력 경로(Audio Input Path)
- 변환할 오디오 파일의 전체 경로를 입력합니다. 지원 형식: mp3, mp4, mpeg, mpga, m4a, wav, webm.
- 언어(Language)
- 오디오의 BCP-47 언어 코드를 입력합니다 (예: ko, en, ja). 언어를 지정하면 정확도와 속도가 향상됩니다. 비워두면 자동 감지됩니다.
- 프롬프트(Prompt)
- 모델 스타일을 유도하거나 도메인별 용어를 지정할 선택적 힌트를 입력합니다. 특수 용어나 약어를 인식시키는 데 유용합니다.
- 결과(Result) : 변환된 텍스트를 저장할 변수명을 입력합니다. Result는 String 형식의 변수입니다.