Function: generateTranscription()
function generateTranscription<TAdapter, TStream>(options): TranscriptionActivityResult<TStream>;
정의 위치: packages/ai/src/activities/generateTranscription/index.ts:189
오디오를 텍스트로 변환하는 트랜스크립션 활동입니다.
AI 음성-텍스트 모델을 사용하여 오디오 콘텐츠를 트랜스크립션합니다.
타입 매개변수
TAdapter
TAdapter extends TranscriptionAdapter<string, TranscriptionProviderOptions<TAdapter>>
TStream
TStream extends boolean = false
매개변수
options
TranscriptionActivityOptions<TAdapter, TStream>
반환값
TranscriptionActivityResult<TStream>
예제
오디오 파일 트랜스크립션
import { generateTranscription } from '@tanstack/ai'
import { openaiTranscription } from '@tanstack/ai-openai'
const result = await generateTranscription({
adapter: openaiTranscription('whisper-1'),
audio: audioFile, // File, Blob, or base64 string
language: 'en'
})
console.log(result.text)
타임스탬프를 포함한 상세 출력
const result = await generateTranscription({
adapter: openaiTranscription('whisper-1'),
audio: audioFile,
responseFormat: 'verbose_json'
})
result.segments?.forEach(segment => {
console.log(`[${segment.start}s - ${segment.end}s]: ${segment.text}`)
})
스트리밍 트랜스크립션 결과
for await (const chunk of generateTranscription({
adapter: openaiTranscription('whisper-1'),
audio: audioFile,
stream: true
})) {
console.log(chunk)
}