본문으로 건너뛰기

Function: generateTranscription()

function generateTranscription<TAdapter, TStream>(options): TranscriptionActivityResult<TStream>;

정의 위치: packages/ai/src/activities/generateTranscription/index.ts:189

오디오를 텍스트로 변환하는 트랜스크립션 활동입니다.

AI 음성-텍스트 모델을 사용하여 오디오 콘텐츠를 트랜스크립션합니다.

타입 매개변수

TAdapter

TAdapter extends TranscriptionAdapter&lt;string, TranscriptionProviderOptions&lt;TAdapter>>

TStream

TStream extends boolean = false

매개변수

options

TranscriptionActivityOptions&lt;TAdapter, TStream>

반환값

TranscriptionActivityResult&lt;TStream>

예제

오디오 파일 트랜스크립션

import { generateTranscription } from '@tanstack/ai'
import { openaiTranscription } from '@tanstack/ai-openai'

const result = await generateTranscription({
adapter: openaiTranscription('whisper-1'),
audio: audioFile, // File, Blob, or base64 string
language: 'en'
})

console.log(result.text)

타임스탬프를 포함한 상세 출력

const result = await generateTranscription({
adapter: openaiTranscription('whisper-1'),
audio: audioFile,
responseFormat: 'verbose_json'
})

result.segments?.forEach(segment => {
console.log(`[${segment.start}s - ${segment.end}s]: ${segment.text}`)
})

스트리밍 트랜스크립션 결과

for await (const chunk of generateTranscription({
adapter: openaiTranscription('whisper-1'),
audio: audioFile,
stream: true
})) {
console.log(chunk)
}