LLM 기반 알고리즘을 설계하여 자막을 문단과 장(chapter)으로 구성합니다.
Wikiprompt, 무료 프롬프트 백과사전에서
LLM 기반 알고리즘을 설계하여 자막을 문단과 장(chapter)으로 구성합니다. LLM을 사용하여 자막 세그먼트를 문단과 장으로 구성하는 알고리즘을 설계하라는 상세한 프롬프트로, 컨텍스트 창, 페이지 매김, 비용, 출력 형식에 대한 특정 제약 조건을 포함합니다.
프롬프트 내용저장
🌐
现在我有一个字幕json文件,格式为
```TypeScript
type SubtitleSegment = {
start: number;
end: number;
text: string;
words: { word: string; start: number; end: number }[];
};
type Subtitle = {
segments: SubtitleSegment[];
};
```
Segment可以理解为一个句子或者句子的一部分,现在请帮我设计一个算法,根据字幕文件内容中句子之间的关系,整理成段落(Paragraph)和章节(Chapter)。
返回的格式为
```TypeScript
type Paragraph = {
start: number;
end: number;
text: string;
segments: SubtitleSegment[];
};
type Chapter = {
title: string;
paragraphs: Paragraph[];
};
type Transcription = {
chapters: Chapter[];
};
```
使用大语言模型技术,但是要考虑:
1. 上下文窗口长度,字幕内容可能很长很长,所以需要事先分页
2. 如果分页,注意不要让段落和章节之间出现断层,也就是不要让一个章节的内容被分到两页中导致上下文不连贯
3. 大语言模型不擅长数数,所以不能要求它输出字符位置,只能返回拆分后的结果做分析
4. 大语言模型可以返回结构化数据,但是要注意返回的内容不一定精准,可能会有删减文字、标点
5. 最好能考虑大模型调用的成本,不要让大模型调用次数太多或者传输的数据太多,比如是否可以一次返回章节和段落的关系
请设计算法,可以辅助代码说明
전체 프롬프트를 보려면 로그인하세요
Continue with:
By logging in, you agree to our Terms of Use and Privacy Policy
사용법
이 프롬프트는 coding와 함께 사용하도록 설계되었습니다. 위의 프롬프트 내용을 복사하여 원하는 AI 도구에 붙여넣으세요.
최상의 결과를 얻으려면 자리 표시자(대괄호 또는 대문자로 표시)를 특정 요구 사항으로 사용자 지정할 수 있습니다.
토론
댓글 0개