Discussion

Concevoir un algorithme basé sur LLM pour organiser les sous-titres en paragraphes et chapitres

De Wikiprompt, l’encyclopédie libre de prompts

宝玉
Contribué par宝玉XSource

19 déc. 2024

Concevoir un algorithme basé sur LLM pour organiser les sous-titres en paragraphes et chapitres Un invite détaillée demandant de concevoir un algorithme utilisant un LLM pour organiser des segments de sous-titres en paragraphes et chapitres, avec des contraintes spécifiques sur la fenêtre de contexte, la pagination, le coût et le format de sortie.

Contenu du PromptEnregistrer

🌐
Voici une traduction en français de votre demande : --- Maintenant, j'ai un fichier de sous-titres au format JSON, structuré comme suit : ```TypeScript type SubtitleSegment = { start: number; end: number; text: string; words: { word: string; start: number; end: number }[]; }; type Subtitle = { segments: SubtitleSegment[]; }; ``` Un segment peut être compris comme une phrase ou une partie de phrase. Veuillez maintenant concevoir un algorithme qui, en se basant sur les relations entre les phrases du contenu du fichier de sous-titres, organise le tout en paragraphes (Paragraph) et en chapitres (Chapter). Le format de retour est : ```TypeScript type Paragraph = { start: number; end: number; text: string; segments: SubtitleSegment[]; }; type Chapter = { title: string; paragraphs: Paragraph[]; }; type Transcription = { chapters: Chapter[]; }; ``` Utilisez la technologie des grands modèles de langage (LLM), mais tenez compte des points suivants : 1. La longueur de la fenêtre de contexte - le contenu des sous-titres peut être très long, il est donc nécessaire de paginer au préalable. 2. Lors de la pagination, veillez à ce qu'il n'y ait pas de rupture entre les paragraphes et les chapitres - c'est-à-dire qu'un chapitre ne doit pas être réparti sur deux pages, ce qui rendrait le contexte incohérent. 3. Les grands modèles de langage ne sont pas doués pour compter - il ne faut donc pas leur demander de sortir des positions de caractères ; ils doivent uniquement renvoyer les résultats segmentés pour analyse. 4. Les grands modèles de langage peuvent renvoyer des données structurées, mais il faut noter que le contenu renvoyé n'est pas toujours précis - il peut y avoir des suppressions de texte ou de ponctuation. 5. Il est préférable de prendre en compte le coût d'appel des modèles - il ne faut pas que le nombre d'appels soit trop élevé ou que les données transférées soient trop volumineuses. Par exemple, est-il possible de renvoyer en une seule fois la relation entre chapitres et paragraphes ? Veuillez concevoir un algorithme, en vous aidant éventuellement de code pour l'expliquer.

Connectez-vous pour voir le prompt complet

Continuer avec:

En vous connectant, vous acceptez nos Conditions et Confidentialité

Utilisation

Ce prompt est conçu pour être utilisé avec coding. Copiez le contenu ci-dessus et collez-le dans votre outil d’IA préféré.

Pour de meilleurs résultats, personnalisez les espaces réservés (indiqués par des crochets ou des majuscules) selon vos besoins.

Références

Catégories :coding| twitter| llm-algorithm| subtitle-processing

Discussion