토론

햇살 가득한 절벽 길이 키 큰 황금빛 풀 사이로 구불구불 이어진다. 아래로

Wikiprompt, 무료 프롬프트 백과사전에서

宝玉
기여자宝玉X출처

2024년 8월 28일

햇살 가득한 절벽 길이 키 큰 황금빛 풀 사이로 구불구불 이어진다. 아래로 Excel/CSV에서 대규모 데이터셋을 분류하기 위해 AI를 사용하는 단계별 가이드 - 샘플 프롬프트와 파일 분할, 처리, 병합을 위한 워크플로우 포함.

프롬프트 내용저장

🌐
첫째, 이 작업은 한 번에 완료할 수 없습니다. 더 간단한 작업으로 나누고 AI가 각 단계를 반자동으로 완료하도록 도와야 합니다. 어려운 점: 1. Excel 데이터를 읽어야 함 2. 각 레코드를 분류하기 위해 AI가 필요함 3. 결과를 Excel에 다시 작성해야 함 4. 20,000개 레코드를 한 번에 처리할 수 없음 - 여러 배치로 나누고 병합해야 함 제가 접근하는 방법은 다음과 같습니다: 1. Excel을 CSV로 내보내고 분류에 필요한 필드만 유지하되, 두 필드는 필수입니다: 부품 ID와 부품 설명. 대형 언어 모델은 텍스트를 잘 처리하고 비용 효율적이므로 순수 텍스트로 충분합니다. 멀티모달은 더 복잡할 것입니다. 2. 프로그램을 사용하여 대형 CSV를 여러 개의 작은 CSV 파일로 분할합니다. 20,000개 레코드는 컨텍스트 창에 들어가지 않습니다. 배치당 몇 개의 레코드가 가장 잘 작동하는지 테스트하십시오 (예: 100, 50, 10). 3. 입력 부품 ID와 설명을 기반으로 분류를 생성하는 프롬프트를 작성합니다. 이것이 핵심 작업입니다: a) LLM이 선택할 수 있는 사전 정의된 카테고리 b) 쉬운 파싱을 위한 출력 데이터 구조 정의 (JSON, XML, YAML 또는 CSV) c) 원하는 구조를 출력하도록 프롬프트 작성 GPT-4o용 예시 프롬프트: 20,000행의 단편화된 부품 설명이 있는 Excel이 있습니다. 각 행을 분류하기 위해 AI를 사용하고 싶습니다. 다음을 생성해 주세요: - 각각 약 1문단 분량의 상세한 부품 설명 5개 - 약 10개 항목의 완전한 부품 카테고리 세트 - 부품 ID와 설명을 입력으로 받아 해당 카테고리를 JSON 형식으로 반환하는 프롬프트. 입력 예시: [{"id": "123", "description": "XXXXX"}, {"id": "345", "description": "YYYY"}]. 출력 예시: {"123": "cat1", "345": "cat2"} 4. LLM API를 호출하는 프로그램을 작성합니다: a) 한 번에 하나의 작은 CSV 파일 읽기 b) CSV를 파싱하여 부품 목록 얻기 c) 프롬프트와 부품 목록으로 LLM API 호출 d) API 응답을 파싱하여 ID-카테고리 매핑 얻기 e) 카테고리가 추가된 새 CSV로 저장 f) 모든 파일이 처리될 때까지 반복 5. 모든 분류된 CSV 파일을 하나의 대형 CSV로 병합하고 Excel로 다시 가져옵니다. 핵심은 복잡한 문제를 더 작은 문제로 나누고 각 단계에 AI를 사용하는 것입니다. 문제가 발생하면 LLM에 도움을 요청하십시오.

전체 프롬프트를 보려면 로그인하세요

Continue with:

By logging in, you agree to our Terms of Use and Privacy Policy

사용법

이 프롬프트는 productivity와 함께 사용하도록 설계되었습니다. 위의 프롬프트 내용을 복사하여 원하는 AI 도구에 붙여넣으세요.

최상의 결과를 얻으려면 자리 표시자(대괄호 또는 대문자로 표시)를 특정 요구 사항으로 사용자 지정할 수 있습니다.

참고 자료

분류:productivity| twitter| excel| csv

토론