Empresas
Empregos
  • Sobre nós
  • Soluções
    • Publicação de vagas
      Publique sua vaga e receba candidatos qualificados em 48h.
    • Avaliações de candidatos
      Mais de 500 testes técnicos e psicológicos, mais anti-fraude.
    • Headhunting
      Busca executiva personalizada do início ao fim.
    • Folha de Pagamento + EOR
      Dispersão de folha e EOR em mais de 15 países da LATAM.
  • Preços
  • Empregos

0

232
Visualizações
busque en cada uno de los cubos s3 y vea si existe la carpeta dada

Estoy tratando de obtener los archivos de carpetas específicas en s3 Buckets:

Tengo 4 cubos en s3 con los siguientes nombres:

 1 - 'PDF' 2 - 'TXT' 3 - 'PNG' 4 - 'JPG'

La estructura de carpetas para todos los cubos s3 se ve así:

 1- PDF/analysis/pdf-to-img/processed/files 2- TXT/report/processed/files 3- PNG/analysis/reports/png-to-txt/processed/files 4- JPG/jpg-to-txt/empty

Tengo que verificar si este prefijo de carpeta processed/files está presente en el depósito, y si está presente, leeré los archivos presentes en esos directorios, de lo contrario los ignoraré.


Código:

 buckets = ['PDF','TXT','PNG','JPG'] client = boto3.client('s3') for i in bucket: result = client.list_objects(Bucket=i,Prefix = 'processed/files', Delimiter='/') print(result)

Puedo ingresar a cada directorio si la estructura de carpetas es la misma, pero ¿cómo puedo manejar esto cuando la estructura de carpetas varía para cada depósito?

over 4 years ago · Santiago Trujillo
2 Respostas
Responde à pergunta

0

Este es quizás un proceso largo.

 buckets = ['PDF','TXT','PNG','JPG'] s3_client = getclient('s3') for i in buckets: result = s3_client.list_objects(Bucket= i, Prefix='', Delimiter ='') contents = result.get('Contents') for content in contents: if 'processed/files/' in content.get('Key'): print("Do the process")

Puede obtener la lista de directorios del depósito s3. Si contiene la carpeta requerida, realice el proceso requerido.

over 4 years ago · Santiago Trujillo Relatório

0

import boto3 client = boto3.client('s3') bucket_name = "bucket_name" prefix = "" s3 = boto3.client("s3") result = client.list_objects(Bucket=bucket_name, Delimiter='/') for obj in result.get('CommonPrefixes'): prefix = obj.get('Prefix') file_list = ListFiles(client,bucket_name,prefix) for file in file_list: if "processed/files" in file: print("Found",file) def ListFiles(client, bucket_name, prefix): _BUCKET_NAME = bucket_name _PREFIX = prefix """List files in specific S3 URL""" response = client.list_objects(Bucket=_BUCKET_NAME, Prefix=_PREFIX) for content in response.get('Contents', []): #print(content) yield content.get('Key') 

ingrese la descripción de la imagen aquí ] 1

over 4 years ago · Santiago Trujillo Relatório
Responde à pergunta
Encontrar trabalhos remotos

Descubra a nova forma de encontrar um emprego!

melhores empregos
Principais categorias de trabalho
Empresas
Postar vaga Preços Comercial
Jurídico
Termos e Condições Política de privacidade
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Recomende algumas ofertas para mim
Preciso de ajuda