Business
Jobs
  • About Us
  • Solutions
    • Job Postings
      Post your job and receive qualified candidates in 48h.
    • Candidate Assessments
      500+ technical and psychological tests, plus anti-fraud.
    • Headhunting
      Tailor-made executive search from start to finish.
    • Payroll + EOR
      Payroll dispersal and EOR across 15+ LATAM countries.
  • Pricing
  • Jobs

0

358
Views
Usando sklearn cross_val_score y kfolds para ajustar y ayudar a predecir el modelo

Estoy tratando de entender el uso de la validación cruzada de kfolds del módulo sklearn python.

Entiendo el flujo básico:

  • instanciar un modelo, por ejemplo model = LogisticRegression()
  • ajustando el modelo, por ejemplo model.fit(xtrain, ytrain)
  • predicción, por ejemplo model.predict(ytest)
  • utilice, por ejemplo, la puntuación de val cruzada para probar la precisión del modelo ajustado.

Donde estoy confundido es usar sklearn kfolds con puntaje de val cruzado. Según tengo entendido, la función cross_val_score se ajustará al modelo y predecirá en los kfolds, lo que le dará una puntuación de precisión para cada pliegue.

por ejemplo, usando un código como este:

 kf = KFold(n=data.shape[0], n_folds=5, shuffle=True, random_state=8) lr = linear_model.LogisticRegression() accuracies = cross_val_score(lr, X_train,y_train, scoring='accuracy', cv = kf)

Entonces, si tengo un conjunto de datos con datos de entrenamiento y prueba, y uso la función cross_val_score con kfolds para determinar la precisión del algoritmo en mis datos de entrenamiento para cada pliegue, ¿el model ahora está ajustado y listo para la predicción en los datos de prueba? Entonces, en el caso anterior usando lr.predict

over 4 years ago · Santiago Trujillo
1 answers
Answer question

0

No, el modelo no está ajustado. Mirando el código fuente de cross_val_score :

 scores=parallel(delayed(_fit_and_score)(clone(estimator),X,y,scorer, train,test,verbose,None,fit_params)

Como puede ver, cross_val_score clona el estimador antes de ajustarle los datos de entrenamiento de plegado. cross_val_score le dará una serie de puntuaciones que puede analizar para saber cómo se desempeña el estimador para diferentes pliegues de los datos para verificar si se ajusta demasiado a los datos o no. Puedes saber más al respecto aquí

Debe ajustar todos los datos de entrenamiento al estimador una vez que esté satisfecho con los resultados de cross_val_score , antes de poder usarlos para predecir los datos de prueba.

over 4 years ago · Santiago Trujillo Report
Answer question
Find remote jobs

Discover the new way to find a job!

Top jobs
Top job categories
Business
Post vacancy Pricing Sales
Legal
Terms and conditions Privacy policy
© 2026 PeakU Inc. All Rights Reserved.
Andres GPT
Show me some job opportunities
There's an error!