RPubs will retire in June 2027. Your existing documents will stay accessible through December 31, 2031
and Connect Cloud is the recommended home for new publishing. Read the blog post

Recently Published

Questão 01 - CPAD
Presentation Deck
Next word prediction app presentation deck
Contratos públicos y bloques políticos
Este reporte analiza contratos públicos de partidos políticos en México a partir de dos bases de datos proporcionadas por MCCI. El documento integra una exploración general de los datasets, un análisis descriptivo de contratos_montos.csv y un pipeline de clasificación supervisada con tidymodels para identificar bloques políticos contratantes. La variable objetivo clasifica los registros en tres grupos: oficialista, definido únicamente como Morena; oposición tradicional, integrada por PAN, PRI y PRD; y fuerzas locales, integrada por MC, PT y PVEM. El análisis excluye explícitamente las variables tema y area, así como identificadores y variables equivalentes al partido, para reducir fuga de información. Se comparan modelos de regresión logística multinomial, Random Forest, XGBoost y glmnet con validación cruzada estratificada. El reporte presenta métricas de desempeño, matriz de confusión, ranking de variables importantes e interpretaciones sustantivas sobre patrones de gasto, concentración de proveedores y temporalidad contractual. Este trabajo fue elaborado con apoyo de herramientas de inteligencia artificial generativa para estructuración, documentación y revisión técnica. Las decisiones analíticas, selección de variables, interpretación sustantiva y validación de resultados corresponden a las personas autoras del proyecto.
Ks_Test_1_12_06_2026
Actividad 05
ANOVAs Lab
Grade 5 Unit 8 MCQs-6
Grade 5 unit 8 topics
Document
MileStone Report
Milestone_Report
This report presents the complete methodology, implementation, and evaluation of a next-word prediction system built as the final capstone project for the Johns Hopkins Data Science Specialization on Coursera. The project was developed using three large English-language text corpora drawn from blogs, news articles, and Twitter posts, collectively comprising over 580 MB of raw text and approximately 4.27 million lines.