Saltar al contenido principal
🇬🇧 English 🇧🇷 Português 🇩🇪 Deutsch
Convertidor de imágenes Convertidor de vídeo Convertidor de audio Convertidor de documentos
Herramientas Guías Formatos Precios API
Iniciar sesión
Guía

Formato CSV y TSV: Guía Técnica Completa

PC Por Pablo Cirre

Conversiones relacionadas

Pon en práctica lo que acabas de aprender — convierte tus archivos ahora en segundos, gratis y sin registro.

Preguntas frecuentes

Excel no detecta automáticamente la codificación. Al abrir un archivo .csv haciendo doble clic, Excel asume la codificación predeterminada del sistema (por ejemplo, Windows-1252 en sistemas de Europa Occidental) en lugar de UTF-8. Los caracteres acentuados y símbolos se interpretan mal. Soluciones: (1) añade un BOM UTF-8 (\xEF\xBB\xBF) al inicio del archivo — Excel lo respeta; (2) usa el asistente de importación Datos → Desde texto/CSV y selecciona UTF-8 manualmente; (3) guarda como .xlsx en lugar de .csv cuando Excel sea el consumidor final.

Envía <strong>PDF</strong> cuando el documento es final y el layout debe preservarse tal cual (contratos, facturas, certificados). Envía <strong>DOCX</strong> cuando los revisores deben editar, comentar o usar control de cambios. Muchos equipos envían ambos: PDF como versión canónica + DOCX para feedback editable. PDF/A es el adecuado para archivado legal (ISO 19005).

CSV usa una coma (o carácter específico del idioma como punto y coma) como delimitador de campo y requiere entrecomillado y escape para campos que contienen el delimitador, comillas dobles o saltos de línea. TSV usa un carácter de tabulador, que rara vez aparece en los datos, por lo que el entrecomillado casi nunca es necesario. Usa TSV para pipelines de bioinformática (GFF3, BED, VCF), herramientas de línea de comandos Unix (cut -f funciona nativamente con tabuladores) y pegado desde portapapeles de hojas de cálculo. Usa CSV cuando el sistema receptor lo exija o cuando los valores puedan contener tabuladores.

Round-trip entre formatos similares (DOCX ↔ ODT, DOCX → PDF) suele ser seguro. Round-trip con funciones específicas del formato (macros de Word, tablas complejas, notas al pie) suele perder fidelidad. Las fuentes incrustadas sobreviven solo si origen y destino lo soportan (PDF sí, DOCX sí, HTML plano no). Previsualiza siempre antes de borrar el original.

Procesa el archivo fila por fila en lugar de cargarlo todo a la vez. En Python, csv.reader ya es un iterador perezoso — nunca llames list(reader) en un archivo enorme. Con pandas usa chunksize: for chunk in pd.read_csv("grande.csv", chunksize=100000): procesar(chunk). Para consultas de tipo SQL sin sobrecarga de memoria, DuckDB puede consultar CSV directamente: SELECT * FROM read_csv_auto("grande.csv") WHERE precio > 100. Para consultas repetidas convierte una vez a Parquet (5-10× más pequeño, columnar, tipado) usando pyarrow o el comando COPY TO de DuckDB.

Si el PDF contiene texto real (no imágenes escaneadas), <code>pdftotext</code> de poppler-utils o <a href="/es/convert/pdf-a-txt">PDF a TXT</a> funcionan en segundos. Si el PDF es escaneado, necesitas OCR — Tesseract es el estándar open-source. Las herramientas PDF de KaijuConverter detectan automáticamente texto vs. imagen y enrutan según el caso.

Excel aplica inferencia de tipos automática al abrir archivos CSV, convirtiendo "001" a entero 1 (eliminando el cero inicial) y "1/2" a una fecha (2 de enero). Para evitarlo: (1) usa el asistente de importación Datos → Desde texto/CSV y establece explícitamente el tipo de columna como Texto; (2) programáticamente entrecomilla todos los valores en el CSV (Excel aún infiere tipos para números entrecomillados, por lo que el asistente de importación es la solución real); (3) genera directamente .xlsx con openpyxl o xlsxwriter donde controlas los formatos de celda.

Edición ligera (anotaciones, firmas, campos de formulario) es viable en cualquier lector PDF. Edición estructural (cambiar párrafos, reemplazar imágenes) es incómoda — PDF es un formato de presentación, no de edición. El flujo robusto es: mantén el origen DOCX/MD/HTML como máster y regenera el PDF cuando haya cambios. Las herramientas que "editan PDF" hacen ingeniería inversa del layout y suelen romperlo.

Usamos cookies y tecnologías similares para personalizar contenido y anuncios, y para analizar el tráfico. Más información sobre cookies.