Fundamentos de Organización de Archivos y Estructuras de Datos
Enviado por Chuletator online y clasificado en Informática y Telecomunicaciones
Escrito el en
español con un tamaño de 4,36 KB
¿Qué es organizar un archivo?
Organizar un archivo consiste en definir cómo se almacenan y estructuran sus registros.
Conceptos fundamentales
- Campo: Dato individual.
- Registro: Conjunto de campos relacionados.
- Archivo: Conjunto de registros.
Organización vs. Método de Acceso
- Organización: Se refiere a cómo se almacenan y estructuran los datos físicamente.
- Acceso: Se refiere a la forma en que los datos se recorren o se localizan.
Organización tipo Pila (LIFO)
Se basa en el principio LIFO (Last In, First Out), donde el último elemento en entrar es el primero en salir.
Operaciones principales:
- PUSH: Agrega un elemento a la pila.
- POP: Elimina el último elemento agregado.
- PEEK/TOP: Consulta el último elemento sin eliminarlo.
Ejemplo: Si entran los elementos A, B, C, el primero en salir será el C.
Organización y Acceso Secuencial
En la organización secuencial, los registros están dispuestos uno después de otro.
- Acceso secuencial: Revisa los registros desde el primero, uno por uno, hasta encontrar el dato deseado.
- Acceso directo: Permite llegar al registro sin necesidad de recorrer todos los anteriores.
Organización Secuencial Indexada
Este modelo combina el almacenamiento secuencial con el uso de un índice.
¿Qué es un índice?
Es una estructura auxiliar que relaciona una clave con la ubicación o referencia de un registro. Su función principal es facilitar la localización de registros mediante dicha clave.
El proceso de indexar
Indexar consiste en crear una estructura que relacione una clave con la ubicación de la información. El flujo de trabajo es el siguiente:
Datos → Identificar clave → Crear índice → Buscar por clave → Localizar información.
Índice invertido
Relaciona una palabra específica con los documentos donde esta aparece.
Ejemplo:
- python → doc1, doc3
- xml → doc2, doc4
- git → doc2, doc3
¿Para qué sirve un índice invertido? Se utiliza para localizar rápidamente en qué documentos aparece una palabra determinada.
Formatos de Representación de Datos: XML, JSON y CSV
XML (Extensible Markup Language)
Es un formato de texto diseñado para representar información estructurada y jerárquica mediante el uso de etiquetas.
Ejemplo:
<producto id="P001">
<nombre>Mouse</nombre>
</producto>Comparativa de formatos
- XML: Posee una estructura jerárquica, utiliza etiquetas, permite el anidamiento y tiene una alta verbosidad.
- JSON: Posee una estructura jerárquica, utiliza claves y tiene una verbosidad media.
- CSV: Posee una estructura tabular, no utiliza etiquetas y tiene un anidamiento limitado.
Preguntas frecuentes sobre formatos
- ¿Qué formato usar para datos jerárquicos con etiquetas explícitas? El formato XML.
- ¿Qué diferencia a XML de JSON? XML utiliza etiquetas explícitas y suele ser más verboso que JSON.
Integridad de Datos
La integridad de datos busca que la información se mantenga completa, correcta, consistente y protegida contra modificaciones no autorizadas.
¿Qué pregunta responde la integridad?
¿El contenido se mantiene sin modificaciones no autorizadas o inesperadas?
Causas de la pérdida de integridad:
- Errores humanos.
- Fallos de software.
- Transferencias de datos incompletas.
- Problemas de almacenamiento físico.
- Modificaciones no autorizadas.
- Eliminación de información.
- Manipulación maliciosa.
Alteración: Se define como cualquier cambio realizado sobre el contenido original de los datos.