martes, 6 de noviembre de 2012

Act 2.13 Filtros dos pág. 57






Act 2.12 Proyecto Gunteberg pág. 55


Proyecto de Guntenberg

El Proyecto Gutenberg (PG) fue desarrollado por Michael Hart en 1971 con el fin de crear una biblioteca de libros electrónicos gratuitos a partir de libros que ya existen físicamente. Estos libros electrónicos se encuentran disponibles desde entonces en Internet.
Los textos que se proporcionan son principalmente de dominio público, bien porque nunca tuvieron derechos de autor, bien porque si los tuvieron ya han expirado. También hay algunos textos bajo derechos de autor que el Proyecto Gutenberg ha hecho disponibles con el permiso de sus escritores. Al proyecto se le puso el nombre del impresor alemán del siglo XV Johannes Gutenberg, quien inventó la imprenta de tipos móviles. En noviembre de 2009 el Proyecto Gutenberg tenía casi 30.000 libros en su colección, de ellos 267 en español. En portugués había 364, en inglés 25496, y en francés 1496.


En 1971, Michael Hart estudiaba en la Universidad de Illinois. Hart obtuvo el acceso a uno de los ordenadores principales del Laboratorio de Investigación de Materiales de la universidad, el Xerox Sigma V. Este ordenador especial resultó ser uno de los 15 nodos de la red de ordenadores que posteriormente se convertiría en Internet. Hart creyó que algún día los ordenadores serían asequibles para el público en general y decidió hacer disponibles obras de literatura de forma gratuita y electrónica. Como tenía una copia de la Declaración de Independencia de los Estados Unidos en su mochila, ésta se convirtió en el primer texto electrónico del Proyecto Gutenberg.

Para cuando la Universidad de Illinois dejó de hospedar el Proyecto Gutenberg a mediados de los 90, Hart ya lo estaba dirigiendo desde el Illinois Benedictine College. Más tarde llegó a un acuerdo similar con la Carnegie Mellon University, que aceptó administrar las finanzas del Proyecto Gutenberg. Pero no fue hasta el año 2000 que el Proyecto Gutenberg fue oficialmente reconocido como una persona jurídica independiente, siendo actualmente una sociedad no lucrativa legalmente constituida en Misisipi.

Desde los primeros días del proyecto, el tiempo que se requiere para digitalizar un libro ha disminuido enormemente. Los libros ya no se escriben directamente, sino que se convierten a texto con la ayuda del software de reconocimiento óptico de caracteres (el OCR). A pesar de estos avances, los libros aún tienen que corregirse y editarse minuciosamente antes de que puedan ser añadidos a la colección.

lunes, 29 de octubre de 2012

Act 2.10 En qué consisten las tecnologías asp, Japón y php pág. 50

ASP: es un framework para aplicaciones web desarrollado y comercializado por Microsoft. Es usado por programadores para construir sitios web dinámicos, aplicaciones web y servicios web XML. Apareció en enero de 2002 con la versión 1.0 del .NET Framework, y es la tecnología sucesora de la tecnología Active Server Pages (ASP). ASP.NET esta construido sobre el Common Language Runtime, permitiendo a los programadores escribir código ASP.NET usando cualquier lenguaje admitido por el .NET Framework.
Cualquier persona que esta familiarizada con el desarrollo de aplicaciones web sabrá que el desarrollo web no es una tarea simple. Ya que mientras que un modelo de programación para aplicaciones de uso común está muy bien establecido y soportado por un gran número de lenguajes, herramientas de desarrollo, la programación web es una mezcla de varios lenguajes de etiquetas, un gran uso de lenguajes de script y plataformas de servidor. Para el programador de nivel intermedio, el conocimiento y las habilidades que se necesitan para desarrollar aplicaciones web requieren de un mayor conocimiento tanto de lenguajes de programación, etiquetado y formato, como de diversas tecnologías de software relativas al desarrollo distribuido y concurrente, de las que son necesarias en el desarrollo tradicional de aplicaciones.
JSP: JavaServer Pages (JSP) es una tecnología Java que permite generar contenido dinámico para web, en forma de documentos HTML, XML o de otro tipo.
Esta tecnología es un desarrollo de la compañía Sun Microsystems. La Especificación JSP 1.2 fue la primera que se liberó y en la actualidad está disponible la Especificación JSP 2.1.
Las JSP's permiten la utilización de código Java mediante scripts. Además, es posible utilizar algunas acciones JSP predefinidas mediante etiquetas. Estas etiquetas pueden ser enriquecidas mediante la utilización de Bibliotecas de Etiquetas (TagLibs o Tag Libraries) externas e incluso personalizadas.
PHP: es un lenguaje de programación de uso general de script del lado del servidor originalmente diseñado para el desarrollo web de contenido dinámico. Fue uno de los primeros lenguajes de programación del lado del servidor que se podían incorporar directamente en el documento HTML en lugar de llamar a un archivo externo que procese los datos. El código es interpretado por un servidor web con un módulo de procesador de PHP que genera la página Web resultante. PHP ha evolucionado por lo que ahora incluye también una interfaz de línea de comandos que puede ser usada en aplicaciones gráficas independientes. PHP puede ser usado en la mayoría de los servidores web al igual que en casi todos los sistemas operativos y plataformas sin ningún costo.
PHP fue creado originalmente por Rasmus Lerdorf en 1995. Actualmente el lenguaje sigue siendo desarrollado con nuevas funciones por el grupo PHP.Este lenguaje forma parte del software libre publicado bajo la licencia PHP que es incompatible con la Licencia Pública General de GNU debido a las restricciones del uso del término PHP

martes, 23 de octubre de 2012

Actividadad 2.8 Antecedentes de buscadores pagina 466



Gopher es un servicio de Internet consistente en el acceso a la información a través de menús. La información se organiza en forma de árbol: sólo los nodos contienen menús de acceso a otros menús o a hojas, mientras que las hojas contienen simplemente información textual. En cierto modo es un predecesor de la Web, aunque sólo se permiten enlaces desde nodos-menús hasta otros nodos-menús o a hojas, y las hojas no tienen ningún tipo de hiperenlaces.
Gopher es uno de los sistemas de Internet para recuperar información que precedió a la World Wide Web. Fue creado en 1991 en la Universidad de Minesota y fue el primer sistema que permitió pasar de un sitio a otro seleccionando una opción en el menú de una página. Esa es la razón por la que adquirió mayor popularidad que sus competidores, que acabaron siendo sustituidos por la Web.
Con Gopher puedes acceder a un gran número de servidores, la mayoría de ellos gestionados por Universidades u Organizaciones gubernamentales, que contienen información sobre una amplia gama de temas especializados que no suelen encontrarse en los sitios Web. Los servidores Gopher, igual que los servidores FTP almacenan archivos y documentos que puede verse en línea o transferirse al PC.
Del mismo modo que todos los sitios Web del mundo forman la World Wide Web, el Gophersapce engloba los 5000 o más servidores de Gopher existentes. En gran medida acceder a un servidor de Gopher es parecido a utilizar un sitio FTP (sólo que tiende a provocar una cierta sensación de suciedad en el usuario), ya que la información se presenta en menús que contienen archivos y carpetas. Se navega por estas últimas para buscar archivos, documentos u otras carpetas que dispongan de más niveles de información. Normalmente los archivos se visualizan o bajan haciendo clic en ellos.
Aunque los servidores gopher que quedan son testimoniales, el navegador Firefox soportaba el mismo hasta la versión 3. Internet Explorer lo eliminó en 2002, después de descubrirse una vulnerabilidad.
Archie es un sistema para la localización de información sobre archivos y directorios, muy unido al servicio FTP. Es como una gran base de datos donde se encuentra registrada una gran cantidad de nombres de archivos y los servidores FTP. Al igual que gopher, ha sido reemplazado por la WWW.
Archie fue el primer motor de búsqueda que se ha inventado, diseñado para indexar archivos FTP, permitiendo a la gente encontrar archivos específicos. La implementación original se escribió en 1990 por Alan Emtage, Bill Heelan, y Peter J. Deutsch, entonces estudiantes en la Universidad McGill de Montreal.
Las primeras versiones de archie simplemente contactaban una lista de archivos FTP en bases regulares (contactando cada una apenas una vez cada mes, para no gastar muchos recursos en los servidores remotos) y requiriendo un listado. Estos listados eran almacenados en ficheros locales para ser buscados usando el comando grep de UNIX. Más tarde, se desarrollaron front- y back-ends más eficaces, y este sistema pasó de ser una herramienta local a un recurso para toda la red, a un servicio popular accesible desde múltiples sitios de Internet. A tales servidores se podía acceder de muchas formas: usando un cliente local (como archie o xarchie); haciendo telnet al servidor directamente, enviando queries por correo electrónico y más tarde con interfaces World Wide Web. El nombre archie viene de la palabra inglesa "archive", pero también está asociado con la serie de cómics americano “Archie”. Esta no era la intención original, pero fue lo que actuó como inspiración para los nombres de Jughead (oficialmente acrónimo de Jonzy's Universal Gopher Hierarchy Excavation And Display) y Verónica (acrónimo de "Very Easy Rodent-Oriented Net-wide Index to Computer Archives"), ambos sistemas de búsqueda para del protocolo Gopher. Con la aparición del World Wide Web la búsqueda de archivos se simplificó mucho, y actualmente hay muy pocos servidores activos. Se puede encontrar un gateway en Polonia y Japón.

VERONICA:
Algún día se podría necesitar recuperar información o un fichero de un servidor Gopher. El problema es cómo obtener los servidores correctos que proporcionan la información necesaria sin llamar a los menús Gopher interminables. Afortunadamente, hay una forma de hacer el uso de Gopher más fácil.
Esta herramienta se llama Veronica (Very Easy Rodent-Oriented Net-wide Index to Computerized Archives) y hace para Gopherspace lo que Archie hace para los sitios FTP.
Veronica es un sistema que descubre recursos que proporciona acceso a los recursos de información que se mantienen en la mayoría (99%+) de los servidores Gopher del mundo. Además de los datos Gopher nativos, Veronica incluye referencias a muchos recursos proporcionados por otros tipos de servidores de información, tales como servidores WWW, archivos usenet y servicios de información accesible por telnet.
Las peticiones de Veronica son búsquedas de palabras clave en títulos. Una consulta simple puede ser bastante potente porque incluye un gran número de servidores de información en el índice.
A Veronica se accede a través de software del cliente Gopher. Un usuario de Veronica pide una consulta (vía cliente Gopher) que puede contener expresiones de palabras clave booleana así como directivas Veronica especiales. El resultado de una búsqueda Veronica es un menú Gopher comprende artículos de información cuyos títulos contienen las palabras clave especificadas. Se puede navegar por el menú de resultados como si se tratara de cualquier otro menú Gopher.
En enero de 1995, se indizaron 5057 servidores Gopher. El índice también incluye artículo de otros 5000 servidores aproximádamente, en casos donde estos servidores se referencien en menús Gopher. Estos otros servidores incluyen 3905 servidores WWW y más o menos 1000 servicios de tipo TELNET.
En la mayoría de los servidores Gopher se puede encontrar Veronica seleccionando Otros Gopher y Servicios de Información en el menú principal y luego Buscar en el Gopherspace usando Veronica.
Judhead: es otro servicio adicional de Gopher desarrollada en la Universidad de Utah. En muchos aspectos Jughead es muy similar a Veronica, porque permiten examinar títulos de Gopher, pero delimita la búsqueda a solo un grupo específico de servidores, esto es, a los que pertenecen a una comunidad de red por lo que hace posible examinar solo bases de datos selectas.
Telnet: El comando Telnet permite obtener acceso a máquinas remotas conectadas a Internet. Esto hace suponer que el usuario tiene una cuenta (Login) y una clave de acceso válidos
FTP: Los servidores FTP son computadoras de acceso público en Internet que contienen Archivos. En esencia, todo lo que puede almacenarse en el disco puede ponerse a disposición del público en un servidor FTP. Por eso se puede emplear el comando FTP Protocolo de transferencia de Archivos (file transfer protocol) para tener acceso a estos servidores. Para reducir la carga de asignar a cada usuario una clave de acceso para el sistema remoto de cómputo, la mayoría de los sitios comerciales de Internet permiten la transferencia de archivos por medio de una clave de accesos de usuario anónimo (anonymous). En lugar de una contraseña (password), se pide a los usuarios algún tipo de información, como su dirección de correo electrónico.