<?xml version="1.0" encoding="utf-8"?>
<rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom"><channel><title>Recent changes to Install</title><link>https://sourceforge.net/p/pwa-technologies/wiki/Install/</link><description>Recent changes to Install</description><atom:link href="https://sourceforge.net/p/pwa-technologies/wiki/Install/feed" rel="self"/><language>en</language><lastBuildDate>Tue, 17 Dec 2013 15:54:54 -0000</lastBuildDate><atom:link href="https://sourceforge.net/p/pwa-technologies/wiki/Install/feed" rel="self" type="application/rss+xml"/><item><title>Install modified by Anonymous</title><link>https://sourceforge.net/p/pwa-technologies/wiki/Install/</link><description>&lt;div class="markdown_content"&gt;&lt;h2 id="install-hadoop"&gt;Install Hadoop&lt;/h2&gt;
&lt;p&gt;After compiling the product following the instructions of &lt;a class="" href="../Compile"&gt;Compile&lt;/a&gt; there will be a need to create a Hadoop cluster to process a large number of arc files. This file has for base the tutorial &lt;a href="http://wiki.apache.org/hadoop/QuickStart" rel="nofollow"&gt;http://wiki.apache.org/hadoop/QuickStart&lt;/a&gt;, &lt;a href="http://hadoop.apache.org/common/docs/current/cluster_setup.html" rel="nofollow"&gt;http://hadoop.apache.org/common/docs/current/cluster_setup.html&lt;/a&gt; and &lt;a href="http://wiki.apache.org/hadoop/GettingStartedWithHadoop" rel="nofollow"&gt;http://wiki.apache.org/hadoop/GettingStartedWithHadoop&lt;/a&gt;. The cluster of Hadoop servers is only used by the pwa for the creation of indexes for the collections, for an active and production Hadoop cluster consult the Project page. &lt;/p&gt;
&lt;p&gt;This assumes a tutorial basic knowledge of Hadoop and some knowledge of apache tomcat server. &lt;/p&gt;
&lt;p&gt;First you have to grab the files generated by the &lt;a class="" href="../Compile"&gt;Compile&lt;/a&gt; procedure of the Hadoop and copy them to all your cluster servers. &lt;/p&gt;
&lt;h3 id="hadoop-configuration-files"&gt;Hadoop configuration files&lt;/h3&gt;
&lt;p&gt;Has the tutorial pages before explain, the Hadoop system can be run in a distributed way. To run a large number of arc files this is the best way of achieving this. &lt;/p&gt;
&lt;p&gt;Has a base configuration the Portuguese Web Archive assumes the following directory structure, and this tutorial is based on it: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;opt&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;searcher&lt;/span&gt;
             &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;apache&lt;/span&gt;&lt;span class="o"&gt;-&lt;/span&gt;&lt;span class="n"&gt;tomcat&lt;/span&gt;&lt;span class="o"&gt;-&lt;/span&gt;&lt;span class="mf"&gt;5.5.25&lt;/span&gt; &lt;span class="o"&gt;-&amp;gt;&lt;/span&gt; &lt;span class="n"&gt;tomcat&lt;/span&gt; &lt;span class="n"&gt;server&lt;/span&gt;
             &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;arcproxy&lt;/span&gt; &lt;span class="o"&gt;-&amp;gt;&lt;/span&gt; &lt;span class="n"&gt;files&lt;/span&gt; &lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;the&lt;/span&gt; &lt;span class="n"&gt;arcproxy&lt;/span&gt; &lt;span class="n"&gt;database&lt;/span&gt;
             &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;collections&lt;/span&gt; &lt;span class="o"&gt;-&amp;gt;&lt;/span&gt; &lt;span class="n"&gt;collections&lt;/span&gt; &lt;span class="n"&gt;served&lt;/span&gt; &lt;span class="n"&gt;by&lt;/span&gt; &lt;span class="n"&gt;this&lt;/span&gt; &lt;span class="n"&gt;hadoop&lt;/span&gt; &lt;span class="n"&gt;search&lt;/span&gt; &lt;span class="n"&gt;server&lt;/span&gt;
             &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;dictionaries&lt;/span&gt; &lt;span class="o"&gt;-&amp;gt;&lt;/span&gt; &lt;span class="n"&gt;dictionaries&lt;/span&gt; &lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;the&lt;/span&gt; &lt;span class="n"&gt;spellchecker&lt;/span&gt; &lt;span class="n"&gt;application&lt;/span&gt;
             &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;hadoop&lt;/span&gt; &lt;span class="o"&gt;-&amp;gt;&lt;/span&gt; &lt;span class="n"&gt;hadoop&lt;/span&gt; &lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;processing&lt;/span&gt; &lt;span class="n"&gt;the&lt;/span&gt; &lt;span class="n"&gt;arc&lt;/span&gt; &lt;span class="n"&gt;files&lt;/span&gt;
             &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;logs&lt;/span&gt; &lt;span class="o"&gt;-&amp;gt;&lt;/span&gt; &lt;span class="n"&gt;Logs&lt;/span&gt; &lt;span class="n"&gt;from&lt;/span&gt; &lt;span class="n"&gt;the&lt;/span&gt; &lt;span class="n"&gt;hadoop&lt;/span&gt; &lt;span class="n"&gt;search&lt;/span&gt; &lt;span class="n"&gt;servers&lt;/span&gt;
             &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;run&lt;/span&gt; &lt;span class="o"&gt;-&amp;gt;&lt;/span&gt; &lt;span class="n"&gt;directory&lt;/span&gt; &lt;span class="n"&gt;to&lt;/span&gt; &lt;span class="n"&gt;hold&lt;/span&gt; &lt;span class="n"&gt;the&lt;/span&gt; &lt;span class="n"&gt;pid&lt;/span&gt; &lt;span class="n"&gt;files&lt;/span&gt;
             &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;scripts&lt;/span&gt; &lt;span class="o"&gt;-&amp;gt;&lt;/span&gt; &lt;span class="n"&gt;scripts&lt;/span&gt; &lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;starting&lt;/span&gt; &lt;span class="n"&gt;applications&lt;/span&gt;
&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;data&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;outputs&lt;/span&gt; &lt;span class="o"&gt;-&amp;gt;&lt;/span&gt; &lt;span class="n"&gt;directory&lt;/span&gt; &lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;the&lt;/span&gt; &lt;span class="n"&gt;indexes&lt;/span&gt; &lt;span class="n"&gt;created&lt;/span&gt; &lt;span class="n"&gt;from&lt;/span&gt; &lt;span class="n"&gt;the&lt;/span&gt; &lt;span class="n"&gt;arc&lt;/span&gt; &lt;span class="n"&gt;files&lt;/span&gt;
&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;hadooptemp&lt;/span&gt; &lt;span class="o"&gt;-&amp;gt;&lt;/span&gt; &lt;span class="n"&gt;directory&lt;/span&gt; &lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;all&lt;/span&gt; &lt;span class="n"&gt;the&lt;/span&gt; &lt;span class="n"&gt;Hadoop&lt;/span&gt; &lt;span class="n"&gt;files&lt;/span&gt; &lt;span class="n"&gt;used&lt;/span&gt; &lt;span class="k"&gt;for&lt;/span&gt; &lt;span class="n"&gt;indexing&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;p&gt;Starting up a cluster: &lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;You will need to define a server for Hadoop master, this server will have the namenode and tasktracker (for more information on Hadoop &lt;a class="" href="http://wiki.apache.org/hadoop" rel="nofollow"&gt;Hadoop wiki page&lt;/a&gt; and &lt;a class="" href="http://hadoop.apache.org/" rel="nofollow"&gt;project page&lt;/a&gt;). &lt;/li&gt;
&lt;li&gt;Copy the Hadoop folder after &lt;a class="" href="../Compile"&gt;Compile&lt;/a&gt; to every server of the cluster. &lt;/li&gt;
&lt;li&gt;Ensure that the Hadoop package is accessible from the same path on all nodes that are to be included in the cluster. If you have separated configuration from the install then ensure that the config directory is also accessible the same way. &lt;/li&gt;
&lt;li&gt;Populate the &lt;code&gt;slaves&lt;/code&gt; file with the nodes to be included in the cluster. One node per line. &lt;/li&gt;
&lt;li&gt;Format the Namenode &lt;/li&gt;
&lt;li&gt;Configure a environment variable for the Hadoop home &lt;code&gt;% export HADOOP_HOME=/opt/searcher/hadoop&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;Run the command &lt;code&gt;% ${HADOOP_HOME}/hadoop/bin/start-dfs.sh&lt;/code&gt; on the node you want the Namenode to run on. This will bring up HDFS with the Namenode running on the machine you ran the command on and Datanodes on the machines listed in the slaves file mentioned above. &lt;/li&gt;
&lt;li&gt;Run the command &lt;code&gt;% ${HADOOP_HOME}/hadoop/bin/start-mapred.sh&lt;/code&gt; on the machine you plan to run the Jobtracker on. This will bring up the Map/Reduce cluster with Jobtracker running on the machine you ran the command on and Tasktrackers running on machines listed in the slaves file. &lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;After knowing what server to use has master define it in the configurations files. Setup masters at &lt;code&gt;${HADOOP_HOME}/conf/masters&lt;/code&gt; file: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="n"&gt;master&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;example&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;com&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;p&gt;Setup slaves at &lt;code&gt;${HADOOP_HOME}/conf/slaves&lt;/code&gt; file: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="n"&gt;server1&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;example&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;com&lt;/span&gt;
&lt;span class="n"&gt;server2&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;example&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;com&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;p&gt;For your cluster you need to edit the file of &lt;code&gt;${HADOOP_HOME}/conf/hadoop-site.xml&lt;/code&gt;. You should change the value of &lt;code&gt;fs.default.name&lt;/code&gt; to the namenode server , the value of &lt;code&gt;mapred.job.tracker&lt;/code&gt; to the tasktracker server. There is also a need to correct the directories path for your system: &lt;code&gt;dfs.name.dir&lt;/code&gt;, &lt;code&gt;dfs.data.dir&lt;/code&gt;, &lt;code&gt;mapred.system.dir&lt;/code&gt;, &lt;code&gt;mapred.local.dir&lt;/code&gt; and &lt;code&gt;hadoop.tmp.dir&lt;/code&gt;. Every option of this configurable in this file is in the file &lt;code&gt;${HADOOP_HOME}/conf/hadoop-default.xml&lt;/code&gt;: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="cp"&gt;&amp;lt;?xml version=&amp;quot;1.0&amp;quot;?&amp;gt;&lt;/span&gt;
&lt;span class="cp"&gt;&amp;lt;?xml-stylesheet type=&amp;quot;text/xsl&amp;quot; href=&amp;quot;configuration.xsl&amp;quot;?&amp;gt;&lt;/span&gt;
&lt;span class="nt"&gt;&amp;lt;configuration&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;property&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;name&amp;gt;&lt;/span&gt;fs.default.name&lt;span class="nt"&gt;&amp;lt;/name&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;value&amp;gt;&lt;/span&gt;master.example.com:9000&lt;span class="nt"&gt;&amp;lt;/value&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;/property&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;property&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;name&amp;gt;&lt;/span&gt;mapred.job.tracker&lt;span class="nt"&gt;&amp;lt;/name&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;value&amp;gt;&lt;/span&gt;master.example.com:9001&lt;span class="nt"&gt;&amp;lt;/value&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;/property&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;property&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;name&amp;gt;&lt;/span&gt;dfs.name.dir&lt;span class="nt"&gt;&amp;lt;/name&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;value&amp;gt;&lt;/span&gt;/hadooptemp/dfs/namenode&lt;span class="nt"&gt;&amp;lt;/value&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;/property&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;property&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;name&amp;gt;&lt;/span&gt;dfs.data.dir&lt;span class="nt"&gt;&amp;lt;/name&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;value&amp;gt;&lt;/span&gt;/hadooptemp/dfs/datanode&lt;span class="nt"&gt;&amp;lt;/value&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;/property&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;property&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;name&amp;gt;&lt;/span&gt;mapred.system.dir&lt;span class="nt"&gt;&amp;lt;/name&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;value&amp;gt;&lt;/span&gt;/hadooptemp/mapred/system&lt;span class="nt"&gt;&amp;lt;/value&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;/property&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;property&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;name&amp;gt;&lt;/span&gt;mapred.local.dir&lt;span class="nt"&gt;&amp;lt;/name&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;value&amp;gt;&lt;/span&gt;/hadooptemp/mapred/local&lt;span class="nt"&gt;&amp;lt;/value&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;/property&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;property&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;name&amp;gt;&lt;/span&gt;mapred.child.java.opts&lt;span class="nt"&gt;&amp;lt;/name&amp;gt;&lt;/span&gt;
   &lt;span class="nt"&gt;&amp;lt;value&amp;gt;&lt;/span&gt;-Xmx6000m&lt;span class="nt"&gt;&amp;lt;/value&amp;gt;&lt;/span&gt;
 &lt;span class="nt"&gt;&amp;lt;/property&amp;gt;&lt;/span&gt;
  &lt;span class="nt"&gt;&amp;lt;property&amp;gt;&lt;/span&gt;
     &lt;span class="nt"&gt;&amp;lt;name&amp;gt;&lt;/span&gt;hadoop.tmp.dir&lt;span class="nt"&gt;&amp;lt;/name&amp;gt;&lt;/span&gt;
     &lt;span class="nt"&gt;&amp;lt;value&amp;gt;&lt;/span&gt;/hadooptemp/tmp/hadoop-${user.name}&lt;span class="nt"&gt;&amp;lt;/value&amp;gt;&lt;/span&gt;
  &lt;span class="nt"&gt;&amp;lt;/property&amp;gt;&lt;/span&gt;
&lt;span class="nt"&gt;&amp;lt;/configuration&amp;gt;&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;p&gt;Edit JAVA_HOME variable at &lt;code&gt;${HADOOP_HOME}/conf/hadoop-env.sh&lt;/code&gt;: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="p"&gt;...&lt;/span&gt;
&lt;span class="n"&gt;export&lt;/span&gt; &lt;span class="n"&gt;JAVA_HOME&lt;/span&gt;&lt;span class="o"&gt;=/&lt;/span&gt;&lt;span class="n"&gt;usr&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;java&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="k"&gt;default&lt;/span&gt;
&lt;span class="p"&gt;...&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;p&gt;Edit files at master and copy for all other machines. &lt;/p&gt;
&lt;p&gt;There is also the need to share the ssh public key from the master server to the other servers: &lt;/p&gt;
&lt;ol&gt;
&lt;li&gt;
&lt;p&gt;generate ssh key: &lt;/p&gt;
&lt;p&gt;ssh-keygen -t dsa -P '' -f ~/.ssh/id_dsa&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;remove pwd request from localhost: &lt;/p&gt;
&lt;p&gt;cat ~/.ssh/id_dsa.pub &amp;gt;&amp;gt;&amp;gt; ~/.ssh/authorized_keys&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;test (if no pwd is requested then it is OK): &lt;/p&gt;
&lt;p&gt;ssh localhost&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;Put the key in other machines, repeat for every machine in the cluster. &lt;/p&gt;
&lt;p&gt;ssh-copy-id -i ~/.ssh/id_dsa.pub user@server1.example.com&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;Create directories configured in the &lt;code&gt;hadoop-site.xml&lt;/code&gt;: &lt;/p&gt;
&lt;p&gt;mkdir -p /hadooptemp/dfs/datanode&lt;br /&gt;
mkdir -p /hadooptemp/dfs/datanode/&lt;br /&gt;
mkdir -p /hadooptemp/mapred/system/&lt;br /&gt;
mkdir -p /hadooptemp/mapred/local/&lt;/p&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;Format the HDFS (attention the y is capitalized): &lt;/p&gt;
&lt;p&gt;${HADOOP_HOME}/bin/hadoop namenode -format&lt;/p&gt;
&lt;/li&gt;
&lt;/ol&gt;
&lt;p&gt;&lt;strong&gt;Note:&lt;/strong&gt; If format is aborted then remove directories and format it again (directories from &lt;code&gt;hadoop-site.xml&lt;/code&gt;): &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="n"&gt;rm&lt;/span&gt; &lt;span class="o"&gt;-&lt;/span&gt;&lt;span class="n"&gt;rf&lt;/span&gt; &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;hadooptemp&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;dfs&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;namenode&lt;/span&gt;&lt;span class="o"&gt;/*&lt;/span&gt;
&lt;span class="n"&gt;rm&lt;/span&gt; &lt;span class="o"&gt;-&lt;/span&gt;&lt;span class="n"&gt;rf&lt;/span&gt; &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;hadooptemp&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;dfs&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;datanode&lt;/span&gt;&lt;span class="o"&gt;/*&lt;/span&gt;
&lt;span class="n"&gt;rm&lt;/span&gt; &lt;span class="o"&gt;-&lt;/span&gt;&lt;span class="n"&gt;rf&lt;/span&gt; &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;hadooptemp&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;mapred&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;system&lt;/span&gt;&lt;span class="o"&gt;/*&lt;/span&gt;
&lt;span class="n"&gt;rm&lt;/span&gt; &lt;span class="o"&gt;-&lt;/span&gt;&lt;span class="n"&gt;rf&lt;/span&gt; &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;hadooptemp&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;mapred&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;local&lt;/span&gt;&lt;span class="o"&gt;/*&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;h3 id="using-hadoop"&gt;Using Hadoop&lt;/h3&gt;
&lt;ol&gt;
&lt;li&gt;
&lt;p&gt;Start the Hadoop daemons in all machines from the Hadoop cluster: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="cp"&gt;${&lt;/span&gt;&lt;span class="n"&gt;HADOOP_HOME&lt;/span&gt;&lt;span class="cp"&gt;}&lt;/span&gt;/bin/start-all.sh
&lt;/pre&gt;&lt;/div&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;See if the services started OK: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="n"&gt;NameNode&lt;/span&gt; &lt;span class="n"&gt;http&lt;/span&gt;&lt;span class="o"&gt;:&lt;/span&gt;&lt;span class="c1"&gt;//master.example.com:50070/&lt;/span&gt;
&lt;span class="n"&gt;JobTracker&lt;/span&gt; &lt;span class="n"&gt;http&lt;/span&gt;&lt;span class="o"&gt;:&lt;/span&gt;&lt;span class="c1"&gt;//master.example.com:50030/&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;/li&gt;
&lt;li&gt;
&lt;p&gt;Stop the Hadoop deamons: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="cp"&gt;${&lt;/span&gt;&lt;span class="n"&gt;HADOOP_HOME&lt;/span&gt;&lt;span class="cp"&gt;}&lt;/span&gt;/bin/stop-all.sh
&lt;/pre&gt;&lt;/div&gt;
&lt;/li&gt;
&lt;/ol&gt;
&lt;h2 id="operating-system-changes"&gt;Operating system changes&lt;/h2&gt;
&lt;h3 id="change-the-limits-for-the-number-of-open-files"&gt;Change the limits for the number of open files&lt;/h3&gt;
&lt;p&gt;There is a need to change some parameters for the servers. Because the Hadoop system opens a large number of files there is a need to add 2 lines to the file &lt;code&gt;/etc/security/limits.conf&lt;/code&gt;: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="p"&gt;...&lt;/span&gt;
&lt;span class="o"&gt;*&lt;/span&gt; &lt;span class="n"&gt;hard&lt;/span&gt; &lt;span class="n"&gt;nofile&lt;/span&gt; &lt;span class="mi"&gt;65000&lt;/span&gt;
&lt;span class="o"&gt;*&lt;/span&gt; &lt;span class="n"&gt;soft&lt;/span&gt; &lt;span class="n"&gt;nofile&lt;/span&gt; &lt;span class="mi"&gt;30000&lt;/span&gt;
&lt;span class="p"&gt;...&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;h3 id="set-the-default-charset-in-the-machines"&gt;Set the default charset in the machines&lt;/h3&gt;
&lt;p&gt;Change variable LANG in file &lt;code&gt;/etc/sysconfig/i18n&lt;/code&gt;: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="n"&gt;LANG&lt;/span&gt;&lt;span class="o"&gt;=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;pt_PT.ISO-8859-1&amp;quot;&lt;/span&gt;
&lt;span class="p"&gt;...&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;h2 id="install-search-system"&gt;Install search system&lt;/h2&gt;
&lt;h3 id="requirements"&gt;Requirements&lt;/h3&gt;
&lt;ul&gt;
&lt;li&gt;Install apache tomcat 5.5.25 &lt;a href="http://archive.apache.org/dist/tomcat/tomcat-5/v5.5.25/bin/apache-tomcat-5.5.25.tar.gz" rel="nofollow"&gt;http://archive.apache.org/dist/tomcat/tomcat-5/v5.5.25/bin/apache-tomcat-5.5.25.tar.gz&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;Get the compilation result of Hadoop 0.14.4 instructions in &lt;a class="" href="../Compile"&gt;Compile&lt;/a&gt;&lt;/li&gt;
&lt;li&gt;The files are going to be called, for simplification purposes: &lt;ul&gt;
&lt;li&gt;nutchwax.jar: &lt;code&gt;pwa-technologies/PwaArchive-access/projects/nutchwax/nutchwax-job/target/nutchwax-job-0.11.0-SNAPSHOT.jar&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;nutchwax.war: &lt;code&gt;pwa-technologies/PwaArchive-access/projects/nutchwax/nutchwax-webapp/target/nutchwax-webapp-0.11.0-SNAPSHOT.war&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;wayback.war: &lt;code&gt;pwa-technologies/PwaArchive-access/projects/wayback/wayback-webapp/target/wayback-1.2.1.war&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;pwalucene.jar: &lt;code&gt;pwa-technologies/PwaLucene/target/pwalucene-1.0.0-SNAPSHOT.jar&lt;/code&gt;&lt;/li&gt;
&lt;/ul&gt;
&lt;/li&gt;
&lt;/ul&gt;
&lt;h3 id="install-tomcat"&gt;Install tomcat&lt;/h3&gt;
&lt;ul&gt;
&lt;li&gt;To install and configure tomcat this &lt;a class="" href="http://tomcat.apache.org/tomcat-5.5-doc/setup.html" rel="nofollow"&gt;documentation&lt;/a&gt; should be followed. &lt;/li&gt;
&lt;li&gt;Untar the file to /opt/searcher/apache-tomcat-5.5.25 &lt;code&gt;tar -zxf apache-tomcat-5.5.25.tar.gz&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;Configure a environment variable for the Catalina home &lt;code&gt;% export CATALINA_HOME=/opt/searcher/apache-tomcat-5.5.25&lt;/code&gt;&lt;/li&gt;
&lt;/ul&gt;
&lt;h3 id="configure-nutchwax-web-application"&gt;Configure nutchwax Web application&lt;/h3&gt;
&lt;p&gt;Copy the file nutchwax.war to &lt;code&gt;${CATALINA_HOME}/webapps/&lt;/code&gt;&lt;/p&gt;
&lt;p&gt;Set ${CATALINA_HOME}/webapps/nutchwax/WEB-INF/classes/hadoop-site.xml with: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="nt"&gt;&amp;lt;name&amp;gt;&lt;/span&gt;searcher.dir&lt;span class="nt"&gt;&amp;lt;/name&amp;gt;&lt;/span&gt;
&lt;span class="nt"&gt;&amp;lt;value&amp;gt;&lt;/span&gt;/opt/searcher/scripts&lt;span class="nt"&gt;&amp;lt;/value&amp;gt;&lt;/span&gt;
...
&lt;span class="nt"&gt;&amp;lt;name&amp;gt;&lt;/span&gt;wax.host&lt;span class="nt"&gt;&amp;lt;/name&amp;gt;&lt;/span&gt;
&lt;span class="nt"&gt;&amp;lt;value&amp;gt;&lt;/span&gt;example.com:8080/wayback/wayback&lt;span class="nt"&gt;&amp;lt;/value&amp;gt;&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;p&gt;Where the directory of the &lt;code&gt;searcher.dir&lt;/code&gt; &lt;code&gt;/opt/searcher/scripts&lt;/code&gt; should have a file named &lt;code&gt;search-servers.txt&lt;/code&gt; that defines where the nutch servers are running: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;  &lt;span class="n"&gt;example&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;com&lt;/span&gt; &lt;span class="mi"&gt;21111&lt;/span&gt;
  &lt;span class="n"&gt;example&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;com&lt;/span&gt; &lt;span class="mi"&gt;21112&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;p&gt;The property &lt;code&gt;wax.host&lt;/code&gt; should have the host with the wayback configuration that is open to the world. &lt;/p&gt;
&lt;h3 id="configure-wayback-web-application"&gt;Configure wayback Web application&lt;/h3&gt;
&lt;p&gt;Copy the file wayback.war to &lt;code&gt;${CATALINA_HOME}/webapps/&lt;/code&gt;&lt;/p&gt;
&lt;p&gt;Update &lt;code&gt;${CATALINA_HOME}/webapps/wayback/WEB-INF/wayback.xml&lt;/code&gt; file: &lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;The &lt;code&gt;resourceIndex&lt;/code&gt; maps the arc name and an URL for the arc it self, normally the URL of the arc is served by an http server. The configuration should refer the arcproxy that knows where all the arc files exist. &lt;/li&gt;
&lt;li&gt;The &lt;code&gt;remotecollection&lt;/code&gt; is the location of the search for an url. It should be configured with the nutchwax search. &lt;/li&gt;
&lt;li&gt;
&lt;p&gt;The &lt;code&gt;uriConverter&lt;/code&gt; is used to reply the url to be accessed. &lt;/p&gt;
&lt;p&gt;...&lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
...&lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
...&lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
&lt;br /&gt;
...&lt;/p&gt;
&lt;/li&gt;
&lt;/ul&gt;
&lt;h3 id="configure-arcproxy-web-application"&gt;Configure arcproxy Web application&lt;/h3&gt;
&lt;p&gt;Copy the file wayback.war to &lt;code&gt;${CATALINA_HOME}/webapps/&lt;/code&gt; and rename it to arcproxy, &lt;code&gt;mv wayback.xml arcproxy.xml&lt;/code&gt;&lt;/p&gt;
&lt;p&gt;Replace ${CATALINA_HOME}/webapps/arcproxy/WEB-INF/wayback.xml file: &lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;
&lt;p&gt;Change the &lt;code&gt;bdbPath&lt;/code&gt;, &lt;code&gt;bdbName&lt;/code&gt; and &lt;code&gt;logPath&lt;/code&gt; to the parameters to your desire, the directories have to be writable by tomcat application. &lt;/p&gt;
&lt;p&gt;&amp;lt;?xml version="1.0" encoding="UTF-8"?&amp;gt;&lt;br /&gt;
&amp;lt;!DOCTYPE beans PUBLIC "-//SPRING//DTD BEAN//EN" "http://www.springframework.org/dtd/spring-beans.dtd"&amp;gt;&lt;br /&gt;
&lt;/p&gt;
&lt;!--
    The following 3 beans are required when using the ArcProxy for providing 
    HTTP 1.1 remote access to ARC files distributed across multiple computers 
    or directories.
--&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="nt"&gt;&amp;lt;bean&lt;/span&gt; &lt;span class="na"&gt;id=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;filelocationdb&amp;quot;&lt;/span&gt; &lt;span class="na"&gt;class=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;org.archive.wayback.resourcestore.http.FileLocationDB&amp;quot;&lt;/span&gt;
    &lt;span class="na"&gt;init-method=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;init&amp;quot;&lt;/span&gt;&lt;span class="nt"&gt;&amp;gt;&lt;/span&gt;
    &lt;span class="nt"&gt;&amp;lt;property&lt;/span&gt; &lt;span class="na"&gt;name=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;bdbPath&amp;quot;&lt;/span&gt; &lt;span class="na"&gt;value=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;/opt/searcher/arcproxy&amp;quot;&lt;/span&gt; &lt;span class="nt"&gt;/&amp;gt;&lt;/span&gt;
    &lt;span class="nt"&gt;&amp;lt;property&lt;/span&gt; &lt;span class="na"&gt;name=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;bdbName&amp;quot;&lt;/span&gt; &lt;span class="na"&gt;value=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;arquivo&amp;quot;&lt;/span&gt; &lt;span class="nt"&gt;/&amp;gt;&lt;/span&gt;
    &lt;span class="nt"&gt;&amp;lt;property&lt;/span&gt; &lt;span class="na"&gt;name=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;logPath&amp;quot;&lt;/span&gt; &lt;span class="na"&gt;value=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;/opt/searcher/arcproxy/tmp_arc-db.log&amp;quot;&lt;/span&gt; &lt;span class="nt"&gt;/&amp;gt;&lt;/span&gt;
&lt;span class="nt"&gt;&amp;lt;/bean&amp;gt;&lt;/span&gt;

&lt;span class="nt"&gt;&amp;lt;bean&lt;/span&gt; &lt;span class="na"&gt;name=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;8080:arcproxy&amp;quot;&lt;/span&gt; &lt;span class="na"&gt;class=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;org.archive.wayback.resourcestore.http.ArcProxyServlet&amp;quot;&lt;/span&gt;&lt;span class="nt"&gt;&amp;gt;&lt;/span&gt;
    &lt;span class="nt"&gt;&amp;lt;property&lt;/span&gt; &lt;span class="na"&gt;name=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;locationDB&amp;quot;&lt;/span&gt; &lt;span class="na"&gt;ref=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;filelocationdb&amp;quot;&lt;/span&gt; &lt;span class="nt"&gt;/&amp;gt;&lt;/span&gt;
&lt;span class="nt"&gt;&amp;lt;/bean&amp;gt;&lt;/span&gt;
&lt;span class="nt"&gt;&amp;lt;bean&lt;/span&gt; &lt;span class="na"&gt;name=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;8080:locationdb&amp;quot;&lt;/span&gt; &lt;span class="na"&gt;class=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;org.archive.wayback.resourcestore.http.FileLocationDBServlet&amp;quot;&lt;/span&gt;&lt;span class="nt"&gt;&amp;gt;&lt;/span&gt;
    &lt;span class="nt"&gt;&amp;lt;property&lt;/span&gt; &lt;span class="na"&gt;name=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;locationDB&amp;quot;&lt;/span&gt; &lt;span class="na"&gt;ref=&lt;/span&gt;&lt;span class="s"&gt;&amp;quot;filelocationdb&amp;quot;&lt;/span&gt; &lt;span class="nt"&gt;/&amp;gt;&lt;/span&gt;
&lt;span class="nt"&gt;&amp;lt;/bean&amp;gt;&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;p&gt;&lt;/p&gt;
&lt;/li&gt;
&lt;/ul&gt;
&lt;h3 id="configure-browser-web-application"&gt;Configure browser Web application&lt;/h3&gt;
&lt;p&gt;The browser application has the objective of making the arc files available through http. By creating a repository of files arc files. The creation of the application is made creating a folder for the application inside webapps directory of tomcat. &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;mkdir -p &lt;span class="cp"&gt;${&lt;/span&gt;&lt;span class="n"&gt;CATALINA_HOME&lt;/span&gt;&lt;span class="cp"&gt;}&lt;/span&gt;/webapps/browser/WEB-INF
mkdir -p &lt;span class="cp"&gt;${&lt;/span&gt;&lt;span class="n"&gt;CATALINA_HOME&lt;/span&gt;&lt;span class="cp"&gt;}&lt;/span&gt;/webapps/browser/files
&lt;/pre&gt;&lt;/div&gt;
&lt;p&gt;Then creating a file web.xml in the WEB-INF directory. &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="cp"&gt;&amp;lt;?xml version=&amp;quot;1.0&amp;quot; encoding=&amp;quot;ISO-8859-1&amp;quot;?&amp;gt;&lt;/span&gt;
&lt;span class="cp"&gt;&amp;lt;!DOCTYPE web-app&lt;/span&gt;
&lt;span class="cp"&gt;    PUBLIC &amp;quot;-//Sun Microsystems, Inc.//DTD Web Application 2.3//EN&amp;quot;&lt;/span&gt;
&lt;span class="cp"&gt;    &amp;quot;http://java.sun.com/dtd/web-app_2_3.dtd&amp;quot;&amp;gt;&lt;/span&gt;

&lt;span class="nt"&gt;&amp;lt;web-app&amp;gt;&lt;/span&gt;
    &lt;span class="nt"&gt;&amp;lt;display-name&amp;gt;&lt;/span&gt;browser&lt;span class="nt"&gt;&amp;lt;/display-name&amp;gt;&lt;/span&gt;
    &lt;span class="nt"&gt;&amp;lt;description&amp;gt;&lt;/span&gt;File Browsing Application for the Document Share&lt;span class="nt"&gt;&amp;lt;/description&amp;gt;&lt;/span&gt;

    &lt;span class="c"&gt;&amp;lt;!-- Enable directory listings by overriding the server default web.xml --&amp;gt;&lt;/span&gt;
    &lt;span class="c"&gt;&amp;lt;!-- definition for the default servlet --&amp;gt;&lt;/span&gt;
    &lt;span class="nt"&gt;&amp;lt;servlet&amp;gt;&lt;/span&gt;
        &lt;span class="nt"&gt;&amp;lt;servlet-name&amp;gt;&lt;/span&gt;DefaultServletOverride&lt;span class="nt"&gt;&amp;lt;/servlet-name&amp;gt;&lt;/span&gt;
        &lt;span class="nt"&gt;&amp;lt;servlet-class&amp;gt;&lt;/span&gt;org.apache.catalina.servlets.DefaultServlet&lt;span class="nt"&gt;&amp;lt;/servlet-class&amp;gt;&lt;/span&gt;
        &lt;span class="nt"&gt;&amp;lt;init-param&amp;gt;&lt;/span&gt;
            &lt;span class="nt"&gt;&amp;lt;param-name&amp;gt;&lt;/span&gt;listings&lt;span class="nt"&gt;&amp;lt;/param-name&amp;gt;&lt;/span&gt;
            &lt;span class="nt"&gt;&amp;lt;param-value&amp;gt;&lt;/span&gt;true&lt;span class="nt"&gt;&amp;lt;/param-value&amp;gt;&lt;/span&gt;
        &lt;span class="nt"&gt;&amp;lt;/init-param&amp;gt;&lt;/span&gt;
        &lt;span class="nt"&gt;&amp;lt;load-on-startup&amp;gt;&lt;/span&gt;1&lt;span class="nt"&gt;&amp;lt;/load-on-startup&amp;gt;&lt;/span&gt;
    &lt;span class="nt"&gt;&amp;lt;/servlet&amp;gt;&lt;/span&gt;

    &lt;span class="c"&gt;&amp;lt;!-- Add a mapping for our new default servlet --&amp;gt;&lt;/span&gt;
    &lt;span class="nt"&gt;&amp;lt;servlet-mapping&amp;gt;&lt;/span&gt;
        &lt;span class="nt"&gt;&amp;lt;servlet-name&amp;gt;&lt;/span&gt;DefaultServletOverride&lt;span class="nt"&gt;&amp;lt;/servlet-name&amp;gt;&lt;/span&gt;
        &lt;span class="nt"&gt;&amp;lt;url-pattern&amp;gt;&lt;/span&gt;/&lt;span class="nt"&gt;&amp;lt;/url-pattern&amp;gt;&lt;/span&gt;
    &lt;span class="nt"&gt;&amp;lt;/servlet-mapping&amp;gt;&lt;/span&gt;

&lt;span class="nt"&gt;&amp;lt;/web-app&amp;gt;&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;h2 id="start-search-system"&gt;Start Search System&lt;/h2&gt;
&lt;p&gt;For this you need to have the nutchwax.jar and the Hadoop folder after &lt;a class="" href="../Compile"&gt;Compile&lt;/a&gt; has been run. &lt;/p&gt;
&lt;ul&gt;
&lt;li&gt;Copy the folder of Hadoop to the server that will serve the collection. For each collection you will need a new copy of this folder. (example: &lt;code&gt;/opt/searcher/collections/test_collection_hadoop&lt;/code&gt;). &lt;/li&gt;
&lt;li&gt;Copy the file nutchwax.jar to /opt/searcher/collections/test_collection_hadoop &lt;/li&gt;
&lt;li&gt;Get the scripts from &lt;code&gt;svn checkout http://pwa-technologies.googlecode.com/svn/trunk/scripts&lt;/code&gt; to &lt;code&gt;/opt/searcher/scripts&lt;/code&gt;&lt;/li&gt;
&lt;li&gt;Configure a environment variable for the Scripts directory &lt;code&gt;% export SCRIPTS_DIR=/opt/searcher/scripts&lt;/code&gt;. &lt;/li&gt;
&lt;li&gt;Copy the file pwa_lucene.jar to /opt/searcher/scripts. &lt;/li&gt;
&lt;li&gt;Configure a environment variable for the Collections directory &lt;code&gt;% export COLLECTIONS_DIR=/opt/searcher/collections&lt;/code&gt;. &lt;/li&gt;
&lt;li&gt;
&lt;p&gt;Create the file &lt;code&gt;${COLLECTIONS_DIR}/search-servers.txt&lt;/code&gt; should have the following definition, 1 line per collection: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="n"&gt;hostname&lt;/span&gt;  &lt;span class="n"&gt;port_for_server&lt;/span&gt; &lt;span class="n"&gt;folder_of_hadoop_server&lt;/span&gt; &lt;span class="n"&gt;folder_for_outputs&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;/li&gt;
&lt;/ul&gt;
&lt;p&gt;example: &lt;/p&gt;
&lt;div class="codehilite"&gt;&lt;pre&gt;&lt;span class="n"&gt;master&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;example&lt;/span&gt;&lt;span class="p"&gt;.&lt;/span&gt;&lt;span class="n"&gt;com&lt;/span&gt; &lt;span class="mi"&gt;21111&lt;/span&gt; &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;opt&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;searcher&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;collections&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;test_collection_hadoop&lt;/span&gt; &lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;data&lt;/span&gt;&lt;span class="o"&gt;/&lt;/span&gt;&lt;span class="n"&gt;outputs&lt;/span&gt;
&lt;/pre&gt;&lt;/div&gt;
&lt;ul&gt;
&lt;li&gt;Start the servers: &lt;code&gt;% ${SCRIPTS_DIR}/start-slave-searchers.sh&lt;/code&gt;. &lt;/li&gt;
&lt;li&gt;Verify the &lt;code&gt;/opt/searcher/logs/slave-searcher-21111.log&lt;/code&gt; for startup errors of the server. &lt;/li&gt;
&lt;li&gt;To stop the server use: &lt;code&gt;% ${SCRIPTS_DIR}/stop-slave-searchers.sh&lt;/code&gt;&lt;/li&gt;
&lt;/ul&gt;&lt;/div&gt;</description><dc:creator xmlns:dc="http://purl.org/dc/elements/1.1/">Anonymous</dc:creator><pubDate>Tue, 17 Dec 2013 15:54:54 -0000</pubDate><guid>https://sourceforge.net75c9979dfbe07f49dc04302fb254dce9b76b57c8</guid></item></channel></rss>