#!/bin/bash

SCRIPT=`realpath $0`
SCRIPTPATH=`dirname $SCRIPT`
CSVFILE=$SCRIPTPATH/../source_urls.csv
TARGET_FOLDER=$SCRIPTPATH/../content

cat $CSVFILE | 
sed '1d' |
awk 'BEGIN {FS="\t"}; {print $2}' |
while read URL; do
  printf "Retrieving $URL\n"
  # @see https://www.gnu.org/software/wget/manual/wget.html
  wget --quiet --convert-links --page-requisites $URL --directory-prefix=$TARGET_FOLDER  
done
