Curl Extrair Arquivos De Sites
Curl Baixar vários arquivos de um site
Se você tiver uma lista de links dos arquivos, crie um arquivo urls.txt e cole dentro, use o comando para baixar tudo:
curl -O -L $(cat urls.txt)
-L → segue redirecionamentos (importante se o link for algo como download?id=123).
Automação com grep + curl
Você pode extrair os links dos arquivos da página dos site e depois baixar tudo, com o comando:
curl -s https://linux.jar.io/qbittorrent-puglins \
| grep -oE 'https?://[^"]+\.py' \
| xargs -n1 curl -O -L
Explicação:
curl -s → baixa o HTML da página.
grep -oE ‘https?://[^”]+.py’ → pega todos os links que terminam em .py.
xargs -n1 curl -O -L → baixa cada link encontrado.
Um exemplo de arquivo script em Bash que usa curl + grep para extrair todos os links de arquivos .py da página que você citou e baixá-los automaticamente:
cat «‘EOF’ > ~/baixar_py.sh #!/bin/bash
este comando cria um arquivo SH para baixar .py, mude o url e o tipo de arquivo que você deseja
URL inicial
URL=”https://linux.jar.io/qbittorrent-puglins”
Baixa o HTML da página, extrai links .py e faz download
curl -s “$URL”
| grep -oE ‘https?://[^”]+.py’
| while read -r link; do
echo “Baixando: $link”
curl -O -L “$link”
done
EOF
Rode os comandos para baixar tudo:
1
chmod +x baixar_py.sh
2
./baixar_py.sh
Explicando o comando: Usa curl -s para pegar o HTML da página.
grep -oE ‘https?://[^”]+.py’ encontra todos os links que terminam em .py.
Para cada link encontrado, roda curl -O -L para baixar o arquivo (seguindo redirecionamentos).
OBS.: Se os links forem gerados via JavaScript, aí o curl não vai enxergar — nesse caso seria melhor usar httrack ou um script em Python com requests + BeautifulSoup.