Tool zum herunterladen von HTML-Seiten

paddi

New member
Themenstarter
Registriert
26 Okt. 2005
Beiträge
301
Von Acrobat Professional weiß ich, dass die ein Tool integriert haben, mit denen man aus einer Quell-HTML-Seite bis zu einer angegebenen Hierarchie-Tiefe alle verlinkten Seiten mitherunterladen kann.
Gibt es sowas auch als Freeware? Wäre toll für offline-Surfstunden...
 
Für Firefox gibt es ein Plugin namens "Scrapbook", das genau den gleichen Funktionsumfang hat - kann das sehr empfehlen. Du findest es auf der Mozilla Homepage.
 
hallo,
ist das nicht diese ganz normale Internetexplorerfunktion Tools-Synchronize in der Menüleiste?
mfG
rudolfka
p.s.:
Kontextmenü:make available offline: Checkbox anklicken
 
Wenn man eine Webseite klonen will, ist das vorgenannte HTTrack geeigneter. Das passt automatisch alle Links an und man hat den HTML-Source.

Scrapbook ist klasse zum Archivieren bzw. Offline-Betrachten, wenn man eine geniale Seite findet.

Jetzt kommt es darauf an, was der Threadstarter eigentlich will ;)

G.
 
Also httrack saugt ja ganz ordentlich, aber irgendwie sehr viel von dem was ich eigentlich nicht brauche.
Aber wahrscheinlich habe ich es falsch konfiguriert (da sind ja 100e Optionen).

Toll wäre ein Tool, das zu allen Links auf einer Seite weiterverzweigt und diese ebenfalls herunterlädt.
 
Original von paddi
Toll wäre ein Tool, das zu allen Links auf einer Seite weiterverzweigt und diese ebenfalls herunterlädt.

Genau das macht Httrack. Aber damit kann man sich ruck-zuck das Internet reinsaugen. Externe Links sind von Haus aus abgestellt. Macht auch irgendwie Sinn.

G.
 
Wusste gar nicht, dass es wget auch für Windows gibt. Sonst wäre das auch meine Empfehlung gewesen... Nutze ich unter Linux auch für den gewünschten Zweck:

wget -r -c -l0 -R pdf -L -N http://www.hallo-spencer.de/home/index.php

-r rekursiv, Links werden verfolgt
-l wie weit werden Links verfolgt 0=unendlich, daher Einschränkung durch L notwendig
-N nur neuere werden runtergeladen
-L nur relative Links werden verfolgt (also wird die Seite nicht verlassen)
-R die danach folgenden Dateiformate werden ausgeschlossen
-c fortsetzen
 
Danke vorerst, aber ich schaffe es einfach nicht mit wget, dass mir auch die Links verfolgt werden.
Selbst wenn ich -L weglasse und -l5 einstelle! Es wird mir immer nur die "Einstiegsseite" heruntergeladen!
Was mir httrack zuviel herunterlädt, saugt wget zu wenig :-(
 
Original von paddi
Es wird mir immer nur die "Einstiegsseite" heruntergeladen!
Versuch doch mal den genauen Pfad zur Startseite anzugeben. Bei meinem Hallo-Spencer-Bsp oben hat es auch nicht geklaptt (*schäm*), ich hab das mal entsprechend abgeändert. So klappt es bei mir.

Gruß, Mario
 
  • ok1.de
  • thinkstore24.de
  • ok2.de - Notebook Computer Server
  • Preiswerte-IT - Gebrauchte Lenovo Notebooks kaufen

Werbung

Zurück
Oben