Обсуждение настройки и работы сервисов, резервирования, сетевых настроек и вопросов безопасности ОС.
Модераторы: SLEDopit , Модераторы разделов
Sekta-N
Сообщения: 854
ОС: Зоопарк
Сообщение
Sekta-N » 31.03.2008 11:11
В школу прислали список белых сайтов. Мне их надо перенести в текстовой документ. Список находится в html формате.
пробывал grep
http://www . имя_файла, но он мне выдал такое:
/div><div class='link'><a href='http://www.zorich.ru/'><img class='img_icon' src ='ico_web.gif'> ��������� ����� � ���������� ��������</a></div><div class='link' ><a href='http://lleo.aha.ru/'><img class='img_icon' src='ico_web.gif'> �������� � ���� ������� ��������</a></div>
<a href="http://www.informika.ru/"><img class='img_banner' src='logo_informika.g if' title='��� ���� ��� "���������"'></a>
admin@linux:/home/diski/catalog>
Как из этого вырвать только www.<site>.xz
Нет тут подписи и не будет.
diesel
Бывший модератор
Сообщения: 5989
ОС: OS X, openSuSE, ROSA, Debian
Сообщение
diesel » 31.03.2008 11:40
grep -oE 'http://[0-9a-zA-Z\-_\.]*'
где-то так
Sekta-N
Сообщения: 854
ОС: Зоопарк
Сообщение
Sekta-N » 31.03.2008 11:44
Спасибо!
Кому надо держите white лист сайтов для образовательных учреждений.
Представляю сколько бы я виндоусе это бы переносил в фильтр.
Запустил еще uniq | sort
У вас нет необходимых прав для просмотра вложений в этом сообщении.
Нет тут подписи и не будет.
keir
Сообщения: 317
ОС: linux
Сообщение
keir » 31.03.2008 11:53
помимо
grep -а еще
uniq на этот лист наложить надо
Trust №1