Обсуждение настройки и работы сервисов, резервирования, сетевых настроек и вопросов безопасности ОС.
Модераторы: SLEDopit , Модераторы разделов
roleg
Сообщения: 38
ОС: ALT Linux 4
Сообщение
roleg » 20.05.2009 18:01
Сижу и думаю как сделать чтобы из html докуманта без переводов и концов строк одним sed выражением вырезать все ссылки между
href=" и
"
пишу так, пример:
Код: Выделить всё
echo GET /search?num=100\&q=туплю | netcat www.google.ru 80 | sed -e 's/[hH][rR][eE][fF]\=\"\(.*\)\"/\n\1/i'
чё да как, там в конце$, начале^ строки или синтаксис неправильный, забыл вобще
а в нете как всегда неподходят примеры и тонна мануалов которые невозможно за 5 мин. поднять.
помогите вобщем...
drBatty
Сообщения: 8735
Статус: GPG ID: 4DFBD1D6 дом горит, козёл не видит...
ОС: Slackware-current
Сообщение
drBatty » 20.05.2009 19:43
roleg писал(а): ↑ 20.05.2009 18:01
Сижу и думаю как сделать чтобы из html докуманта без переводов и концов строк одним sed выражением вырезать все ссылки между href=" и "
man sed не такой уж и длинный, а вопрос скорее по регулярным выражениям. RE за пять минут ещё никто не освоил. Простите
Shell
doc ~/er $echo '<td class="row5"><a href="forum/viewforum.php?f=12">Internet</a></td>' | sed -r 's/(.*<a href=")[^"]*(".*)/\1\2/'
<td class="row5"><a href="">Internet</a></td>
а... только ссылки надо... тогда так
Shell
doc ~/er $echo '<td class="row5"><a href="forum/viewforum.php?f=12">Internet</a></td>' | sed -r 's/.*<a href="([^"]*)".*/\1\n/ig'
forum/viewforum.php?f=12
roleg писал(а): ↑ 20.05.2009 18:01
забыл вобще
а вот тут вы нас обманываете...
RE как велосипед - разучится невозможно