Думаю, ради одной задачи, одного человека не стоит это включать в программу. Если только сообщество выскажется о необходимости... Хотя показанный...
Что то не то... В вашем примере на странице _http://www.triplag.com/4room/viewtopic.php?f=3&t=6621&start=15 первый пост, сглатываются строки...
что-то у меня так не получается пример страниц _http://www.triplag.com/4room/viewtopic.php?f=3&t=6621&start=15 - в первом посте цитата 1 уровень...
Задаю границы <div class="postbody"> ... </div> предварительно поиск-замена <div class="quotecontent">{skip}</div>| не убирает всё лишнее, если...
Здравствуйте. Попадается такая вот рекурсивная конструкция Может быть так: <div class="postbody"> <div class="quotecontent"> Нужно удалить...
Здравствуйте. 1. На сайте есть "зашифрованная" ссылка, кликом по которой попадаем на сторонний сайт. Спарсить сам документ по этой ссылке можно...
Именно для этого программа и создавалась. Можно.
GETMORECONTENT ( и [GETMORECYCLECONTENT]) я пробовал, но он берет только на уровень ниже , а если страниц допустим 10. Или я его его не правильно...
~Дошло как сделать, но всё равно это пост обработка. Если кто подскажет, как решить средствами CD буду благодарен.
Здравствуйте. Парсю стандартный форум. Некоторое топики разбиты на страницы >2 как можно собрать топик в один файл. Пост обработка внешним...
Спасибо, но наверно придется делать внешним скриптом... вариант с [INT_ID] тут наверное не пройдет - разрядность впередиидущих нулей вроде никак...
Скажите пожалуйста, а никак нельзя сделать так, что бы файлы нумеровались не article_№.txt, а article_00000001.txt article_00000002.txt
я согласен, с другой стороны, галка есть - должна работать :) а с третей, я не пойму куда воткнуть регистронезависимость, так что ли (?i)
у меня что с галкой, что без галки регистр Учитывается пишу туда так - re:\bName\b| (хочу удалить слово Name) [IMG]
Есть стандартный форум. Все уже скачано на диск - можно запустить как с локалхоста, так и просто парсить файлы. Топики содержат несколько страниц...
сделал так [REPLACE(re:((\S*)(@)(\S*))|)] [REPLACE(re:((\S*)(http:)(\S*))|)] [REPLACE(re:((\S*)(www.)(\S*))|)] [REPLACE(re:((\S*)(.com)(\S*))|)]...
Есть спарсенный текст в котором могут хаотически содержаться нежелательные кусочки - майлы, урлы... не могу сообразить, как их просто выкинуть из...
Имена участников (разделяйте запятой).