во-первых, чтобы не мешали смайлики - выделяйте часть кода опциями "ВВ-код". получится так: Code: [REPLACE(, |{br};;;;;;;)][VALUE][/REPLACE] по второму пункту. кажется, я помню, откуда взялась эта конструкция. этот уродливый фрагмент родился из невозможности перехода на новую строку посредством #13 в настройках повторяющихся границ. Ссылки недоступны для гостей сегодня, проблемы уже нет. повторяющиеся границы отделяются друг от друга не через #13 а {br} и все переходы работают. соотв. и конструкция эта уже не нужна. замените ее на ;;;;;;;[VALUE], и поставьте {br} в настройках деления циклов повторяющихся границ.
у меня что с галкой, что без галки регистр Учитывается пишу туда так - re:\bName\b| (хочу удалить слово Name)
в данном случае заглавная буква попадает в регулярное выражение. вполне логично, что для нее действуют правила, предусмотренные именно для синтаксиса регулярных выражений. в регулярках нечувствительность к регистру прописывается отдельно, в самой формуле. это как в программировании - вы можете вставить в общий блок какую-то часть, внутри которой действуют свои, особые правила, имеющие приоритет над внешними. тут свои переменные, своя логика. а за ее пределами - все общее. P.S. не претендую на истину в последней инстанции. все это - мое личное ИМХО.
я согласен, с другой стороны, галка есть - должна работать а с третей, я не пойму куда воткнуть регистронезависимость, так что ли (?i)
Автокодировка и [PARAM] Есть такой мелкий, неприятный и непонятный (по крайней мере, мне) бажик. Сразу на примере: Берем ссылку на парсинг Ссылки недоступны для гостей В принципе, если задаем границы парсинга, то сразу видим, что автоматом CD здесь кодировку не определил (utf-8). Но при этом он все равно отлично парсит страницу, даже если не задавать границу. Но только до того момента, пока мы не вставим [PARAM] в ссылку и шаблон вывода, тогда на выходе мы получаем значение [PARAM] в ansi (стоит по умолчанию в кодировке сохраняемого документа), а тело статьи уже в utf-8. В принципе таких страниц у меня получается около 3%, не критично (по-этому и бажик мелкий), но и не приятно. Может можно как-то подружить парам и автокодировку на этих 3-ех процентах?
Помню по 1 миллиону ссылок загружал в CD и он запускался, а сейчас добавил всего 500к ссылок вида Ссылки недоступны для гостей запрос&site=®ion=®ion_id=&zone=all&wordforms=all&lang%5B%5D=all&within=0&mime%5B%5D=all&numdoc=50&sub=s и программа не смогла даже запуститься, появилась полоса загрузки бекапа и на 92% какая-то ошибка выскакивает (не вижу её, полоса бекапа перекрывает её)
парсю страницы Ссылки недоступны для гостей Ссылки недоступны для гостей Ссылки недоступны для гостей забираю кусок текста / Турция / Аланья / Кестель (нужно по отдельности страна, город, курорт) спереди бывает лишнее, например "Сеть ACG Hotels" пишу границу так начало title="Отели{skip}<span itemprop="title"> конец </span> если указываю номер тега по счёту 1, то программа уже не понимает границу.
Это вроде и не баг, а так и предусмотрено ранее было при использовании {skip} в указани границ. Как вариант можно регуляркой метки проставить в главном окне "поиск-замена" Ссылки недоступны для гостей
DOWNLOADFILENAMES DOWNLOADFILENAMES не парсит точки в название файла и добавляет лишнее расширение файлов.
Здравствуйте! Подскажите, как отключить автоматическое создание файлов? У меня парсинг идет в MySQL, используются только скрипты, а файлы автоматом создаются. После того, как файлов становится больше 20 тыс в папке, CD периодически подвисает во время парсинга.
Два варианта на такой случай. 1. сохраните все в один файл с дозаписыванием (стоит обратить внимание что такой вариант наиболее хорошь поскольку напарсенные ссылки страниц тогда фиксируются в подключенном текстовом файле, если подключен) 2. вариант. если парсите в базу по определенному диапазону один раз, то в шаблоне вывода можно все удалить что за пределами макроса подключения пхп скрипта. Рекомендую первый вариант, проще и фикируется по надобности спарсенное.
У меня почему-то программа перестала использовать загруженные прокси. Стоит галочка: использовать прокси при парсинге контента и ссылок... А в логе парсинга: прокси не используется. Только вчера парсил с проксями. А со вчерашнего вечера перестал. Пробовал подставлять разные прокси. Чекает, но не использует почему-то... Подскажите, пожалуйста, из-за чего может такое быть?
Обнаружен баг при генерации XML для Wordpress: В самих статях категория указана в нижнем регистре (категория), а в заголовках - регистрозависима (Категория). Ссылки недоступны для гостей Ссылки недоступны для гостей
Возник баг в 7 версии, сегодня обновил: оставил сканер на несколько часов, прихожу, пишет: В программе запущен сканнер сайтов, желаете закрыть? И так несколько раз нажал "нет". Ну и сам он завис. Сканер был с проксями. В 3-й версии при тех же условиях и тот же сайте для сканера такого не было.
Content Downloader 7 версии 7.02 (18.08.2013): ВАЖНО!!!: Устранена ошибка, связанная с произвольным закрытием программы, если такое повторится, прошу обратиться в Skype smartbyte_support или ICQ 571-880-051, спасибо! Приносим искренние извинения за предоставленные неудобства и надеемся на ваше понимание. С уважением к вам, администрация SBFactory.ru! - Макрос шаблона вывода IFNIL теперь не вставляет пустую строку; - В окно добавления ссылок (F8) добавлен хоткей ctrl+enter (добавит ссылки к списку); - Хоткеи для перехода к отмеченным элементам (shift+стрелка вверх и shift+стрелка вниз) были заменены на ctrl+стрелка вверх и ctrl+стрелка вниз; - Несколько доработок и исправлений. Все ли хорошо теперь?