Вы здесьeBookDownloader и валидация книжек. ВАЖНО!!!!
Опубликовано сб, 05/04/2008 - 15:44 пользователем Bullfear
Вобщем перед тем как заливать книжку(скачанную ebookDownloader-ом у конкурентов) в библиотеку ее надо проверить на валидность. Надеюсь все знают как это делать? Иначе получаються оччень неприятные вещи. Вот пример текста книжки(Скобочки <> заменены на () ): Тоесть невалидные абзацы тупо пропадают! Есть идеи как можно автоматизировать чистку книг? По сути надо автоматизировать закрывание абзацев, если абзац не закрыт. Или хотя бы какая читалка(для кпк естественно) показывает нормальный текст?
|
Вход на сайтПоиск по блогам и форумамUser menuПоследние комментарии
konst1 RE:Подайте бедному копеечку на книжку с литреса... 2 часа
nehug@cheaphub.net RE:Доступ 3 дня sibkron RE:«Македонский роман XXI века 4 дня sem14 RE:Рассказы Южных морей 1 неделя weis RE:Прошу переформатировать, распознать, etc... 1 неделя arkadybi RE:Абонемент 1 неделя babajga RE:Комната в башне 1 неделя Саша из Киева RE:Герои Израиля 1 неделя babajga RE:сиреневая звезда 1 неделя babajga RE:Сказки Папоротникового Леса 1 неделя sem14 RE:вопрос 2 недели sem14 RE:Премия «Небьюла» (Nebula Award) 2 недели Isais RE:Maxima-library - переезд 3 недели Iron Man RE:Курьезы сканировщика 4 недели tvv RE:Абрахам Вергезе - The Covenant of Water 4 недели Larisa_F RE:Эрнесто и его кролики 1 месяц Саша из Киева RE:Горящие паруса 1 месяц Саша из Киева RE:Американская мозаика 1 месяц Впечатления о книгах
Alhimik0 про Уэльбек: Возможность острова [La possibilité d'une île ru] (Современная проза)
02 07 Счастье это лишь возможность острова на миг открытого нам вдали холодного равнодушного моря нашей жизни. Жизнь - реальна. Все остальное - нет... Оценка: отлично!
udrees про Михайлов: Инфер-3 [СИ] (Боевая фантастика, Киберпанк)
02 07 Хорошее продолжение серии. Написано в жестком стиле, обилие кровищи, сцены жестокости, пыток, убийств. Главный герой никого не боится, шагает по трупам. В разговорах с другими хамоват и быдловат. Никто ему не ровня. ……… Оценка: хорошо
udrees про Михайлов: Инфер-7 [СИ] (Боевая фантастика, Киберпанк, ЛитРПГ, Самиздат, сетевая литература)
02 07 Продолжение жестоких приключений героя в жестоком умирающем мире. Для любителей серии зайдет, благо что антураж поменялся, поменялись монстры и сюжетная линия поменялась. Описания предельно жестокие, с изобилием кровавых ……… Оценка: хорошо
udrees про Михайлов: Инфер-6 [СИ] (Боевая фантастика, Киберпанк, ЛитРПГ)
02 07 В целом хорошо, небольшая смена обстановки, чуть лучше стало описание. Главный герой в целом справедлив, хотя и жесток. Все равно старается помочь угнетенным и отчаявшимся. Находится в «контрах» с власть имущими и эксплуатирующими. Для ……… Оценка: хорошо
udrees про Михайлов: Инфер-5 [СИ] (Боевая фантастика, Киберпанк, Постапокалипсис, Самиздат, сетевая литература)
02 07 Очередное продолжение цикла Низшего. Но сейчас наконец-то смена обстановки. Повествование начинается почти как с первой книги, когда герой переносится без всего в мир Формоз. Но на сей раз путь наверх проходится практически ……… Оценка: хорошо
udrees про Михайлов: Инфер-4 [СИ] (Боевая фантастика, Научная фантастика, ЛитРПГ, Самиздат, сетевая литература)
02 07 Продолжение истории про Низшего, для любителей серии. Особенно ничего интересного по сюжету не будет, скорее это возвращение к старым местам. Происходит наконец-то воссоединение боевого отряда и встреча со старыми друзьями ……… Оценка: хорошо
obivatel про Яманов: Братик [litres] (Альтернативная история, Попаданцы)
02 07 Начал ловить себя на мысли "когда там уже финиш" и прекратил читать: зачем себя напрягать? Но то, что прочитал: НЕПЛОХО. Оценка: неплохо
decim про Трэвис Коркоран
02 07 Первая книга - отлично. Вторая - хорошо. Если вы любитель alex_rozoff и его "Меганезии", то и эти книги зайдут. Взгляды автора схожи с розовскими - анархо-капитализм как возможный выход. Действие происходит в условном ………
decim про Фибих: Двужильная Россия [litres] (Биографии и Мемуары)
02 07 Человек, что называется, попал в жернова. С точки зрения садомазохистов - сам виноват, и вообще скажи спасибо, что не убили. Фарисейство это - до первого пинка. Об уровне полемики говорит и то, что национальность у садюшки ……… Оценка: хорошо
svengali про Туччи: Вкус. Кулинарные мемуары [litres] (Биографии и Мемуары, Публицистика, Кулинария, Кино)
01 07 Какой ещё "кассероле"? Переводчик никогда не слышал слово кастрюля? Кастрюля, а не "кассероле". Оценка: нечитаемо
polyn про Миронова: Под сенью омелы [litres] (Современные любовные романы, Любовные детективы)
30 06 И на этот раз у автора получилась незабываемая, необычная история с непредсказуемыми поворотами сюжета. Читала и наслаждалась. Это и детектив, поскольку тут речь идёт о нескольких убийствах. Это и мистика, связанная с ……… Оценка: отлично!
lukyanelena про Зинина: Эффект "Федора" [СИ] (Современные любовные романы, Самиздат, сетевая литература)
30 06 Отличная история созависимых отношений, жертва и абьюзер. И все это завернуто в фантик "любовь". Нет там никакой любви. Всегда она будет виновата, а он, так и быть, будет прощать. Очень опасно, когда девочки верят в такую туфту. Беэээээ Оценка: неплохо |
Комментарии
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Это разработчику надо писать:
http://www.liveinternet.ru/users/dimzon541/
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Встречал обращения людей с подобными багами на форуме the-ebook.org. Там, насколько я припоминаю, дело было в альдовских файлах fb2. Возможно, тэги были не закрыты и в исходном тексте - тогда eBookDownloader ни при чем, он ведь хмл на валидность не проверяет.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Вполне возможно. Браузеру то по барабану - он автоматом закрывает. А вот в HaaliReader абзацы пропадают :(
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Не знаю... Читаю с Haali на КПК, и не замечал пропуска абзацев как будто, в том числе и в книгах, полученых с помощью ЕБД. Теперь буду присматриваться повнимательнее.
Кстати, Haali на КПК - единственная читалка, которая может автоматом сделать оглавление при определенном формате абзацев файла txt, и я это широко использую на работе, поэтому перейти на другую читалку никак не могу.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Сам недавно заметил :( Попробуй скачать Княжеский пир 2 Никитина. Цитата вверху оттуда.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
я fb2 читаю ICE Book Reader`ом. У меня у всех файлов с абзацами все впорядке.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Проблема решилась. Надо было просто выкинуть ";№%% Haalireader и поставить нормальный AIReader.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Haali не трож)) лучшая (и быстрая) читалка имхо.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Тоже так думал. Пока не поставил AIReader :) Листает Haali лучше, но проблема в том, что не отображает абзацы в "кривых" книжках (выше пример). Хотя может быть появиться новая версия и тогда... :)
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Сомневаюсь, что в Хаали эта проблема решится.
Там принципиально парсинг тегов параграфов сделан с расчетом на их парность.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Вообще проверить XML на соответствие схеме (в данном случае FB2) - задача тривиальная. По-хорошему, это должно делаться сайтом при каждом приеме fb2 от пользователя.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
И сразу лишимся doc и pdf.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Bullfear, откуда такой вывод ? При заливке fb2 проверяется валидность, а при заливке других форматов не проверяется, т.е. идёт в обход проверки.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
В хаали гемор с абзацами.
Я так понимаю там не отсутствие замыкающего тега а вложенный параграф типа (p)bla bla(p)bla(/p)(/p).
Но на всякий пожарный пришли образец на pisem.net@teolog. Сделаю очередную попытку фикса.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
ebookDownloader пока не умеет делать валидный fb2
Ни одна книга, сохраненная им в fb2 валидации не прошла. Ошибок при этом много: стихи форматируются как эпиграфы, не все теги нормально закрываются и т.д. Собрать книгу руками в результате получается быстрее, чем выправить то, что сделал ebookDownloader. :0(
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Поправить не так долго. В среднем нужно 5-10 минут, если сносок не очень много.
Добавить аннотацию и информацию о книге, убрать section у названия и автора, объединить пустые секции, исправить структуру, если она разветвленная , у эпиграфов исправить вложенный тэг epigraph на author-name, исправить стихи, добавить сноски. В FBE это занимает, как уже написал 5-10 минут.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Это время очень сильно зависит от сложности оформления книги. В книгах, кроме перечисленного вами, ещё и иллюстрации бывают, которые данлоадер только и умеет, что сохранять на диск - и за это автору спасибо. Дерните данлоадером ту же "Ртуть" Нила Стивенсона (http://lib.aldebaran.ru/author/stivenson_nil/stivenson_nil_rtut/) и проверьте, сколько времени у вас уйдет, чтобы вернуть оформление книги хотя бы к альдебарановскому - про печатное я уже и не говорю. Скажете, что 5-10 минут - соврёте.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Последние версии dowloadera вполне нормально сохраняют иллюстрации в fb2 документе.
На Ртуть немного больше времени, минут 20, из-за 56 сносок.
Хотя я хотел не меряться, кто быстрей, а просто пожелать выкладывающим неправленый fb2 утянутый даунлоадером потратить немного времени, и привести документ в нормальный вид.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Пришлите список того что не так, я попытаюсь поправить. Только поконкретней. Насчет сносок не совсем понятно что делать, не всегда понятно что это сноска поэтому я их вообще не обрабатывал.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Создаются лишние секции по подзаголовкам (самый самый частый пример - подзаголовок "* * *") и по началу каждой страницы, на которые книга разбита для онлайн-чтения.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Это не баг, это фича. В некоторых книгах заголовков просто нет, есть только подзаголовки. В результате получается одна здоровая секция и при чтении на некоторых читалках появляются дикие тормоза. Кроме того оказалось что создать несколько заголовков в одной секции значит нажить себе кучу неприятностей. Читалки именно заголовки почему то ненавидят.
Поэтому при встрече с заголовком создается новая секция, так же новая секция создается когда софтина оконечательно отчаивается разобратся с форматированием. Чаще всего на альдебаране.
Так что если не возникает артефактов при отображении, лучше не трогать.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Н-да.
Вот именно поэтому, чем бороться с подобными "фичами", куда проще и быстрее делать fb2 руками, с нуля.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Подскажите лучший софт для конветации в fb2 или сами чем пользуетесь.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
В данный момент я пользуюсь исключительно FB Writer-ом и копипастом. Для конвертации из doc в принципе можно пользоваться утилитами doc2fb или грибовской any2fb, но там контроль и ручная правка всё равно нужны. Any2fb, кстати, понимает не только doc, но и txt, rtf, html и др.