Вы здесьeBookDownloader и валидация книжек. ВАЖНО!!!!
Опубликовано сб, 05/04/2008 - 15:44 пользователем Bullfear
Вобщем перед тем как заливать книжку(скачанную ebookDownloader-ом у конкурентов) в библиотеку ее надо проверить на валидность. Надеюсь все знают как это делать? Иначе получаються оччень неприятные вещи. Вот пример текста книжки(Скобочки <> заменены на () ): Тоесть невалидные абзацы тупо пропадают! Есть идеи как можно автоматизировать чистку книг? По сути надо автоматизировать закрывание абзацев, если абзац не закрыт. Или хотя бы какая читалка(для кпк естественно) показывает нормальный текст?
|
Вход на сайтПоиск по блогам и форумамUser menuПоследние комментарии
Океана RE:Подайте бедному копеечку на книжку с литреса... 1 день
DGOBLEK RE:Прошу переформатировать, распознать, etc... 6 дней akorish RE:Регистрация 1 неделя Tramell RE:Серия "Очень прикольная книга", издательство Азбука-классика 1 неделя Larisa_F RE:Серия "Я познаю мир" издательства "АСТ, Астрель, Олимп",... 1 неделя konst1 RE:Ух, как я не люблю спамеров! 1 неделя tvv RE:DNS 4 недели sem14 RE:«Не забыть бы тогда, не простить бы и не потерять!»-2 ... 4 недели larin RE:Заблокирован 1 месяц konst1 RE:Серия «Интеллектуальный детектив» изд-ва АСТ 1 месяц Larisa_F RE:Серия книг «Судьбы книг» издательства «Книга» 1 месяц fixel RE:Пропал абонемент 1 месяц sem14 RE:Книжная серия "Жизнь в искусстве" издательство "Искусство"... 2 месяца sibkron RE:"100 славянских романов", серия изд.-ва "Центр книги... 2 месяца Larisa_F RE:Серия "Новые сказочные повести" издательство "Самовар" ... 3 месяца sem14 RE:Серия "Символы времени" издательства "Аграф" 3 месяца tvv RE:faq brainstorm =) 3 месяца Larisa_F RE:Серия "Что есть что" издательства "Слово"(чего не хватает) 3 месяца Впечатления о книгах
Stager про Демина: Невеста по спецзаказу, или Моя свекровь и другие животные [СИ] (Любовная фантастика, Самиздат, сетевая литература)
10 05 Ну вот язык хороший, и фантазия есть... Но культуры и образования нет, и это портит всё. Оценка: неплохо
udrees про Яу   : Теория струн и скрытые измерения Вселенной [The shape of inner space. String Theory and the Geometry of the Universe's Hidden Dimensions ru] (Физика, Астрономия и Космос)
10 05 Я могу только процитировать одного ученого из этой книги, чтобы описать свое отношение к этой книге: «…Я обнаружил статью Яу в библиотеке и мало что из нее понял, но из того немногого, что мне удалось понять, я сделал однозначный ……… Оценка: хорошо
udrees про Вальтер: Мешок. Библия вселенной [справочник] (Боевая фантастика, Приключения: прочее, Самиздат, сетевая литература)
10 05 Очень короткое описание, буквально на 5-6 страниц, по сути не произведение, а глоссарий терминов из Вселенной Мешка. Написано просто, без всяких заумных терминов. Я правда не понял, это опечатка или что («Но камни с тварей ……… Оценка: неплохо
udrees про Вальтер: Я её нашёл, но... (Боевая фантастика, Попаданцы, Самиздат, сетевая литература)
10 05 В общем-то нормальное продолжение, главный герой действительно нашел свою невесту, я правда ожидал, что это «но…» будет длиться всю 3-ю книгу, но автор видимо не стал растягивать драму и воссоединил возлюбленных для новых ……… Оценка: хорошо
udrees про Вальтер: Браконьер 6 (Боевая фантастика, Приключения: прочее, Постапокалипсис, Самиздат, сетевая литература)
10 05 Отличное завершение серии про приключения Брака. Написано с душой, описания красочные, много крови, стрельбы и трупов. Язык главного героя грубый, раздраженный, повелевающий. Ну и плюс надо учитывать, что 6-я книга – это как ……… Оценка: отлично!
udrees про Вейр: Антигипоксант [Antihypoxiant ru] (Научная фантастика)
10 05 Еще один коротенький рассказ про возникновение зомби-апокалипсиса. Как говорится, благими намерениями вымощена дорога в ад, и научные открытия всегда несут в себе свою долю опасностей. Читать интересно. Оценка: неплохо
udrees про Вейр: Яйцо [The Egg ru] (Научная фантастика)
10 05 Коротенький рассказик со своей концепцией о жизни после смерти, смысле существования и Боге) мне понравилось. Оценка: неплохо
udrees про Емельянов: Первый игрок [litres] (Боевая фантастика, Фэнтези, Попаданцы)
10 05 Давно не читал такой книги, тем более в жанре литРПГ, попаданцев, чтобы сюжет был сильно усложнен внутренней борьбой и интригами. Сам автор метко написал об этом в одной главе: «Очевидно, что каждый вокруг ведет свою игру, ……… Оценка: хорошо
Никос Костакис про Вязовский: Восход Красной Звезды [СИ] (Альтернативная история, Попаданцы, Самиздат, сетевая литература)
09 05 Мы первые, придумали снимать телевизионное сопровождение, для наших песен. Никто на Западе, такого не делает. ___________________ Кто может пояснить необходимость хотя бы одной запятой?
mysevra про Филатов: Про Федота-стрельца, удалого молодца [ёфицировано] (Юмористические стихи)
09 05 Ну, это уже классика. Что ни фраза, то шедевр. На все случаи жизни. Оценка: отлично!
mysevra про Прошкин: Смертники (Боевая фантастика)
09 05 О, да. Возможно, не канон, но это было замечательно. Обязательно прочту продолжение. Оценка: отлично!
mysevra про Уайт: Мост Дьявола (Полицейский детектив, Триллер, Детективы: прочее)
09 05 То ли это пресыщение, то ли плохо подано, но история вызывает скуку и недоумение. Любое убийство – бесспорно трагедия, но зачем об этом целую книгу писать, да ещё и так невыразительно? Оценка: плохо |
Комментарии
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Это разработчику надо писать:
http://www.liveinternet.ru/users/dimzon541/
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Встречал обращения людей с подобными багами на форуме the-ebook.org. Там, насколько я припоминаю, дело было в альдовских файлах fb2. Возможно, тэги были не закрыты и в исходном тексте - тогда eBookDownloader ни при чем, он ведь хмл на валидность не проверяет.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Вполне возможно. Браузеру то по барабану - он автоматом закрывает. А вот в HaaliReader абзацы пропадают :(
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Не знаю... Читаю с Haali на КПК, и не замечал пропуска абзацев как будто, в том числе и в книгах, полученых с помощью ЕБД. Теперь буду присматриваться повнимательнее.
Кстати, Haali на КПК - единственная читалка, которая может автоматом сделать оглавление при определенном формате абзацев файла txt, и я это широко использую на работе, поэтому перейти на другую читалку никак не могу.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Сам недавно заметил :( Попробуй скачать Княжеский пир 2 Никитина. Цитата вверху оттуда.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
я fb2 читаю ICE Book Reader`ом. У меня у всех файлов с абзацами все впорядке.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Проблема решилась. Надо было просто выкинуть ";№%% Haalireader и поставить нормальный AIReader.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Haali не трож)) лучшая (и быстрая) читалка имхо.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Тоже так думал. Пока не поставил AIReader :) Листает Haali лучше, но проблема в том, что не отображает абзацы в "кривых" книжках (выше пример). Хотя может быть появиться новая версия и тогда... :)
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Сомневаюсь, что в Хаали эта проблема решится.
Там принципиально парсинг тегов параграфов сделан с расчетом на их парность.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Вообще проверить XML на соответствие схеме (в данном случае FB2) - задача тривиальная. По-хорошему, это должно делаться сайтом при каждом приеме fb2 от пользователя.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
И сразу лишимся doc и pdf.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Bullfear, откуда такой вывод ? При заливке fb2 проверяется валидность, а при заливке других форматов не проверяется, т.е. идёт в обход проверки.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
В хаали гемор с абзацами.
Я так понимаю там не отсутствие замыкающего тега а вложенный параграф типа (p)bla bla(p)bla(/p)(/p).
Но на всякий пожарный пришли образец на pisem.net@teolog. Сделаю очередную попытку фикса.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
ebookDownloader пока не умеет делать валидный fb2
Ни одна книга, сохраненная им в fb2 валидации не прошла. Ошибок при этом много: стихи форматируются как эпиграфы, не все теги нормально закрываются и т.д. Собрать книгу руками в результате получается быстрее, чем выправить то, что сделал ebookDownloader. :0(
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Поправить не так долго. В среднем нужно 5-10 минут, если сносок не очень много.
Добавить аннотацию и информацию о книге, убрать section у названия и автора, объединить пустые секции, исправить структуру, если она разветвленная , у эпиграфов исправить вложенный тэг epigraph на author-name, исправить стихи, добавить сноски. В FBE это занимает, как уже написал 5-10 минут.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Это время очень сильно зависит от сложности оформления книги. В книгах, кроме перечисленного вами, ещё и иллюстрации бывают, которые данлоадер только и умеет, что сохранять на диск - и за это автору спасибо. Дерните данлоадером ту же "Ртуть" Нила Стивенсона (http://lib.aldebaran.ru/author/stivenson_nil/stivenson_nil_rtut/) и проверьте, сколько времени у вас уйдет, чтобы вернуть оформление книги хотя бы к альдебарановскому - про печатное я уже и не говорю. Скажете, что 5-10 минут - соврёте.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Последние версии dowloadera вполне нормально сохраняют иллюстрации в fb2 документе.
На Ртуть немного больше времени, минут 20, из-за 56 сносок.
Хотя я хотел не меряться, кто быстрей, а просто пожелать выкладывающим неправленый fb2 утянутый даунлоадером потратить немного времени, и привести документ в нормальный вид.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Пришлите список того что не так, я попытаюсь поправить. Только поконкретней. Насчет сносок не совсем понятно что делать, не всегда понятно что это сноска поэтому я их вообще не обрабатывал.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Создаются лишние секции по подзаголовкам (самый самый частый пример - подзаголовок "* * *") и по началу каждой страницы, на которые книга разбита для онлайн-чтения.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Это не баг, это фича. В некоторых книгах заголовков просто нет, есть только подзаголовки. В результате получается одна здоровая секция и при чтении на некоторых читалках появляются дикие тормоза. Кроме того оказалось что создать несколько заголовков в одной секции значит нажить себе кучу неприятностей. Читалки именно заголовки почему то ненавидят.
Поэтому при встрече с заголовком создается новая секция, так же новая секция создается когда софтина оконечательно отчаивается разобратся с форматированием. Чаще всего на альдебаране.
Так что если не возникает артефактов при отображении, лучше не трогать.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Н-да.
Вот именно поэтому, чем бороться с подобными "фичами", куда проще и быстрее делать fb2 руками, с нуля.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
Подскажите лучший софт для конветации в fb2 или сами чем пользуетесь.
Re: eBookDownloader и валидация книжек. ВАЖНО!!!!
В данный момент я пользуюсь исключительно FB Writer-ом и копипастом. Для конвертации из doc в принципе можно пользоваться утилитами doc2fb или грибовской any2fb, но там контроль и ручная правка всё равно нужны. Any2fb, кстати, понимает не только doc, но и txt, rtf, html и др.