скрипт для лингвистического анализа текста
Опубликовано вс, 28/12/2008 - 12:58 пользователем Wictor
Forums: Просматривая отзывы на книгу Хаецкой Царство небесное натолкнулся на интересную статистику, сгенерированную скриптом (http://fantlab.ru/work9929): Цитата: Лингвистический анализ текста: Учитывая то, что большинство современных книг весьма низкого качества, задумался: можно ли дать предварительную оценку книги на основании этих цифр. Вообще при выборе книги вы бы на такую статистику обращали бы внимание?
|
Вход на сайтПоиск по блогам и форумамUser menuПоследние комментарии
weis RE:Подайте бедному копеечку на книжку с литреса... 49 мин.
Isais RE:Семейственность в литературе 2 дня miri.ness_ RE:Доступ 27 4 дня bmusanov Оплатил, но абонемент не отображается 1 неделя holla RE:Багрепорт - 2 1 неделя sem14 RE:Книжная серия "Жизнь в искусстве" издательство "Искусство"... 1 неделя konst1 RE:Файнридер для Win11 1 неделя larin RE:Оплатил, но абонемент не отображается 1 неделя sem14 RE:Книжная серия «Сlio» издательства "Евразия" 2 недели Isais RE:Национальный конкурс на лучшее литературное произведение... 2 недели Isais RE:Детство, опаленное войной (Вторая мировая 1939-1945 и ВОВ) 2 недели sem14 RE:Современная корейская литература. Книжная серия... 2 недели sem14 RE:«Морской роман» — книжная серия Калининградского книжного... 2 недели larin RE:Оплатил,но абонемент не отображается 2 недели sd RE:Fishing 3 недели Алексей111111111111 RE:Оплатила,но абонемент не отображается 3 недели kopak RE:Беженцы с Флибусты 3 недели Isais RE:Вадим Иванович Туманов - Всё потерять - и вновь начать с... 3 недели Впечатления о книгах
lokiiii про Михайлов: Инфер-10 (Боевая фантастика, Киберпанк, Постапокалипсис, Самиздат, сетевая литература)
12 08 Оди ушел в конце восьмой книги, а не девятой. И на этом подцикл Инфер, по сути, завершен. Начиная с девятой (где и описано куда подевался его экз) книги идёт уже новый подцикл, для которого автору просто было лень придумывать ……… Оценка: хорошо
Синявский про Евгений Львович Чижов
11 08 11 авг - РИА Новости. Писатель Евгений Чижов утонул в Балтийском море, сообщил его друг, писатель Дмитрий Данилов.
decim про Астраби: Сумма наших жизней (Современная проза)
11 08 Дамский роман с психологией. На копейку сложнее стандартного "арлекина", но и только. Годится для чтения в зале ожидания или вагоне. Неплохо. Оценка: неплохо
dolle про Михайлов: Инфер-10 (Боевая фантастика, Киберпанк, Постапокалипсис, Самиздат, сетевая литература)
10 08 Оди опять вернулся. Без нейроимплантов и прочих " плюшек" он скрывается от матери. Новый сюжет, новые локации и интрига в конце книги.
udrees про Михайлов: Инфер-10 (Боевая фантастика, Киберпанк, Постапокалипсис, Самиздат, сетевая литература)
10 08 Я думал история Оди завершилась вполне логично в 9-й книге, ан-нет, триумфальное возвращение гоблина. Правда там не объясняется, откуда он выполз и куда подевался его экзо-костюм Ночная гадюка. Помнится в 9-й книге он в нем ……… Оценка: отлично!
udrees про Докинз: Бог как иллюзия [The God Delusion ru] (Религиоведение, Философия)
10 08 Очень познавательная книга, исследующая возникновение и пользу религии в жизни человека. Мне в общем-то понравилось, как автор раскладывает по полочкам основные моменты того, как религия влияет на нашу жизнь, рассматривает ……… Оценка: отлично!
udrees про Жуков: Человек в космосе. Отодвигая границы неизвестного [сборник litres] (Научная литература: прочее)
10 08 Книга – просто набор интервью разных людей, приглашенных на конференцию посвященной космосу. Здесь и космонавты, и ученые, и биологи, астрономы, и певцы) В общем-то большей частью читать скучно, все повторяются. Космонавты ……… Оценка: плохо
udrees про Атаманов: Забаненный 4 (Боевая фантастика, ЛитРПГ, Самиздат, сетевая литература)
10 08 Наверное достойное завершение серии про Забаненного, персонаж наконец-то достигнет своей цели. Написана книга хорошо, сюжет очень живой и не позволяет заскучать, поэтому читается очень легко. Разговоры персонажей тоже нормальные, ……… Оценка: хорошо
mysevra про Муравьева: Как воспитывали русского дворянина. Опыт знаменитых семей России – современным родителям (История, Педагогика)
09 08 Восхитительная книга. Нечто вроде «Лорд должен». Сейчас у нас таких людей уже не делают. Оценка: отлично!
mysevra про Нечуй-Левицкий: Кайдашева сім’я [uk] (Классическая проза)
09 08 Навіщо я його перечитала? Писав майстер, інакше мене б не трусило від злості та огиди. Мені вкрай не подобається історія і персонажі, але ж дійсно шедевр, оскільки одним із завдань літератури є змусити читача задуматися. Оценка: хорошо
mysevra про Чёрч: Во тьме безмолвной под холмом [litres] (Ужасы, Триллер)
09 08 Ну кто же не любит на ночь истории о старых недобрых богах? Живенько так, с фантазией. Оценка: отлично!
edik_m про Филипенко: Кремулятор (Современная проза)
09 08 Тяжелая книга. Вряд ли её можно рассматривать как достоверное историческое свидетельство, но моим представлениям о той эпохе она вполне соответствует. Оценка: хорошо |
Отв: скрипт для лингвистического анализа текста
Хотите поверить алгеброй гармонию? :)
Нет. Цифры любопытные, но, увы, о качестве книги они ровным счетом ничего не говорят.
Отв: скрипт для лингвистического анализа текста
А если бедный язык у автора? Ну т.е. значение "Активный словарный запас"?
Отв: скрипт для лингвистического анализа текста
Вы считаете, что у Елены Хаецкой "бедный язык"? :)
Отв: скрипт для лингвистического анализа текста
Я вот тоже очень удивилась. Зато выявилась достоверность "скриповой" оценки текста. :)
Отв: скрипт для лингвистического анализа текста
Под словом "автор" я имел в виду автора гипотетического. Хаецкая мне нравится, хотя в некоторых ее произведения встречаются повторы чуть ли не абзацев. Например куски текста из Саги о Хелоте встречаются в Харольде.
Отв: скрипт для лингвистического анализа текста
Не люблю говорить о сферических конях в вакууме. В Вашем примере активный словарный запас автора "ниже среднего". С творчеством автора Вы знакомы. Значит, можете сделать выводы. Вы считаете, что у данного автора "бедный язык"? Если ответ "да", то Вы можете смело использовать данный скрипт для предварительной оценки произведения :)
Отв: скрипт для лингвистического анализа текста
На именно такую статистику - скорее не обращал бы, чем обращал.
Но вообще-то идея не такая уж дурацкая, гармонию - не гармонию, а некоторые характеристики текста программно поймать вполне можно, хоть тот же "Штампомер" вспомнить. У меня давно свербила идея попробовать на зубок тексты людей, явно не умеющих писать (ака графоманов).
Есть как минимум два довольно легко формализуемых признака графоманского текста:
1. Избыток восклицательных знаков в прямой речи героев.
2. Вязкость словоупотребления, то бишь - одинаковые или однокоренные слова в соседних предложениях (например "Но вообще-то идея не такая уж дурацкая..." и "У меня давно свербила идея...").
Был ешё и третий признак, но я его, каюсь, забыл...
Отв: скрипт для лингвистического анализа текста
Вот ещё можно вдоволь поиграться: http://rusf.ru/books/analysis/ :)
Отв: скрипт для лингвистического анализа текста
Можно обращать и на такую но ... только строить ее не по книге, а по автору. Т.е. ввести весь его опубликованный корпус и построить профиль, желательно в привязке ко времени, что б была видна и динамика. Но при этом не забывать, что это относительные характеристики и их надо сравнивать с "подпольем" и "потолком" ;), т.к. средняя температура по больнице ничего толкового не выявит.