распознавание антиботовских картинок

[Удален]
#231

"

юни:
Откуда у Вас такая уверенность, до сих пор не пойму? Детализация фрагмента увеличивает всё - и детализацию предполагаемых символов, и детализацию шумов. Т.е., отношение остаётся неизменным."?

да вы неуч!

фрагмент матрицы, имеющий заполнение 100% может иметь только чистый полезный сигнал, а если взять полную матрицу с символом внутри, то соотношение сигнал шум никогда не может быть по определению равно полезному сигналу.

Кроме того, при сравнении полных матриц, нельзя пользоваться сравнительным анализом в полной мере. пример рассматривался (i ,1)

юни
На сайте с 01.11.2005
Offline
952
#232
tar729:
фрагмент матрицы, имеющий заполнение 100% может иметь только чистый полезный сигнал, а если взять полную матрицу с символом внутри, то соотношение сигнал шум никогда не может быть по определению равно полезному сигналу.

Источником Вашего знания не поделитесь? И источником уверенности в пользе детализации, заодно.

Что с ответом на вторую часть 231-го поста?

https://searchengines.guru/ru/forum/944108 - прокси-сервис на базе операторов домашнего интернета, сотни тысяч IP-адресов, канал от 20 Мбит. Пишите в личку.
[Удален]
#233

лох ты Юни.

ваше утверждение относительно неменяющегося соотношения сигнал/шум, относится к системе отсчета МАТРИЦЫ, которые вы сравниваете между собой и весовые коэффициенты получаете относительно системы отсчета МАТРИЦА.

Однако брать то надо другую систему отсчета-СИМВОЛ, и сравнивать надо не матрицы, а СИМВОЛЫ в матрице!

Матрицы-это только координатная система для символа.

Надо сравнивать СИМВОЛЫ, а исключать уже МАТРИЦЫ, к которым относятся сравниваемые объекты.

Весовые коэффициенты надо брать не для матриц, а для символов.

"Если же такое произойдет, то оставшаяся часть, которую придется выкинуть не будет соответствовать ни одному из шаблонов, коэффициент соответствия окажется крайне низким, что говорит об ошибочном разделении объекта.

От чего же "не будет"?"

А если это тоже шум? "

в том то и дело, что это шум, а шумы я не сравниваю, я их исключаю вместе с матрицей, в которой они оказались.

Весовые пороги символов, которые управляют разделением матриц, полученные в результате первичного сравнения фрагментов символов или целых символов, в свою очередь, зависят от алгоритмов более глубокого анализа, которые работают с такими понятиями, как грамматика, семантика. Т.е. если это не каптча, а текст, то прибегается к анализу сочетаний букв. Еще глубже- по иерархии-сочетание слов.

Но мы с вами взяли очень простой пример-каптчу. Там нет грамматики (правильность написания слова в каптче может не быть по умолчанию) ни тем более семантического смысла. Поэтому распознавание символа в каптче на затрагивает эти алгоритмы. Откат действия (разделение матриц) с целью выявления более высоких весов по отдельности (в случае с фиаско), даст однозначный ответ для конкретного символа.

И здесь, как видите, помехи роли не играют, поскольку сравниваются только ПОЛЕЗНЫЕ пикселы, т.е. те, из которых состоят сами символы в оригинале шаблона.

Ваше неумение разделять системы отсчета и пользоваться простейшими, на мой взгляд, хитростями (сравнивать символ а исключать матрицу), является общим деффектом мышления всех вас здесь...

Непонимание , как влияет разделение систем отсчета на конечный результат (выявление соответствия), характерно для вас.

Почитайте топик про логику, вот цитата:

"в логике вообще нет обратных функций, есть только прямые и это связано с тем, что процессы в инерциальных системах (а логика именно ИСО) не обратимы.

Существуют модели обратимых функций (автор Эдвард Фредкин, наделавший много шума в математике. "бильярдная модель"), однако физически она не реализуема.

Обратные функции, например вычитание, реализуются в компьютере теми же сумматорами. При этом используется закон инверсии причинности. Т.е. принудительно осуществляется переход в другую систему отсчета путем изменения исходных критериев истинности для вычислительной системы:

исходно 1=истина, 0= ложь.

Инвертируем сигналы на входе сумматора, получаем

0=истина, 1= ложь

в результате, для исходных критериев истинности процесс сложения преобразуется автоматически по закону инверсии причинности в обратную функцию-вычитание, несмотря на то, что сумматор, физически выполняет ту же операцию сложения.

Вот вам физическая констатация факта работы этого закона, который, как видите, широко используется в калькуляторах и вообще компьютерах.

"

ВОТ ЮНИ ключевая фраза: "Т.е. принудительно осуществляется переход в другую систему отсчета путем изменения исходных критериев истинности для вычислительной системы:

исходно 1=истина, 0= ложь."

если в сравнении матриц, мы сравниваем единицы и нолики, принимая обоих как полезный сигнал (это и есть исходные критерии истинности), то в сравнении символов мы сравниваем в матрицах ТОЛЬКО единички (которыми в шаблонной матрице нарисован символ), т.е. тем самым ПРИНУДИТЕЛЬНО меняем систему отсчета, а саму матрицу используем как координатную систему, связывающую шаблонный сектор и соответствующий сектор исходной картинки.

В итоге по закону инверсии причинности меняется и результат на выходе такого сравнения. Т.е. если раньше истинность касалась самих матриц, то теперь истинность касается фрагментов символов. А нам именно это и нужно, нафиг нам матрицы!? Просуммировав все веса фрагментов относительно шаблонов, мы находим полную матрицу шаблона с нужным символом целиком (по наибольшему общему символьному весу в нем), тем самым завершая идентификацию символа. Этому символу соответствует своя матрица, и переходя обратно в систему отсчета-матрица, где критериями истинности вновь становятся и 0 и 1, вы уже можете выделить помехи и далее их классифицировать с целью создания БД помех. Таким образом, вы имеете возможность обучать программу новым видам помех, в т.ч.выделить закономерности и найти вашу волнистую линию.

Вот это и есть решение общей проблемы. А в частном случае для конкретной яндексовской каптчи, где мы знаем вид помехи, целесообразнее выделить волнистую линию в самом начале.

Если до меня это никто не применял по слабоумию, то можете записать на мой счет еще одно ноу-хау, хотя я на него особо не претендую. На мой взгляд, это элементарные вещи, просто вы о них не знаете и вряд ли еще кто то об этом знает. Поскольку вы (и не только вы, но и на других форумах) задаете просто НАИТУПЕЙШИЕ вопросы и тезисы типа : "поделитесь источником своих знаний"

Естесственно, что при таком подходе, я и говорю об увеличенном соотношении сигнал/шум при фрагментации.

А вы даже не в состоянии врубиться, о какой системе отсчета идет речь.

И теперь вам, дураку, должно быть понятно, что фрагментация матриц в сочетании с методом исключения этих матриц (это и есть сравнительный анализ) дает 100% теоретический результат при идентификации (отличении) одного объекта от другого в матрице.

И человеческий механизм обработки образов работает по той же системе. Вы что, смотрите на 2 фотографии и сравниваете матрицы в которых они находятся? Нет конечно. Вы сравниваете изображения, а матрицы остаются за кадром, хотя и принимают в этом процессе самое непосредственное участие, просто вы о нем ничего не знаете.

[Удален]
#234
юни:
Источником Вашего знания не поделитесь?

Логика

юни:
И источником уверенности в пользе детализации, заодно.

Логика

Учите логику господа, я специально для вас придурков собрал все законы логики вместе, чтобы вы ими пользовались.

/ru/forum/196932

spark
На сайте с 24.01.2001
Offline
130
#235
юни:
Откуда у Вас такая уверенность
tar729:
лох ты Юни

Не касаясь содержания дискуссии, просил бы не превращать дискуссию в "базар". В противном случае топик будет перемещен на Троещинский рынок, чтобы tar729 имел возможность перетереть о капчах с правильными лексически близкими пацанами :) Штрафую за грубость.

[Удален]
#236
spark:
Не касаясь содержания дискуссии....

а вот касаться нужно обязательно...

топик, кстати, несмотря на весь "базар", спровоцированный, впрочем, не мной, содержит достаточно много конструктивности по делу и несет в себе весьма ценную технологию, ранее не применявшуюся НИГДЕ.

Я держу этот контент еще на одном форуме, контент просто супер!!!

юни
На сайте с 01.11.2005
Offline
952
#237
tar729:
ваше утверждение относительно неменяющегося соотношения сигнал/шум, относится к системе отсчета МАТРИЦЫ, которые вы сравниваете между собой и весовые коэффициенты получаете относительно системы отсчета МАТРИЦА.

Однако брать то надо другую систему отсчета-СИМВОЛ, и сравнивать надо не матрицы, а СИМВОЛЫ в матрице!

Откуда Вы знаете, где в матрице символы, а где шум? Об этом речь и идёт.

Это простая детализация сама собой разделяет шум от символов?

tar729:
в том то и дело, что это шум, а шумы я не сравниваю, я их исключаю вместе с матрицей, в которой они оказались.

На какой стадии Вы их отделили от символов?

tar729:
Откат действия (разделение матриц) с целью выявления более высоких весов по отдельности (в случае с фиаско), даст однозначный ответ для конкретного символа.

И здесь, как видите, помехи роли не играют, поскольку сравниваются только ПОЛЕЗНЫЕ пикселы, т.е. те, из которых состоят сами символы в оригинале шаблона.

Не вижу. Вы не указываете перехода от матрицы, как набора точек в растре, к разделению его на полезную информацию и помехи.

Рано или поздно, предполагаемый алгоритм наткнётся на такую вариацию символов и шумов, "веса" которой в равной степени распределятся между полузатёртой "Ж", сильноискажённой "К" и слабоискажённой "Х". И, поскольку требуется однозначное решение, то точность распознавания составит не 100%, а 30%.

Вы такой вариант предполагаете? Как с ним бороться?

Предложенные Вами переходы между координатными системами не решают этой принципиальной проблемы:

tar729:
если в сравнении матриц, мы сравниваем единицы и нолики, принимая обоих как полезный сигнал (это и есть исходные критерии истинности)
Откуда взялись эти критерии? Из воздуха?

Если алгоритм сравнивает исходные нолики и единички части матрицы, то почему именно одной конкретной части? Если всей матрицы, то почему единицы, переходящие в новую систему отсчёта являются априори полезным сигналом?

Если же это только вероятно правильный сигнал, то мы опять возвращаемся к обучению алгоритма методом простого перебора. Наслоение из новой системы координат не меняет сути дела - в любом случае, возможен вариант, когда весовые коэфициенты (в разбираемом нами примере с искажениями буквы "Ж") будут равны между собой, и в случае однозначного выбора между ними, общая погрешность системы возрастает в три раза.

Причем это простой пример, не берущий в расчёт комбинации символов. Как Вы предполагаете бороться с этим?

[Удален]
#238
юни:
Откуда Вы знаете, где в матрице символы, а где шум? Об этом речь и идёт."

не знаю, да и не нужно мне это. Это нужно потом, когда пополнять БД шумов надо будет. механизм описан в прдыдущем посте.


"Это простая детализация сама собой разделяет шум от символов?"

нет, переход из одной системы отсчета в дргую. Изменение критериев истинности это делает, написано же как, и даже показан пример, как та же фича работает в компьютере, когда из операции сложения делают операцию вычитания.


"На какой стадии Вы их отделили от символов?"

как только принял за полезный сигнал тело символа, а не тело матрицы.


"Не вижу."

очки наденьте.


" Вы не указываете перехода от матрицы, как набора точек в растре, к разделению его на полезную информацию и помехи."

указываю. читайте внимательно как изменяются критерии истинности.



"Рано или поздно, предполагаемый алгоритм наткнётся на такую вариацию символов и шумов, "веса" которой в равной степени распределятся между полузатёртой "Ж", сильноискажённой "К" и слабоискажённой "Х". И, поскольку требуется однозначное решение, то точность распознавания составит не 100%, а 30%."

"Вы такой вариант предполагаете? Как с ним бороться?"

также, как и человек. Я же пояснял, как это делается для текста. Используется косвенная информация. В каптче ее нет. Человек столкнется с теми же проблемами, с тем же результатом по коэффициенту распознаваемости, что и мой алгоритм.
Поймите, мой метод точно такой же, как и у человека реализован.


"Предложенные Вами переходы между координатными системами не решают этой принципиальной проблемы:"

переход не между координатными системами, координатная система та же остается.

"Откуда взялись эти критерии? Из воздуха?"

нет, просто они по умолчанию находятся в аналитической системе. Вы и не подозреваете об их существовании.

например, принято, что 1= истина
0=ложь

на этом строятся математические операции сложения в компьютере.
меняют критерии истинности-получают операцию вычитания.

если сравниваются матрицы, то этот критерий по умолчанию заключается в том, что истинность касается всей матрицы, поскольку операция ХОР устанавливает истинность совпадения для каждого бита в матрице отдельно.
Т.е. сравнивается не смысловое содержание 0 и 1, а по умолчанию сравнивается "системный смысл" на физическом уровне, т.е. напряжения сравниваются, приведенные ко входам ХОР.

Логике абсолютно по барабану, какой смысл в какой системе отсчета вы будете вкладывать в 1 и 0.

Наша задача, как раз ВЛОЖИТЬ смысл в них для своей собственной системы отсчета, человеческой, понимаете.
Т.е. Мы вкладываем мысленно этот смысл в 1 и 0, и вот какой:
Единички у нас будут отображать в матрице те пикселы, из которых складывается символ, а ноликом у нас будет помеха.

Вот эти критерии истинности, несущие смысловую нагрузку матрицы, мы и будем дальше обрабатывать. НО мы их НИГДЕ в программе не записываем, это не нужно.

Логика будет все делать для нас теперь сама.

Зато теперь мы можем сравнивать уже не сами матрицы, а то содержание, которое мы им придали.
Т.е. как и прежде, мы обрабатываем те же матрицы, но помехи в них мы уже не учитываем, понимаете? Мы сравниваем шаблонную матрицу уже не как всю матрицу, а сравниваем только те части шаблона, которые мы считаем нужным сравнивать, т.е. сравниваем мы только соответствие единичек с тем местом, где они должны находиться в исходной каптче для этого шаблона. Т.е. мы сравниваем соответствие координат, по которым располагаются в шаблоне и в каптче единички, несущие смысловую нагрузку в ЧЕЛОВЕЧЕСКОЙ системе отсчета.

Таким образом, мы заставляем компьютер сравнивать не матрицы, а смысл, который мы в них заложили. Сам переход из одной системы нигде не зафиксирован, он содержится в том, как мы начинаем интерпретировать (обрабатывать) полученные результаты с ХОР.

Мы начинаем определять веса соответствий уже совсем по другому алгоритму, мы считаем только те совпадения, которые нужны нам, и тем самым, получаем другие результаты уже количественно.

Именно так мы и осуществили переход из одной системы отсчета в другую, и вот ТЕПЕРЬ уже, зафиксировали РЕЗУЛЬТАТ этого прехода в весовых коэффициентах.


"Если алгоритм сравнивает исходные нолики и единички части матрицы, то почему именно одной конкретной части?"

не одной, а последовательно все, а потом веса суммируются.

"Если всей матрицы, то почему единицы, переходящие в новую систему отсчёта являются априори полезным сигналом?"

пожалуйста, сделайте полезным сигналом нолик, а не единицу, дело вкуса.

"Если же это только вероятно правильный сигнал, то мы опять возвращаемся к обучению алгоритма методом простого перебора. Наслоение из новой системы координат не меняет сути дела - в любом случае, возможен вариант, когда весовые коэфициенты (в разбираемом нами примере с искажениями буквы "Ж") будут равны между собой, и в случае однозначного выбора между ними, общая погрешность системы возрастает в три раза."

мы получим плохие веса только в центральной части полной матрицы, но по суммарным весам определим, что это буква скорее Ж, чем другая, и чем вообще 3 других символа (скобки и К), для каптчи, разумеется. Да вы бы и сами, как человек, оказались бы в сильно затруднительной ситуации, если бы не знали, что в капчах скобки не используются. Но это пардон, доп. информация. Можете ввести ее в алгоритм капчи или вообще лишить его шаблонов для скобок.
Для текста, мы однозначно скажем, что это Ж по контексту.
юни
На сайте с 01.11.2005
Offline
952
#239
tar729:
Используется косвенная информация. В каптче ее нет.

Откуда она берётся? Где источник?

tar729:
нет, просто они по умолчанию находятся в аналитической системе. Вы и не подозреваете об их существовании.

Что значит "по умолчанию"? Кто создал эти критерии, на базе чего, по каким законам и алгоритмам? Что такое вообще "аналитическая система"?

tar729:
Единички у нас будут отображать в матрице те пикселы, из которых складывается символ, а ноликом у нас будет помеха.

Вот эти критерии истинности, несущие смысловую нагрузку матрицы, мы и будем дальше обрабатывать.

Ещё раз - кто решает, что единички безошибочно описывают именно символ? Вы заранее знаете, что так и будет? Или опять перебором?

tar729:
Зато теперь мы можем сравнивать уже не сами матрицы, а то содержание, которое мы им придали.
Т.е. как и прежде, мы обрабатываем те же матрицы, но помехи в них мы уже не учитываем, понимаете?

Опять нету переходной точки, Вы её теряете. Априори даёте, что к этой стадии помехи отделены, и есть что сравнивать - но этого не произошло.

В реальности, произвольному набору точек, схожих по непонятно каким критериям, задан флаг "истинно", а другому произвольному набору - флаг "ложно", причём нет даже намёка на решение проблемы возможного пересечения этих двух множеств, по части совпадающих критериев.

Но Вам уже нетерпится перейти к разделению "матрица - выделенный из матрицы символ", так и не решив проблему первоначального отсева шумов.

[Удален]
#240
юни:
Откуда она берётся? Где источник?"

в семантическом смысле, который имеет вид записи мыслеформы, конечно. (используя упомянутую структуру БД, хе-хе)



"Что значит "по умолчанию"?"

не понимаете смысла слов?
по умолчанию, значит безусловно, т.е. информация введена в систему при ее построении извне, конструктором системы.


"Кто создал эти критерии"

схемотехник, разработчик процессоров, создатель непосредственных чипов.

", на базе чего, по каким законам и алгоритмам?"

на базе булевых функций: ХОР

00=0
01=1
10=1
11=0

а мог бы и наоборот

00=1
01=0
10=0
11=1

а сама операция ХОР сравнивает сигнал на одном входе относительно сигнала на другом входе по умолчнию.

и это уже не зависит от разработчика, логику как систему функций придумал не разработчик процессоров, и даже не Буль. читайте тему про логику.


"Что такое вообще "аналитическая система"?"

система, выполняющая анализ, сравнение чего то с чем то с некой целью.

"Ещё раз - кто решает, что единички безошибочно описывают именно символ? Вы заранее знаете, что так и будет? Или опять перебором?"

ну у нас же есть шаблонная матрица. в ней уже все представлено. Или вы до сих пор не можете понять, что такое шаблонная матрица с символом внутри, отрисованный черными пикселами на белом фоне? черные пикселы-единицы, белые пикселы-нули.

"Опять нету переходной точки, Вы её теряете. "

это вы ее н там ищете.

"Априори даёте, что к этой стадии помехи отделены, и есть что сравнивать - но этого не произошло."
это произошло в вашей голове, а потом записалось в виде весовых коэффициентов соответствия.

"В реальности, произвольному набору точек, схожих по непонятно каким критериям"

очень понятно


",... задан флаг "истинно", а другому произвольному набору - флаг "ложно""

почему произвольному? работаем с шаблоном, критерии истинности устанавливаем для уже известного символа в матрице шаблона.


", причём нет даже намёка на решение проблемы возможного пересечения этих двух множеств, по части совпадающих критериев."

Ну почему?

пример с 1 и i описывает работу со схожими кластерами в середине символов.

"Но Вам уже нетерпится перейти к разделению "матрица - выделенный из матрицы символ", так и не решив проблему первоначального отсева шумов."

я ее решил, это вы никак не въедите почемуто.
проблема решена именно в тот момент, когда мы смотря на шаблон, заносим в категорию "шум" всякую лишнюю или отсутствующую 1 в соответствующей части каптчи.
вы этого не понимаете да?

вы хотите избавиться от шумов на каптче, а от них нужно избавляться на шаблоне, экий вы тормознутый, однако. Закон инверсии причинности курите. Переходите в другую систему, извольте инвертировать и задачу.

Ндааа, тяжко не зная логики и ее законов пытаться чего то там понять, а тем более воплотить в программном коде...

Авторизуйтесь или зарегистрируйтесь, чтобы оставить комментарий