Kategorien
EN Geschichte / history Wissenschaft / science

Hyman Eli Goldberg and Emanuel Goldberg – two pioneers of optical character and code recognition – or why one of them was not properly credited

I was researching for an article about image and object recognition, when I stumbled upon an inconsistency. In the Wikipedia article about optical character recognition (OCR) I read:

“In 1914, Emanuel Goldberg developed a machine that read characters and converted them into standard telegraph code.”

A few a few lines further it was stated that the same Emanuel Goldberg developed a machine (called “Statistical Machine”) for searching microfilm archives using an optical code recognition system. Furthermore it was stated that the Statistical Machine got patented in 1931.
Now I wanted to know more about these machines and immediately found lots of information about the Statistical Machine on the web. For instance about it’s intended purpose that was to retrieve accounting and sales statistics, therefore the name (source).
But for the first machine I found absolutely nothing, only dozens of articles with copies of the sentence from Wikipedia. This was strange, why were there no sketches and no technical details available, when it was such a noteworthy invention?

I studied the footnotes. In the Wikipedia article the indicated source for the information about the machine of 1914 was:

Dhavale, Sunita Vikrant (2017). Advanced Image-Based Spam Detection and Filtering Techniques. Hershey, PA: IGI Global. p. 91.

I quickly found the passage in the book by Dr. Dhavale and read about the same:

“In 1914, Emanuel Goldberg developed a machine to convert printed characters into standard telegraph code.”

She presented another source for this: Schantz, Herbert F. (1982). The history of OCR, optical character recognition

„Okay, we are getting closer“, I thought. Thanks to ebook lending I was able to look that up promptly. The answer may not surprise you. Herbert F. Schantz states crystal clear that it was Goldberg who invented a machine that reads and converts typed messages to standard telegraph code (Morse code):

Schantz 1982, snippet of page 2

One can see that the year for the invention now has changed from 1914 to 1912. – A few lines above Schantz mentions a time window (between 1912 and 1914) to include the invention of the optophone by Edmund Fournier d’Albe:

Schantz 1982, snippet of page 2

I assume this is how the year 1914 got into the book of Dhavale. Please also note that the forename is misspelled. His correct name is Emanuel Goldberg.

But what really astonished me, was the notion that the work was done in Chicago. Emanuel Goldberg was Professor at Leipzig (Germany) during that time, why should he work in Chicago?

At this point I already sensed that Schantz’s research for this chapter was deeply flawed. – I decided to consult the only comprehensive biography of Emanuel Goldberg that is available. It was written by Berkeley professor Michael Buckland and published in 2006. The title of the book: Emanuel Goldberg and his Knowledge Machine.

Of course “knowledge machine” refers to Goldberg’s Statistical Machine. (For those who are interested in the operating principles of that machine: the technical details can be found on this page). Anyway. I leafed through the book. It was was arranged more or less chronologically and I found nothing about Goldberg spending time in Chicago or working on a machine that converts characters to Morse code.

I was already in the 1930s and half through the book as Buckland suddenly quotes from this passage of the book of Herbert F. Schantz:

Schantz 1982, snippet of page 3

The passage starts with the notion that Goldberg was „already known for the invention of OCR-type telegraphic devices.“ But other than Dr. Dhavale Prof. Buckland realized that Schantz had messed it up. Buckland knew that two inventive Goldbergs existed, both working on optical recognition systems. The famous one is of course Emanuel Goldberg. The almost forgotten one is Hyman Eli Goldberg (also known as Hyman Golber, due to a later change of name).

Here is, what Buckland states with regard to Schantz’s confusion:

“For once in his life, Goldberg received more than his fair share of credit, because two inventive Goldbergs working on pattern recognition devices have not been adequately distinguished. The other Goldberg was Hymen [sic] Eli Goldberg of Chicago, who was associated with the Goldberg Calculating Machine Company and changed his name to Hymen Eli Golber. Golber obtained numerous U.S. and German patents, most of them in the years 1907 to 1914 and 1930, for innovations in calculating and printing machinery. One of his techniques was to print characters in electrically conducting ink on a nonconducting surface. A sensor would then test whether surface points were conductive or not, thereby detecting the location and shape of printed characters.”

Buckland 2006, p. 162

Note that Buckland got the forename wrong. Hyman is correct.

Long story short: It was Hyman Eli Goldberg who patented a machine that converts characters into telegraph code.

And this is the corresponding patent: it was filed as „Controller“ in 1911 and granted in 1915: patents.google.com/patent/US1165663A (a precursor version is patented under US1117184.)

patent US1165663, snippet of page 1

By the way: the machine can NOT process standard print or typewrite letters. The conversion works due to a specifically shaped set of letters and digits that is presented on page 3 of the patent file:

patent US1165663, snippet of page 3

For further reading: there is at least one publication (from Dennis Yi Tenen, Columbia University) that acknowledges, explains and credits the invention of Hyman Eli Goldberg properly: amodern.net/article/laminate-text

Conclusion: It is a bit frustrating that Michael Buckland’s finding did not make it into the Wikipedia (as of 11/11/2022). The false claim is now spread over the Internet and will never vanish completely.
So what can be learned from this? – Well, obviously this: do not trust every information that is in the Wikipedia, always look for the original source, if something looks inconsistent, dig deep.

Kategorien
DE Philosophie / philosophy

Moral und Distanz

Der folgende Text ist meinem Roman Die Außerstandsetzung entnommen. Er bildet dort das Schlusskapitel eines technikkritischen Manifests, das den Titel In feindlicher Koexistenz trägt.

To those who think that all this sounds like science fiction, we point out that yesterday’s science fiction is today’s fact.[1]

Angenommen es existierte ein Computersystem, mit dem sich jede Schutzmaßnahme umgehen ließe, ein System, das in jeden Account, jedes Smartphone und jeden adressierbaren PC eindringen könnte – und zwar ohne die geringsten Spuren zu hinterlassen. Nehmen wir weiterhin an, man selbst hätte die privilegierte Möglichkeit, dieses Instrument zu nutzen. Die Versuchung, sich informelle Vorteile zu verschaffen, wäre sicherlich groß. Welche Grenzen würde man sich auferlegen? Würde man bloß Personen ausspähen, die man nicht kennt, nicht mag oder „die es verdienen“? Oder würde man auch Partner und Freunde kontrollieren, wenn ein Anlass da wäre?

Ein solches Szenario zielt natürlich auf die Frage ab, ob wir moralische Regelsätze auch dann befolgen, wenn wir wissen, dass unser Tun nicht sanktioniert wird. Ich bin in dieser Frage Pessimist. Ich denke, dass auch diejenigen, die meinen, hohe moralische Standards zu haben, nicht vor solchen Versuchungen gefeit wären. Es würde vermutlich klein anfangen und sich steigern, sobald das Gehirn gelernt hätte, dass negative Konsequenzen ausbleiben.

Im nicht-digitalen Miteinander gibt es zum Glück natürliche Schranken; Mechanismen, die evolutionär gewachsen sind und das Zusammenleben in kleinen Gruppen sicherstellen: Bspw. können nur trainierte oder pathologisch veranlagte Menschen einem Wehrlosen eigenhändig physische Gewalt zufügen, ohne dabei Reue, Widerwillen oder Mitgefühl zu empfinden. Wird Gewalt aber nicht mehr von Angesicht zu Angesicht ausgeübt, versagen die nativen Schutzmechanismen. Das zeigt sich am deutlichsten in der modernen Kriegsführung (Töten per Knopfdruck). Darüber hinaus hat sich in den Milgram-Experimenten offenbart, dass selbst untrainierte Zivilisten zu schwerer Folter fähig sind, wenn Befehlston und räumliche Distanz zusammenkommen.[2]

Das Internet ist erst wenige Dekaden alt. Trotzdem verbringen wir einen Großteil unserer Zeit im Netz. Eingedenk des oben Gesagten ist es nicht verwunderlich, dass der Ton in den sozialen Medien oft aggressiv ist und ein zunehmender Verfall der Sitten beklagt wird. Die wenigsten Hasskommentare und Beleidigungen haben in diesen Kommunikationsräumen Konsequenzen für den Absender. Ein schlechtes Gewissen oder Mitleid stellt sich bei vielen nicht ein, da das Gegenüber, mit dem man oft nicht bekannt ist, ein Abstraktum bleibt, ja bleiben muss. Ähnlich verhält es sich bei Internetkriminellen. Das Wissen um die negativen Konsequenzen für Hacking-Opfer ist natürlich da, aber Distanz und Anonymität des Mediums verhindern überaus erfolgreich, dass die Psyche rebelliert. Kriminelle, die Verschlüsselungstrojaner verschicken oder Handelsplätze für Kryptowährungen kompromittieren, müssen dafür schließlich nicht einmal ihre Komfortzone verlassen. Im 20. Jahrhundert waren Bankräuber noch hartgesottene Kerle, bereit, im Ernstfall die Schusswaffe zu gebrauchen. Diesen Typus des Bankräubers wird es in Zukunft nicht mehr geben. Stattdessen werden zunehmend solche zu Kriminellen, die im echten Leben[3] nicht fähig wären, einen Taschendiebstahl zu begehen. Bestes Beispiel hierfür ist vielleicht der US-Amerikaner Ross Ulbricht. Der libertäre Penn-State-Absolvent[4] hob mit Silk Road innerhalb weniger Monate die größte Handelsplattform des Darknets aus der Taufe. Dass Ulbricht nun vierzig Jahre einsitzen muss, klingt vielleicht ungerecht, eingedenk, dass er keine physische Gewalt ausgeübt hat (und keine Vorstrafen hatte). Aber um potentielle Nachahmer maximal abzuschrecken, musste die Justiz natürlich Härte zeigen.

Womit wir wieder beim Ausgangsszenario wären, dem Problemkomplex, den eine ultimative Spionagemaschine schaffen würde (dass eine solche kein bloßes Gedankengespinst bleiben muss, wurde bereits erörtert[5]). Hier sollten wir uns nichts vormachen: Internetkonzerne mögen öffentlich einen Kodex propagieren, die treibende Kraft aber bleibt die Gier nach Profit. Genauso unweigerlich folgen Geheimdienste und staatlich geförderte Hackerkonglomerate ihren je eigenen Interessen, während Sanktionen qua ihrer Spitzenposition im Machtgefüge meist verunmöglicht werden. Es sind diese unkontrollierbaren Strukturen, die stets einen Technologievorsprung haben werden! Gleichzeitig läuft das Individuum Gefahr, zum gläsernen Testobjekt zu degenerieren, und zwar ohne dass es sich daran stören würde.

Technologie ist Macht. Das gilt heute, das gilt morgen. Wir können also entweder dabei zusehen, wie uns unsere Freiheit nach und nach genommen wird, oder wir können Widerstand leisten. Passiven Widerstand leisten wir, indem wir der digitalen Welt so oft wie möglich abschwören und uns wieder auf das zurückbesinnen, was oben als natürliches Leben beschrieben wurde, einschließlich der Nutzung von Small-Scale-Technologie und dem Verzicht auf Konsumgüter, die wir nicht zwingend benötigen. Aktiven Widerstand leisten wir, indem wir uns in Gemeinschaften Gleichgesinnter organisieren und unsere Botschaft durch Aktionen zivilen Ungehorsams ins Kernbewusstsein der Gesellschaft tragen. Das mögen kleine Schritte sein, aber sie geschehen aufrechten Ganges. – Wer denken kann, der denke, und schreite voran.


[1] Ted Kaczynski: Industrial Society and Its Future, Abschnitt 160.
[2] Milgram: Behavioral Study of Obedience. Journal of Abnormal and Social Psychology 67, 1963, S. 371-78.
[3] Hacker und Netzaktivisten bevorzugen oft das Kürzel afk (away from keyboard), da sie die digitale Welt als gleichberechtigten Teil der Realität ansehen.
[4] Masterabschluss in Kristallografie.
[5] Anm. d. Verfassers: Erörtert wurde die Symbiose von Super- und Quantencomputer.

Kategorien
DE

OkCupid – damals und heute – ein kritischer Erfahrungsbericht

2014 habe ich mich auf OkCupid angemeldet. Das auf der Beantwortung und Gewichtung von Fragen beruhende Matchingsystem erschien mir eine wohltuende Alternative zu Tinder und dem oberflächlichen Swipen zu sein. Damals gab es keine deutsche Sprachversion, was den Effekt hatte, dass das Publikum internationaler war als bei der Konkurrenz. Es gab 2014 natürlich auch schon Funktionen, die nur gegen Bezahlung freigeschaltet wurden, aber die kostenfreie Version war insgesamt gut nutzbar und nicht so stark eingeschränkt, wie das heute der Fall ist. Klar, es wurde viel Werbung geschaltet, aber das war und ist völlig ok, schließlich muss sich die Plattform für die Betreiber rechnen.

Damals gab man einige Präferenzen an und dann wurden einem nur solche Profile angezeigt, die darauf passten, wobei Profile mit dem höchsten Matchwert noch oben sortiert wurden. War man zu wählerisch, musste man z.B. den Suchradius erweitern oder bestimmte Vorgaben wieder abwählen, aber es wurden einem nicht x-beliebige Profile angezeigt, wie das heute der Fall ist, wenn man die kostenlose Version verwendet.

Nach und nach ist OkCupid leider zur Tinder-Kopie geworden. Mittlerweile wird man auch hier zum Swipen (App) bzw. Wegklicken (Desktop) verpflichtet und kann sich erst gegenseitig schreiben, wenn ein Match vorliegt. Natürlich sieht man nur dann, wer einen geliket hat, wenn man zahlender Kunde ist. Günstig ist das nicht. Hier die aktuellen Preise für OkCupid Premium (Stand Juli 2022).

Man soll natürlich gleich 6 Monate buchen – macht 101,46 €, die sofort fällig werden.

Alternativ kann man versuchen, den Erstkontakt über ein sogenanntes „Intro“ herzustellen. Allerdings versanden solche Textnachrichten oft, da sie nur von Mitgliedern mit Abo überblickt werden können. Ohne Abo sieht man immer nur die älteste Nachricht. Um die übrigen sichtbar zu machen, muss man sich durch die Profile der Absender hangeln. Das machen viele natürlich nicht. Einen Spam-Ordner geht man ja auch nicht Mail für Mail durch.

Präferenzen werden nur in kostenpflichtiger Version streng berücksichtigt

Ich habe es bereits angesprochen. Früher hat OkCupid die Präferenzen aller Nutzer befolgt. Wenn man angegeben hat, dass man heterosexuelle Frauen sucht, dann wurden auch nur Profile mit Frauen dieser Orientierung ausgeliefert. Prinzipiell ist das auch immer noch möglich, aber man muss für sogenannte „No-Gos“ das Premium-Abo haben. Und so werden dem nicht zahlenden Nutzer im Jahr 2022 auch Profile angezeigt, die von der sexuellen Orientierung her gar nicht passen, und zwar ständig. Ich habe natürlich nichts dagegen, dass man auf OkCupid alle denkmöglichen Geschlechter, Orientierungen und Vorlieben angeben kann – jeder möge nach seiner Façon glücklich werden – aber als störend empfinde ich es schon, dass ich mich durch Profile klicken muss, die grundsätzlich nicht passen. Es soll natürlich stören und gefrustete Nutzer in die Bezahlversion treiben. Ob diese Strategie aufgeht? Ich habe da große Zweifel.

Früher war es außerdem so, dass man ein Profil einmal wegklicken musste und dann wurde es nicht wieder vorgeschlagen. Heute werden weggeklickte Profile einfach wieder und wieder ausgeliefert. Offenbar will man zweierlei: Nutzer möglichst lange auf der Plattform halten und gleichzeitig vermeiden, dass sie sich abwenden, weil sie in ihrer Region nicht fündig werden. „Dann lassen wir sie doch einfach noch einmal durchswipen, den meisten fällt es sowieso nicht auf.“ So oder so ähnlich scheinen die Strategen hinter OkCupid zu denken.

Du bist ein guter Fang! Auch OkCupid betreibt Abzocke

Nun komme ich zu dem Punkt, der mich dazu bewogen hat, diesen Artikel zu schreiben. Ich dachte immer, OkCupid sei einigermaßen fair und betreibe keine Abzocke wie andere Anbieter. Leider ist das nicht der Fall. Man wird auch hier mit Tricks zum Abschließen eines Abos gebracht.

Like ist nicht gleich Like
Man geht ja davon aus, dass die Likes, die man erhalten hat, von Nutzern kommen, die grundsätzlich interessant sein könnten. Deswegen freut man sich durchaus über 39 Likes und denkt sich, „ach komm, ich zahl mal einen Monat, und schaue mir an, wer mich da geliket hat.“

Screenshot aus der Desktop-Version. Man wird umschmeichelt, um zu zahlen.

Nachdem man bezahlt hat, stellt man ernüchtert fest, dass 90 Prozent der Anfragen aus Kenia oder anderen Regionen der dritten Welt stammen. Man denkt sich, gut, das mag wohl daher kommen, dass es Leute gibt, die bei Entfernung „überall“ angeben. Tatsächlich gibt es aber noch einen anderen Grund – und hier nimmt die Masche ihren Lauf:

Ich habe das Premium-Abo einen Monat lang gehabt. Es kamen in dieser Zeit keine Likes hinzu, was an meinem Profil liegen mag, aber just nachdem das Abo abgelaufen war und ich keine Likes mehr sehen konnte, gingen binnen einer Stunde dutzende neue Likes ein. In den Tagen danach herrschte hingegen wieder die gewohnte Flaute. Was war hier passiert?
Nun, es ist wohl so: Sowie mein Abo abgelaufen war, wurde mein Profil für kurze Zeit für Nutzer freigegeben, die weltweit suchen und selbst aus Ländern stammen, in denen man sich nach westlichem Wohlstand sehnt. Die Likes prasseln dann rein wie Platzregen, wobei der Algorithmus bei einer hinreichenden Menge zumacht, es sollen ja keine unrealistischen Werte entstehen. Es braucht also gar keine Fake-Accounts, um Nutzer in ein Abo zu locken. Die hier beschriebene Methode ist raffinierter, vermutlich wird sie bei allen Accounts angewendet, die kaum oder keine Likes in ihrer Heimatregion erzielen und kein aktives Abo haben. Beweisen kann ich das natürlich nicht, aber ich bin mir verdammt sicher, dass es so gemacht wird.

Fazit
OkCupid ist mittlerweile eine Dating-Plattform wie jede andere. Man wird zu oberflächlichem Swipen gezwungen. Die kostenlose Version ist nur sehr eingeschränkt nutzbar und man wird mit miesen Tricks in ein Abo gelockt. Ich kann OkCupid daher nicht mehr empfehlen. Das war vor ein paar Jahren noch anders. Schade.