Niños y niñas, señores y señoras, lagartos y lagartas. ¡Bienvenidos a una nueva entrada de Lee mi tesis! [*Confeti*]… después de 9 meses… y más o menos 5 o 6 visitantes a la página. Claramente esta idea fue un éxito rotundo. ROTUNDO. En cualquier caso, en el equipo de redacción de lee mi tesis no queremos quedarnos dormidos en los laureles y perder lectores, así que aquí va otra.
Debemos admitir que la última entrada fue algo… fácil. No nos tomó más de un par de horas encontrar casos de investigación poco rigurosa plagio y falta de cuidado absoluto descaro en la metodología. En este caso la situación fue un poco diferente, el alaj… aleje… al que le hacemos el honor, no cometió plagio descarado, pero digamos que su tesis no es una de las obras magistrales de la lingüística. Se trata hoy de Julio Alexander Bernal Chávez (JABC), lingüista con doctorado de la universidad de Bergen, y director de la linea de investigación en lingüística de corpus del Instituto Caro y Cuervo (ICC).
En su perfil del ICC aparece lo siguiente:
Director del grupo de investigación lingüística del Instituto Caro y CuervoDirector de la línea de investigación Lingüística de corpusDirector del proyecto Actitudes lingüísticas de los bogotanos hacia las variantes nacionales y hacia las variantes de los países hispanohablantes.Co director de los proyectos:
- Corpus lingüísticos del Instituto Caro y Cuervo (CLICC)
- ALEC Interactivo
- Lexicografía electrónica y especializada: el caso del diccionario académico de la medicina (DIACME)
Doctorem Philosophiae Universidad de Bergen – Noruega
Magister en Lexicografía Hispánica- Escuela de lexicografía Hispánica, Asociación de Academias de la Lengua Española y Real Academia Española.
Magister en Lingüística Española. Seminario Andrés Bello. Instituto Caro y CuervoLicenciado en Lingüística y Literatura de la Universidad Distrital “Francisco José de Caldas”Coordinó el proceso de creación y acreditación de la Maestría en Lingüística del Instituto Caro y CuervoIntegrante del comité académico del Instituto Caro y Cuervo
Intereses investigativos:
Lingüística de corpus, lexicografía y sociolingüística.
Osea, no es cualquier pelagatos… ¿O tal vez sí? Veamos.
Hay varios puntos que queremos tratar al respecto del trabajo de JABC. El resumen del asunto es que el trabajo de Julio no se corresponde con el cargo que tiene. Ni su tesis ni sus otras publicaciones dan muestra de ningún tipo de competencia investigativa. Mucho menos de competencia como lingüista de corpus, en especial cuando lista en colciencias que una de las áreas de investigación activas es «Lingüística Computacional y de Corpus, Activa:Si».
Empecemos.
Porcentajes… esos difíciles porcentajes:
Una cosa que nos llamó de inmediato la atención leyendo los trabajos de JABC, es su liberal e innovadora forma de usar porcentajes. La mayoría de investigadores son viejos conservadores que creen que los porcentajes en una tabla deben sumar a 100… por eso de ser ‘por-ciento’. No Julio, él no para en 100, a veces sigue, a veces no llega. Él rompe y revoluciona paradigmas matemáticos. Veamos ejemplos:
En este artículo sobre el español bogotano (el título es: «Características de las valoraciones de estatus y solidaridad de las variedades iberoamericanas de español por parte de los hispanohablantes de Bogotá, D.C. Lihn») tenemos :

El lector cuidadoso notará que los porcentajes en este caso suman a 96.7%. PERO! sí, es posible que el resto de del porcentaje esté en ingresos no presentados en la tabla, pero eso significa que no es claro a qué corresponden los porcentajes. O estos dos ejemplos:

En ambas tablas los porcentajes suma 100.1%… sí, ya sabemos, error de redondeo… es posible. Aunque vale la pena preguntarse por qué no redondear uno de los números hacia abajo para que de 100%… Pero miren ahora esta:

No solo es casi ilegible esa tabla, no es claro a qué deben sumar las columnas y las filas… no a 100… Las demás tablas no son mucho mejores:

Puede que seamos sea muy chapados a la antigua, pero porcentajes sueltos sin referente claro no son nuestra idea de «buen trabajo investigativo». Pero todo eso se perdona si el paper termina con un detallado análisis estadístico de los resultados, ¿cierto? AJAJAJAJAJA. No, eso sería demasiado mainstream. El paper termina en básicamente en observaciones cualitativas de los datos:
En términos sociales, las personas de estrato socieconómico bajo fueron las que respondieron con mayor congruencia en vincular al español colombiano con las características de la «solidaridad». Por el contrario, los informantes bogotanos de género masculino son los que menor regularidad en las contestaciones expusieron en cuanto a los vínculos de las variedades nacionales del español con este conjunto de características.
Pero sin trabajo estadístico, y con porcentajes inventados, no es claro que los resultados digan nada de nada.
Pero, volviendo al tema. Porcentajes. Si ahora vamos a su tesis, nos encontramos tablas y tablas de porcentajes que no suman 100%:

No tenemos ni idea de cómo se lee eso. En la tabla 6 vemos que el total de hombres suma 32%, y el total de mujeres suma el 35.5%… ??? Lo que sucede es que estos números corresponden al porcentaje con relación al total de la muestra (?) que respondió ‘sí’ a la pregunta «LE GUSTARÍA QUE SE DIERAN LAS NOTICIAS…» (así… todo en mayúsculas, gritando). La explicación para este sistema totalmente confuso es la siguiente (p. 102):
Sin embargo, en el presente trabajo los resultados se muestran teniendo como parámetro, que cada casilla estratificada representa el 100% de la población de ese sector de la caracterizado según censo de 2005-2006, por tanto cada casilla representa el porcentaje de informantes de ese sector de la población (Tabla 7), no del total de la muestra ( Tabla 6).
Por ejemplo, a los hombres de estrato alto entre 20 y 34 años que les gustaría que se dieran noticias de radio en el español de Colombia según el total de la muestra sería de 1,25%; mientras que dentro de los informantes del sector poblacional hombres de estrato alto entre 20 y 34 años, corresponde al 100% de los informantes que fueron seleccionados según porcentajes poblacionales del censo de 2005-2006.
Sigh… Eso significa que leer cualquier dato requiere hacer un paso de abstracción extra. Por supuesto, el autor nos ayuda con gráficos tridimensionales en de torta en excel:

Este gráfico es completamente inútil. Los mismos datos que presenta la torta están ya en la tabla justo sobre la torta, y las tres dimensiones son completamente superfluas. Es por esto que en general no se recomiendan ni gráficos de tortas ni usar 3D a menos que sea absolutamente necesario. [Hay unas 10 de estas gráficas en la tesis. Es francamente deprimente.]
Otro gráfico ridículo es el siguiente sobre el número de años que sus participantes llevan viviendo en Bogotá:

En este caso hay varias cosas por notar. Primero, todos los años están dados en números redondos, pero de todas formas conserva el .00 (?). Como ordenó la gráfica (imposible presentar esto en una tabla, claro) por número de participantes (creemos, los ejes no tienen nombre), el número de años está totalmente desordenado. Finalmente, por alguna razón insiste en dar números exactos para todas las respuestas en vez de usar intervalos (de 30 a 35 años), cuando es claro que las personas que dijeron «llevo unos 30 años acá» no le estaban dando números exactos.
Y seguimos. En esta gráfica los porcentajes suman a 100.3%:

Y en esta maravilla los porcentajes suman 100.1% en la tabla y 100.2 en la gráfica.

Si insistimos con este tema, es que esto demuestra la falta de cuidado de Julio al escribir. Si estos fueran reportes para la tienda de trago de la esquina, entenderíamos que no es muy importante ser preciso. Pero esto es una disertación. Y no es un error, son decenas de errores de este tipo. Además es importante notar que JABC es director del área de lingüística de corpus, del ICC, un rol en el que uno esperaría que la persona tena un manejo mínimo de métodos cuantitativos y estadísticos. Pero el nivel que demuestra es que no tiene un manejo de los conceptos básicos del análisis de datos, y de la presentación de datos cuantitativos (¿ya mencionamos que en la tesis tampoco hay análisis estadístico?)
Temas superfluos
Otro punto preocupante de la disertación de JABC es la cantidad de basura información no tan importante que incluye. Para entender este punto de verdad habría que leer la tesis, pero aquí haremos un pequeño esfuerzo para ilustrar el problema.
– Una sección «4.4 NOMBRES DADOS A LA LENGUA QUE HABLA» (también en mayúsculas, gritando) de unas 3 páginas sobre lo importante del nombre de la lengua que las personas hablan. Hay puntos tan importantes como que:
Según Villa (2001:17) en Colombia se realizó un sondeo acerca del idioma que hablan los colombianos como resultado se encontró que el 45% de los informantes respondió español un 40% eligió castellano, 10% prefiere americano, y el 5% se decide por Colombiano.
y que obviamente van acompañados por más gráficas mal hechas en 3 dimensiones.
– Secciones cada una de unas 8 o 10 páginas citando las razones dadas por los encuestados sobre «La razón por la cual se escoge a Perú como el país en donde más se habla incorrectamente el español se relaciona con elementos asociados»… para cada uno de los países. Lo mismo para más o menos todas las preguntas del cuestionario.
– Hay secciones como «2.2.1 Identidad y sujeto» que son completamente incomprensibles, con elementos ‘filosóficos’ como:
A pesar de las contingencias del tiempo, las experiencias y las relaciones, los sujetos permanecen siempre como sí mismos, con una esencia de yo que otorga al nacer, rango social, género y clan familiar; así el individuo contaba con una sensación de pertenencia, comunidad, estabilidad y seguridad.
La identidad de la mismidad parte en Occidente de la exclusión de la diferencia, la
alteridad o la pluralidad, al igual que al enfocarse en la identidad se ha olvidado la
diferencia.
Tal totalidad como totalitarismo, desde la mismidad desconoce la alteridad, lo que implica una identidad que no reconoce al otro como otro. Tal fenómeno es denominado por Erikson (1971) identidad negativa cuando el totalitarismo coarta la posibilidad de identidad en la diferencia, o la unidad en la diversidad.
Y que en general no tienen nada qué ver con nada. Esto es simplemente relleno.
– En general hay unas 100 páginas solo con tablas y gráficos.
Problemas bibliográficos
En la página 173 dice que «Según Caravedo (2009: 25, retomando a Landi 1995)», pero en las referencias no hay ningún Landi.
En la página 174 «En este proceso se ubica el campo de la dialectología perceptiva o perceptual ( Anders, Hundt y Lasch 2010: XI-XIII citado por Quesada 2014: 260)» pero Anders et al. no están en las referencias
En la página 34 dice «Por su parte, Hegel considera que la identidad se constituye tanto de la identidad misma como de la diferencia, las cuales están constantemente en oposición complementaria (Rojas G. 2011: 29).» pero no cita a Hegel.
Algunas de las citas son a documentos relativamente oscuros que se encontró en internet. Por ejemplo, cita a Castells (¿?) de un documento online que no es una publicación, pero que parece ser sacado de una ponencia no científica. No obstante, la cita hace parecer que el texto fuera un trabajo publicado en una revista o algo así.
En varias ocaciones cita a un Le Page: «Un desarrollo en los estudios de lengua e identidad son los trabajos acerca de comodación Lingüística SAT (Speech Accommodation Theory, Giles 1977a; Le Page and Tabouret-Keller 1985)» pero no aparece en la bibliografía.
Usa formatos inconsistentes:
«(Fernández Sevilla 1980: 470)» vs «(Del Valle, José & Villa, Laura 2007: 99)» (algunas veces con primer nombre y algunas veces no)
Algunas entradas en la bibliografía no aparecen en ninguna parte en el texto.
Brock, R. & Tabouret-Keller, A. (1985). Acts of identity: Creole-based approaches to
language and ethnicity. Cambridge: Cambridge University Press.
Por lo que parece que al final simplemente hubiera incluido todo lo que leyó.
Hay citas en las que el año no coincide «(Bucholtz & Hall 2004: 376).» con la literatura:
Bucholtz, M. & Hall, K. (2005). Identity and interaction: A sociocultural linguistic
approach. Discourse Studies, 7(4-5), 585-614.
«Cahuzac (1990)»
Cahuzac, P. (1980). La división del español de América en zonas dialectales. Situación
etnolingüística o semántico-dialectal. Lingüística española actual, 2, 385-461.
«Según Villa (2001:17)»
Villa Mejía, V. (2000). Política idiomática en Colombia: visión sociolingüística. Medellín: Universidad de Antioquia.
¿Citas que no coinciden?: «Granda (1996)» [p. 26] con la bibliografía:
De Granda, G. (1996a). Interferencia y convergencia sintáctica e isogramatismo amplio en el español paraguayo. International Journal of the Sociology of Language, 117(1), 63-80.
De Granda, G. (1996b). El español del Paraguay: temas problemas y métodos. Estudios paraguayos, 7(1).
En este caso no solo está citando mal a De Granada, no es claro cuál de los dos textos está citando.
Citas inexistentes: «Salamanca & Valverde (2009) revisan actitudes» pero no existe en la bibliografía. Lo más cercano es un
Zamora Salamanca, F. J. (2012). El español general y las traducciones literarias. Un
decenio (1933-1942). En F. Lebsanft, W. Mihatsch & C. Polzin-Haumann (Eds.). El
español, ¿desde las variedades a la lengua pluricéntrica? (pp. 229-256). Madrid/Frankfurt. Iberoamericana/Vervuert.
Que no cita en ninguna parte.
Lo mismo con un «Quesada Pacheco (2014)» que tampoco aparece en la bibliografía. Hay unos
Quesada, M. Á. (2006). Lenguas en contacto en Latinoamérica. En M. C. Álvarez-Solar y E. Fonseca (Eds.) Sociedad y cultura en América Latina (pp. 27-40). Bergen:
Fagbokforlaget. Quesada, M. Á. (2008). El español de América. Cartago: Editorial Tecnológica de Costa Rica.
Quesada, M. Á. (2014). División dialectal del español de América según sus hablantes. Análisis dialectológico perceptual. Boletín de filología, 49(2), 257-309.
¿Que tal vez sea el texto? No es claro. El año coincide pero no el nombre. En alguna parte JABC menciona que «En el año 2010 se hace una prueba piloto a dos informantes de Bogotá, y los resultados se sistematizaron en Bergen, por Miguel Ángel Quesada Pacheco» entonces es posible que sea el mismo.
Etc. Esta crítica puede parecer un poco puntillosa, pero es importante ser sistemático en el manejo de referencias. No incluir referencias a autores citados es un error. Para ser claro: es normal que haya algunos errores, no es normal que haya docenas y docenas de errores. Recuerden que es la persona encargada de sistematizar todos los datos del ICC, un trabajo que uno pensaría requiere ser cuidadoso.
Falta de texto original
Esta vez no fuimos capaces de encontrar plagios, probablemente no los hay. Pero la razón no es que JABC haya hecho mucho trabajo original, es más bien que no hay casi nada original en el texto. La gran mayoría de los párrafos son comentarios y resúmenes de citas y otros textos. Bien entradas las 186 páginas tenemos aún párrafos como:
La apertura a la diversidad, el reconocimiento de identidades múltiples, adaptables y cambiantes dependiendo de las circunstancias y los contextos hace parte de la constitución posmoderna de sujeto, propuesta por Hall y Mc Grew (1992: 275), cuya identidad es continuamente formada y cambiada en relación con las distintas formas de representar los sistemas culturales que lo rodean (Morghenthaler 2008: 132).
En el caso de la lingüística se han acuñado conceptos como Speech Accommodation Theory (Le Page 1985; Giles 1977a; Tabouret-Keller 1998; Milroy 1980) en dónde los hablantes adaptan su discurso dependiendo de las identidades que se requieran proyectar. Desde la perspectiva de análisis de ideologías lingüísticas Geeraerts (2003: 25) habla de posmodern awareness basado en dos características, por un lado la crisis de los sistemas estructurados de interpretación sustentados en ideas fijas de progreso y nacionalismo, y por otro lado el reconocimiento y nivelación de los sistemas culturales periféricos con los hegemónicos, con lo que las lenguas permiten la expresión lingüística de múltiples identidades.
Different languages may then […] express this fragmentation (or perhaps rather
multiplication) of identities (Geeraerts 2003: 27).
Esto no es normal. Pasado el punto medio de la disertación uno esperaría que la mayoría del texto fueran ideas propias, pero casi no hay nada propio en todo el trabajo. Lo peor es que no hay trabajo crítico sobre los resúmenes que hace de los diversos autores. Normalmente debería haber discusión sobre lo positivo y negativo de las ideas que se mencionan, no una tirada de mini descripciones de las ideas de decenas de otros textos. Lo único propio son las tablas y tablas de porcentajes que no suman 100.
Es una tesis completamente inútil
Para terminar, veamos cuál es la conclusión general de la tesis de doctorado (recuerden, doctorado):
En suma, respecto a la agradabilidad de las variantes lingüísticas de los países en dónde se habla español, identificamos en las respuestas de los encuestados que los países que agradan más en la forma de habla a los encuestados son Colombia, España, México y Argentina, mientras que los países que menos agradan son Perú, Bolivia y Venezuela; los países respecto a los que hay indiferencia o desconocimiento son Belice, Honduras, Guatemala, El Salvador y Nicaragua. Esta selección es coherente con las selecciones realizadas en los capítulos de unidad y corrección.
Osea, hay dialectos que les gustan a los bogotanos, y hay otros que no tanto. Un descubrimiento impresionante. Esto es tema para un paper de segunda, no para un texto de 300 páginas (de las cuales 100 son discusión sobre qué es el prestigio y qué son las actitudes lingüísticas).
El abstract de la tesis promete: «quantitative and qualitative analyses were applied.». Creo que hemos mostramos bastante bien que ni lo uno ni lo otro se observa en este trabajo.
