Lección 2 de 5 · 40 minutos
Buscar literatura con IA sin inventar fuentes
Al terminar esta lección
podrás buscar literatura académica combinando Google Scholar, Semantic Scholar, Consensus, Elicit y Perplexity, verificar que cada fuente existe de verdad y guardarla organizada en Zotero.
Camila está en octavo semestre de Psicología en Bogotá y su directora de tesis le pidió "el estado del arte" sobre ansiedad académica en estudiantes universitarios. Camila le preguntó a un chatbot y en treinta segundos tenía una lista hermosa: doce referencias con autores, revistas, años y hasta números de páginas. Se sintió salvada. Dos días después, cuando fue a descargar los PDF para leerlos, cinco de esas doce referencias simplemente no existían: el autor era real, la revista era real, pero ese artículo nunca se escribió. La directora lo notó en la primera revisión y la confianza quedó golpeada.
Eso que le pasó a Camila tiene nombre: alucinación. Los modelos de lenguaje generan texto que suena correcto, y una referencia bibliográfica es justamente un patrón de texto muy fácil de imitar. La buena noticia es que hoy existen herramientas de IA que no inventan porque no generan la referencia: la buscan en una base de datos real y te muestran de dónde salió. En esta lección vas a aprender cuál herramienta sirve para cada momento de tu búsqueda, cómo verificar en menos de un minuto que un artículo existe, y cómo dejarlo guardado en Zotero para que en la lección siguiente puedas leerlo sin volver a buscarlo. Partimos de la pregunta de investigación que armaste en la lección 1: sin esa pregunta, buscar es dar palos de ciego.
Por qué la IA inventa referencias (y qué herramientas no lo hacen)
Un modelo de lenguaje (la tecnología detrás de ChatGPT, Claude o Gemini) funciona prediciendo qué palabra sigue. No tiene una biblioteca adentro: tiene patrones estadísticos del texto con el que fue entrenado. Cuando le pides una referencia, produce algo con la forma de una referencia —apellido, año, título plausible, revista plausible— sin ningún mecanismo que verifique que ese objeto existe en el mundo. Por eso las citas falsas suelen ser tan convincentes: mezclan autores que sí publican del tema con títulos que suenan a ese campo.
La distinción clave que necesitas es entre dos modos de trabajo:
- Generativo puro: el modelo responde de memoria. Útil para reformular tu pregunta, traducir términos o proponer sinónimos de búsqueda. Nunca para pedir referencias.
- Búsqueda con recuperación: la herramienta primero consulta una base de datos de artículos reales y después usa el modelo para resumir lo que encontró. Cada frase viene con un enlace al artículo fuente. Aquí entran Consensus, Elicit, Semantic Scholar y Perplexity.
El segundo modo se llama RAG (Retrieval-Augmented Generation, o generación aumentada por recuperación). Reduce mucho las citas inventadas, pero no elimina otro error más silencioso: la herramienta cita un artículo que sí existe pero dice algo distinto a lo que la IA resumió. A eso se le llama misattribution o atribución incorrecta, y es más peligroso porque pasa la primera revisión.
Regla práctica para toda la lección: la IA te lleva al artículo, no reemplaza leerlo. Si vas a citar una frase en tu tesis, esa frase la sacaste del PDF que abriste con tus ojos, no del resumen de una herramienta.
Prueba tú mismo: pídele a un chatbot cualquiera "dame 5 artículos científicos sobre deserción universitaria en Colombia con DOI". Copia cada DOI en doi.org y cuenta cuántos abren. Ese experimento de cinco minutos te vacuna para siempre.
El mapa de herramientas: cuál usar en qué momento
No compiten entre sí; cubren etapas distintas de la búsqueda. Este es el orden que recomiendo.
1. Google Scholar — el buscador académico más amplio y gratuito. Indexa artículos, tesis, libros y literatura gris (informes, documentos de trabajo). Es el mejor para español y para producción latinoamericana, que otras bases cubren mal. Su superpoder es el enlace "Citado por": te deja saltar de un artículo viejo a todos los que lo citaron después. No tiene IA que resuma, y eso está bien: es tu fuente de verdad.
2. Semantic Scholar — base de datos académica gratuita, con enfoque en conexiones entre papers. Te muestra citas, referencias y artículos relacionados de forma navegable. Sirve para el paso de "ya tengo un artículo bueno, ¿qué más hay alrededor?".
3. Consensus — buscador que responde preguntas de sí/no o de relación causal consultando artículos reales. Su valor está en que te muestra la distribución de la evidencia: cuántos estudios encontrados apoyan, cuántos contradicen. Tiene plan gratuito con límite mensual de búsquedas.
4. Elicit — pensado para revisión de literatura: te arma una tabla donde cada fila es un artículo y cada columna un dato que tú pides (población, método, tamaño de muestra, resultado principal). Ahorra horas de tabulación manual. Plan gratuito limitado.
5. Perplexity — buscador conversacional con enlaces. No es específicamente académico, así que mezcla fuentes de prensa y blogs con papers. Úsalo para entender un tema nuevo rápido y para encontrar informes de entidades colombianas (ministerios, DANE, universidades) que no están en bases académicas. Verifica siempre el tipo de fuente antes de citarla.
Casi todas piden cuenta con correo. Las funciones gratuitas alcanzan de sobra para una tesis de pregrado si las combinas en vez de exprimir una sola.
Ruta típica: Perplexity para entender el tema y el vocabulario → Consensus para ver qué dice la evidencia → Google Scholar y Semantic Scholar para conseguir los artículos completos → Elicit para tabularlos → Zotero para guardarlos.
Construir buenas búsquedas: la IA te da las palabras, tú das la estructura
El error más común no es usar mal la IA, es buscar con palabras del lenguaje cotidiano. Las bases académicas responden a términos controlados: el vocabulario que la comunidad de tu disciplina usa de verdad. Si buscas "estudiantes estresados por la universidad" encuentras poco; si buscas "academic stress" o "test anxiety" encuentras mucho.
Aquí sí conviene usar un chatbot generativo, porque no le estás pidiendo hechos sino vocabulario. Prompt para copiar:
Soy estudiante de [tu carrera] en Colombia. Mi pregunta de investigación es:
"[pega aquí tu pregunta de la lección 1]"
No me des referencias ni artículos. Dame solamente:
1. 8 términos de búsqueda en inglés que usaría la literatura académica de este campo
2. Sus equivalentes en español
3. 3 cadenas de búsqueda booleana combinando esos términos
4. 3 términos cercanos que NO debo confundir con el míoCon esas palabras armas cadenas booleanas, que son la forma de combinar términos que entienden los buscadores:
ANDreduce:"academic stress" AND "university students"trae solo lo que tenga ambos.ORamplía:("academic stress" OR "academic anxiety")trae cualquiera de los dos.- Comillas fijan la frase exacta:
"deserción universitaria". - El signo menos excluye:
-secundaria.
En Google Scholar además puedes usar site: para dominios y filtrar por año en la barra izquierda. Ejemplo real de cadena:
("academic stress" OR "academic anxiety") AND ("university students" OR "higher education") AND (Colombia OR "Latin America")
Corre esa misma cadena en Google Scholar y en Semantic Scholar; los resultados no serán iguales y eso es señal de que estás cubriendo más terreno. Guarda tus cadenas en un documento: una revisión de literatura seria debe poder decir qué buscó, dónde y cuándo.
Documenta así cada búsqueda: `Fecha: 2026-09-09 | Base: Google Scholar | Cadena: ("academic stress" OR "academic anxiety") AND "university students" AND Colombia | Filtro: 2019-2026 | Resultados: 214 | Revisados: primeros 40`
Verificar en 60 segundos: el protocolo antifantasmas
Toda referencia que salga de una herramienta con IA pasa por este filtro antes de entrar a tu tesis. Son cuatro chequeos y ninguno toma más de un minuto.
1. ¿Existe el DOI? El DOI (Digital Object Identifier) es el código permanente de un artículo, tipo 10.1016/j.xxxx.2023.01.001. Pégalo después de https://doi.org/ en el navegador. Si abre el artículo, existe. Si da error, sospecha fuerte. Ojo: no todos los artículos latinoamericanos tienen DOI, así que la ausencia no prueba que sea falso, solo que toca verificar de otro modo.
2. ¿Aparece el título exacto en Google Scholar? Copia el título entre comillas y búscalo. Si no aparece nada o aparece un artículo con título parecido pero distinto, la referencia está deformada.
3. ¿Coinciden autores, año y revista? Las alucinaciones frecuentemente mezclan: título real de un autor, atribuido a otro; o año corrido. Compara los cuatro datos contra la página de la revista, no contra otra IA.
4. ¿El artículo dice lo que la IA dijo que decía? Este es el chequeo que casi nadie hace. Abre el PDF, busca con Ctrl+F la cifra o el concepto que te interesa y léelo en su párrafo. Si la IA te dijo "el estudio encontró una correlación fuerte" y el paper dice "se observó una correlación débil y no significativa", acabas de evitar un error grave.
Un quinto chequeo, de calidad y no de existencia: mira dónde se publicó. Revistas colombianas serias suelen estar indexadas en SciELO o Redalyc, ambas de acceso abierto y gratuitas. Si la revista no aparece en ningún índice reconocido y cobra por publicar rápido, ten cuidado: existen revistas depredadoras que publican casi cualquier cosa sin revisión real.
Si tu universidad tiene convenio de bases de datos, entra por la biblioteca con tu correo institucional: muchos PDF de pago se abren gratis desde ahí.
Marca cada referencia en tu documento de trabajo con una etiqueta: ✅ verificada (DOI abre + leí el resumen), ⚠️ existe pero no la he leído, ❌ no la encontré → se elimina, no se cita.
Zotero: que nada se te pierda y la bibliografía se arme sola
Zotero es un gestor de referencias gratuito y de código abierto. Guarda cada artículo con sus datos, el PDF y tus notas, y después genera la bibliografía en el formato que pidas (APA, IEEE, Vancouver). Es la pieza que convierte tu búsqueda en algo reutilizable.
Montaje, una sola vez:
1. Instala Zotero en el computador desde zotero.org y crea cuenta gratuita para sincronizar. 2. Instala el Zotero Connector, la extensión del navegador. Es la que hace la magia. 3. Crea una colección (carpeta) con el nombre de tu tesis, y subcolecciones por tema.
Uso diario: cuando estés viendo un artículo en Google Scholar, Semantic Scholar, SciELO o la página de la revista, haces clic en el ícono del Connector y Zotero guarda autor, título, año, revista, DOI y, si está en abierto, el PDF. Desde la página de resultados de Scholar el ícono cambia a una carpeta y puedes guardar varios de una.
Tres hábitos que separan una biblioteca útil de un basurero digital:
- Revisa los metadatos al guardar. Los datos capturados a veces vienen incompletos, sobre todo en revistas latinoamericanas. Corrige el año o el nombre de la revista en el momento; después no lo haces.
- Usa etiquetas y no solo carpetas. Etiquetas como
metodo-cualitativo,Colombia,clavete permiten cruzar temas. - Escribe una nota de tres líneas apenas guardas: qué pregunta responde, qué método usó, por qué te sirve. Tu yo de dentro de dos meses te lo agradece.
Para escribir, Zotero tiene complemento para Word, LibreOffice y Google Docs: insertas la cita y la bibliografía se construye y renumera sola. Si trabajas solo desde celular, puedes ir guardando enlaces en un documento y pasarlos a Zotero cuando tengas computador.
Nota corta dentro de Zotero: "Encuesta a 312 estudiantes de pregrado, Medellín, 2023. Escala DASS-21. Sirve para justificar el instrumento en mi capítulo 3. Limitación: una sola universidad privada."
Práctica: Arma tu primer corpus verificado de 10 fuentes
Toma la pregunta de investigación de la lección 1 y pásala por el prompt de vocabulario de la sección 3 en cualquier chatbot gratuito. Anota 8 términos en inglés y sus equivalentes en español.
Construye 3 cadenas booleanas con esos términos y córrelas en Google Scholar filtrando por los últimos 5 o 7 años. Abre las primeras 20 fichas y guarda con Zotero Connector las que te sirvan.
Toma el artículo que más te guste, ábrelo en Semantic Scholar y revisa 'referencias' y 'citado por'. Guarda 3 artículos nuevos que encuentres por esa vía.
Formula tu pregunta como una afirmación en Consensus (por ejemplo: '¿el estrés académico se asocia con deserción universitaria?') y revisa la distribución de evidencia. Guarda 2 artículos de ahí.
Usa Perplexity para buscar un informe o estadística oficial colombiana sobre tu tema. Revisa el enlace y confirma que sea de una entidad y no de un blog.
Aplica el protocolo de verificación de 60 segundos a las 10 fuentes: DOI, título exacto, autores/año/revista, y lectura del resumen. Marca ✅, ⚠️ o ❌ en cada una.
Crea en Zotero la colección de tu tesis, mueve allí las verificadas, corrige metadatos y ponle a cada una una etiqueta y una nota de tres líneas.
Genera desde Zotero la bibliografía en el formato que exige tu programa y guarda aparte el registro de tus cadenas de búsqueda con fecha.
Al terminar tienes: Una colección en Zotero con al menos 10 referencias verificadas, etiquetadas y anotadas, más un registro reproducible de qué buscaste, dónde y cuándo.
Dónde se equivoca la gente
- Pedirle referencias directamente a un chatbot generativo y copiarlas a la tesis.Usa el chatbot solo para vocabulario y cadenas de búsqueda. Las referencias salen de Google Scholar, Semantic Scholar, Consensus o Elicit, y siempre pasan por el protocolo de verificación.
- Confiar en el resumen que la herramienta hace del artículo y citarlo como si lo hubieras leído.Abre el PDF y localiza la frase o la cifra en su párrafo original. Si no puedes acceder al texto completo, entra por la biblioteca de tu universidad o busca la versión en abierto; si no aparece, no lo cites.
- Buscar solo en español y solo en Google Scholar, y concluir que 'no hay nada' del tema.Corre la misma búsqueda en inglés y en al menos dos bases distintas. La mayor parte de la literatura académica está en inglés; el vacío casi siempre es del buscador, no del campo.
- Guardar todo en una carpeta de descargas con nombres como 'articulo3.pdf' y dejar Zotero para el final.Guarda con el Connector en el momento en que encuentras el artículo, corrige los metadatos ahí mismo y escribe la nota de tres líneas antes de cerrar la pestaña.
Lo que te llevas
- Los modelos de lenguaje inventan referencias porque generan texto con forma de cita, no porque consulten una biblioteca; nunca les pidas fuentes de memoria.
- Cada herramienta cubre una etapa: Perplexity para entender, Consensus para ver la evidencia, Google Scholar y Semantic Scholar para conseguir los artículos, Elicit para tabularlos.
- Las buenas búsquedas se hacen con términos del campo y cadenas booleanas (AND, OR, comillas), no con lenguaje cotidiano.
- El protocolo de verificación tiene cuatro pasos: DOI que abra, título exacto en Scholar, coincidencia de autores/año/revista, y que el artículo diga lo que la IA afirmó.
- Zotero con su Connector guarda referencia, PDF y notas, y arma la bibliografía sola; su valor depende de que corrijas metadatos y anotes al momento de guardar.
- Una revisión seria documenta qué cadenas buscó, en qué base y en qué fecha, para que otra persona pueda reproducirla.
Palabras nuevas
- Alucinación
- Cuando un sistema de IA produce información falsa con apariencia de verdadera, como una referencia bibliográfica que nunca existió.
- DOI (Digital Object Identifier)
- Código permanente que identifica un artículo académico. Si lo pegas después de https://doi.org/ debe llevarte al artículo real.
- Cadena booleana
- Combinación de términos de búsqueda usando AND (ambos), OR (cualquiera) y comillas (frase exacta) para hacer búsquedas precisas en bases académicas.
- RAG (generación aumentada por recuperación)
- Técnica en la que la IA primero busca en una base de datos real y luego resume lo encontrado, citando la fuente; reduce las citas inventadas pero no las malas interpretaciones.
- Revista depredadora
- Publicación que cobra por publicar sin hacer revisión por pares seria; sus artículos no deben usarse como respaldo en una tesis.
Quiz de la lección
Seis preguntas. Nadie te califica: sirven para que sepas si entendiste. Con cuatro buenas vas bien.
Ya tienes una pila de artículos verificados en Zotero; en la lección 3 vas a aprender a leer treinta de ellos sin morir en el intento, decidiendo en minutos cuáles merecen lectura completa y cuáles no.