Saltar al contenido
latentSource
Machine learning · IA · Ciencia de datos

Notas sobre construircon datos e IA.

Soy Oswaldo Orona. Escribo sobre los sistemas que construyo, desde búsqueda y agentes de IA hasta los datos que los sostienen. Lee las decisiones, explora los resultados y revisa el código.

Agentes

Sistemas que construí, con código y decisiones que puedes revisar.

JobMap
Agente

JobMap

Describe el trabajo que quieres hacer, explora vacantes relacionadas y revisa la evidencia detrás de los juicios de relevancia de Jev.

Explorar el agente →
Atlas de embeddings de Star Wars
Agente

Atlas de embeddings de Star Wars

Un explorador interactivo de quince descripciones de personajes, con puntuaciones de similitud, proyecciones y una comparación al quitar las relaciones con otros personajes.

Explorar el agente →
ReActReel
Agente

ReActReel

Un agente de búsqueda de cine y música que convierte una frase recordada en un video, con las llamadas a herramientas junto al resultado.

Explorar el agente →
Enmascarar antes de entregar los datos
Agente

Enmascarar antes de entregar los datos

Un flujo de transferencia entre bases de datos que enmascara los campos de clientes antes de entregarlos al agente o a su buzón.

Explorar el agente →
Asistente de transporte de Ciudad de México
Agente

Asistente de transporte de Ciudad de México

Un mapa de transporte con un asistente que resuelve lugares y pide a un motor de rutas que calcule el viaje.

Explorar el agente →
Memo Ocho Bits
Agente

Memo Ocho Bits

Un participante de IA en una quiniela mundialista, con pronósticos guardados y una tabla de posiciones calculada junto a jugadores humanos.

Explorar el agente →
Investigar el derrame en el Golfo
Agente

Investigar el derrame en el Golfo

Una investigación geoespacial creada para cuestionar la versión del gobierno mexicano sobre el derrame con registros de buques, capas satelitales y comunicados fechados.

Explorar el agente →
El blog como servidor MCP
Agente

El blog como servidor MCP

Un endpoint MCP público para que un asistente busque en el blog, recorra el catálogo y recupere artículos completos.

Explorar el agente →
Sobre mi trayectoria

Biblioteca

Proyectos, análisis y guías sobre los sistemas con los que trabajo.

Ejecutar Ollama correctamente: Modelos locales y tus propios fine-tunes en una sola GPU

Ejecutar Ollama correctamente: Modelos locales y tus propios fine-tunes en una sola GPU

Ollama es la forma menos complicada de servir modelos locales en una sola GPU, pero sus valores predeterminados están ajustados para demos, no para producción. Analizamos lo que realmente importa (quantization, memoria de contexto, keep-alive) y cómo ejecutar tu propio modelo con fine-tuning tras la misma API.

1 jul 20266 min read
Cómo funciona realmente un loop de agente ReAct

Cómo funciona realmente un loop de agente ReAct

Un recorrido por una ejecución real de un agente ReAct: la consulta fue "Houston, we have a problem" y el agente devolvió la marca de tiempo exacta de YouTube. Puedes reproducir la ejecución grabada dentro de este artículo, incluyendo los tokens de pensamiento.

1 jun 202611 min read
El Prompt Engineering ha muerto, larga vida al Prompt Engineering

El Prompt Engineering ha muerto, larga vida al Prompt Engineering

Muchos decían que el prompt engineering era una moda pasajera. Se equivocaron: simplemente evolucionó. Del prompting artesanal al diseño sistemático de prompts para sistemas en producción.

25 may 20267 min read
Construcción de sitios web personales impulsados por IA

Construcción de sitios web personales impulsados por IA

Tu sitio de portafolio puede hacer más que mostrar contenido estático. Aprende a integrar chat de IA, RAG y herramientas agénticas en un sitio web personal.

18 may 20262 min read
Self-Hosting de IA: Ejecutando LLMs en tu propio hardware

Self-Hosting de IA: Ejecutando LLMs en tu propio hardware

Las APIs en la nube son convenientes pero costosas. Explora cómo ejecutar LLMs de código abierto en tus propios servidores, desde la selección de hardware hasta la optimización de la inferencia.

4 may 20266 min read
PostgreSQL como base de datos vectorial: pgvector en producción

PostgreSQL como base de datos vectorial: pgvector en producción

No necesitas una base de datos vectorial independiente. pgvector convierte a PostgreSQL en un motor de búsqueda semántica con índices HNSW, consultas híbridas y todo el poder de SQL.

27 abr 20267 min read
Claude Code y el futuro del desarrollo asistido por IA

Claude Code y el futuro del desarrollo asistido por IA

Claude Code integra un agente de IA directamente en tu terminal. Explora lo que las herramientas de codificación autónomas significan para los flujos de trabajo de ingeniería de software.

20 abr 20266 min read
Workflows agénticos: Orquestación de pipelines de IA de múltiples pasos

Workflows agénticos: Orquestación de pipelines de IA de múltiples pasos

La IA de un solo prompt está alcanzando su límite. Los workflows agénticos encadenan múltiples llamadas a LLM con herramientas, ramificaciones y bucles de retroalimentación para resolver tareas complejas de manera confiable.

13 abr 20267 min read
Destilación de modelos: comprimiendo inteligencia sin perderla

Destilación de modelos: comprimiendo inteligencia sin perderla

Los modelos grandes son potentes pero costosos. La destilación transfiere su conocimiento a modelos más pequeños, rápidos y económicos, y los resultados son sorprendentemente buenos.

30 mar 20265 min read
Knowledge Graphs y LLMs: Razonamiento estructurado a escala

Knowledge Graphs y LLMs: Razonamiento estructurado a escala

Las alucinaciones ocurren cuando los modelos adivinan. Los knowledge graphs proporcionan a los LLMs un eje estructurado y verificable, y la combinación es más potente que cualquiera de los dos por separado.

16 mar 20265 min read
IA on-device: El impulso hacia el edge intelligence

IA on-device: El impulso hacia el edge intelligence

Desde el Neural Engine de Apple hasta las NPU de Qualcomm, la IA se está trasladando de la nube a tu dispositivo. Analizamos qué impulsa este cambio y las posibilidades que esto desbloquea.

9 mar 20265 min read
Fine-Tuning vs RAG: Eligiendo la estrategia correcta

Fine-Tuning vs RAG: Eligiendo la estrategia correcta

Ambos enfoques personalizan los LLM para dominios específicos, pero resuelven problemas distintos. Aquí te explicamos cómo elegir la herramienta adecuada y cuándo combinarlas.

2 mar 20265 min read
DeepSeek R1 y la revolución del razonamiento open-source

DeepSeek R1 y la revolución del razonamiento open-source

Un laboratorio chino lanzó un modelo de razonamiento que igualó a OpenAI o1 a una fracción del costo, y luego lo liberó como open-source. He aquí por qué esto es sumamente importante.

2 feb 20266 min read
IA en 2026: Lo que traerán los próximos 12 meses

IA en 2026: Lo que traerán los próximos 12 meses

Desde modelos nativos de razonamiento hasta ingenieros de software autónomos, estas son las tendencias que definirán la IA en 2026.

26 ene 20265 min read
2025: El año en que la IA se volvió mainstream

2025: El año en que la IA se volvió mainstream

Una mirada retrospectiva a los avances, sorpresas y giros que definieron la inteligencia artificial en 2025, desde los modelos de razonamiento hasta la revolución de los agentes.

19 ene 20265 min read
Visualización de espacios latentes de alta dimensión

Visualización de espacios latentes de alta dimensión

Los espacios latentes codifican el significado en la geometría. Aprenda cómo las técnicas de reducción de dimensionalidad como t-SNE y UMAP hacen visibles estas estructuras invisibles.

12 ene 20266 min read
Construyendo un pipeline de RAG con Gemini

Construyendo un pipeline de RAG con Gemini

Una guía práctica para construir un pipeline de Retrieval-Augmented Generation utilizando la API de Gemini de Google, File Search Store y modelos de embeddings.

5 ene 20266 min read
Asignación eficiente de recursos de GPU

Asignación eficiente de recursos de GPU

Optimiza tu infraestructura de ML con estrategias como MIG y cuantización para reducir costos sin sacrificar el rendimiento.

29 dic 20256 min read
Construyendo un pipeline de RAG desde cero

Construyendo un pipeline de RAG desde cero

Una guía técnica paso a paso para construir un sistema de Generación Aumentada por Recuperación (RAG) para datos empresariales.

22 dic 20258 min read
Tasas Globales de Adopción de IA

Tasas Globales de Adopción de IA

Un desglose visual de cómo la IA está expandiéndose en diversas industrias, desde la salud hasta las finanzas, durante los próximos cinco años.

15 dic 20255 min read
El costo de la inteligencia

El costo de la inteligencia

Rastrea la caída exponencial en los costos de generación de tokens y lo que esta democratización significa para el futuro del software.

8 dic 20255 min read
Leyes de escala de los LLM

Leyes de escala de los LLM

Comprende las leyes de potencia que rigen el rendimiento de la IA: por qué los modelos más grandes y un mayor cómputo generan consistentemente mejores resultados.

1 dic 20255 min read
Evolución de las Arquitecturas Neuronales

Evolución de las Arquitecturas Neuronales

Recorre el linaje de las redes neuronales desde el humilde Perceptrón hasta las masivas ResNets que alimentan la IA actual.

24 nov 20256 min read
Dentro del Transformer

Dentro del Transformer

Explora las capas de la arquitectura Transformer para visualizar cómo los attention heads procesan la información.

17 nov 20256 min read
Mapeando el universo de Star Wars

Mapeando el universo de Star Wars

Un experimento de datos divertido: generar embeddings de personajes de Star Wars en un espacio 3D basados en su sensibilidad a la Fuerza y sus facciones.

10 nov 20257 min read
Clustering de segmentos de clientes

Clustering de segmentos de clientes

Aprende cómo el clustering de K-Means revela patrones ocultos en el comportamiento de los usuarios para impulsar estrategias de negocio dirigidas.

3 nov 20256 min read
Visualizando word embeddings

Visualizando word embeddings

Explora la matemática detrás del lenguaje: observa cómo 'King - Man + Woman = Queen' se representa visualmente en un espacio vectorial.

27 oct 20255 min read
Navegando el espacio latente

Navegando el espacio latente

Descubre los secretos de la compresión de datos de alta dimensionalidad y cómo el mapeo de entradas complejas a espacios más simples impulsa la IA generativa.

20 oct 20255 min read
Bases de datos vectoriales: la capa de memoria de la IA moderna

Bases de datos vectoriales: la capa de memoria de la IA moderna

Los embeddings son el lenguaje de la búsqueda semántica, y las bases de datos vectoriales son el lugar donde residen. Aprende cómo los índices ANN potencian la recuperación a escala.

13 oct 20257 min read
El momento multimodal: cuando la IA aprendió a ver y hablar

El momento multimodal: cuando la IA aprendió a ver y hablar

Los modelos de visión y lenguaje ahora pueden describir imágenes, leer gráficos y analizar videos. Así es como su arquitectura permite un verdadero entendimiento cross-modal.

29 sep 20255 min read
Salidas estructuradas: Haciendo que los LLMs sean confiables en producción

Salidas estructuradas: Haciendo que los LLMs sean confiables en producción

El texto libre funciona bien en una ventana de chat, pero los sistemas en producción necesitan JSON. Una guía sobre decodificación restringida, cumplimiento de esquemas y un ejemplo con Gemini que combina salidas estructuradas con function calling.

22 sep 20259 min read

39 de 39 artículos

Acerca de

Soy Oswaldo Orona, Administrador Principal de Bases de Datos y profesional de IA con base en Denver, CO. Tengo un MCS-DS de UIUC (Tau Beta Pi, Phi Kappa Phi) y aporto más de 25 años de experiencia en bases de datos junto con trabajo práctico profundo en machine learning e ingeniería de IA.

Mis áreas de enfoque incluyen Generación Aumentada por Recuperación (RAG), agentes de IA, Model Context Protocol (MCP), IA geoespacial e IA financiera, todo ejecutándose en un laboratorio casero Proxmox auto-hospedado con Docker y LXC.

Este blog es donde documento exploraciones en el espacio latente: las ideas, experimentos y sistemas que viven entre los datos y el modelo.

@ooronaVer repositorios

ML & IA

  • PyTorch
  • TensorFlow
  • RAG
  • NLP
  • Computer Vision
  • LLMs

Bases de Datos

  • PostgreSQL
  • Oracle
  • Redis
  • pgvector
  • DynamoDB

Infraestructura

  • Docker
  • Proxmox
  • Ansible
  • AWS
  • Linux

Lenguajes

  • Python
  • R
  • SQL
  • PL/SQL
  • Java
  • Bash

Pregunta sobre Oswaldo

Conoce mi experiencia a través de una conversación. Pregunta cómo construí un proyecto, conoce mi trayectoria o comenta cómo mis habilidades encajan en tu equipo.

Estás conversando con un asistente de IA. Puede ayudarte a agendar una llamada o enviar un mensaje. Oswaldo puede recibir un resumen de la conversación.