<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"><channel><title>Carlos Capote</title><description>Compartir es la tecnología más antigua. Y la reproducibilidad, su forma más avanzada. Publico artículos en profundidad sobre software libre, pedagogía y cultura tecnológica.</description><link>https://carloscapote.com/</link><language>es-es</language><item><title>Cómo usar modelos enormes con GPUs modestas</title><link>https://carloscapote.com/articulos/chiquito-llms-en-hardware-modesto/</link><guid isPermaLink="true">https://carloscapote.com/articulos/chiquito-llms-en-hardware-modesto/</guid><description>Exploro la técnica de la inferencia capa por capa, con precarga en memoria mediante ventanas deslizantes para correr modelos enormes en hardware de andar por casa.</description><pubDate>Fri, 26 Jun 2026 00:00:00 GMT</pubDate><category>LLM</category><category>Python</category><category>GPU</category><category>AirLLM</category></item></channel></rss>