<?xml version="1.0" encoding="UTF-8"?><rss version="2.0"><channel><title>agillm</title><description>Notes on agentic LLMs, reinforcement learning, and model training.</description><link>https://www.agillm.io/</link><item><title>Hello, agillm.io</title><link>https://www.agillm.io/blog/hello-agillm/</link><guid isPermaLink="true">https://www.agillm.io/blog/hello-agillm/</guid><description>What this site is for, and what I plan to write about.</description><pubDate>Sun, 06 Sep 2026 00:00:00 GMT</pubDate></item><item><title>Qwen3-VL Video GRPO Training Pipeline</title><link>https://www.agillm.io/blog/qwen3-video-grpo-training/</link><guid isPermaLink="true">https://www.agillm.io/blog/qwen3-video-grpo-training/</guid><description>An interactive visualization of the Qwen3-VL GRPO training pipeline.</description><pubDate>Sun, 06 Sep 2026 00:00:00 GMT</pubDate></item><item><title>Qwen3-VL Video SFT Training Pipeline</title><link>https://www.agillm.io/blog/qwen3-video-training/</link><guid isPermaLink="true">https://www.agillm.io/blog/qwen3-video-training/</guid><description>An interactive visualization of the Qwen3-VL supervised fine-tuning pipeline.</description><pubDate>Sun, 06 Sep 2026 00:00:00 GMT</pubDate></item></channel></rss>