原帖内容

Wow... alucinante esto. Qwen 3.8 Flash Next corriendo en local en una única RTX 6000 Pro. La receta esta basada en un fork fijado de SGLang, que sirve RadixArk/Qwen3.8-Flash-Next-NVFP4 en una única RTX PRO 6000 de 96 GB y la he limitado a 275 W; driver NVIDIA 610.57.04, CUDA 13.3.1, Python 3.12, PyTorch 2.13, Triton, FlashInfer y NIXL 1.4. El modelo combina expertos MoE cuantizados en NVFP4 con componentes sensibles en BF16 y tablas PLE FP8 alojadas en RAM, mientras la caché se organiza en GPU, HiCache L2 de 16 GiB y NIXL L3 sobre un volumen XFS/NVMe dedicado de 150 GiB con io_uring y E/S directa. La prueba es para valorar la capacidad del modelo con un hartes mínimo en tareas de largo alcance. Corre sobre Pi con una configuración mínima únicamente en los settings globales, las skillls de orca no aplican. Sin AGENTS.md, sin instrucciones de ningúna clase nada mas que un Prompt (eso si, muy elaborado lo cual también es parte de la prueba). El encargo era construir desde cero HF-IonoSim Live, un simulador web de propagación HF con física ionosférica, datos y previsiones reales de NOAA, una interfaz limpia en modo dark y un globo 3D realista con capas OpenStreetMap al estilo Google Earth. Todo en Vanilla JS + Three.js, sin frameworks ni build step, con tests, funcionamiento offline y servidor propio con hot reload en el puerto 8080. He elegido este proyecto porque concentra complejidades matemáticas y lógicas bastante potentes como modelado ionosférico multicapa, trazado numérico de rayos, cálculo de MUF/LOF y presupuestos de enlace, procesamiento de datos en tiempo real, renderizado 3D y coordinación asíncrona de cálculos pesados sin bloquear la interfaz. Además, es un campo sobre el que tengo conocimientos suficientes para evaluar la calidad general de la implementación más allá del software como la coherencia del modelo físico, sus supuestos, sus resultados y sus limitaciones. He parado de grabar a las 2 h y pico para no hacer este post eterno, A partir del primer minuto la grabación esta x30. Prompt completo en el hilo.