Blogs
Optimizing MiniMax M3 Sparse Attention on NVIDIA Blackwell
Fireworks built a KV-stationary sparse-attention kernel for MiniMax M3 on NVIDIA Blackwell (SM100), reaching ~980 TFLOP/s: 1.9–2.4× a query-stationary baseline and ~1.6× open-source MSA.
ResearchMix Data or Merge Models? Optimizing for Diverse Multi-Task LearningCohere
ResearchMultilingual Arbitrage: Optimizing Data Pools to Accelerate Multilingual ProgressCohere
BlogsOptimizing AI Video Costs and SpeedHeygen
BlogsWSL 2 GPU Support for Docker Desktop on NVIDIA GPUsDocker
BlogsTop 10 Tips for Creating Attention-Grabbing AI Marketing VideosHeygen
BlogsOptimizing aggregation in the Vitess query plannerPlanetscale
BlogsIndexing sparse vectors with TursoTurso
Products & ServicesMiniMax H3 Max: Free AI Video Generator, Ranked #1, Post-Trained by falFal
