{"node":{"id":19420,"uuid":"fa85de47-168e-419b-a6e2-f82d31bfd73e","title":"HeadWiseKV: Budgeted Per-Head Cache Residency for Hybrid Long-Context Language Models","url":"https:\/\/www.xmt.pub\/index.php\/node\/19420","created":1788413411},"trust_level":"l0_aggregate","publisher":null,"source_url":"https:\/\/arxiv.org\/abs\/2609.02029","provenance":{"algorithm":"sha256(source_url|publisher_id|created)","stored":"7ab5f4e379a7dc213b39e296e1c0e23b6f5d7074e73e7d497d5de4293a4d2ed9","expected":"7ab5f4e379a7dc213b39e296e1c0e23b6f5d7074e73e7d497d5de4293a4d2ed9","status":"verified"}}