{"as_of":"2026-08-09T20:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cb4b7f1f96c7647b926b7136067a8e171733593b63455dbdf935c19c6772fb36","coverage":[{"denominator":64,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":64,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:45:48.555417Z","state":"measured"},{"denominator":64,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":64,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04405/citation-record","integrity":"/paper/2608.04405/integrity","json":"/paper/2608.04405/citation-record.json","paper":"/paper/2608.04405"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.562012Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":"911ddc57-73b0-47f0-9558-3ce17c665d00","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:44.502013Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:620580f87a0781d589ca736ac5115b8e79f5016d13d24aff08d6dba7bd98ef25","observation_id":"98bd1211-0457-40bf-8c2d-bd5821c1b941","resolution":{"observed_at":"2026-08-07T00:45:49.566385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:44.671883Z","title":"Claude-3 Model Card , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:44.671883Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:200204721c94de5e124bc2091b788ad745758376e77fd481ce1ce3e8395742d7","observation_id":"3e34aa05-262a-4fff-b25f-0ed524695119","resolution":{"observed_at":"2026-08-07T00:45:44.671883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:44.838100Z","title":"Proceedings of machine learning and systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:44.838100Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:352a59b5831533280b87b45b92b8da14904f067542edd3e827e4ed9ecfbc0041","observation_id":"1329a8a8-27d4-4f34-913e-85536512e153","resolution":{"observed_at":"2026-08-07T00:45:44.838100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:45.019470Z","title":"Model Tells You What to Discard: Adaptive","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.019470Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:803988039873524072621db1e307de66e893e5c35aa0ddfbbfab5bdc137aa379","observation_id":"6f68cde1-2560-4273-8b87-52d868cac273","resolution":{"observed_at":"2026-08-07T00:45:45.019470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.520710Z","title":null,"venue":null,"work_id":"5ae9e9b2-410f-4d63-a3e0-7e95f218755f","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.080091Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:4f30d84950f3369993fa982e3fadf3b8d8c8c439eaa731dfccf3dc026d94b61f","observation_id":"dac62c12-18bc-4900-9fd3-b24fa6d62178","resolution":{"observed_at":"2026-08-07T00:45:49.524891Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.505500Z","title":null,"venue":null,"work_id":"2b770d6c-1834-4b7e-9b57-3d7539c47e64","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.126296Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:1a2e5610a6bd60bcc0e8e7f1e5a4aed88fd46102f834c8b4235c995f0f120568","observation_id":"ae09cead-d01e-4dde-b7df-fe84a405500a","resolution":{"observed_at":"2026-08-07T00:45:49.510510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.485564Z","title":null,"venue":null,"work_id":"14ec73fe-f7ce-4832-8cc7-c3880c0d5051","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.199502Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:c8f06c89f1119a80735746d8c506b59dad13360854ce2db9d636619211974035","observation_id":"87db65a8-a421-4b90-b996-bdee82f935d2","resolution":{"observed_at":"2026-08-07T00:45:49.489837Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:45.340059Z","title":"Thirty-seventh Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.340059Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:bfc84ce75ecab4c674b24af8e3cf6357c1c376fadb7bc43d6e679e3d3870e18f","observation_id":"3e43558a-cc1c-4f6e-8fdd-6ded987c46b0","resolution":{"observed_at":"2026-08-07T00:45:45.340059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:45.509378Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.509378Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:d39154ebe1446e2ec47ec548503519a8c31c6042fb1118c2a1ea5a2d5a42a348","observation_id":"5eb4dbe8-d238-4a5c-b6ef-387b04cc12a6","resolution":{"observed_at":"2026-08-07T00:45:45.509378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.452110Z","title":"Proceedings of Machine Learning and Systems , volume=","venue":null,"work_id":"428338e8-6b88-4835-a62a-dd5baf822c0a","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.549797Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:fae634111e426837f31014741767c229ac98b92a1c5d47ccf4de0e505057a62b","observation_id":"d64bcbe5-ad45-470b-a8a0-ebfd482cd988","resolution":{"observed_at":"2026-08-07T00:45:49.456470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.438360Z","title":null,"venue":null,"work_id":"0a87d1fb-0bf2-4684-b328-99d9ddb5ed56","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.636469Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:c4d7403d31cbba23966c59cab5d6e3713a0c428bf2f5fbb93ec2c701d9fa2571","observation_id":"a983a3d5-76b3-4114-a28d-332c51f31587","resolution":{"observed_at":"2026-08-07T00:45:49.442209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.425457Z","title":null,"venue":null,"work_id":"7069fcd5-4a79-454c-9be5-be6b8fd70d01","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.692223Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:044e0144c55f4d29534ff64ee87a80791727b99f4a4cebb85c4c36486e34045f","observation_id":"b36d195e-eb79-44ea-b867-9c4b4a0b61b1","resolution":{"observed_at":"2026-08-07T00:45:49.429414Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.411748Z","title":"Spotlight Attention: Towards Efficient","venue":null,"work_id":"80027f11-9f00-4b41-9499-712745fac7ef","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.754602Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:8aaa3874f6c1b2c5e00e49ef028d38402906bb28339d865e8ea70306634bd2b1","observation_id":"bef283cd-a4c6-4a8d-a680-4c2923e4a5e5","resolution":{"observed_at":"2026-08-07T00:45:49.416295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:45.836639Z","title":"FlashAttention: Fast and Memory-Efficient Exact Attention with","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.836639Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:b8792532d865e19fa9f294fc5d16600f766a637f33bfe675f399d87480b87e90","observation_id":"cef7a563-2c41-4001-b4ec-366481c6ce39","resolution":{"observed_at":"2026-08-07T00:45:45.836639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:45.931473Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.931473Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:b797d168029795e1b1030088b7c6f8075e63d2a282fcf56c76830036287174cc","observation_id":"4bb71fa0-ea82-451e-a745-8b98a46e61e7","resolution":{"observed_at":"2026-08-07T00:45:45.931473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:45.999066Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:45.999066Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:e0de5f83ecc47aa934c14548681d1d146a8d8a58a28fb1f4fccb4fbbb285495b","observation_id":"492a6cd4-c8a6-4357-92c8-d9c51657d321","resolution":{"observed_at":"2026-08-07T00:45:45.999066Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:46.124148Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.124148Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:459f9516a0afd40759e78481515d142226ddb0ea1c24c811015e3d6e855c6ecb","observation_id":"e9771ca1-8f7a-447a-b98e-8ef91035aa19","resolution":{"observed_at":"2026-08-07T00:45:46.124148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:46.352439Z","title":"Proceedings of the 62nd annual meeting of the association for computational linguistics (volume 1: Long papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.352439Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:5f8274bfe97adc3a7c43b7b773dda11cf43916a49780c578e5d92cc19cd681d5","observation_id":"1f2597f7-6c5f-4a31-8fa9-67b54193540a","resolution":{"observed_at":"2026-08-07T00:45:46.352439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:46.426634Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.426634Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:0fe26bec8ec9c79682f820d8571d2581030704500988270e1ca6ae7fee5df183","observation_id":"bd6ef8b9-09e9-45a3-aeec-89fc978e05f0","resolution":{"observed_at":"2026-08-07T00:45:46.426634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:46.532884Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.532884Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:508b1eecdb8fd86fc3d1691ac8f7310dbd1561c84f2f0a19523a989ac6dc4745","observation_id":"702c9da4-8052-40ea-a6db-2a3c05463a4a","resolution":{"observed_at":"2026-08-07T00:45:46.532884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:46.601006Z","title":"Transactions of the Association for Computational Linguistics , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.601006Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:0d442b4d9b68f44084f60e432acc79c17d468fa1df3e266e25fcc871c7bcdd82","observation_id":"d0b8689c-2a56-412b-9596-6032009fe2c4","resolution":{"observed_at":"2026-08-07T00:45:46.601006Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.322688Z","title":null,"venue":null,"work_id":"afa54206-b031-4fea-8096-c21a4d33f58b","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.740905Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:e4017c094dd0e844df5e04acd18eec1b059d9ef91732fe8efaec38ae0cf04cee","observation_id":"d373459a-e353-4141-9c04-78f0841c5c15","resolution":{"observed_at":"2026-08-07T00:45:49.326839Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:46.848913Z","title":"Forty-second International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:46.848913Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:551c5b27b30cc202ff06d25fe717f8d62daee199ab6467d60270c79c1c655517","observation_id":"f53e6ef9-51b0-4d9c-ac96-765af8e13b58","resolution":{"observed_at":"2026-08-07T00:45:46.848913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.298550Z","title":"Github repository: hoskison-center/proof-pile","venue":null,"work_id":"f6f2a9b3-f8d9-43a6-b446-904d2121d37a","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.047920Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:46132246530024ecd4e49f648091460a7b52f97480d770f703dc443be679d006","observation_id":"d0429fe5-2587-461a-8efb-c96b9c003402","resolution":{"observed_at":"2026-08-07T00:45:49.303081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.284782Z","title":"Huggingface dataset: namespace-pt/long-llm-data","venue":null,"work_id":"87995cd0-9707-4e71-9b6b-2b2d336a57e9","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.103533Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:8a7128f193bf9806d1538362bf1f6565cec59eb0e54bc0c64994e36245836239","observation_id":"2ab00192-8e2d-46c0-b242-74b42dcc2205","resolution":{"observed_at":"2026-08-07T00:45:49.289011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:47.235596Z","title":"doi:10.5281/zenodo.12608602 , url =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.235596Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:79d54803420693a23b77d9d200ad1f4e07a4a19787d602c67a6732d28868905c","observation_id":"62f3b984-ea25-4934-bb55-47ea276c57c6","resolution":{"observed_at":"2026-08-07T00:45:47.235596Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.270849Z","title":"Needle In A Haystack - Pressure Testing LLMs","venue":null,"work_id":"d706195d-8d26-4022-bad6-4982a7be92ab","year":null},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.343303Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:3fa5718310ec690bfdc8d408488bef9f49deca16303cd7869cfd3d9b44ca08c6","observation_id":"82347311-c9ee-4eb5-adc6-c99fd737f4a9","resolution":{"observed_at":"2026-08-07T00:45:49.275138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T00:45:47.445113Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.445113Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:67954ffe3f01b4ca66c8e96fc927b88a31ed1b0cb8d3923eed83faad46d6a660","observation_id":"ca7ac0a0-b7a3-4214-8ef9-16af23f6ba61","resolution":{"observed_at":"2026-08-07T00:45:47.445113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.257656Z","title":"J., Soloveychik, I., and Kamath, P","venue":null,"work_id":"7b6b83e4-e273-4656-a27a-a73b3736586c","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.542976Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:f80c9ed1668426f799ef1fbf17db724c689035968ed9348cb66e01ce69322717","observation_id":"5de07a54-a4da-4290-8108-891ec18b6d44","resolution":{"observed_at":"2026-08-07T00:45:49.261734Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.242904Z","title":"The claude 3 model family: Opus, sonnet, haiku","venue":null,"work_id":"e1d516ec-0a34-418b-8c25-d00128980a34","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.631915Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:d9a2a2f6b2a81f029e0b475c38a573be5cc4c8b349edf296aa80fc82e156621e","observation_id":"487b2b72-6cff-4e2c-9f99-534e5777f3da","resolution":{"observed_at":"2026-08-07T00:45:49.247793Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:47.723353Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.723353Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:cc4e57e056f538c681be5176e96588d7e865ecb2633432d73f5e90681d256619","observation_id":"0c80b8ad-8250-4faf-a108-1d1451c2b132","resolution":{"observed_at":"2026-08-07T00:45:47.723353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:47.847487Z","title":"Longbench v2: Towards deeper understanding and reasoning on realistic long-context multitasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.847487Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:46546197ddcb47d3be42483d96697952c0652e131f9b26f0f2abc75d625e7c8f","observation_id":"e3c744f0-b0f9-480e-bcf0-c39315548fc2","resolution":{"observed_at":"2026-08-07T00:45:47.847487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.208954Z","title":"Pyramid KV : Dynamic KV cache compression based on pyramidal information funneling","venue":null,"work_id":"d2604dd4-414d-435f-83ef-4d86ffa5d7b3","year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:47.923378Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:72d7f4c113b6dddc105e9fd483774ea58e976df8c169c73f345ab4ff7987fd56","observation_id":"1bb237ad-973d-452e-9a08-e2fbb38702ed","resolution":{"observed_at":"2026-08-07T00:45:49.213802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.194324Z","title":"Magic PIG : LSH sampling for efficient LLM generation","venue":null,"work_id":"d2a08aa8-0299-4dc0-aa11-17cdcb00a6ca","year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.091500Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:d24bc15dccf303dd4ea24f1a1678f80306e9d2191f54a4629beec7f704fbf588","observation_id":"2eabe147-6e65-4048-8950-a6f1379915e2","resolution":{"observed_at":"2026-08-07T00:45:49.198514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-07T01:45:38.840969Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T00:45:48.223022Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.223022Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:77c0376d2e1713c30fc9c174e5df2290377037ee2ed56a8b37a02ed6d16b72a0","observation_id":"081e11f3-47ef-4eed-8037-03d30156e423","resolution":{"observed_at":"2026-08-07T00:45:48.223022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.180970Z","title":"Flashattention-2: Faster attention with better parallelism and work partitioning","venue":null,"work_id":"74c7b67e-793b-45b1-973c-9de2ae2cf2cf","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.386943Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:e10177b29ebb919821bad9b5810b622254890d28f023f245785afafacece2f43","observation_id":"2a4b8387-d5da-4c51-afe2-882926edbced","resolution":{"observed_at":"2026-08-07T00:45:49.185400Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.166972Z","title":"Y., Ermon, S., Rudra, A., and Re, C","venue":null,"work_id":"30478628-3379-43ee-a5d2-fe2396bf1a16","year":2022},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.440388Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:8a0ed5a0f57dda0339a882101a018497cd4da64712da056005125243369faac0","observation_id":"b48affb5-10e3-47a4-87b4-0c3cc6309661","resolution":{"observed_at":"2026-08-07T00:45:49.171609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.152221Z","title":"E., and Stoica, I","venue":null,"work_id":"bf80d6c2-9104-4b47-b75c-e06b49d1fc68","year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.444491Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:e74834136cf3abcbfcc4f4b8dafebc7bb726569108f876cd000aa019d7563f76","observation_id":"80239adc-7d65-4ef2-a647-7b0d7c13390a","resolution":{"observed_at":"2026-08-07T00:45:49.156512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.448707Z","title":"The language model evaluation harness, 07 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.448707Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:9f3117fd3ed501646372c535a50e3c8bbef391897ec0c8a6a1afcbbc1543a36f","observation_id":"5a18a2d2-dc12-4945-946f-2c00ee6ca851","resolution":{"observed_at":"2026-08-07T00:45:48.448707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.138122Z","title":"Model tells you what to discard: Adaptive KV cache compression for LLM s","venue":null,"work_id":"5497c218-a911-47b8-8a18-ca400bbbae4d","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.454453Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:8f1f7147d3082da07370a20890f26be05ef58f95da541abe83d84057a604dc11","observation_id":"58c60a82-6cd4-4d20-94f8-7afa6c2ec18c","resolution":{"observed_at":"2026-08-07T00:45:49.142226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02572","last_updated":"2025-06-03T07:53:32Z","snapshot_observed_at":"2026-08-08T22:46:21.801125Z","submitted_at":"2025-06-03T07:53:32Z","title":"HATA: Trainable and Hardware-Efficient Hash-Aware Top-k Attention for Scalable Large Model Inference","version":1},"cited_work":{"arxiv_id":"2506.02572","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.02572","snapshot_observed_at":"2026-08-07T00:45:48.747511Z","title":"HATA: Trainable and Hardware-Efficient Hash-Aware Top-k Attention for Scalable Large Model Inference","venue":"cs.LG","work_id":"b281805c-434b-4b6f-8e01-cbc075af3219","year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.458849Z"},"links":{"cited_paper":"/paper/2506.02572","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:34af1b28090a8c724a30cd23dd94b019111a01e4f0a01bf8b5035bafde82483e","observation_id":"8a1c847a-d352-4183-97c4-ee08663a825b","resolution":{"observed_at":"2026-08-07T00:45:48.754100Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T00:45:48.463249Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.463249Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:8992d916f5746c5dec194f071d3463a59b547e104af2f4552baa78707fb9985b","observation_id":"ecb4448e-00e0-4300-b69f-cffade0e387f","resolution":{"observed_at":"2026-08-07T00:45:48.463249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11421","last_updated":"2024-03-18T02:30:23Z","snapshot_observed_at":"2026-08-09T07:19:27.126976Z","submitted_at":"2024-03-18T02:30:23Z","title":"FastDecode: High-Throughput GPU-Efficient LLM Serving using Heterogeneous Pipelines","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11421","snapshot_observed_at":"2026-08-07T00:45:48.467163Z","title":"and Zhai, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.467163Z"},"links":{"cited_paper":"/paper/2403.11421","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:640f429573ceba09ee8d9572e43ebd3221877d1e4088d22ca8e9636c0838c1d9","observation_id":"e3cec5c8-1849-4e2e-89b7-01434f9dcc5b","resolution":{"observed_at":"2026-08-07T00:45:48.467163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.471650Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.471650Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:a8fb03a64c52d38317921ae4506f53e12f1a50ba34e28431f20b95799d71adcb","observation_id":"78a83260-f28a-49ce-9f21-f6a2dc2b3004","resolution":{"observed_at":"2026-08-07T00:45:48.471650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.113655Z","title":"RULER : What s the real context size of your long-context language models? In First Conference on Language Modeling, 2024","venue":null,"work_id":"e991ee98-fdc1-4369-9677-9818b3816d76","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.476537Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:f69df1b2511b74ba7ab391d82617d744c5b1b04bbad015aaeba59f71d49ea5c2","observation_id":"af515b52-0466-49a6-8ffc-be5556a2a259","resolution":{"observed_at":"2026-08-07T00:45:49.118630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T00:45:48.481136Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.481136Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:413f0a0e26770af5e2ff4993269449987137f693e15d7d565202e2c1d19b5bcb","observation_id":"58a95e18-6567-4c32-a3be-aeea0733e726","resolution":{"observed_at":"2026-08-07T00:45:48.481136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.098778Z","title":"Needle in a haystack - pressure testing llms, 2023","venue":null,"work_id":"b38d3120-97cd-4377-a642-5a66caa7fc53","year":2023},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.485518Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:c31d062b542f950baeacbba83861d3e401ab26e9a2b998149fde910c4ba0b044","observation_id":"a7402952-de9f-4da5-8708-0afa1115235f","resolution":{"observed_at":"2026-08-07T00:45:49.103843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.083851Z","title":"Spotlight attention: Towards efficient LLM generation via non-linear hashing-based KV cache retrieval","venue":null,"work_id":"c5000b1c-4995-42de-a72d-be7439fd6270","year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.489508Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:f65f194113afe263fc4c746ae467c654be131fb8bb5af30f3f70117d0093d583","observation_id":"0fa777ee-833e-484c-9c35-80b797d84d9b","resolution":{"observed_at":"2026-08-07T00:45:49.088165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.070382Z","title":"Snap KV : LLM knows what you are looking for before generation","venue":null,"work_id":"2f4782c7-b262-46f7-bdc5-c2f1a6658228","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.493989Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:0c5783bfbb98f59939241bbf375a6f15455c7adca4d708e278c3598a3fbb2142","observation_id":"82e90470-43f2-4d55-bff8-d3af616edfb5","resolution":{"observed_at":"2026-08-07T00:45:49.074517Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02401","last_updated":"2025-08-04T13:26:16Z","snapshot_observed_at":"2026-08-09T03:46:52.706849Z","submitted_at":"2025-08-04T13:26:16Z","title":"CompressKV: Semantic Retrieval Heads Know What Tokens are Not Important Before Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02401","snapshot_observed_at":"2026-08-07T00:45:48.497849Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.497849Z"},"links":{"cited_paper":"/paper/2508.02401","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:b680b36bd4958e931c36c9e523a3730cc552b04d544d7911c14c52661b6f93c9","observation_id":"5cbfbc9c-57d0-48b7-a240-4400d564416c","resolution":{"observed_at":"2026-08-07T00:45:48.497849Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06104","last_updated":"2024-06-18T09:16:14Z","snapshot_observed_at":"2026-08-07T11:50:21.011836Z","submitted_at":"2024-01-11T18:35:26Z","title":"Transformers are Multi-State RNNs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.06104","snapshot_observed_at":"2026-08-07T00:45:48.501586Z","title":"Transformers are multi-state rnns","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.501586Z"},"links":{"cited_paper":"/paper/2401.06104","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:0d547987519d4a26f284a1c361d9c4fdba72a2a60fb3a9be0ec4912634a9c6fb","observation_id":"21c45e05-256e-4f45-aed1-31751a9dd61c","resolution":{"observed_at":"2026-08-07T00:45:48.501586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.056269Z","title":"Efficiently scaling transformer inference","venue":null,"work_id":"3723d25a-b24e-4343-b36f-be2932e7c8d8","year":2023},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.505287Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:d0256beb997811b9ec0917f9becb3da47878d62bda48256ad50c35cac07d810a","observation_id":"a1364e24-a837-4295-bdfd-bf2b475f3031","resolution":{"observed_at":"2026-08-07T00:45:49.061315Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.043092Z","title":"CAKE : Cascading and adaptive KV cache eviction with layer preferences","venue":null,"work_id":"d9c30182-d312-4234-9d59-e14184ec168e","year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.509196Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:07c0e145109d474344163367ff87a1b015d3fd2f4aa2ecfe4e9f5ac8a69bf75d","observation_id":"2b8a0f5d-41b5-492c-bf41-e9545623b29b","resolution":{"observed_at":"2026-08-07T00:45:49.047179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.030336Z","title":"W., Potapenko, A., Jayakumar, S","venue":null,"work_id":"b0d92e59-23ef-43f1-a196-67559700370e","year":2020},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.513305Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:5bef320781d94e4e17b5fbdf33050fda1aa78abbc761c7dfb9a0f0445293f8c2","observation_id":"6e7fe64e-838a-4376-a26f-6baea2f56420","resolution":{"observed_at":"2026-08-07T00:45:49.034216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.518314Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.518314Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:656368d12f6d62424a890c1eb770add5108171cb463e75d8c59e889f33ec09d4","observation_id":"a8de4fdf-ea70-4e67-9314-c46683f0b3df","resolution":{"observed_at":"2026-08-07T00:45:48.518314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:49.004761Z","title":"QUEST : Query-aware sparsity for efficient long-context LLM inference","venue":null,"work_id":"89b28335-ba48-463d-8a1a-74673f767c5f","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.522252Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:02f00cb47766da4b5b574efb1315e60257a00fc8184a14768db2a73d6535ec63","observation_id":"5c3d5672-c45b-439e-9be5-eb4d52a46fb3","resolution":{"observed_at":"2026-08-07T00:45:49.009542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.958826Z","title":"Leave no document behind: Benchmarking long-context llms with extended multi-doc qa","venue":null,"work_id":"51cbd65a-ec21-4502-9be5-a0d9d64940a9","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.526633Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:b4a95b76447a07c6f3bfb7d1bc038165cae0f4a7ccc98436af18101442ef7e40","observation_id":"e2ff1f98-d88e-4d4a-9fbe-e8888981a4f5","resolution":{"observed_at":"2026-08-07T00:45:48.980227Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.944477Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"df82f5c8-e1c1-420c-bfff-2e9946f49d0f","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.530814Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:a7a3648ac16a4eae8105c44b418bf3aec7cea60c3202610f520b574000bac3e7","observation_id":"b29bbc48-98eb-4259-93d1-198f95f2a2c9","resolution":{"observed_at":"2026-08-07T00:45:48.948921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-07T00:45:48.534839Z","title":"Qwen3 technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.534839Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:6765f36ec942e023da68b09398e0f379018291bc2299408540bc6477a44df678","observation_id":"b4faa074-20e7-49af-8243-627b6f5d711d","resolution":{"observed_at":"2026-08-07T00:45:48.534839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15383","last_updated":"2025-01-26T03:47:25Z","snapshot_observed_at":"2026-07-31T01:49:29.562668Z","submitted_at":"2025-01-26T03:47:25Z","title":"Qwen2.5-1M Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15383","snapshot_observed_at":"2026-08-07T00:45:48.538584Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.538584Z"},"links":{"cited_paper":"/paper/2501.15383","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:5d22484dc4d6d4bc57abe6b83c04a55e2cec750777d55fce9570536fa16ac5f0","observation_id":"de6a2277-4edb-46d0-8692-8e3ee5b02e44","resolution":{"observed_at":"2026-08-07T00:45:48.538584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.930380Z","title":"Huggingface dataset: namespace-pt/long-llm-data, 2024","venue":null,"work_id":"527d0069-7ce9-4f13-89c6-53c4c2fad428","year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.542875Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:5bb5cd38952fb555859ca9475608abfb9042659439819749679023ddcd7f49b1","observation_id":"3f30f609-ae21-4631-9c75-dde604bf68b6","resolution":{"observed_at":"2026-08-07T00:45:48.934585Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13718","last_updated":"2024-02-24T15:07:55Z","snapshot_observed_at":"2026-08-02T23:59:10.592798Z","submitted_at":"2024-02-21T11:30:29Z","title":"$\\infty$Bench: Extending Long Context Evaluation Beyond 100K Tokens","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13718","snapshot_observed_at":"2026-08-07T00:45:48.547366Z","title":"K., Han, X., Thai, Z","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.547366Z"},"links":{"cited_paper":"/paper/2402.13718","citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:c9316e9f4a611d9b9e84161e78adf32930456fc7cf8c347cd4cbe68b65784f00","observation_id":"b76b7076-7ac9-4a03-9408-1683c1071703","resolution":{"observed_at":"2026-08-07T00:45:48.547366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.916651Z","title":"H2o: Heavy-hitter oracle for efficient generative inference of large language models","venue":null,"work_id":"0a3175b5-1807-4680-8e03-6a666fa77473","year":2023},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.551437Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:532cff2c5473c3c0992b7cbff387c9bc8773cdababa7f0dcd00e5f7cecc607e2","observation_id":"5d79c0a7-586d-448d-9c59-dd60a5a3eb40","resolution":{"observed_at":"2026-08-07T00:45:48.921189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:45:48.902994Z","title":null,"venue":null,"work_id":"0902a876-c4c0-4ce6-9974-25a11854408b","year":2022},"citing_paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-07T00:45:48.555417Z"},"links":{"citing_paper":"/paper/2608.04405"},"observation_digest":"sha256:a2e87e458c008155e2962afef7e684945d1d79157b247fa22d64e489b9d97657","observation_id":"774a348e-c6a2-43f5-a710-fe32e610019e","resolution":{"observed_at":"2026-08-07T00:45:48.907002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2608.04405","last_updated":"2026-08-05T03:19:21Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T23:11:36.041523Z","submitted_at":"2026-08-05T03:19:21Z","title":"Training-Free Hashing-Based Attention via Binary Principal Components"},"reference_resolution":{"displayed":64,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":37,"verified_exact":1,"verified_fuzzy":26},"total_outbound_references":64},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 64 of 64 outbound references and 0 inbound Pith citation observations for arXiv:2608.04405."}