{"as_of":"2026-08-15T14:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a0944b1e7bd3a35115afd9c231f7a93c909ef50985c72946fcb0a5e2ae333e93","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:08:09.488803Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T13:15:07.167572Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.03865","snapshot_observed_at":"2026-08-05T13:15:07.167572Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.00925","last_updated":"2025-08-31T16:21:21Z","snapshot_observed_at":"2026-08-12T12:22:27.868619Z","submitted_at":"2025-08-31T16:21:21Z","title":"DTRNet: Dynamic Token Routing Network to Reduce Quadratic Costs in Transformers","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-05T13:15:07.167572Z"},"links":{"cited_paper":"/paper/2507.03865","citing_paper":"/paper/2509.00925"},"observation_digest":"sha256:7f12547d6ab514f5d4950656fad3e7718a6e9139b3bdb837e10f3bfc5cafeda2","observation_id":"4040624e-1a52-449c-ad62-3e59d3d9a76d","resolution":{"observed_at":"2026-08-05T13:15:07.167572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"cited_work":{"arxiv_id":"2507.03865","doi":"10.48550/arxiv.2507.03865","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03865","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Orthorank: Token selection via sink token orthogonality for efficient llm inference","venue":"ArXiv.org","work_id":"31d45eea-ebd3-4a43-aa7a-0441e22a75d9","year":null},"citing_paper":{"arxiv_id":"2602.01203","last_updated":"2026-05-27T09:56:04Z","snapshot_observed_at":"2026-08-11T13:05:48.942605Z","submitted_at":"2026-02-01T12:45:39Z","title":"Attention Sink Forges Native MoE in Attention Layers: Sink-Aware Training to Address Head Collapse","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T08:47:29.236561Z"},"links":{"cited_paper":"/paper/2507.03865","citing_paper":"/paper/2602.01203"},"observation_digest":"sha256:92c03673c116424700cccc2316cb25f77f67a9a32419db3e698db1e5d7a95d1a","observation_id":"1b256f7d-5bfb-4f70-a411-d8e74ae2a03f","resolution":{"observed_at":"2026-05-16T08:47:37.280027Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.03865","snapshot_observed_at":"2026-08-03T05:50:25.027494Z","title":"Orthorank: Token selection via sink token orthogonality for efficient llm inference","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01203","last_updated":"2026-05-27T09:56:04Z","snapshot_observed_at":"2026-08-11T13:05:48.942605Z","submitted_at":"2026-02-01T12:45:39Z","title":"Attention Sink Forges Native MoE in Attention Layers: Sink-Aware Training to Address Head Collapse","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-03T05:50:25.027494Z"},"links":{"cited_paper":"/paper/2507.03865","citing_paper":"/paper/2602.01203"},"observation_digest":"sha256:11c40ca8cb603ccc30857befe9cd384a66d43d9186d6d07178e67327d75743b3","observation_id":"e4d1dbc0-a3f4-46bd-87cd-26436f2198d6","resolution":{"observed_at":"2026-08-03T05:50:25.027494Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"cited_work":{"arxiv_id":"2507.03865","doi":"10.48550/arxiv.2507.03865","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03865","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Orthorank: Token selection via sink token orthogonality for efficient llm inference","venue":"ArXiv.org","work_id":"31d45eea-ebd3-4a43-aa7a-0441e22a75d9","year":null},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2507.03865","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:fb3db262dafa884b7723582a45691db4addb1fb456b9a0ca283100a7ca3b56cc","observation_id":"df018183-1fe6-4e00-831b-dc59de7a9fd1","resolution":{"observed_at":"2026-06-28T23:32:46.707032Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"cited_work":{"arxiv_id":"2507.03865","doi":"10.48550/arxiv.2507.03865","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.03865","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Orthorank: Token selection via sink token orthogonality for efficient llm inference","venue":"ArXiv.org","work_id":"31d45eea-ebd3-4a43-aa7a-0441e22a75d9","year":null},"citing_paper":{"arxiv_id":"2606.07604","last_updated":"2026-05-29T09:40:38Z","snapshot_observed_at":"2026-08-03T04:00:50.272221Z","submitted_at":"2026-05-29T09:40:38Z","title":"Contribution Weights: A Geometrical Analysis of Self-Attention Transformers","version":1},"reference_index":171,"source":"arxiv_source","source_observed_at":"2026-06-28T23:29:02.457697Z"},"links":{"cited_paper":"/paper/2507.03865","citing_paper":"/paper/2606.07604"},"observation_digest":"sha256:49407dbbaf098bfe37a844f1465b3db39ed162a2763e88fa26a62666c00696e6","observation_id":"e37ca751-0043-4a4b-9ad3-43f1489a797d","resolution":{"observed_at":"2026-06-28T23:32:47.283100Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.03865/citation-record","integrity":"/paper/2507.03865/integrity","json":"/paper/2507.03865/citation-record.json","paper":"/paper/2507.03865"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:06.520040Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.520040Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:1d44af2448e9be34b939f5ac6b073691db0c9897b54d5e0249aae13878b9f91f","observation_id":"8025c31f-e790-499d-bb46-40311bd8d76e","resolution":{"observed_at":"2026-08-06T20:08:06.520040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.141286Z","title":"Fast and robust early-exiting framework for autoregressive language models with synchronized parallel decoding","venue":null,"work_id":"2c2ec33a-bb70-4dfb-ab24-862be492f371","year":2023},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.540763Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:f06f5362f8790d23cbe3ec4b951d1cabec70a7d97557b8fc64b9ef5a0e32d815","observation_id":"3271328d-b004-4830-869d-45401ba497cd","resolution":{"observed_at":"2026-08-06T20:08:11.144777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.131893Z","title":"Longbench: A bilingual, multitask benchmark for long context understanding","venue":null,"work_id":"161d39a8-01de-498f-bc55-26fb465bcfcd","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.575951Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:c741ff23631028c5cc1ffcabc22d0d0b846304bc6c0233b9eb4a84bbafdbd3ef","observation_id":"4861d466-5830-4fd9-b861-0622edabd0d0","resolution":{"observed_at":"2026-08-06T20:08:11.134965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:06.665742Z","title":"Piqa: Reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.665742Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:2464d7acaace0853d9296ff44d5bc0919d4c12dc2c2c73c56a52553019e12e65","observation_id":"a3febf6d-418c-4022-a485-f1c4592d3c68","resolution":{"observed_at":"2026-08-06T20:08:06.665742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:06.694850Z","title":"Spectral filters, dark signals, and attention sinks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.694850Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:ed71f7a1957425d236a0a257af3f97b115b88e9a0a8eefa88c5930c0b34639bf","observation_id":"7b46542b-851f-463d-8eef-d25b67658055","resolution":{"observed_at":"2026-08-06T20:08:06.694850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-13T18:05:41.301999Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-06T20:08:06.728594Z","title":"Sepllm: Accelerate large language models by compressing one segment into one separator","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.728594Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:38424040608dd1d6e4e1943500d562b4930b6af58e430b04ccec1f5ee18daf13","observation_id":"7e3cbe33-ce91-4136-8db3-9c084ff0c855","resolution":{"observed_at":"2026-08-06T20:08:06.728594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.116320Z","title":"Ee-llm: Large-scale training and inference of early-exit large language models with 3d parallelism","venue":null,"work_id":"bfb4beb5-b4a0-4494-81a1-af340fe90d09","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.784271Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:3a9c008c7a6cf107f74f33c8fd9f59f1b1776c13650842429b476eea20850a17","observation_id":"3871d836-3f1b-46ac-99f7-e2d643164297","resolution":{"observed_at":"2026-08-06T20:08:11.119715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05457","last_updated":"2018-03-14T18:04:21Z","snapshot_observed_at":"2026-08-14T19:36:07.505691Z","submitted_at":"2018-03-14T18:04:21Z","title":"Think you have Solved Question Answering? Try ARC, the AI2 Reasoning Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05457","snapshot_observed_at":"2026-08-06T20:08:06.826197Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.826197Z"},"links":{"cited_paper":"/paper/1803.05457","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:34016f081d03243fa7427fced003a80430fa85380e7f72182131d7a728eef2e1","observation_id":"6a2e375d-4bd9-46bc-b2f7-ceee1f13df11","resolution":{"observed_at":"2026-08-06T20:08:06.826197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.02628","last_updated":"2023-07-05T19:59:09Z","snapshot_observed_at":"2026-08-13T11:02:00.153169Z","submitted_at":"2023-07-05T19:59:09Z","title":"SkipDecode: Autoregressive Skip Decoding with Batching and Caching for Efficient LLM Inference","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.02628","snapshot_observed_at":"2026-08-06T20:08:06.884228Z","title":"Skipdecode: Autoregressive skip decoding with batching and caching for efficient llm inference","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.884228Z"},"links":{"cited_paper":"/paper/2307.02628","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:35f8d8ea657f9a5530696c2761cdf3eacec8cf9a760bd6f90157ee62e4a7bbab","observation_id":"8fe2c9d0-f948-465b-942a-3381ee8bc030","resolution":{"observed_at":"2026-08-06T20:08:06.884228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T20:08:06.940790Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.940790Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:0a47c2b04d3464b6ea7a7d6200c69b23cc85a844b3087c3dea7ed2d9da529c73","observation_id":"22d001fd-06b5-44b3-9188-35a713a1b314","resolution":{"observed_at":"2026-08-06T20:08:06.940790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.107011Z","title":"Layerskip: Enabling early exit inference and self-speculative decoding","venue":null,"work_id":"64dd408c-7ba7-446b-bed0-ffcdc3d9e487","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:06.986186Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:df22fc32fa9e2503b0954b0318832b9cce666e2e6d5ec800ed9a9463c07b12f3","observation_id":"cf401c8b-e256-4a47-9367-6c7a4db9f037","resolution":{"observed_at":"2026-08-06T20:08:11.110224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.096141Z","title":"When attention sink emerges in language models: An empirical view","venue":null,"work_id":"5e076050-f72b-42cc-ba0e-815b15426daf","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.062613Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:c71149715138396e1510973688e7b3d50b2bc9fddfac3ea71268174efa92069a","observation_id":"1c73407b-f2ef-4a55-b6bb-09fa8cbfb7b4","resolution":{"observed_at":"2026-08-06T20:08:11.099806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:07.136253Z","title":"J., yelong shen, Wallis, P., Allen-Zhu, Z., Li, Y., Wang, S., Wang, L., and Chen, W","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.136253Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:5004f629abc51ee85e0e2c5a77cf517a0d26451bfbca21a89d5adba393a75b82","observation_id":"870b8fee-af36-484a-8381-11b1f0f59ac2","resolution":{"observed_at":"2026-08-06T20:08:07.136253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T20:08:07.195766Z","title":"Q., Sablayrolles, A., Mensch, A., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.195766Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:83799a533b337bc6b2585161f742a1ccfeb439d9f3e597fd2ca562105059fc84","observation_id":"3133fe33-7106-4036-8df3-ea59d7c6b30b","resolution":{"observed_at":"2026-08-06T20:08:07.195766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-13T19:43:49.936776Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-06T20:08:07.249338Z","title":"Q., Sablayrolles, A., Roux, A., Mensch, A., Savary, B., Bamford, C., Chaplot, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.249338Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:a366bd72b500f8aff7a6fd9689b21a7f837a4d379657fcdce6bfa978a89b4393","observation_id":"52bdaca1-fa16-4b5d-b930-9629ec47723e","resolution":{"observed_at":"2026-08-06T20:08:07.249338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.078608Z","title":"D-llm: A token adaptive computing resource allocation strategy for large language models","venue":null,"work_id":"af30881d-8c74-4a94-a10f-ac35cc621b79","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.288318Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:dc0b26b106fa50e2156d4031857b802d1d566d09607d0a1767cf9c7d1d0ef6a8","observation_id":"c5ab7db0-7fb5-4b79-a78f-e3774e77afb1","resolution":{"observed_at":"2026-08-06T20:08:11.082034Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02834","last_updated":"2024-06-23T08:45:33Z","snapshot_observed_at":"2026-08-13T04:26:58.030844Z","submitted_at":"2024-02-05T09:44:49Z","title":"Shortened LLaMA: Depth Pruning for Large Language Models with Comparison of Retraining Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02834","snapshot_observed_at":"2026-08-06T20:08:07.404789Z","title":"Shortened llama: A simple depth pruning for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.404789Z"},"links":{"cited_paper":"/paper/2402.02834","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:7c6465da387618a7cbcd6989d2810546259f04f1dae08f22e5f7b0ec46797b16","observation_id":"b92bd581-f141-4ed6-955b-46c974e5ccc7","resolution":{"observed_at":"2026-08-06T20:08:07.404789Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.068607Z","title":"B io M istral: A collection of open-source pretrained large language models for medical domains","venue":null,"work_id":"afb89b9f-4633-45a6-82e1-1915fb796c35","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.480577Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:5ac34b5cdacec2231b1dd6d9f50d854585c9728ff8d89e86601fd7cdc7aa7d1b","observation_id":"d0c73403-f92f-4756-93ab-f13daf0b7375","resolution":{"observed_at":"2026-08-06T20:08:11.071971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16747","last_updated":"2024-06-24T15:55:59Z","snapshot_observed_at":"2026-08-12T23:35:59.371821Z","submitted_at":"2024-06-24T15:55:59Z","title":"Sparser is Faster and Less is More: Efficient Sparse Attention for Long-Range Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16747","snapshot_observed_at":"2026-08-06T20:08:07.633297Z","title":"Sparser is faster and less is more: Efficient sparse attention for long-range transformers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.633297Z"},"links":{"cited_paper":"/paper/2406.16747","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:68458bdcfca8169fe39d285d339a0eeed0e7563060b7f879f449e9315d74d856","observation_id":"00e02adc-9716-4445-82a2-57fffb6784c8","resolution":{"observed_at":"2026-08-06T20:08:07.633297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-14T01:18:55.206280Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-06T20:08:07.685132Z","title":"Shortgpt: Layers in large language models are more redundant than you expect","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.685132Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:358dd66e6af8266da8505d729edf44e4eb679ee42fa1bdde18a8d3b93e11b20f","observation_id":"ebc7bd35-3c72-41ea-8248-cfa28d1b62d4","resolution":{"observed_at":"2026-08-06T20:08:07.685132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.057931Z","title":"Pointer sentinel mixture models","venue":null,"work_id":"93c1e2b1-b424-47ed-8f00-bb37fb8c55bf","year":2022},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.752189Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:208451dda534bebbdd4de63c327d12515633d54cc2ba2ddd871fd757f3273404","observation_id":"b5ce3c25-d6bf-44cd-8c55-7a4c02fc4a5f","resolution":{"observed_at":"2026-08-06T20:08:11.061210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.046577Z","title":"Using an llm to help with code understanding","venue":null,"work_id":"1f2ba12d-6ba0-49b8-ac0b-30b75558fd86","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.806617Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:72f538fe2bda0746d11199de9808180429d14d2d9097f4028004ed3186729843","observation_id":"7e696759-321d-482e-a7b2-db9808987c1a","resolution":{"observed_at":"2026-08-06T20:08:11.050576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:07.846759Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.846759Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:70197dd30710464d2f48c9702af765d17bc38a879f3da1281347e91a0559ae56","observation_id":"e3f9296e-de56-4039-9696-d66615f753ec","resolution":{"observed_at":"2026-08-06T20:08:07.846759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02258","last_updated":"2024-04-02T19:28:11Z","snapshot_observed_at":"2026-08-13T18:31:52.318837Z","submitted_at":"2024-04-02T19:28:11Z","title":"Mixture-of-Depths: Dynamically allocating compute in transformer-based language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02258","snapshot_observed_at":"2026-08-06T20:08:07.957269Z","title":"C., and Santoro, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.957269Z"},"links":{"cited_paper":"/paper/2404.02258","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:3e67f4fc40f3058f0ed551c19b2d0f3f19cd1f7e65675789ed39e8509aa4c4d6","observation_id":"57f4bdd9-3066-46f7-b105-9bcddaf9047a","resolution":{"observed_at":"2026-08-06T20:08:07.957269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:07.997272Z","title":"L., Bhagavatula, C., and Choi, Y","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:07.997272Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:86ef400c66d490f57fe53bea2003f77f76b204d72e10a2e2e4d7b0655c37edc1","observation_id":"e5224ed9-8b43-4c75-ac39-c02ce6f43d03","resolution":{"observed_at":"2026-08-06T20:08:07.997272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:11.024373Z","title":"Q., Tay, Y., and Metzler, D","venue":null,"work_id":"3c5f98db-c544-4877-9de0-b015ae02fa72","year":2022},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.188012Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:1b62e79fd4ee0bb12e84ae114465e49138b063f96c7942f9645eccf323dcc085","observation_id":"67011f70-86fa-4438-b248-fe500a267bcb","resolution":{"observed_at":"2026-08-06T20:08:11.027343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.16286","last_updated":"2024-07-23T08:40:27Z","snapshot_observed_at":"2026-08-12T23:16:38.789613Z","submitted_at":"2024-07-23T08:40:27Z","title":"A deeper look at depth pruning of LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.16286","snapshot_observed_at":"2026-08-06T20:08:08.244465Z","title":"A., Dong, X., Heinrich, G., Breuel, T., Kautz, J., Krueger, D., and Molchanov, P","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.244465Z"},"links":{"cited_paper":"/paper/2407.16286","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:9cad13f9df98d593c21c05b220260f16c273a46c81a889120a08b34edeb11bcc","observation_id":"06e44b8d-493f-4b07-9890-2f66f876fd32","resolution":{"observed_at":"2026-08-06T20:08:08.244465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12016","last_updated":"2024-10-04T06:26:20Z","snapshot_observed_at":"2026-08-14T14:26:17.846467Z","submitted_at":"2024-06-17T18:33:44Z","title":"Prefixing Attention Sinks can Mitigate Activation Outliers for Large Language Model Quantization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12016","snapshot_observed_at":"2026-08-06T20:08:08.298473Z","title":"Prefixing attention sinks can mitigate activation outliers for large language model quantization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.298473Z"},"links":{"cited_paper":"/paper/2406.12016","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:d133f14352fff50bc7477aab16802766efe03b4c47cad5696c0ab07636b60f59","observation_id":"e2bb6b72-cc2a-47c0-9b84-e450ce09f459","resolution":{"observed_at":"2026-08-06T20:08:08.298473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.912591Z","title":"Sleb: Streamlining llms through redundancy verification and elimination of transformer blocks","venue":null,"work_id":"33eeafc7-fa1e-4e9b-bf2f-f7b9e996bb5b","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.393078Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:72b173e192076f4f1115fb5de4cab081d3a98cad42b933dfacd9943901b1e239","observation_id":"32042cfd-8cb9-4108-b8ba-e4bf8c82d96f","resolution":{"observed_at":"2026-08-06T20:08:10.915706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.902993Z","title":"Z., and Liu, Z","venue":null,"work_id":"fa6d734d-b568-45bf-a7dc-8a48e269ffc3","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.446045Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:aa17fcaa55ab1f042dfbce89e0b868c1aa17aaf8d9e45d09302d6e5e7f66a35f","observation_id":"c8970a42-2ccc-4f37-8dd1-ff8b0dd3fc6e","resolution":{"observed_at":"2026-08-06T20:08:10.906428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.868281Z","title":"Razorattention: Efficient kv cache compression through retrieval heads","venue":null,"work_id":"26b1bc50-cb7f-40f1-91ff-055d89be491a","year":2025},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.512199Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:5b47f895db7331e1cd264f616fa437baa5c70190dff9860cd39d12605b9cc712","observation_id":"6fc4520c-285e-49a0-b59a-02cabd591125","resolution":{"observed_at":"2026-08-06T20:08:10.896623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.649259Z","title":"J., Ting, D","venue":null,"work_id":"e6c1f989-7b37-4706-a9b9-5f7285ddd6b0","year":1930},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.610825Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:9243c13c73ff8811783e66c678d01cb6222940c2933cf7d14c58f1a5ea593e19","observation_id":"3846996a-fad5-4ef1-9520-6dc86ad22fcc","resolution":{"observed_at":"2026-08-06T20:08:10.740169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-06T20:08:08.722523Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.722523Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:b385e0f46e1681d3f768dfc7c25d35e5169f99dc0283f604c875bbcd1912aa8e","observation_id":"4533b7cf-cd02-4b68-9921-77c3bb68dc7f","resolution":{"observed_at":"2026-08-06T20:08:08.722523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17564","last_updated":"2023-12-21T06:21:11Z","snapshot_observed_at":"2026-08-14T12:54:48.492396Z","submitted_at":"2023-03-30T17:30:36Z","title":"BloombergGPT: A Large Language Model for Finance","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17564","snapshot_observed_at":"2026-08-06T20:08:08.837488Z","title":"Bloomberggpt: A large language model for finance","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.837488Z"},"links":{"cited_paper":"/paper/2303.17564","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:b7b371ab77daf446f15f068857829d0e0b7216103f439a51827607da16475d5e","observation_id":"bd2fa558-17d1-4cef-9907-f074a86bf813","resolution":{"observed_at":"2026-08-06T20:08:08.837488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.472968Z","title":"T., Peng, R., Wu, Q., and Wang, C","venue":null,"work_id":"c3a2ef19-9c33-4419-8abb-b1f8ff4b720d","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:08.895926Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:843dd006d6a27fedf63d040f205410ab4f71f878cd7b33cb0b6f91ba6e010ead","observation_id":"2877ea30-5aea-4eb7-8810-eddfceecbbbc","resolution":{"observed_at":"2026-08-06T20:08:10.551322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.285719Z","title":"Duoattention: Efficient long-context llm inference with retrieval and streaming heads","venue":null,"work_id":"e555d158-9021-4b4b-a681-882688d518b3","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:09.003068Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:858a7f1ef4fa6755575c17d4c562b5364994e4fb04809ad9bf0701684e61e903","observation_id":"13964cca-0020-4437-8b2f-7895d5678333","resolution":{"observed_at":"2026-08-06T20:08:10.339924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:10.129247Z","title":"Efficient streaming language models with attention sinks","venue":null,"work_id":"63a177a5-6036-4343-bbdd-3b0dd95335b8","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:09.106850Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:5407de4d269e9776a739c83741d1877dfc3a17bf487db4746d28e68d9251639d","observation_id":"8527fb09-f508-40c1-a700-609a7a9bc288","resolution":{"observed_at":"2026-08-06T20:08:10.169486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:09.965158Z","title":null,"venue":null,"work_id":"7bc3c3c6-d472-4940-b8c6-7657d7b42fb8","year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:09.248931Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:32cfeba52b070be4ade484fd43d60af332ce6bb43538b91ccf35338f56da1837","observation_id":"3ee6e21e-26f5-49f1-a821-95061880a634","resolution":{"observed_at":"2026-08-06T20:08:10.029542Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:08:09.729193Z","title":"Hellaswag: Can a machine really finish your sentence? In Proceedings of the 57th Annual Meeting of the Association for Computational Linguistics, pp.\\ 4791--4800, 2019","venue":null,"work_id":"606dbf5b-2b16-48a9-964d-ca3a203156ab","year":2019},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:09.372102Z"},"links":{"citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:fa64d7bdb9e0898a1954ae5030c3bac2085a9d241040bfb85ed8a36d7abf0055","observation_id":"7f2a254e-64b3-4b64-a42b-e0c7054921df","resolution":{"observed_at":"2026-08-06T20:08:09.806985Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02069","last_updated":"2025-05-15T17:18:12Z","snapshot_observed_at":"2026-08-13T04:39:30.300015Z","submitted_at":"2024-06-04T07:51:30Z","title":"PyramidKV: Dynamic KV Cache Compression based on Pyramidal Information Funneling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.02069","snapshot_observed_at":"2026-08-06T20:08:09.488803Z","title":"Pyramidkv: Dynamic kv cache compression based on pyramidal information funneling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-06T20:08:09.488803Z"},"links":{"cited_paper":"/paper/2406.02069","citing_paper":"/paper/2507.03865"},"observation_digest":"sha256:e806ed01966b471f6e606394f7278e31c492616cd73a4864eff11df4207a1afb","observation_id":"ae04f335-09c4-4713-9b2e-f61df35db73e","resolution":{"observed_at":"2026-08-06T20:08:09.488803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.03865","last_updated":"2025-08-16T11:42:58Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T18:32:34.942731Z","submitted_at":"2025-07-05T02:29:23Z","title":"OrthoRank: Token Selection via Sink Token Orthogonality for Efficient LLM inference"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 5 inbound Pith citation observations for arXiv:2507.03865."}