{"as_of":"2026-08-10T03:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:fc11bfae12f4be9142e7cd01a1640b66739a2652baa9a34735ceefdab9b1cbcd","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:18:52.046720Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.00715/citation-record","integrity":"/paper/2507.00715/integrity","json":"/paper/2507.00715/citation-record.json","paper":"/paper/2507.00715"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:59.563295Z","title":null,"venue":null,"work_id":"2f6424f8-9821-471d-ad4c-8e776babae06","year":null},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:46.480311Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:78b50ddc93db23598ad176e7fbb905bd41ac1daf8a56d60478d6896fdfb5f420","observation_id":"9c1f1b34-6736-4b6d-a8ca-b6e53b224fc8","resolution":{"observed_at":"2026-08-06T21:18:59.714397Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.12094","last_updated":"2025-06-02T11:46:43Z","snapshot_observed_at":"2026-08-09T14:13:36.616554Z","submitted_at":"2024-12-16T18:58:57Z","title":"SepLLM: Accelerate Large Language Models by Compressing One Segment into One Separator","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.12094","snapshot_observed_at":"2026-08-06T21:18:46.625475Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:46.625475Z"},"links":{"cited_paper":"/paper/2412.12094","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:2548613d217cac9869459e87596f83fc296220e39f8f7964645835c9b4912889","observation_id":"1a8464b1-0285-4290-bf96-5dec339b3a40","resolution":{"observed_at":"2026-08-06T21:18:46.625475Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:59.120403Z","title":null,"venue":null,"work_id":"ef398049-fe8e-46c3-9702-56176c3f297e","year":2023},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:46.695727Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:f19eb0f1fc6adb696d814988796af4631a2f604147c9b7da51825341d2c1c30a","observation_id":"79487b53-7732-4be6-90be-df2255d3811a","resolution":{"observed_at":"2026-08-06T21:18:59.211330Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:46.763797Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:46.763797Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:7d50acbdd744dfdf3799fd5bcd1af916e31eccfff47b5623c995c3802a66d954","observation_id":"d6702077-e6dd-43a5-b6d5-62ed83fd2ccc","resolution":{"observed_at":"2026-08-06T21:18:46.763797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02690","last_updated":"2025-02-12T14:32:46Z","snapshot_observed_at":"2026-08-09T12:41:39.057624Z","submitted_at":"2024-04-03T12:37:34Z","title":"How Sparse Attention Approximates Exact Attention? Your Attention is Naturally $n^C$-Sparse","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02690","snapshot_observed_at":"2026-08-06T21:18:46.851223Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:46.851223Z"},"links":{"cited_paper":"/paper/2404.02690","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:b9fe855d43847de6b3a94f099a27e11e791bba48f223e37e8284e2915b0c8791","observation_id":"a6c6c0d2-b311-4656-a2ea-ccd32cfdedfb","resolution":{"observed_at":"2026-08-06T21:18:46.851223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:58.864720Z","title":null,"venue":null,"work_id":"3446906d-2e06-4dea-abd3-b39edcd730fc","year":2021},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:46.920282Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:29e2d25e38540805547a1734fb214ddb421ad5c20278789f63e94f4544e17584","observation_id":"913686f9-e102-4570-b798-06ff3ff395fb","resolution":{"observed_at":"2026-08-06T21:18:58.980560Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:58.598254Z","title":null,"venue":null,"work_id":"d3a35835-1285-4e24-90c9-e7b936a10aa0","year":2025},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:46.975302Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:71adf98ffeebb069decaaf5c17848888e136513303196f45c61b12872d37dcc6","observation_id":"56c15fe0-2fd0-4f3a-b9df-99ee0caa6978","resolution":{"observed_at":"2026-08-06T21:18:58.701955Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:58.297884Z","title":null,"venue":null,"work_id":"f054a11f-7350-4142-987e-8694c49c828f","year":2021},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:47.074776Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:2962b36778134e865bd25ce92c0e145bce345f8a444bde005df9e59db5209500","observation_id":"64629e2f-9ef6-4fd7-bc95-58670d571ac0","resolution":{"observed_at":"2026-08-06T21:18:58.455365Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:58.034580Z","title":null,"venue":null,"work_id":"1e151911-f14b-409c-b54f-e323c68ef5ca","year":2023},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:47.148484Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:9058735046c7d432f753b477a0d9bc4d1720269d1b3e04c23f942b04e9a2b975","observation_id":"0712108a-b798-4e3a-b615-fcba217e1794","resolution":{"observed_at":"2026-08-06T21:18:58.148280Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:57.706181Z","title":null,"venue":null,"work_id":"a431035c-8365-454b-9fdc-31f05aebdd74","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:47.270371Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:ad3743251b4413ae6adee155c7e5e525ace3da32536170cd239ead0ba531dcd4","observation_id":"6ef8450d-9b44-4ecf-b4b7-8b01b96af8c6","resolution":{"observed_at":"2026-08-06T21:18:57.855295Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:57.459282Z","title":null,"venue":null,"work_id":"a0753e67-dea6-422b-b5c9-b489b3afacd6","year":2023},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:47.320647Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:2a429f35853a23d838e14d70213e8d70d6044dba765f8f84e2701cd91619543a","observation_id":"637279b7-e563-4739-8f87-f1809e99949a","resolution":{"observed_at":"2026-08-06T21:18:57.564629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:47.416604Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:47.416604Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:1f5bf011e1ee6d1d0f17f60ac19b4a3fb83aac9936d930c92947c8b28bf4b812","observation_id":"50e652ab-1763-4673-b493-24e9c021c980","resolution":{"observed_at":"2026-08-06T21:18:47.416604Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13795","last_updated":"2025-08-04T10:49:54Z","snapshot_observed_at":"2026-08-05T13:37:28.213031Z","submitted_at":"2024-12-18T12:39:53Z","title":"Mix-LN: Unleashing the Power of Deeper Layers by Combining Pre-LN and Post-LN","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13795","snapshot_observed_at":"2026-08-06T21:18:47.507878Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:47.507878Z"},"links":{"cited_paper":"/paper/2412.13795","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:c291bbe0c4d8fdba108f8f2567101ed97a5a8db64e5d67f20168a28c1a797810","observation_id":"0c3e22a9-0f0c-4540-bc49-1ae4682b283b","resolution":{"observed_at":"2026-08-06T21:18:47.507878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:57.173125Z","title":null,"venue":null,"work_id":"2f29c7e8-4ea6-4fe1-b1b6-7770222647ef","year":2023},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:47.610287Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:a40c61d34ee981bb840f8f4d238913ba924b0f6997d2494c2e9754a6f50d1dcb","observation_id":"3a390b25-378a-4c48-99d4-e1e9fe2c4739","resolution":{"observed_at":"2026-08-06T21:18:57.315186Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:56.858534Z","title":null,"venue":null,"work_id":"4e9246b9-5004-4855-9a1d-fbecb496b8f3","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:47.697798Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:f89f4a58f3845a77600f0a3c8c6248f848253c87f5ce8150622f7337d9e622ae","observation_id":"787729bc-7c45-4a18-87d0-da66b058daaa","resolution":{"observed_at":"2026-08-06T21:18:56.975472Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16924","last_updated":"2024-04-25T17:58:17Z","snapshot_observed_at":"2026-07-06T18:05:46.922400Z","submitted_at":"2024-04-25T17:58:17Z","title":"A Survey of Generative Search and Recommendation in the Era of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.16924","snapshot_observed_at":"2026-08-06T21:18:47.782126Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:47.782126Z"},"links":{"cited_paper":"/paper/2404.16924","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:eed696240e7f20302ebbed4e3c4b9f0160382cadf2171f566906a85951f6527f","observation_id":"289bf4b2-16c7-418a-a59f-fdc77918067c","resolution":{"observed_at":"2026-08-06T21:18:47.782126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:56.564128Z","title":null,"venue":null,"work_id":"82049c26-9877-4a09-99be-6b74f4d08dcd","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:47.864184Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:85ed6bf30bad4cfcf758fb8fc911785ac88d2d160a9e5b1cffb4aa0d0dcac2e6","observation_id":"d23a205d-1a46-451e-9707-6e3f6602df85","resolution":{"observed_at":"2026-08-06T21:18:56.750581Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03094","last_updated":"2024-08-06T10:51:47Z","snapshot_observed_at":"2026-08-04T13:00:13.158988Z","submitted_at":"2024-08-06T10:51:47Z","title":"500xCompressor: Generalized Prompt Compression for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03094","snapshot_observed_at":"2026-08-06T21:18:47.996132Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:47.996132Z"},"links":{"cited_paper":"/paper/2408.03094","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:d4e0520a3d9f2db3fc0246d48183a3c33cd6382aceae10a95898eb362fa25821","observation_id":"46aac62e-036f-4d87-bbd6-517cd2ffb69b","resolution":{"observed_at":"2026-08-06T21:18:47.996132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:48.100897Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:48.100897Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:dee400e0169d5958632226763bf3060e9b716d45a45fd3821198985380603bb2","observation_id":"4c1d1747-bbfa-441f-b9f7-220b57ccded7","resolution":{"observed_at":"2026-08-06T21:18:48.100897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:48.216716Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:48.216716Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:acc111d1bd3ac3832e46f256a128de2a64ed0a0dd7688f76375b79dca28d43e7","observation_id":"edbff09d-653f-4272-9191-2f623a39bd14","resolution":{"observed_at":"2026-08-06T21:18:48.216716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:48.343458Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:48.343458Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:6b5973b58c0176987a4557993aa1bed4f8b4f3d1ffcc4d55f32a28d3954fa68f","observation_id":"e5816601-0a29-45fa-a3e9-b91d8a079beb","resolution":{"observed_at":"2026-08-06T21:18:48.343458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:56.211186Z","title":null,"venue":null,"work_id":"1d4e4417-80b1-418d-a535-7ac76b9c34e8","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:48.614436Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:0f24de23bfc45b958e2e31a1768659eb5a818efbe202df36b94fe12956899e7a","observation_id":"eba5c056-42a4-4d3b-84c6-5d2c25056d07","resolution":{"observed_at":"2026-08-06T21:18:56.387895Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:55.927080Z","title":null,"venue":null,"work_id":"210b1ad7-fe5f-46c0-a9d2-903df301d5a2","year":2025},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:48.768559Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:769bbbc8dcf078f5d081f243adfa6685762af76213b64c897f2ac57ecc6d5541","observation_id":"fdc668d9-5858-473f-92aa-fc60df76245a","resolution":{"observed_at":"2026-08-06T21:18:56.041044Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:48.872582Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:48.872582Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:854c4ba82d584427a4ce4c4bb8f5c40fef58c6e5aafb668b944a2c5e025fd6f0","observation_id":"553a45b9-aa02-4586-9c61-8ef9746bea5c","resolution":{"observed_at":"2026-08-06T21:18:48.872582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:55.662710Z","title":null,"venue":null,"work_id":"dbb13588-7abe-4e0f-bc65-20071a140a34","year":2022},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:49.012109Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:7eb4cc43921514b15c7cf9a8ea92534af2c387df9a81c1e04be7c32d4d35c985","observation_id":"7f3104ee-f998-4654-bde0-03f06e705029","resolution":{"observed_at":"2026-08-06T21:18:55.766475Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:55.294016Z","title":null,"venue":null,"work_id":"fb9e3c20-e7fd-4249-8d1e-47aaf2746904","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:49.113584Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:112f22ce0b34b30e0b9bf361d4d01a49ca296174c3b8a7831626bb061564d690","observation_id":"e4fcbad4-d673-4000-8fff-eefe4dd3beb5","resolution":{"observed_at":"2026-08-06T21:18:55.463952Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:55.006642Z","title":null,"venue":null,"work_id":"7d1f8ade-8e05-423a-b97c-7336e8079ea7","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:49.239855Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:0aa566591c360d42277429a412165052f0c4da08681a5f68e7bdd9a96d6f5215","observation_id":"0cda245f-dc6b-4014-920b-a49ac7f02679","resolution":{"observed_at":"2026-08-06T21:18:55.107568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:49.391449Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:49.391449Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:05557918c71e912f71c91af052c96b7e9f524080d5a2679270dd0424c253cf7e","observation_id":"acd38938-78f1-447d-a7de-554ce4180510","resolution":{"observed_at":"2026-08-06T21:18:49.391449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:54.730174Z","title":null,"venue":null,"work_id":"a1ef3c28-1818-46c1-ab92-52ee9a2a097f","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:49.583360Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:a347e4119b38d2daed1ab24c0caabef3d12bd35c71df429b447d7ff8a77a9d64","observation_id":"1c8e6d41-af67-4062-8ef5-86e30467291a","resolution":{"observed_at":"2026-08-06T21:18:54.840313Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:54.467346Z","title":null,"venue":null,"work_id":"87561c3c-4c21-4212-b9fa-b00281aab431","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:49.760056Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:524a625d0f7385c92d75cd6b72c6d1fbba59b011e74a222aaa5e7e62652fcde5","observation_id":"44e9b58e-bb0c-4dba-a31d-2a44de4c1c21","resolution":{"observed_at":"2026-08-06T21:18:54.560959Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:49.893100Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:49.893100Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:9cb0f092bfd80b06f9caf39fed16bc74c38d2842fa6c335fb528df007229d68b","observation_id":"e6d96f81-86e5-4bb6-8551-429f8940218e","resolution":{"observed_at":"2026-08-06T21:18:49.893100Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17422","last_updated":"2024-09-25T23:14:47Z","snapshot_observed_at":"2026-08-08T15:17:09.772737Z","submitted_at":"2024-09-25T23:14:47Z","title":"Discovering the Gems in Early Layers: Accelerating Long-Context LLMs with 1000x Input Token Reduction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.17422","snapshot_observed_at":"2026-08-06T21:18:50.235479Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:50.235479Z"},"links":{"cited_paper":"/paper/2409.17422","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:ba2dfb7fd336f91c8ec6c3049c7f583952dcb64ec1781f4b20356c66d66ea521","observation_id":"88163e8c-8b7b-431e-85a9-a0678b69b679","resolution":{"observed_at":"2026-08-06T21:18:50.235479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00797","last_updated":"2024-10-15T12:37:40Z","snapshot_observed_at":"2026-07-06T17:10:32.750276Z","submitted_at":"2024-01-01T15:57:15Z","title":"Curriculum-scheduled Knowledge Distillation from Multiple Pre-trained Teachers for Multi-domain Sequential Recommendation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00797","snapshot_observed_at":"2026-08-06T21:18:50.372778Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:50.372778Z"},"links":{"cited_paper":"/paper/2401.00797","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:3482ff1b37af83cc223a989db8a683f8d348eb04fa64d7c51dec39e80b9a5cd0","observation_id":"35697fdd-a950-42da-8477-5d0e9e5fc4a3","resolution":{"observed_at":"2026-08-06T21:18:50.372778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:54.188979Z","title":null,"venue":null,"work_id":"1a35cdcc-2f37-4b22-a9e4-4898d7ff3be1","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:50.527849Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:8fac4f79d20da26f6525957373f3998a9704b7b4128fda5ade07448e2e95bfed","observation_id":"fde5e1b6-d902-408c-94e0-073d0dd3390a","resolution":{"observed_at":"2026-08-06T21:18:54.301472Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-06T21:18:50.658356Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:50.658356Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:d7ca8e757f8e22765fd12f7f81f51f94c283258bdfc5cf6f432bab0f15f54edf","observation_id":"338d1dd6-445e-4a5f-ae98-17b578271fdb","resolution":{"observed_at":"2026-08-06T21:18:50.658356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.03516","last_updated":"2024-02-25T17:56:29Z","snapshot_observed_at":"2026-08-09T21:15:23.871533Z","submitted_at":"2023-04-07T07:20:16Z","title":"Generative Recommendation: Towards Next-generation Recommender Paradigm","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.03516","snapshot_observed_at":"2026-08-06T21:18:50.758850Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:50.758850Z"},"links":{"cited_paper":"/paper/2304.03516","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:064968c1e9c50c83c538dceb57172e24fd6cea610169789b6efeedcf7c2a4363","observation_id":"65dd025a-db20-401d-ad23-34493aea22e1","resolution":{"observed_at":"2026-08-06T21:18:50.758850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:53.848382Z","title":null,"venue":null,"work_id":"60c8217d-ab04-4b29-b185-934d32b8fdea","year":null},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:50.919651Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:b05e124077a846b43f05cc1a41de769afe08005b34b894b064a681e56a6aefa8","observation_id":"b9d31e64-0e09-4bb1-b264-caa7b68f718c","resolution":{"observed_at":"2026-08-06T21:18:54.005508Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:51.202039Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:51.202039Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:3b9032bbde10ee0700359f17ca99182a45cec58a319abad715c59653b4932af7","observation_id":"ca938c6d-d0d9-493e-a2f7-ed6416de83a6","resolution":{"observed_at":"2026-08-06T21:18:51.202039Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05676","last_updated":"2025-04-29T08:43:15Z","snapshot_observed_at":"2026-07-06T18:59:16.978029Z","submitted_at":"2024-08-11T02:31:13Z","title":"Efficiency Unleashed: Inference Acceleration for LLM-based Recommender Systems with Speculative Decoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05676","snapshot_observed_at":"2026-08-06T21:18:51.342589Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:51.342589Z"},"links":{"cited_paper":"/paper/2408.05676","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:00c3240bb82a03aa1390e205028864e05311c40c87db070b9bcdafb33f144fe8","observation_id":"94cc61ca-0653-49eb-8f7f-f613f3745899","resolution":{"observed_at":"2026-08-06T21:18:51.342589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:53.271574Z","title":null,"venue":null,"work_id":"832790eb-7c16-4b8c-9cb1-e506de5a782b","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:51.496852Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:acacf5f635961162b31b29f669e89a444e6c60ec2460fb71b17ffc57ee248cbd","observation_id":"7bd0c9ee-a73a-4307-b0d1-6019347caa8e","resolution":{"observed_at":"2026-08-06T21:18:53.439242Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:53.579149Z","title":null,"venue":null,"work_id":"03eeeabf-da34-4193-aad0-f20171be086b","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:51.039796Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:28c6d9cf950bc8e951d09ad319e2471cb2b7d07bc7395378f34d7e950f38d744","observation_id":"28136167-9563-4ca7-bd95-b15bbc4a66cd","resolution":{"observed_at":"2026-08-06T21:18:53.712231Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:52.788921Z","title":null,"venue":null,"work_id":"00e9b225-22cc-4118-9cd4-cd36166035a7","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:51.791316Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:dd0cf52b85290f91e1bbdbd5fd07b74d2af156a6432e3db05a16efe36282acda","observation_id":"64ebaffb-f933-4c27-8ba4-1d7cc4a11e56","resolution":{"observed_at":"2026-08-06T21:18:52.908614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:52.473958Z","title":null,"venue":null,"work_id":"0fc2abec-78d4-4977-b098-a3414f9d42e5","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:51.900300Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:6b9c6011937a716fcd2362ada935fcab7bc3d372cbf7c3f81ce8eaa09cd01148","observation_id":"e6bd8cfb-340b-457c-9b98-5da3750b596a","resolution":{"observed_at":"2026-08-06T21:18:52.617154Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14294","last_updated":"2024-07-19T04:47:36Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T15:53:08Z","title":"A Survey on Efficient Inference for Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14294","snapshot_observed_at":"2026-08-06T21:18:52.046720Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:52.046720Z"},"links":{"cited_paper":"/paper/2404.14294","citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:86c451aaa5ce64f68889358419d5faf125a225ff1eb6a44fa2b632acf120238d","observation_id":"6848702b-d96e-4489-8539-7831c70e0f67","resolution":{"observed_at":"2026-08-06T21:18:52.046720Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:53.042993Z","title":null,"venue":null,"work_id":"b257b3c8-0eab-44f0-bafc-b7343da122dd","year":2024},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:51.680549Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:458da128ab1d4ef3531003ca23fc13abd9b4d937bb6bda7a09bfbdc30037a0c8","observation_id":"27fa6d3d-69c8-4d2c-9354-1951e90f296b","resolution":{"observed_at":"2026-08-06T21:18:53.159664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:59.312925Z","title":null,"venue":null,"work_id":"43d6d5e3-c9ac-40f7-bb7d-df2c0c76dab0","year":2021},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:46.546252Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:4f2c0d47006d9dbc3f97ae19c98675b298fa2d64821fd67c24bbe7ba3b6d1d7d","observation_id":"b5883e76-d3c4-4dc0-a2e3-e124f5c14c5b","resolution":{"observed_at":"2026-08-06T21:18:59.440376Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:50.080800Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:50.080800Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:40399877763aed83e82fb30dbed1ea3f0d7164c392ba0d7fcab714e9209c8837","observation_id":"abd586e4-cd1c-4373-b938-39826230d662","resolution":{"observed_at":"2026-08-06T21:18:50.080800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:18:48.454346Z","title":"InProceedings of the 30th ACM SIGKDD Conference on Knowledge Discovery and Data Mining","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T21:18:48.454346Z"},"links":{"citing_paper":"/paper/2507.00715"},"observation_digest":"sha256:147a953841f2398d9ec8091dc630107e6bb8d96d5213ea9f12c583e429654af4","observation_id":"ab2a3584-f452-4e3b-8abc-3159a2f9cb43","resolution":{"observed_at":"2026-08-06T21:18:48.454346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.00715","last_updated":"2025-07-01T12:42:06Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-06T21:06:27.845057Z","submitted_at":"2025-07-01T12:42:06Z","title":"EARN: Efficient Inference Acceleration for LLM-based Generative Recommendation by Register Tokens"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2507.00715."}