{"as_of":"2026-08-13T09:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:47782914f1689ea53f246b1a7e8d5867c851cd7ef2832b771a313e7f2e5947ab","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T10:34:25.096818Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":1,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14408","last_updated":"2024-10-06T02:17:26Z","snapshot_observed_at":"2026-08-13T00:24:25.606313Z","submitted_at":"2024-04-22T17:59:29Z","title":"SpaceByte: Towards Deleting Tokenization from Large Language Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14408","snapshot_observed_at":"2026-08-12T10:34:25.096818Z","title":"https://arxiv.org/abs/2404.14408","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.00129","last_updated":"2024-12-10T01:46:31Z","snapshot_observed_at":"2026-08-12T14:34:12.557174Z","submitted_at":"2024-11-28T13:32:56Z","title":"Scaling Particle Collision Data Analysis","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-12T10:34:25.096818Z"},"links":{"cited_paper":"/paper/2404.14408","citing_paper":"/paper/2412.00129"},"observation_digest":"sha256:ac3279ae75efee81c90874b61d813c40db7d8e45201463a127bde784531e67df","observation_id":"b3334554-7d80-4443-b3b7-545eb329cb6d","resolution":{"observed_at":"2026-08-12T10:34:25.096818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14408","last_updated":"2024-10-06T02:17:26Z","snapshot_observed_at":"2026-08-13T00:24:25.606313Z","submitted_at":"2024-04-22T17:59:29Z","title":"SpaceByte: Towards Deleting Tokenization from Large Language Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14408","snapshot_observed_at":"2026-08-10T19:16:20.735877Z","title":"Spacebyte: Towards deleting tokenization from large language modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.10322","last_updated":"2025-01-20T09:33:21Z","snapshot_observed_at":"2026-08-13T00:11:39.062605Z","submitted_at":"2025-01-17T17:51:53Z","title":"Hierarchical Autoregressive Transformers: Combining Byte- and Word-Level Processing for Robust, Adaptable Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-10T19:16:20.735877Z"},"links":{"cited_paper":"/paper/2404.14408","citing_paper":"/paper/2501.10322"},"observation_digest":"sha256:856bf9db087c3eb4e26eca124bd65b063aa5107604ab835769e3e80a84f527f8","observation_id":"20926a3b-0f62-45e6-a6f7-e97a45f61b93","resolution":{"observed_at":"2026-08-10T19:16:20.735877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14408","last_updated":"2024-10-06T02:17:26Z","snapshot_observed_at":"2026-08-13T00:24:25.606313Z","submitted_at":"2024-04-22T17:59:29Z","title":"SpaceByte: Towards Deleting Tokenization from Large Language Modeling","version":3},"cited_work":{"arxiv_id":"2404.14408","doi":"10.48550/arxiv.2404.14408","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.14408","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"13 Proxy Compression for Language Modeling Schuster, M","venue":"arXiv (Cornell University)","work_id":"715a6308-8e7f-4a22-b536-7695e6432ff0","year":2012},"citing_paper":{"arxiv_id":"2602.04289","last_updated":"2026-05-14T17:33:56Z","snapshot_observed_at":"2026-08-11T02:55:58.869095Z","submitted_at":"2026-02-04T07:36:46Z","title":"Proxy Compression for Language Modeling","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T08:03:01.274736Z"},"links":{"cited_paper":"/paper/2404.14408","citing_paper":"/paper/2602.04289"},"observation_digest":"sha256:8b37604d710b8e073e0bf212a24aa9545f6ac30275d8644e07831cf1bafe42e4","observation_id":"04106b73-b51d-4e87-be74-b397c1296efb","resolution":{"observed_at":"2026-05-16T08:07:34.319555Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14408","last_updated":"2024-10-06T02:17:26Z","snapshot_observed_at":"2026-08-13T00:24:25.606313Z","submitted_at":"2024-04-22T17:59:29Z","title":"SpaceByte: Towards Deleting Tokenization from Large Language Modeling","version":3},"cited_work":{"arxiv_id":"2404.14408","doi":"10.48550/arxiv.2404.14408","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.14408","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"13 Proxy Compression for Language Modeling Schuster, M","venue":"arXiv (Cornell University)","work_id":"715a6308-8e7f-4a22-b536-7695e6432ff0","year":2012},"citing_paper":{"arxiv_id":"2605.09630","last_updated":"2026-05-10T16:18:22Z","snapshot_observed_at":"2026-07-31T18:27:32.630942Z","submitted_at":"2026-05-10T16:18:22Z","title":"Scratchpad Patching: Decoupling Compute from Patch Size in Byte-Level Language Models","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-05-12T04:05:28.713898Z"},"links":{"cited_paper":"/paper/2404.14408","citing_paper":"/paper/2605.09630"},"observation_digest":"sha256:348d95b137276a55a14f47401251d8c3e9f68fde74ad2101d0ea3aae0722d1be","observation_id":"9b5ee4b2-cd9a-4ea0-b7ab-431894f91dc0","resolution":{"observed_at":"2026-05-12T06:36:29.090174Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14408","last_updated":"2024-10-06T02:17:26Z","snapshot_observed_at":"2026-08-13T00:24:25.606313Z","submitted_at":"2024-04-22T17:59:29Z","title":"SpaceByte: Towards Deleting Tokenization from Large Language Modeling","version":3},"cited_work":{"arxiv_id":"2404.14408","doi":"10.48550/arxiv.2404.14408","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.14408","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"13 Proxy Compression for Language Modeling Schuster, M","venue":"arXiv (Cornell University)","work_id":"715a6308-8e7f-4a22-b536-7695e6432ff0","year":2012},"citing_paper":{"arxiv_id":"2605.19632","last_updated":"2026-05-19T10:15:58Z","snapshot_observed_at":"2026-07-06T23:30:21.283826Z","submitted_at":"2026-05-19T10:15:58Z","title":"Executable Boundary Contracts for Sound Event Traces","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T02:08:44.066554Z"},"links":{"cited_paper":"/paper/2404.14408","citing_paper":"/paper/2605.19632"},"observation_digest":"sha256:fefa4298c66a82a03dac95dced8d172e63107e710fe600a076e6ad4e646d9c88","observation_id":"2a577dcb-4248-4749-871e-83fd2c2b535f","resolution":{"observed_at":"2026-05-20T02:12:58.499213Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14408","last_updated":"2024-10-06T02:17:26Z","snapshot_observed_at":"2026-08-13T00:24:25.606313Z","submitted_at":"2024-04-22T17:59:29Z","title":"SpaceByte: Towards Deleting Tokenization from Large Language Modeling","version":3},"cited_work":{"arxiv_id":"2404.14408","doi":"10.48550/arxiv.2404.14408","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.14408","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"13 Proxy Compression for Language Modeling Schuster, M","venue":"arXiv (Cornell University)","work_id":"715a6308-8e7f-4a22-b536-7695e6432ff0","year":2012},"citing_paper":{"arxiv_id":"2606.04552","last_updated":"2026-08-04T19:23:40Z","snapshot_observed_at":"2026-08-09T18:20:54.257903Z","submitted_at":"2026-06-03T07:38:17Z","title":"LDARNet: DNA Adaptive Representation Network with Learnable Tokenization for Genomic Modeling","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T06:17:32.321128Z"},"links":{"cited_paper":"/paper/2404.14408","citing_paper":"/paper/2606.04552"},"observation_digest":"sha256:524c7cb5ad53e7e78ccb7d813155f49190f376d70905235bca26dc12ba163bc5","observation_id":"1416a71c-459a-4bf8-b512-e70fb4a9f6c1","resolution":{"observed_at":"2026-07-02T08:16:47.446678Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14408","last_updated":"2024-10-06T02:17:26Z","snapshot_observed_at":"2026-08-13T00:24:25.606313Z","submitted_at":"2024-04-22T17:59:29Z","title":"SpaceByte: Towards Deleting Tokenization from Large Language Modeling","version":3},"cited_work":{"arxiv_id":"2404.14408","doi":"10.48550/arxiv.2404.14408","metadata_source":"arxiv_reference","pith_arxiv_id":"2404.14408","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"13 Proxy Compression for Language Modeling Schuster, M","venue":"arXiv (Cornell University)","work_id":"715a6308-8e7f-4a22-b536-7695e6432ff0","year":2012},"citing_paper":{"arxiv_id":"2606.11219","last_updated":"2026-05-11T20:27:40Z","snapshot_observed_at":"2026-08-05T20:46:41.277498Z","submitted_at":"2026-05-11T20:27:40Z","title":"Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-30T22:11:44.891731Z"},"links":{"cited_paper":"/paper/2404.14408","citing_paper":"/paper/2606.11219"},"observation_digest":"sha256:d617dc3e7975d40f46fcf85b6c1b96ebae0e53df1edb0e65d5974c0b0f5edebe","observation_id":"481b2f69-ab12-4031-9a5b-988493d12183","resolution":{"observed_at":"2026-06-30T22:15:05.673529Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2404.14408/citation-record","integrity":"/paper/2404.14408/integrity","json":"/paper/2404.14408/citation-record.json","paper":"/paper/2404.14408"},"outbound":[],"paper":{"arxiv_id":"2404.14408","last_updated":"2024-10-06T02:17:26Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T00:24:25.606313Z","submitted_at":"2024-04-22T17:59:29Z","title":"SpaceByte: Towards Deleting Tokenization from Large Language Modeling"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2404.14408."}