{"as_of":"2026-08-09T11:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0cc2226c4c425afe3ac197656803cef98d0af55bb688cb6d5fde1d639ac21f8f","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T05:40:37.883484Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2602.01807/citation-record","integrity":"/paper/2602.01807/integrity","json":"/paper/2602.01807/citation-record.json","paper":"/paper/2602.01807"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-03T05:40:35.675422Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:35.675422Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:e2498f945099c7503e53475cd5d9f676651a56fedbbf9db07261794fa9661a17","observation_id":"8214fd7d-cbad-4ef5-b321-25fb8c840b63","resolution":{"observed_at":"2026-08-03T05:40:35.675422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:40:37.883484Z","title":null,"venue":null,"work_id":null,"year":2048},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.883484Z"},"links":{"citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:af22440c25ba3414d3527a7b6e098468720153838a81585b11b1523b392992b8","observation_id":"9d2f3c93-d0e0-44ab-ac7c-bdc22f37a6f9","resolution":{"observed_at":"2026-08-03T05:40:37.883484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.3005","last_updated":"2014-03-04T18:30:26Z","snapshot_observed_at":"2026-08-05T11:04:54.095339Z","submitted_at":"2013-12-11T00:25:57Z","title":"One Billion Word Benchmark for Measuring Progress in Statistical Language Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.3005","snapshot_observed_at":"2026-08-03T05:40:35.923719Z","title":"One billion word benchmark for measuring progress in statistical language modeling","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:35.923719Z"},"links":{"cited_paper":"/paper/1312.3005","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:74417f02a908ebc5f8a5302217ac5ee01798c0cf0bbe3c6e8acc1103f31ea47e","observation_id":"fbb00792-47c9-4bdf-b6fe-5ff89395acea","resolution":{"observed_at":"2026-08-03T05:40:35.923719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:40:36.299268Z","title":"Empowering diffusion models on the embedding space for text generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.299268Z"},"links":{"citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:178a63743320262e175eeff9b66f5ffbcfe67b8eff5d4573fd984e7af07cafd9","observation_id":"ce45871b-0dc8-4944-8fba-8ea58955df84","resolution":{"observed_at":"2026-08-03T05:40:36.299268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.02281","last_updated":"2018-03-09T03:37:52Z","snapshot_observed_at":"2026-08-05T03:59:33.681648Z","submitted_at":"2017-11-07T04:42:48Z","title":"Non-Autoregressive Neural Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.02281","snapshot_observed_at":"2026-08-03T05:40:36.544273Z","title":"O., and Socher, R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.544273Z"},"links":{"cited_paper":"/paper/1711.02281","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:61422f38ef1f78fef293cb4d41151604e10a5f480d9d9796a0a302a280875fab","observation_id":"5122e548-69d6-40f0-9968-5a937c79a09e","resolution":{"observed_at":"2026-08-03T05:40:36.544273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.03295","last_updated":"2024-09-05T07:03:23Z","snapshot_observed_at":"2026-08-07T04:02:06.712022Z","submitted_at":"2024-09-05T07:03:23Z","title":"N-gram Prediction and Word Difference Representations for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.03295","snapshot_observed_at":"2026-08-03T05:40:36.715820Z","title":"N., and Choi, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.715820Z"},"links":{"cited_paper":"/paper/2409.03295","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:e2f68e3bd84d71a0cbe1e3c913975276602ecd9c68a15288ce40d4ca02824087","observation_id":"2f88a959-929d-45fc-a393-9960f5a4d472","resolution":{"observed_at":"2026-08-03T05:40:36.715820Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.01144","last_updated":"2017-08-05T22:45:19Z","snapshot_observed_at":"2026-08-01T18:34:23.156273Z","submitted_at":"2016-11-03T19:48:08Z","title":"Categorical Reparameterization with Gumbel-Softmax","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.01144","snapshot_observed_at":"2026-08-03T05:40:36.899208Z","title":"Categorical repa- rameterization with gumbel-softmax.arXiv preprint arXiv:1611.01144,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.899208Z"},"links":{"cited_paper":"/paper/1611.01144","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:7759754f4f521f1f95160f2089e560bea529a3535ac5fbd2b4b23d98de71cb5b","observation_id":"9db113df-c1c5-49e7-b533-666694f3843d","resolution":{"observed_at":"2026-08-03T05:40:36.899208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:40:36.943528Z","title":"and Rush, A","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.943528Z"},"links":{"citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:297e1577b6a0e19644295c19c9ac76b8f4a59688593cbf238849620575f61ef2","observation_id":"af717510-ccbe-447a-8b39-d28dcc3cfb41","resolution":{"observed_at":"2026-08-03T05:40:36.943528Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.06901","last_updated":"2018-08-27T18:00:08Z","snapshot_observed_at":"2026-07-06T06:24:15.593553Z","submitted_at":"2018-02-19T22:57:54Z","title":"Deterministic Non-Autoregressive Neural Sequence Modeling by Iterative Refinement","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.06901","snapshot_observed_at":"2026-08-03T05:40:37.069510Z","title":"Deterministic non- autoregressive neural sequence modeling by iterative re- finement.arXiv preprint arXiv:1802.06901,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.069510Z"},"links":{"cited_paper":"/paper/1802.06901","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:df17d3ac27ce7bfa037881d693b0a10dced68661e3c265761f3d49b18ea8c0af","observation_id":"b47102b2-ebb6-42c2-a5a8-b70ab49f11c3","resolution":{"observed_at":"2026-08-03T05:40:37.069510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22165","last_updated":"2025-05-28T09:28:52Z","snapshot_observed_at":"2026-08-07T13:11:11.633424Z","submitted_at":"2025-05-28T09:28:52Z","title":"Unifying Continuous and Discrete Text Diffusion with Non-simultaneous Diffusion Processes","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22165","snapshot_observed_at":"2026-08-03T05:40:37.143840Z","title":"Unifying continuous and discrete text diffusion with non-simultaneous diffusion processes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.143840Z"},"links":{"cited_paper":"/paper/2505.22165","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:0ff4ffc3c3918619d351fe50156740e65b4ac1f264d26f009e3fa59132d3f57b","observation_id":"f6980421-355b-4607-8b52-ab5b1d0d945e","resolution":{"observed_at":"2026-08-03T05:40:37.143840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.07885","last_updated":"2020-01-24T04:42:13Z","snapshot_observed_at":"2026-08-01T16:37:37.627374Z","submitted_at":"2020-01-22T05:34:45Z","title":"Normalization of Input-output Shared Embeddings in Text Generation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.07885","snapshot_observed_at":"2026-08-03T05:40:37.204751Z","title":"Normalization of input-output shared embeddings in text generation models.arXiv preprint arXiv:2001.07885,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.204751Z"},"links":{"cited_paper":"/paper/2001.07885","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:89eda423f93c8f5f05df899dc512da9fad9decd9fe349379afdd511e29a6e5c9","observation_id":"50693c75-dca1-48f7-8229-f50ab71ed1dd","resolution":{"observed_at":"2026-08-03T05:40:37.204751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.07843","last_updated":"2016-09-26T04:06:13Z","snapshot_observed_at":"2026-07-06T05:12:10.387914Z","submitted_at":"2016-09-26T04:06:13Z","title":"Pointer Sentinel Mixture Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.07843","snapshot_observed_at":"2026-08-03T05:40:37.274281Z","title":"Pointer sentinel mixture models.arXiv preprint arXiv:1609.07843,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.274281Z"},"links":{"cited_paper":"/paper/1609.07843","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:1218abef8ac5808226fdb6220b3e513a20347768478dbb9980d35409bf4c07bc","observation_id":"5f9c70c0-a342-451f-a720-91a730ae6334","resolution":{"observed_at":"2026-08-03T05:40:37.274281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-04T04:34:22.998376Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-03T05:40:37.330186Z","title":"Large language diffusion models.arXiv preprint arXiv:2502.09992,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.330186Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:5933b2d719d688daa47784eb3b7274113527a298a98b687e2821c483d1f8343c","observation_id":"2d7eef0e-fcaf-405d-8afc-d4705c28a90c","resolution":{"observed_at":"2026-08-03T05:40:37.330186Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.01038","last_updated":"2019-04-01T18:05:02Z","snapshot_observed_at":"2026-08-06T00:26:50.886840Z","submitted_at":"2019-04-01T18:05:02Z","title":"fairseq: A Fast, Extensible Toolkit for Sequence Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.01038","snapshot_observed_at":"2026-08-03T05:40:37.388918Z","title":"fairseq: A fast, ex- tensible toolkit for sequence modeling.arXiv preprint arXiv:1904.01038,","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.388918Z"},"links":{"cited_paper":"/paper/1904.01038","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:02a4068f9c590d450ce57cf67dc5581ba10acd40ee734ec33fc451b86cbc3c6f","observation_id":"ec466d37-e8d4-43a5-8be9-d3197d9a934a","resolution":{"observed_at":"2026-08-03T05:40:37.388918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:40:37.477306Z","title":"Improving word embedding compositionality using lexicographic definitions","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.477306Z"},"links":{"citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:22a6809be135c643ca22853d34e6ba3c1c0c7312ea9b4c4c688a936f290af758","observation_id":"7c6d38ad-9736-4fd7-bcc8-bb30302e7383","resolution":{"observed_at":"2026-08-03T05:40:37.477306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.05737","last_updated":"2024-08-02T16:09:14Z","snapshot_observed_at":"2026-08-06T16:42:40.001017Z","submitted_at":"2023-02-11T16:26:57Z","title":"A Reparameterized Discrete Diffusion Model for Text Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.05737","snapshot_observed_at":"2026-08-03T05:40:37.584436Z","title":"A reparameter- ized discrete diffusion model for text generation.arXiv preprint arXiv:2302.05737,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.584436Z"},"links":{"cited_paper":"/paper/2302.05737","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:63010d8e0fd8b9375a30d5ad0bd36a43274a40718f23224e42b0001e7792e23b","observation_id":"60c68a78-f03a-4f25-ad51-75771cb1a47c","resolution":{"observed_at":"2026-08-03T05:40:37.584436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:40:37.655889Z","title":"Mathematic Backgrounds A.1","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.655889Z"},"links":{"citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:04b9c9f45bb941fa3f74a72c0b66e0d43087ddd13493395ac449a76a537d9713","observation_id":"162ef3e5-ae32-41d3-aa14-1f109d047100","resolution":{"observed_at":"2026-08-03T05:40:37.655889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:40:37.719407Z","title":"This assumption states that, conditioned on a target word y, the remaining word embeddings are isotropically distributed when projected onto the tangent space of ey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.719407Z"},"links":{"citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:cd85dffd028646838db49dbe929ffbf858c9cb365715e84596c6df25f90ade11","observation_id":"06cbd376-8b76-4e6e-a59a-e8e23d68ae25","resolution":{"observed_at":"2026-08-03T05:40:37.719407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:40:37.782415Z","title":"7, and validate whether the condition holds or not","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.782415Z"},"links":{"citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:79785cd2968cb764ee49c8387dc53720ce82fde8f01392b73efcdb46eb70ccfa","observation_id":"ccacfdc9-b4d1-4151-8014-e96ace322d15","resolution":{"observed_at":"2026-08-03T05:40:37.782415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:40:37.848585Z","title":"Importantly, SCLMs introduce almost no additional parameters beyond the baseline models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.848585Z"},"links":{"citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:69a7c427961efe49e9f0c673af091930f3119486b82c7d4317b955196323630b","observation_id":"72d0874d-5b2b-4bdd-a0da-6888343411f9","resolution":{"observed_at":"2026-08-03T05:40:37.848585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:40:36.027090Z","title":"Bert: Pre-training of deep bidirectional transformers for lan- guage understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":2013,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.027090Z"},"links":{"citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:b7c1bbc9cb56c30900e91bd5432341cfc9417ec9b14fee537ae2fa5744cc323d","observation_id":"205894d4-6065-4940-a2eb-7271a6d596a6","resolution":{"observed_at":"2026-08-03T05:40:36.027090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10774","last_updated":"2024-06-14T23:32:32Z","snapshot_observed_at":"2026-07-06T17:17:56.276857Z","submitted_at":"2024-01-19T15:48:40Z","title":"Medusa: Simple LLM Inference Acceleration Framework with Multiple Decoding Heads","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.10774","snapshot_observed_at":"2026-08-03T05:40:35.850429Z","title":"D., Chen, D., and Dao, T","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:35.850429Z"},"links":{"cited_paper":"/paper/2401.10774","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:5659623f906d2343e53751574c7c8a7e378d50487d2e39e2fedf93e33cb5a2cd","observation_id":"70d5d1ed-e416-4c55-984d-4307e7d589cf","resolution":{"observed_at":"2026-08-03T05:40:35.850429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12219","last_updated":"2025-02-24T05:09:09Z","snapshot_observed_at":"2026-07-06T16:09:35.920101Z","submitted_at":"2023-08-23T16:01:12Z","title":"Diffusion Language Models Can Perform Many Tasks with Scaling and Instruction-Finetuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12219","snapshot_observed_at":"2026-08-03T05:40:37.522710Z","title":"Diffusion language models can perform many tasks with scaling and instruction-finetuning.arXiv preprint arXiv:2308.12219, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:37.522710Z"},"links":{"cited_paper":"/paper/2308.12219","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:eee76d5463c91c84d677879220d5f6132307b9771835282598203367f6eff583","observation_id":"bccf7f03-e6fa-4913-9e7f-56a388c41458","resolution":{"observed_at":"2026-08-03T05:40:37.522710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:40:35.714696Z","title":"Encoder-decoder diffusion language mod- els for efficient training and inference.arXiv preprint arXiv:2510.22852,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:35.714696Z"},"links":{"citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:671e2048576e8f627ee1008678591b9068953db47f9d591e2a1d6cd842e4d8e3","observation_id":"e8929d99-8786-4670-91e8-84b198b80415","resolution":{"observed_at":"2026-08-03T05:40:35.714696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.03511","last_updated":"2024-09-09T01:44:27Z","snapshot_observed_at":"2026-07-06T15:23:44.607814Z","submitted_at":"2023-05-02T15:33:09Z","title":"Shared Latent Space by Both Languages in Non-Autoregressive Neural Machine Translation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.03511","snapshot_observed_at":"2026-08-03T05:40:36.626541Z","title":"and Choi, H","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.626541Z"},"links":{"cited_paper":"/paper/2305.03511","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:575c14b6fee7d6480283b22a888b97cdb1abcd87274d4bfa8200c1fd64a2a112","observation_id":"a211423f-9c33-40b5-95c3-0f5dcb98079d","resolution":{"observed_at":"2026-08-03T05:40:36.626541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1902.00613","last_updated":"2019-02-02T01:34:56Z","snapshot_observed_at":"2026-07-06T07:30:42.252550Z","submitted_at":"2019-02-02T01:34:56Z","title":"Understanding Composition of Word Embeddings via Tensor Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1902.00613","snapshot_observed_at":"2026-08-03T05:40:36.229851Z","title":"and Ge, R","venue":null,"work_id":null,"year":1902},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.229851Z"},"links":{"cited_paper":"/paper/1902.00613","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:3083c069d8039b25ded28515afd67723e362f5f6cae583cf67adb8f21859e8a0","observation_id":"e162cefe-3f18-4886-8391-e3e1ecf1220f","resolution":{"observed_at":"2026-08-03T05:40:36.229851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.15089","last_updated":"2022-12-15T14:27:19Z","snapshot_observed_at":"2026-08-07T07:03:02.158312Z","submitted_at":"2022-11-28T06:08:54Z","title":"Continuous diffusion for categorical data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.15089","snapshot_observed_at":"2026-08-03T05:40:36.076757Z","title":"H., Doucet, A., Strudel, R., Dyer, C., Durkan, C., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.076757Z"},"links":{"cited_paper":"/paper/2211.15089","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:cfca7a4ebd1b74ac6e6a8e0bf9af063f7a43146e9c8d900a02ac6469b32bd99a","observation_id":"b9786ab7-2a4e-4ef5-90d1-966e4be1dbe9","resolution":{"observed_at":"2026-08-03T05:40:36.076757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13512","last_updated":"2024-02-21T03:51:34Z","snapshot_observed_at":"2026-07-06T17:33:13.106468Z","submitted_at":"2024-02-21T03:51:34Z","title":"From Self-Attention to Markov Models: Unveiling the Dynamics of Generative Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13512","snapshot_observed_at":"2026-08-03T05:40:36.788842Z","title":"E., Huang, Y ., Li, Y ., Rawat, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.788842Z"},"links":{"cited_paper":"/paper/2402.13512","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:8ced4577feb90cda1ef9fba6de86da1f3731f3c5ea3666cba509e91a7490e32f","observation_id":"6fc2fd45-3594-4ea4-a46c-66aa660b5735","resolution":{"observed_at":"2026-08-03T05:40:36.788842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09622","last_updated":"2025-06-09T02:36:10Z","snapshot_observed_at":"2026-08-09T10:13:05.522551Z","submitted_at":"2025-02-13T18:59:47Z","title":"Theoretical Benefit and Limitation of Diffusion Language Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09622","snapshot_observed_at":"2026-08-03T05:40:36.147398Z","title":"Theoretical benefit and limitation of diffusion language model.arXiv preprint arXiv:2502.09622,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.147398Z"},"links":{"cited_paper":"/paper/2502.09622","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:7c7c4de2e6dc3cacaa9a9e6c371253a6b78cd7c9dcb2a670e5f7c06140598481","observation_id":"6340eabb-75c2-4da2-adc6-4e790fd1058a","resolution":{"observed_at":"2026-08-03T05:40:36.147398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.19737","last_updated":"2024-04-30T17:33:57Z","snapshot_observed_at":"2026-08-03T23:22:09.849239Z","submitted_at":"2024-04-30T17:33:57Z","title":"Better & Faster Large Language Models via Multi-token Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.19737","snapshot_observed_at":"2026-08-03T05:40:36.443731Z","title":"Y ., Rozi`ere, B., Lopez-Paz, D., and Synnaeve, G","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.443731Z"},"links":{"cited_paper":"/paper/2404.19737","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:276a9cfc5e63b23b38c8f26806cd713b3e666637883ce0eca8577597187aa88a","observation_id":"dd81926a-a4e8-42b9-bbe0-18af4101d9eb","resolution":{"observed_at":"2026-08-03T05:40:36.443731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-03T05:40:36.380041Z","title":"M., Hauth, A., Millican, K., et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:36.380041Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:f2f726e52c110d878f4ed48f6fbc48c11c72128f787162714d52f70bc97d0943","observation_id":"8ad7fbec-3ada-4d9e-b0bf-f01d9478b561","resolution":{"observed_at":"2026-08-03T05:40:36.380041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T05:40:35.790839Z","title":"Findings of the 2014 workshop on statistical machine translation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models","version":3},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T05:40:35.790839Z"},"links":{"citing_paper":"/paper/2602.01807"},"observation_digest":"sha256:bd5219054a525aa44f037984fcc30293d0bbe97da9a5b974bf162da35d4e3cd8","observation_id":"727443be-aedc-454f-93cb-293cbd008cbd","resolution":{"observed_at":"2026-08-03T05:40:35.790839Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.01807","last_updated":"2026-05-27T04:12:20Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T11:26:52.551734Z","submitted_at":"2026-02-02T08:40:53Z","title":"Sentence Curve Language Models"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":32,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2602.01807."}