{"as_of":"2026-08-09T11:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:46c6c774cdc16dc370570e80c90ebe798de366de6b31c2cdbd41227a27646479","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":10,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":10,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":10,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:42:04.244106Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":115,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-08-08T11:44:54.578934Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2205.00445","last_updated":"2022-05-01T11:01:28Z","snapshot_observed_at":"2026-08-07T07:47:07.886786Z","submitted_at":"2022-05-01T11:01:28Z","title":"MRKL Systems: A modular, neuro-symbolic architecture that combines large language models, external knowledge sources and discrete reasoning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-15T07:31:08.266737Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2205.00445"},"observation_digest":"sha256:6e5a48f9f10f526d8f690c87258a3d30600eeea45c8c23d7da1768aa1d9f17c1","observation_id":"51cc121f-5b44-4011-a82a-24d065a5cb77","resolution":{"observed_at":"2026-05-15T07:31:08.333752Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-08-08T11:44:54.578934Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2501.10258","last_updated":"2026-04-20T18:47:20Z","snapshot_observed_at":"2026-08-06T10:51:09.586571Z","submitted_at":"2025-01-17T15:40:03Z","title":"DADA: Dual Averaging with Distance Adaptation","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-23T04:54:12.210472Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2501.10258"},"observation_digest":"sha256:c6702335a683b71bb35177b546182f43fc2b441dba5845665297dc34bbb5e59a","observation_id":"868fafc5-e5be-437d-94f1-39a31ae693a8","resolution":{"observed_at":"2026-05-23T04:55:24.886760Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-08-08T11:44:54.578934Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2503.08223","last_updated":"2026-04-09T15:28:27Z","snapshot_observed_at":"2026-07-06T20:50:33.513259Z","submitted_at":"2025-03-11T09:41:29Z","title":"Will LLMs Scaling Hit the Wall? Breaking Barriers via Distributed Resources on Massive Edge Devices","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-23T01:03:26.037233Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2503.08223"},"observation_digest":"sha256:212f6a83c47d58e481abcaabe395fa0ec6bb9c2b37b8146c942d24ec0ac9c358","observation_id":"32becdb3-cf51-4728-8ae6-718acd5704bc","resolution":{"observed_at":"2026-05-23T01:05:16.516916Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-08-08T11:44:54.578934Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-07T00:42:04.244106Z","title":"The cost of training nlp models: A concise overview,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2506.13186","last_updated":"2025-06-16T07:52:15Z","snapshot_observed_at":"2026-08-07T15:42:13.842021Z","submitted_at":"2025-06-16T07:52:15Z","title":"Empirical Evaluation of Large Language Models in Automated Program Repair","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:42:04.244106Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2506.13186"},"observation_digest":"sha256:89731c07a20cea846ec487ff1eefbc3e70fc5d6a82c7a409e990539dc44528d7","observation_id":"f8eff1b3-e612-4aba-8e72-316a59496d27","resolution":{"observed_at":"2026-08-07T00:42:04.244106Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-08-08T11:44:54.578934Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-06T18:50:08.475355Z","title":"The cost of training nlp models: A concise overview.arXiv preprint arXiv:2004.08900,","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2507.07414","last_updated":"2025-07-10T04:13:53Z","snapshot_observed_at":"2026-08-09T01:27:09.521401Z","submitted_at":"2025-07-10T04:13:53Z","title":"GNN-CNN: An Efficient Hybrid Model of Convolutional and Graph Neural Networks for Text Representation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T18:50:08.475355Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2507.07414"},"observation_digest":"sha256:4aa96ab79bc878d6ae0ee5ebdff63b018ef743d1ef2e3ba3764e32231b30cc09","observation_id":"058e6369-1db3-4c0c-8ae7-0fa3aaaac638","resolution":{"observed_at":"2026-08-06T18:50:08.475355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-08-08T11:44:54.578934Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T17:57:18.554935Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2508.15478","last_updated":"2025-09-04T11:23:22Z","snapshot_observed_at":"2026-08-09T01:38:16.786250Z","submitted_at":"2025-08-21T11:56:05Z","title":"SLM-Bench: A Comprehensive Benchmark of Small Language Models on Environmental Impacts--Extended Version","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-05T17:57:18.554935Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2508.15478"},"observation_digest":"sha256:54d05c36a396f0f3e7034d0113ecf06c52b26ec1146422f13b206b6ba10acaed","observation_id":"c0bb041c-8990-4428-baf7-3788aebaa84d","resolution":{"observed_at":"2026-08-05T17:57:18.554935Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-08-08T11:44:54.578934Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2605.02300","last_updated":"2026-05-04T07:48:02Z","snapshot_observed_at":"2026-07-06T23:15:23.301944Z","submitted_at":"2026-05-04T07:48:02Z","title":"A Meta Reinforcement Learning Approach to Goals-Based Wealth Management","version":1},"reference_index":278,"source":"arxiv_source","source_observed_at":"2026-05-08T18:42:50.962120Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2605.02300"},"observation_digest":"sha256:926ba1528c4e826effd02640e6ecafb9d1672aff04ec5a8f49107538811bd0d0","observation_id":"dd41b570-6c05-4f0d-9c3c-eba2179dc77c","resolution":{"observed_at":"2026-05-08T18:44:01.362620Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-08-08T11:44:54.578934Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2605.29755","last_updated":"2026-05-29T07:46:21Z","snapshot_observed_at":"2026-07-06T23:39:10.583797Z","submitted_at":"2026-05-28T10:59:07Z","title":"Rec-Distill: An Industrial Distillation Pipeline for Large-Scale Recommendation Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-29T05:27:15.111684Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2605.29755"},"observation_digest":"sha256:29e89fac1698e7284915b657d8fac06ee8a68ed54154e93bed07ebe68715acaa","observation_id":"a7282dea-01d8-43be-b4da-75b44a3a8ca7","resolution":{"observed_at":"2026-06-29T15:13:32.263241Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-08-08T11:44:54.578934Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2606.09401","last_updated":"2026-06-08T12:21:02Z","snapshot_observed_at":"2026-07-06T23:48:44.159537Z","submitted_at":"2026-06-08T12:21:02Z","title":"Benchmarking Empirical Privacy Protection for Adaptations of Large Language Models","version":1},"reference_index":142,"source":"arxiv_source","source_observed_at":"2026-06-27T17:13:46.335347Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2606.09401"},"observation_digest":"sha256:6c4cbf0c7f9b0209c5d15716c1acb22eca6b3b978376103897a48b6d020dafa6","observation_id":"10257109-a9df-4153-b93e-5099e51628d9","resolution":{"observed_at":"2026-07-03T00:27:29.573111Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","snapshot_observed_at":"2026-08-08T11:44:54.578934Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview","version":1},"cited_work":{"arxiv_id":"2004.08900","doi":"10.48550/arxiv.2004.08900","metadata_source":"arxiv_reference","pith_arxiv_id":"2004.08900","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Sharir, B","venue":"arXiv (Cornell University)","work_id":"49a44ad2-3337-48ea-ac20-5ee1f30ac458","year":2020},"citing_paper":{"arxiv_id":"2606.28386","last_updated":"2026-06-22T17:06:05Z","snapshot_observed_at":"2026-08-02T11:08:25.094268Z","submitted_at":"2026-06-22T17:06:05Z","title":"Data Provenance for Image Auto-Regressive Generation","version":1},"reference_index":121,"source":"arxiv_source","source_observed_at":"2026-06-30T10:28:59.577056Z"},"links":{"cited_paper":"/paper/2004.08900","citing_paper":"/paper/2606.28386"},"observation_digest":"sha256:e7a60fdcb9482b4810501af28928060f59932f4f8d67bc69eb90ccb5f3c454d8","observation_id":"d304d835-8439-4c07-a847-ed9c62b28e30","resolution":{"observed_at":"2026-06-30T10:44:37.328290Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2004.08900/citation-record","integrity":"/paper/2004.08900/integrity","json":"/paper/2004.08900/citation-record.json","paper":"/paper/2004.08900"},"outbound":[],"paper":{"arxiv_id":"2004.08900","last_updated":"2020-04-19T16:28:35Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T11:44:54.578934Z","submitted_at":"2020-04-19T16:28:35Z","title":"The Cost of Training NLP Models: A Concise Overview"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 10 inbound Pith citation observations for arXiv:2004.08900."}