{"as_of":"2026-08-09T22:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:664ea26c92b017efc983bdf95df0cfd7eb118827319d2ac9660647933ea8bdca","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":12,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":12,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":12,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:33:39.064313Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-02T01:56:27.114999Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-08-07T15:33:39.064313Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14852","last_updated":"2025-05-20T19:31:52Z","snapshot_observed_at":"2026-08-09T16:09:50.289736Z","submitted_at":"2025-05-20T19:31:52Z","title":"EasyMath: A 0-shot Math Benchmark for SLMs","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:33:39.064313Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2505.14852"},"observation_digest":"sha256:be4e328aa13e09f2cc3df4b5df79d1f23b875f605a499bb2fe71f10cc66e0bb7","observation_id":"afce4c83-1dbc-448d-82ba-b27682fe53ec","resolution":{"observed_at":"2026-08-07T15:33:39.064313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":"2503.16974","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-07-02T01:56:27.114999Z","title":"Assessing consistency and reproducibility in the outputs of large language models: Evidence across diverse finance and accounting tasks","venue":null,"work_id":"e44b95e7-c91f-4e0d-974a-30f06e0bd151","year":2025},"citing_paper":{"arxiv_id":"2505.15134","last_updated":"2025-05-21T05:39:11Z","snapshot_observed_at":"2026-08-08T21:58:35.154185Z","submitted_at":"2025-05-21T05:39:11Z","title":"The Unreasonable Effectiveness of Entropy Minimization in LLM Reasoning","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-18T15:58:33.219451Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2505.15134"},"observation_digest":"sha256:640b9ba39b84a2699019ecceff95300e8895cf0e240dcfe9446fb7017df9f453","observation_id":"eda8e380-146e-4921-ac4f-6308acb1848a","resolution":{"observed_at":"2026-05-18T15:58:33.525577Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-08-05T11:39:47.834129Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02363","last_updated":"2025-09-02T14:24:25Z","snapshot_observed_at":"2026-08-06T17:39:53.698217Z","submitted_at":"2025-09-02T14:24:25Z","title":"Towards Temporal Knowledge-Base Creation for Fine-Grained Opinion Analysis with Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-05T11:39:47.834129Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2509.02363"},"observation_digest":"sha256:f64f5e234e917948ac10f42f38615038bc0de3bc88280691fa64b4efa5e35b32","observation_id":"d42194f6-6da4-4a9b-bc1d-a72b0c8f9db0","resolution":{"observed_at":"2026-08-05T11:39:47.834129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-08-03T08:30:49.119437Z","title":"CoRRabs/2503.16974(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.16800","last_updated":"2026-08-03T09:26:43Z","snapshot_observed_at":"2026-08-07T03:32:51.850019Z","submitted_at":"2026-01-23T14:52:56Z","title":"Large Language Models as Automatic Annotators and Annotation Adjudicators for Fine-Grained Opinion Analysis","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T08:30:49.119437Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2601.16800"},"observation_digest":"sha256:3c53ecff1564c9071b14b29aaea3c1ce8ee75f6bbbed706b4186f4ce38a1ba1c","observation_id":"13d0e133-3bb0-4eb9-8de0-dcf7bb612298","resolution":{"observed_at":"2026-08-03T08:30:49.119437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-08-04T06:19:09.680553Z","title":"CoRRabs/2503.16974(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.16800","last_updated":"2026-08-03T09:26:43Z","snapshot_observed_at":"2026-08-07T03:32:51.850019Z","submitted_at":"2026-01-23T14:52:56Z","title":"Large Language Models as Automatic Annotators and Annotation Adjudicators for Fine-Grained Opinion Analysis","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T06:19:09.680553Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2601.16800"},"observation_digest":"sha256:05e712e33ac0a50534f3e7317ba497f90a2844a115f5d591732096331bcb6e20","observation_id":"7525b13b-a51e-4a14-9485-0428f05dc043","resolution":{"observed_at":"2026-08-04T06:19:09.680553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-08-02T22:32:02.023467Z","title":"and Wang, Y","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.16666","last_updated":"2026-06-02T02:15:05Z","snapshot_observed_at":"2026-08-02T22:31:53.381890Z","submitted_at":"2026-02-18T18:05:44Z","title":"Towards a Science of AI Agent Reliability","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-02T22:32:02.023467Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2602.16666"},"observation_digest":"sha256:b31eed2d324d4480edd3fd36616d12bb292fd8d34197f60ede36373b92857852","observation_id":"58b21271-5c75-4a4a-8ea2-59011ee69658","resolution":{"observed_at":"2026-08-02T22:32:02.023467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":"2503.16974","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-07-02T01:56:27.114999Z","title":"Assessing consistency and reproducibility in the outputs of large language models: Evidence across diverse finance and accounting tasks","venue":null,"work_id":"e44b95e7-c91f-4e0d-974a-30f06e0bd151","year":2025},"citing_paper":{"arxiv_id":"2604.13413","last_updated":"2026-04-15T02:31:31Z","snapshot_observed_at":"2026-07-06T23:01:23.771347Z","submitted_at":"2026-04-15T02:31:31Z","title":"Dataset-Level Metrics Attenuate Non-Determinism: A Fine-Grained Non-Determinism Evaluation in Diffusion Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T13:31:46.940449Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2604.13413"},"observation_digest":"sha256:1b3294123d5f0464d8e4f8e227a1216567049db41c54c77ea7fab2107b12e4d0","observation_id":"5bf674ad-7849-4264-a9ca-469bcab8a4e1","resolution":{"observed_at":"2026-05-10T13:35:26.402158Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-07-12T20:50:53.567415Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.13416","last_updated":"2026-07-06T05:33:02Z","snapshot_observed_at":"2026-08-02T11:35:00.658422Z","submitted_at":"2026-04-15T02:33:44Z","title":"DF3DV-1K: A Large-Scale Dataset and Benchmark for Distractor-Free Novel View Synthesis","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-12T20:50:53.567415Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2604.13416"},"observation_digest":"sha256:07341a223f4d8419b02e42cc36d5eaf50c205c5f8a896b01f814c2bd71d635d6","observation_id":"6b05796b-0d86-42d7-8102-e322530cb9f5","resolution":{"observed_at":"2026-07-12T20:50:53.567415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":"2503.16974","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-07-02T01:56:27.114999Z","title":"Assessing consistency and reproducibility in the outputs of large language models: Evidence across diverse finance and accounting tasks","venue":null,"work_id":"e44b95e7-c91f-4e0d-974a-30f06e0bd151","year":2025},"citing_paper":{"arxiv_id":"2605.23955","last_updated":"2026-05-27T17:26:09Z","snapshot_observed_at":"2026-08-08T08:44:23.201660Z","submitted_at":"2026-05-11T17:46:38Z","title":"From Accuracy to Auditability: A Survey of Determinism in Financial AI Systems","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T22:27:30.692356Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2605.23955"},"observation_digest":"sha256:44f6ca61e8b9264e720740e890ea09f894e7ccfac8e8052ad8a11d18e9d06f07","observation_id":"6d4a2621-690f-4808-ae15-0689c3f5d5c0","resolution":{"observed_at":"2026-07-01T14:05:45.811279Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":"2503.16974","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-07-02T01:56:27.114999Z","title":"Assessing consistency and reproducibility in the outputs of large language models: Evidence across diverse finance and accounting tasks","venue":null,"work_id":"e44b95e7-c91f-4e0d-974a-30f06e0bd151","year":2025},"citing_paper":{"arxiv_id":"2607.00856","last_updated":"2026-07-01T12:22:04Z","snapshot_observed_at":"2026-08-07T15:02:20.980878Z","submitted_at":"2026-07-01T12:22:04Z","title":"Shapley in Context: Explaining Financial Language with Domain Expertise","version":1},"reference_index":284,"source":"arxiv_source","source_observed_at":"2026-07-02T01:46:33.186116Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2607.00856"},"observation_digest":"sha256:6512f8729ce2be2f77a31c527c6709d678675814f03f28a02b6608dfcab574f2","observation_id":"6a8b0efe-dbe4-48e5-94be-133175b7d75a","resolution":{"observed_at":"2026-07-02T01:56:27.118015Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-08-02T11:50:21.831933Z","title":"Assessing consistency and reproducibility in the outputs of large language models: Evidence across diverse finance and accounting tasks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20491","last_updated":"2026-07-24T14:53:06Z","snapshot_observed_at":"2026-08-06T04:10:40.538060Z","submitted_at":"2026-06-10T03:31:09Z","title":"DFAH-Bench: Benchmarking Observable Agent Instability in Financial Decision-Making","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T11:50:21.831933Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2607.20491"},"observation_digest":"sha256:07832362ddc11dec436ea4e7beaf82a290442d7d77877c5fec985c8faba33a61","observation_id":"d781a69a-bd23-4d97-b24f-630a92ca4bd9","resolution":{"observed_at":"2026-08-02T11:50:21.831933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16974","snapshot_observed_at":"2026-08-02T12:15:36.327966Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24765","last_updated":"2026-06-05T12:36:36Z","snapshot_observed_at":"2026-08-08T11:26:09.306176Z","submitted_at":"2026-06-05T12:36:36Z","title":"Measuring and Improving Behavioral Consistency in Large Language Models through Fact-Heuristic-Emotion State Enforcement","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-02T12:15:36.327966Z"},"links":{"cited_paper":"/paper/2503.16974","citing_paper":"/paper/2607.24765"},"observation_digest":"sha256:b9882e3233e7d289b2427065a061ffa09077999df3166e5beb6a8aa6a3a3aa22","observation_id":"f0e011b8-26aa-419b-9208-9ca2b9a07db7","resolution":{"observed_at":"2026-08-02T12:15:36.327966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.16974/citation-record","integrity":"/paper/2503.16974/integrity","json":"/paper/2503.16974/citation-record.json","paper":"/paper/2503.16974"},"outbound":[],"paper":{"arxiv_id":"2503.16974","last_updated":"2025-09-13T01:57:49Z","latest_version":4,"primary_category":"q-fin.GN","snapshot_observed_at":"2026-08-07T16:47:06.262521Z","submitted_at":"2025-03-21T09:43:37Z","title":"Assessing Consistency and Reproducibility in the Outputs of Large Language Models: Evidence Across Diverse Finance and Accounting Tasks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 12 inbound Pith citation observations for arXiv:2503.16974."}