{"as_of":"2026-08-09T13:58:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9a83f63aa378150e527293c3f6d57c0411e13fe34777d33507145ca620da9299","coverage":[{"denominator":10,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":10,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T04:09:49.243797Z","state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T14:52:42.813309Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2602.05897","last_updated":"2026-05-27T06:15:48Z","snapshot_observed_at":"2026-08-08T01:49:57.559195Z","submitted_at":"2026-02-05T17:15:12Z","title":"Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.05897","snapshot_observed_at":"2026-07-14T14:52:42.813309Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09880","last_updated":"2026-07-10T18:13:54Z","snapshot_observed_at":"2026-08-09T13:05:07.464071Z","submitted_at":"2026-07-10T18:13:54Z","title":"CLIR-Bench: Benchmarking Multimodal Question Answering over Irregular Clinical Time Series","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-14T14:52:42.813309Z"},"links":{"cited_paper":"/paper/2602.05897","citing_paper":"/paper/2607.09880"},"observation_digest":"sha256:8f0b633b83c4ca30b5a8aeb951f5509fdfcbe051de8410a6ca02ed6ca0f60972","observation_id":"2befc4e1-7fe5-4a7a-8ba7-22bc161c998d","resolution":{"observed_at":"2026-07-14T14:52:42.813309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2602.05897/citation-record","integrity":"/paper/2602.05897/integrity","json":"/paper/2602.05897/citation-record.json","paper":"/paper/2602.05897"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:09:48.916643Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05897","last_updated":"2026-05-27T06:15:48Z","snapshot_observed_at":"2026-08-08T01:49:57.559195Z","submitted_at":"2026-02-05T17:15:12Z","title":"Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T04:09:48.916643Z"},"links":{"citing_paper":"/paper/2602.05897"},"observation_digest":"sha256:aff98d5d20d3c6ede5bbde6252bcc9355ed05cf7e77d23882a17d8965b15f6c9","observation_id":"91a99dbd-85d5-472e-b9bf-4716629a7e93","resolution":{"observed_at":"2026-08-03T04:09:48.916643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:09:48.990491Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05897","last_updated":"2026-05-27T06:15:48Z","snapshot_observed_at":"2026-08-08T01:49:57.559195Z","submitted_at":"2026-02-05T17:15:12Z","title":"Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T04:09:48.990491Z"},"links":{"citing_paper":"/paper/2602.05897"},"observation_digest":"sha256:5548007d88e6d576d530d504ce50918a4969af94268541d186695272a104a2ad","observation_id":"feb71d4c-4332-4e4e-94ea-3b92ad96a4f4","resolution":{"observed_at":"2026-08-03T04:09:48.990491Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:09:49.135992Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.05897","last_updated":"2026-05-27T06:15:48Z","snapshot_observed_at":"2026-08-08T01:49:57.559195Z","submitted_at":"2026-02-05T17:15:12Z","title":"Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T04:09:49.135992Z"},"links":{"citing_paper":"/paper/2602.05897"},"observation_digest":"sha256:20b8f3e4944a6df038df67663d66e2bb63e3ba79d715436572632704f3899c84","observation_id":"287c4a17-b522-4b7a-8127-d4e9a8460bf3","resolution":{"observed_at":"2026-08-03T04:09:49.135992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:09:49.243797Z","title":"new_question_1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05897","last_updated":"2026-05-27T06:15:48Z","snapshot_observed_at":"2026-08-08T01:49:57.559195Z","submitted_at":"2026-02-05T17:15:12Z","title":"Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T04:09:49.243797Z"},"links":{"citing_paper":"/paper/2602.05897"},"observation_digest":"sha256:300ed670b18c580a0e991d1fa3646506ed64d73879dac131d5d54eaaac069735","observation_id":"3d98b1e1-bc17-4a8e-acae-a8fc774ebfab","resolution":{"observed_at":"2026-08-03T04:09:49.243797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03200","last_updated":"2025-01-06T18:28:04Z","snapshot_observed_at":"2026-08-09T02:18:44.778615Z","submitted_at":"2025-01-06T18:28:04Z","title":"The FACTS Grounding Leaderboard: Benchmarking LLMs' Ability to Ground Responses to Long-Form Input","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03200","snapshot_observed_at":"2026-08-03T04:09:48.472543Z","title":"URL https://aclanthology.org/2025.findin gs-acl.269/","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05897","last_updated":"2026-05-27T06:15:48Z","snapshot_observed_at":"2026-08-08T01:49:57.559195Z","submitted_at":"2026-02-05T17:15:12Z","title":"Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T04:09:48.472543Z"},"links":{"cited_paper":"/paper/2501.03200","citing_paper":"/paper/2602.05897"},"observation_digest":"sha256:5d3c74c513cc2446a65a8245f3afd13e09893af7749cec8b7acaeb49a71dff4d","observation_id":"d5b6b225-781e-4335-b577-abe861a02ca9","resolution":{"observed_at":"2026-08-03T04:09:48.472543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:09:48.763037Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05897","last_updated":"2026-05-27T06:15:48Z","snapshot_observed_at":"2026-08-08T01:49:57.559195Z","submitted_at":"2026-02-05T17:15:12Z","title":"Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T04:09:48.763037Z"},"links":{"citing_paper":"/paper/2602.05897"},"observation_digest":"sha256:dd12669f1b686665008c30a7d06b286fe86c54f3bdcf69679d313f84dd29ff8c","observation_id":"afd2a6cd-2ad7-4aac-ac82-e01d76411e67","resolution":{"observed_at":"2026-08-03T04:09:48.763037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12599","last_updated":"2025-06-03T02:14:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T02:48:14Z","title":"Kimi k1.5: Scaling Reinforcement Learning with LLMs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12599","snapshot_observed_at":"2026-08-03T04:09:48.842765Z","title":"Wait, I need to think","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05897","last_updated":"2026-05-27T06:15:48Z","snapshot_observed_at":"2026-08-08T01:49:57.559195Z","submitted_at":"2026-02-05T17:15:12Z","title":"Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T04:09:48.842765Z"},"links":{"cited_paper":"/paper/2501.12599","citing_paper":"/paper/2602.05897"},"observation_digest":"sha256:a84d371ff701cdb205b1bd3da9f03df09cd2ddfc7db3c378e3b63703b50047d6","observation_id":"8924ffb2-89f7-4ce6-994b-ae8d3aea172b","resolution":{"observed_at":"2026-08-03T04:09:48.842765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04664","last_updated":"2025-09-04T21:26:31Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-04T21:26:31Z","title":"Why Language Models Hallucinate","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04664","snapshot_observed_at":"2026-08-03T04:09:48.609050Z","title":"doi: 10.18653/v1/P17-1147","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05897","last_updated":"2026-05-27T06:15:48Z","snapshot_observed_at":"2026-08-08T01:49:57.559195Z","submitted_at":"2026-02-05T17:15:12Z","title":"Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-03T04:09:48.609050Z"},"links":{"cited_paper":"/paper/2509.04664","citing_paper":"/paper/2602.05897"},"observation_digest":"sha256:c4bf38aa19c4fab459a1a85bffee72a3e8e7d6583f05a3dc87bc04cfe4fef834","observation_id":"e2a3ce71-11dd-4a11-9d7d-e8459ca4b964","resolution":{"observed_at":"2026-08-03T04:09:48.609050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11306","last_updated":"2025-02-16T23:05:36Z","snapshot_observed_at":"2026-08-07T18:14:09.976845Z","submitted_at":"2025-02-16T23:05:36Z","title":"Smoothing Out Hallucinations: Mitigating LLM Hallucination with Smoothed Knowledge Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11306","snapshot_observed_at":"2026-08-03T04:09:48.708609Z","title":"Liu, B., Li, H., Wang, S., Nie, S., and Zhang, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05897","last_updated":"2026-05-27T06:15:48Z","snapshot_observed_at":"2026-08-08T01:49:57.559195Z","submitted_at":"2026-02-05T17:15:12Z","title":"Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T04:09:48.708609Z"},"links":{"cited_paper":"/paper/2502.11306","citing_paper":"/paper/2602.05897"},"observation_digest":"sha256:1695170a80469c56a243f5a2c16b34e827fc3330cb730be0e84cf03b2e0e1b97","observation_id":"62fab9f8-67f8-495f-ae62-a0028f908a72","resolution":{"observed_at":"2026-08-03T04:09:48.708609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T04:09:48.340314Z","title":"Haque, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05897","last_updated":"2026-05-27T06:15:48Z","snapshot_observed_at":"2026-08-08T01:49:57.559195Z","submitted_at":"2026-02-05T17:15:12Z","title":"Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T04:09:48.340314Z"},"links":{"citing_paper":"/paper/2602.05897"},"observation_digest":"sha256:e6deb601ba3a528f9451b693054b7f62d3dbd49a00a67e8a8385f17563dd3e84","observation_id":"1832476d-24f2-466d-8b07-a60996cc1d98","resolution":{"observed_at":"2026-08-03T04:09:48.340314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2602.05897","last_updated":"2026-05-27T06:15:48Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T01:49:57.559195Z","submitted_at":"2026-02-05T17:15:12Z","title":"Stop Rewarding Hallucinated Steps: Faithfulness-Aware Step-Level Reinforcement Learning for Small Reasoning Models"},"reference_resolution":{"displayed":10,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":10},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 10 of 10 outbound references and 1 inbound Pith citation observation for arXiv:2602.05897."}