{"as_of":"2026-08-10T20:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:855cac1c047fb6fbca9c6508d39ca5b80b5724820714bf5a9a98eeb948544213","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:44:59.786646Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T17:57:23.282052Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T05:46:09.807404Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"cited_work":{"arxiv_id":"2502.07747","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.07747","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Whodunit: Evaluation benchmark for culprit detection in mystery stories","venue":null,"work_id":"662c237b-ee63-4de1-9963-71a717f4bcd5","year":2025},"citing_paper":{"arxiv_id":"2604.08016","last_updated":"2026-04-23T16:14:56Z","snapshot_observed_at":"2026-08-05T09:50:09.073358Z","submitted_at":"2026-04-09T09:16:00Z","title":"Wiring the 'Why': A Unified Taxonomy and Survey of Abductive Reasoning in LLMs","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-10T17:57:23.282052Z"},"links":{"cited_paper":"/paper/2502.07747","citing_paper":"/paper/2604.08016"},"observation_digest":"sha256:9b69ad39d1f63466161e7b8e343dc9dc3f842eeceb6454cc0e0a14bd32884f60","observation_id":"5195f490-acfd-420c-9c88-98dbe2a01f82","resolution":{"observed_at":"2026-05-11T05:46:09.877297Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.07747/citation-record","integrity":"/paper/2502.07747/integrity","json":"/paper/2502.07747/citation-record.json","paper":"/paper/2502.07747"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-08T11:44:59.700476Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.700476Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:730a629e9e78db015186b38003d701afffb5111f7227e3d88b958fe36ef828c7","observation_id":"39b2c24b-2545-4049-b454-603a1a4f1cb4","resolution":{"observed_at":"2026-08-08T11:44:59.700476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:45:00.063553Z","title":null,"venue":null,"work_id":"d89b22e4-a900-40d8-a168-7f19ac2a0ba4","year":2021},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.706172Z"},"links":{"citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:d16c53a208edb8d517958f1a734f5ddbb2b5814b38f00522b2d57418363288f6","observation_id":"d5e90bf2-a2d1-41c1-943e-4a42362d8876","resolution":{"observed_at":"2026-08-08T11:45:00.069383Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-08T11:44:59.710993Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.710993Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:1e3092bf60e3686fd5c11dfba0bc3b08f6239b5473bdb20354f6d938a0904760","observation_id":"50b29953-3905-433e-9a69-512a0e5c8c4e","resolution":{"observed_at":"2026-08-08T11:44:59.710993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-10T12:35:09.020030Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-08T11:44:59.715986Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.715986Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:e8e075358762103281ec25b800b26d1d17ff5680786531b53e5f4b1ac139f565","observation_id":"010dfd47-a8f6-406d-bebb-f6b29bc53777","resolution":{"observed_at":"2026-08-08T11:44:59.715986Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:45:00.045447Z","title":null,"venue":null,"work_id":"53b07ff8-3b38-44eb-a671-c42268c2ea13","year":2023},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.722751Z"},"links":{"citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:ba0523afa7388f68270b1c7dd0dfe4f4991e4a1c67d0d632d3bb0eb74e0d62e0","observation_id":"091c956d-2a2b-46be-bd39-1828c1575ef4","resolution":{"observed_at":"2026-08-08T11:45:00.050955Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:44:59.727737Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.727737Z"},"links":{"citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:74884235be8658f48295e727a0b639564376f9527d189c72b0aa1c8e08e8ea9e","observation_id":"600c0ef7-64ef-43bd-9648-089d3d84fe33","resolution":{"observed_at":"2026-08-08T11:44:59.727737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-01T19:14:56.803459Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-08T11:44:59.733056Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.733056Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:8923ea322a925a979d5068a6b17ef35ea7a5d6e145a8d3c33347438c055413e0","observation_id":"6ccb9e5d-77dc-4605-97b2-3ff4ae39264b","resolution":{"observed_at":"2026-08-08T11:44:59.733056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:44:59.738022Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.738022Z"},"links":{"citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:2c8b6423d2367f8aba6ad39fac1858428a9dfdfddd0fde046c650aab8d3961a7","observation_id":"8f06e9fa-0bdd-4c18-bd1b-7e6a95367a23","resolution":{"observed_at":"2026-08-08T11:44:59.738022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:44:59.993389Z","title":null,"venue":null,"work_id":"88791854-2ccf-4ee7-af2d-af5de434ed43","year":2022},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.742707Z"},"links":{"citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:04ecbc4385ee5a51b1574c6225eeee05c25049d433163bcb085be3d4be60bc59","observation_id":"f9df960a-91e3-40da-8691-2bce538e669e","resolution":{"observed_at":"2026-08-08T11:44:59.999161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:44:59.747533Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.747533Z"},"links":{"citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:93074f6a45f7fc56eef007700cbd0bad9eef8b04798524292b0252aaac5f4593","observation_id":"ea275fd5-fdff-4702-9748-9a4287871438","resolution":{"observed_at":"2026-08-08T11:44:59.747533Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2004.14967","last_updated":"2020-10-09T23:40:11Z","snapshot_observed_at":"2026-07-06T09:16:37.287949Z","submitted_at":"2020-04-30T17:16:31Z","title":"PlotMachines: Outline-Conditioned Generation with Dynamic Plot State Tracking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.14967","snapshot_observed_at":"2026-08-08T11:44:59.752378Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.752378Z"},"links":{"cited_paper":"/paper/2004.14967","citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:0dd903db1f421f3e0fc7d04c589121224abb29b7cd4ea3448b6f0b9edb9ae49c","observation_id":"a0f75bec-e159-4903-a39a-d7db722d934f","resolution":{"observed_at":"2026-08-08T11:44:59.752378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:44:59.757427Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.757427Z"},"links":{"citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:b7184035a2dae6b60b4933d18ffc43a477518a444b24d6b2c72a3b785f007ba1","observation_id":"0f087741-f23f-44b2-91d8-e6093f350b0f","resolution":{"observed_at":"2026-08-08T11:44:59.757427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.04615","last_updated":"2023-06-12T17:51:15Z","snapshot_observed_at":"2026-07-06T13:19:12.109592Z","submitted_at":"2022-06-09T17:05:34Z","title":"Beyond the Imitation Game: Quantifying and extrapolating the capabilities of language models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.04615","snapshot_observed_at":"2026-08-08T11:44:59.762175Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.762175Z"},"links":{"cited_paper":"/paper/2206.04615","citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:aced46d29000956aaea9a0bc384dd8b9c002d837f36daae699399d6d7f8e22bc","observation_id":"f26113ed-0664-4453-8dee-31c96fbbe350","resolution":{"observed_at":"2026-08-08T11:44:59.762175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:44:59.767095Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.767095Z"},"links":{"citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:02628fb8d3b51c5e8fc69d772d93b371f8cb45cc4dcb189d1245ff66b3473d15","observation_id":"494b9779-6d1e-48d0-8252-c4273c606e7a","resolution":{"observed_at":"2026-08-08T11:44:59.767095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-08T11:44:59.771725Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.771725Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:613c06ee1124d52756d98abd6f5531b3eed550d8fd3da265cd1cab056b8a1d3d","observation_id":"b1137e2f-cc6c-44c3-9429-dd16f6a4aebf","resolution":{"observed_at":"2026-08-08T11:44:59.771725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:44:59.776792Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.776792Z"},"links":{"citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:b8e939512c5ded8a1f41fad2076f79ff9f88cce3136c126b6565ccdb9914276b","observation_id":"db0776ab-3549-4225-b694-1d124fb1f7d8","resolution":{"observed_at":"2026-08-08T11:44:59.776792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:44:59.781345Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.781345Z"},"links":{"citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:bae481250c7746e4ce1297162b235005d3a2e83e4f099bb05d98144f3ed065a4","observation_id":"92941092-748c-4246-9086-a0422cb9996c","resolution":{"observed_at":"2026-08-08T11:44:59.781345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T11:44:59.786646Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T11:44:59.786646Z"},"links":{"citing_paper":"/paper/2502.07747"},"observation_digest":"sha256:e4aa08e9948956ef90ed01d17b6e1cfb7ff0938aaadc7dfdbd2e2653793cea1d","observation_id":"3c46f2b9-10f3-40b8-bfb5-19a543093cba","resolution":{"observed_at":"2026-08-08T11:44:59.786646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.07747","last_updated":"2025-02-11T18:14:44Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T02:46:07.194163Z","submitted_at":"2025-02-11T18:14:44Z","title":"WHODUNIT: Evaluation benchmark for culprit detection in mystery stories"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 1 inbound Pith citation observation for arXiv:2502.07747."}