{"as_of":"2026-08-18T07:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b6298ceaf485087542d6eb873d601c567cdd1ead3971394e20f7b9b0657fd0c7","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:48:18.762671Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-19T17:49:01.198956Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-19T17:52:43.078608Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"cited_work":{"arxiv_id":"2506.11110","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.11110","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.11110 , year=","venue":null,"work_id":"ec5a8941-6b9f-45ec-b69a-8856aeeaeab1","year":null},"citing_paper":{"arxiv_id":"2605.15226","last_updated":"2026-05-13T14:14:54Z","snapshot_observed_at":"2026-08-12T12:37:27.717204Z","submitted_at":"2026-05-13T14:14:54Z","title":"Is Agentic AI Ready for Real-World Hardware Engineering? A Deep Dive with Phoenix-bench","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-19T17:49:01.198956Z"},"links":{"cited_paper":"/paper/2506.11110","citing_paper":"/paper/2605.15226"},"observation_digest":"sha256:991b8142071923b69a68912472660d897a2dfaa38f2d0b09778b8629a4774c45","observation_id":"c96603d8-3ba7-4d44-86c3-920d4ea43f0a","resolution":{"observed_at":"2026-05-19T17:52:43.083675Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.11110/citation-record","integrity":"/paper/2506.11110/integrity","json":"/paper/2506.11110/citation-record.json","paper":"/paper/2506.11110"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.142633Z","title":null,"venue":null,"work_id":"368fc1a2-ed8c-44e7-a750-2148e4d75ce8","year":2021},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.674740Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:95dcc9ffad26f1469b951893007f2e9d5cf91f6864aacda5b620ebed05f1ff97","observation_id":"ca8b12ba-acf4-4680-97e9-4b44f66a4dde","resolution":{"observed_at":"2026-08-07T05:48:19.145616Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-07T05:48:18.679496Z","title":"A., Adeli, E., Altman, R., Arora, S., von Arx, S.,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.679496Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:c2706083fa042c95d32089590583e5171cf47ce7b543c6259d6a16d26fac043b","observation_id":"a8801b79-71de-4efb-8102-d2978f32e8e6","resolution":{"observed_at":"2026-08-07T05:48:18.679496Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.133761Z","title":null,"venue":null,"work_id":"1732f007-016b-4dd7-98bc-103237fbd4dd","year":2014},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.683603Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:e4a395877208c4a12a88320384ddf6801b3b225193f8b48c4a445b7645cb4c5c","observation_id":"ecb9b38d-20a2-44e3-bcb3-9c35e283c271","resolution":{"observed_at":"2026-08-07T05:48:19.136887Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15217","last_updated":"2023-09-11T17:25:24Z","snapshot_observed_at":"2026-08-17T11:20:55.974248Z","submitted_at":"2023-07-27T22:29:25Z","title":"Open Problems and Fundamental Limitations of Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15217","snapshot_observed_at":"2026-08-07T05:48:18.687477Z","title":"K., Scheurer, J., Rando, J.,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.687477Z"},"links":{"cited_paper":"/paper/2307.15217","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:3ff0f9224709b8adf20d84944c6a55f5da74dfa6cbbb7458786dd7ea383a0f84","observation_id":"22e083f8-5051-4f3b-aa9e-db05d3809bee","resolution":{"observed_at":"2026-08-07T05:48:18.687477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:18.691190Z","title":"N., Agarwal, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.691190Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:68e1a847c00455eb4fa6b6782644705b0375fd982bab728c5817ce2337d0cc26","observation_id":"6b2f8c53-b099-458e-a10e-bf6182cea7cb","resolution":{"observed_at":"2026-08-07T05:48:18.691190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.124997Z","title":"M., & Daw, N","venue":null,"work_id":"8e99565f-74a5-4edf-9c84-fb217e53e611","year":2017},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.694315Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:614826e2fbba9034216aa14b8932fc0be4d88b2201709be2a207816c60876053","observation_id":"db6f8624-e4bd-4c88-9df9-582ee930b5ed","resolution":{"observed_at":"2026-08-07T05:48:19.127987Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.116396Z","title":"(2025, April 30)","venue":null,"work_id":"7dad30f7-bb29-417b-83ba-630b28ac3945","year":2025},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.697755Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:d86b1fd82674b2c3213e01a6eb08a47a2ed5c74f8c06b2c0493ab182b524b9eb","observation_id":"9ddfbf91-19f2-4714-bbdc-235b33366262","resolution":{"observed_at":"2026-08-07T05:48:19.119230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.107336Z","title":null,"venue":null,"work_id":"9a972f3b-911a-4105-befa-4a91a8be6200","year":2017},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.700779Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:9adf8cb15425914dd2e82018e5e16d6b61dbc07eb451b77b364a54be16ef827d","observation_id":"b39862d8-ce43-47f7-844f-957846d06e8f","resolution":{"observed_at":"2026-08-07T05:48:19.110513Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1906.01820","last_updated":"2021-12-01T11:22:52Z","snapshot_observed_at":"2026-08-17T12:23:45.330984Z","submitted_at":"2019-06-05T04:43:25Z","title":"Risks from Learned Optimization in Advanced Machine Learning Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1906.01820","snapshot_observed_at":"2026-08-07T05:48:18.703719Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.703719Z"},"links":{"cited_paper":"/paper/1906.01820","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:809072713119b803381fd70a0037090af1baad437eeed19f5cdc6a0be9401eb6","observation_id":"e730bfc6-e3a6-4a94-ab32-a95e4216e086","resolution":{"observed_at":"2026-08-07T05:48:18.703719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:18.707257Z","title":"J., Madotto, A., & Fung, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.707257Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:52bdaa60d3ceb3c8d679d9a581022a0bcd14663a558dd0b811af9a62f24ae3da","observation_id":"4a69ce99-64f9-4aea-8806-6bc031bb9582","resolution":{"observed_at":"2026-08-07T05:48:18.707257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-14T05:42:29.067319Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-07T05:48:18.710373Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.710373Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:a369d38987efc0d2d59ed1b0330a3f9e1c09d9169a52ac138027bc9b0be20488","observation_id":"8f402b56-e2e0-4ef0-bfd4-d525c25fa11a","resolution":{"observed_at":"2026-08-07T05:48:18.710373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.097051Z","title":null,"venue":null,"work_id":"f0f68b7e-cdff-4f34-a799-b9a2a2040493","year":1999},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.713713Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:683e03e7c9064cdeec40d4f3f4e3741f851a3a8a9af952d638ee2cd142a34b37","observation_id":"b81764dd-ef14-4a02-be18-39d51fb5d48b","resolution":{"observed_at":"2026-08-07T05:48:19.100206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.19203","last_updated":"2024-11-28T15:23:12Z","snapshot_observed_at":"2026-08-17T14:14:27.770693Z","submitted_at":"2024-11-28T15:23:12Z","title":"An Extensive Evaluation of Factual Consistency in Large Language Models for Data-to-Text Generation","version":1},"cited_work":{"arxiv_id":"2411.19203","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.19203","snapshot_observed_at":"2026-08-07T05:48:18.949273Z","title":"An Extensive Evaluation of Factual Consistency in Large Language Models for Data-to-Text Generation","venue":"cs.CL","work_id":"cb8f387b-3084-4317-b39e-9888d6f657e8","year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.717088Z"},"links":{"cited_paper":"/paper/2411.19203","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:c11726493555af69906fa08c95439f93c365f407cacd471139ea1df44840ce42","observation_id":"2e5dd03d-1075-4823-9f36-5942d21527f2","resolution":{"observed_at":"2026-08-07T05:48:18.954423Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.17651","last_updated":"2023-05-25T19:13:47Z","snapshot_observed_at":"2026-08-17T09:48:37.358540Z","submitted_at":"2023-03-30T18:30:01Z","title":"Self-Refine: Iterative Refinement with Self-Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.17651","snapshot_observed_at":"2026-08-07T05:48:18.720267Z","title":"& Clark, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.720267Z"},"links":{"cited_paper":"/paper/2303.17651","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:f0088189cd8b0a25f254d88e7d8d6fc7ac3f4908b3cdab422e9a7ec247c669e6","observation_id":"3c3a3762-9a4b-42d2-b847-2a4f0e3c7fa0","resolution":{"observed_at":"2026-08-07T05:48:18.720267Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.088000Z","title":"(2025, January 28)","venue":null,"work_id":"2e71ab2e-eb10-4673-9a45-2fe9f011db9a","year":2025},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.723677Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:ce561b87c1315104d6cd7471a4b2fc4ee2958e5e3514eaee46433b3cf572e287","observation_id":"3f14e3bd-1841-425e-87f1-78a2aecff5c8","resolution":{"observed_at":"2026-08-07T05:48:19.091152Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.078975Z","title":null,"venue":null,"work_id":"368345fa-8c46-4960-b634-e31c9c3cf915","year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.726713Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:9e509d7bd0b3054cd802dc4d02a449d0946863cb19b24eedba68781a158e55a5","observation_id":"0f12f923-b83b-4644-85fa-769ee9358583","resolution":{"observed_at":"2026-08-07T05:48:19.082051Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T05:48:18.729834Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.729834Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:4e01cb09cd6b0e83b752b2bb45aef9fd39923101beb7c325433bffa88b94f96c","observation_id":"909b254f-98bd-4f5a-aee7-6d0d9ecd945d","resolution":{"observed_at":"2026-08-07T05:48:18.729834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.069623Z","title":"& Lowe, R","venue":null,"work_id":"67292a0a-344c-47a3-8d0e-80286fdd13fc","year":2022},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.733751Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:5439499935d2516f5b2bf037857d26bc413b293b9d30eb8fdb050df32107484c","observation_id":"993b0081-e2ce-4874-8b9c-27e3287e84e8","resolution":{"observed_at":"2026-08-07T05:48:19.072558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.17753","last_updated":"2025-02-20T19:54:03Z","snapshot_observed_at":"2026-08-16T13:39:40.733970Z","submitted_at":"2024-06-25T17:40:47Z","title":"Measuring and Benchmarking Large Language Models' Capabilities to Generate Persuasive Language","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.17753","snapshot_observed_at":"2026-08-07T05:48:18.736717Z","title":"B., Augenstein, I., & Assent, I","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.736717Z"},"links":{"cited_paper":"/paper/2406.17753","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:12015130b7c4e91538723ea3c6afaec73bd97bf0a62e40776ff5a959b5d7e4ca","observation_id":"319f121d-f7be-4b3d-bb7c-32c8f7e5aaca","resolution":{"observed_at":"2026-08-07T05:48:18.736717Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09251","last_updated":"2022-12-19T05:13:52Z","snapshot_observed_at":"2026-08-14T22:08:45.647927Z","submitted_at":"2022-12-19T05:13:52Z","title":"Discovering Language Model Behaviors with Model-Written Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09251","snapshot_observed_at":"2026-08-07T05:48:18.740179Z","title":"(2022).Discovering Language Model Behaviors with Model-Written Evaluations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.740179Z"},"links":{"cited_paper":"/paper/2212.09251","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:bc17e2104da5879f2aad38882b9f7d539ca8e03a6d314c317fb2e9cabc1e8801","observation_id":"2cdaf0f9-fac2-48fa-a533-58f61e1a17aa","resolution":{"observed_at":"2026-08-07T05:48:18.740179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13548","last_updated":"2025-05-10T07:10:46Z","snapshot_observed_at":"2026-08-14T16:46:25.561386Z","submitted_at":"2023-10-20T14:46:48Z","title":"Towards Understanding Sycophancy in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.13548","snapshot_observed_at":"2026-08-07T05:48:18.743441Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.743441Z"},"links":{"cited_paper":"/paper/2310.13548","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:93a9a692e4ce0a101f7dfb7cbc6fb769020df308b48a201f1b2a9859eec7663a","observation_id":"f80abd4b-c4ec-4e6a-a5db-cc57c0a0b564","resolution":{"observed_at":"2026-08-07T05:48:18.743441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.02420","last_updated":"2024-10-31T04:50:59Z","snapshot_observed_at":"2026-08-16T14:21:44.422114Z","submitted_at":"2024-02-04T09:36:31Z","title":"Factuality of Large Language Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.02420","snapshot_observed_at":"2026-08-07T05:48:18.746771Z","title":"M., Zaman, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.746771Z"},"links":{"cited_paper":"/paper/2402.02420","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:4baa65bb4d9cd750c11c6a638837331e5eb0c6e7745e1c042039538ee8e4a329","observation_id":"f65fc0bd-1523-4229-a7ee-f6471302f18a","resolution":{"observed_at":"2026-08-07T05:48:18.746771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:19.060431Z","title":null,"venue":null,"work_id":"e6432c3d-98e0-49d7-b504-9bb5e263c4c3","year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.749955Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:dc2854b1e46d3664970bdace695b8a984baba9bc3ff41965bb94b937ec538c18","observation_id":"2d5ce6e7-4f3b-4b59-be71-657dc31564ee","resolution":{"observed_at":"2026-08-07T05:48:19.063567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:48:18.752928Z","title":"(2024).OpenFactCheck: A Unified Framework for Factuality Evaluation of LLMs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.752928Z"},"links":{"citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:f0a575ee38c1a3bd618c8caabd8ebbc3300721efa33218462bb96b55d65e4042","observation_id":"b0ec885d-1048-4ee7-9218-0abf556dda90","resolution":{"observed_at":"2026-08-07T05:48:18.752928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04368","last_updated":"2024-11-07T01:58:42Z","snapshot_observed_at":"2026-08-17T10:08:57.374438Z","submitted_at":"2024-11-07T01:58:42Z","title":"Measuring short-form factuality in large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04368","snapshot_observed_at":"2026-08-07T05:48:18.755967Z","title":"W., Jiao, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.755967Z"},"links":{"cited_paper":"/paper/2411.04368","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:57fa07fb181718cbd23eb7c71b8e25880512adf74a1e2fd03cf548dc699c8a1c","observation_id":"a67319c4-9aba-48ee-a765-8ba08e47cab0","resolution":{"observed_at":"2026-08-07T05:48:18.755967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.19764","last_updated":"2024-10-17T05:28:24Z","snapshot_observed_at":"2026-08-16T13:38:48.252976Z","submitted_at":"2024-06-28T09:09:36Z","title":"Belief Revision: The Adaptability of Large Language Models Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.19764","snapshot_observed_at":"2026-08-07T05:48:18.759340Z","title":"C., Winata, G","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.759340Z"},"links":{"cited_paper":"/paper/2406.19764","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:64d994e932d2d0dc949d5d0467e0a0a3f838a2fd59ea5ec565721dbb113556e5","observation_id":"db70f714-40be-4af9-9c46-4c8fdccd6114","resolution":{"observed_at":"2026-08-07T05:48:18.759340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.18223","last_updated":"2026-03-18T05:34:39Z","snapshot_observed_at":"2026-08-14T10:40:26.323157Z","submitted_at":"2023-03-31T17:28:46Z","title":"A Survey of Large Language Models","version":19},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.18223","snapshot_observed_at":"2026-08-07T05:48:18.762671Z","title":"p must be ’1 ’ , ’2 ’ , or ’ infty ’","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T05:48:18.762671Z"},"links":{"cited_paper":"/paper/2303.18223","citing_paper":"/paper/2506.11110"},"observation_digest":"sha256:3f3c1ecdeae4e4748b7719fa59f0e263792466f598a7f45c4eaab442663b2d59","observation_id":"a177b9fb-1376-40c8-be69-b7d7ad8c4bb9","resolution":{"observed_at":"2026-08-07T05:48:18.762671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.11110","last_updated":"2025-06-08T14:08:22Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-14T14:49:58.241818Z","submitted_at":"2025-06-08T14:08:22Z","title":"AssertBench: A Benchmark for Evaluating Self-Assertion in Large Language Models"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":1,"verified_fuzzy":4},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 1 inbound Pith citation observation for arXiv:2506.11110."}