{"as_of":"2026-08-09T20:41:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9b53a394a227d9aadc33c4a52764477bc84392c03cdff0cc92468e18548a9f0f","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":11,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":11,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":11,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":11,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:35:42.930625Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":13,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":"2312.07910","doi":"10.48550/arxiv.2312.07910","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Available: https://arxiv.org/pdf/2312.07910","venue":"arXiv (Cornell University)","work_id":"011d2381-27dd-46a9-b560-d308963bc72b","year":2023},"citing_paper":{"arxiv_id":"2404.01318","last_updated":"2024-10-31T22:26:40Z","snapshot_observed_at":"2026-08-02T14:59:12.115203Z","submitted_at":"2024-03-28T02:44:02Z","title":"JailbreakBench: An Open Robustness Benchmark for Jailbreaking Large Language Models","version":5},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-05-15T06:08:05.386345Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2404.01318"},"observation_digest":"sha256:ea9b56c7522ded84f38f040ed96e44efbf3efb63cc67c6b192efa4af361cb366","observation_id":"acac4324-7306-4d43-9b7a-3ea2b6ec88c4","resolution":{"observed_at":"2026-05-15T06:08:05.558387Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-07T23:35:42.930625Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.09670","last_updated":"2025-02-12T22:55:43Z","snapshot_observed_at":"2026-08-09T08:58:06.881734Z","submitted_at":"2025-02-12T22:55:43Z","title":"The Science of Evaluating Foundation Models","version":1},"reference_index":109,"source":"pdf_text","source_observed_at":"2026-08-07T23:35:42.930625Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2502.09670"},"observation_digest":"sha256:4728cf2036fa688f052a6f6f41a7150a8d790b688d54ff464eb4c53885a6daf8","observation_id":"d98d3097-f199-4160-b3fa-6426e57924ce","resolution":{"observed_at":"2026-08-07T23:35:42.930625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-07T15:42:44.481313Z","title":"Promptbench: A unified library for evaluation of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14201","last_updated":"2025-05-20T11:01:33Z","snapshot_observed_at":"2026-08-07T15:36:15.927880Z","submitted_at":"2025-05-20T11:01:33Z","title":"FLASH-D: FlashAttention with Hidden Softmax Division","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:44.481313Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2505.14201"},"observation_digest":"sha256:56bbfc4ad4c638926c0648a19f8557cbf66dbe78d620cb285f867afa0b02c7a9","observation_id":"e3b17ae8-85ee-4fe3-a048-05050b577aba","resolution":{"observed_at":"2026-08-07T15:42:44.481313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-07T15:42:48.583082Z","title":"Promptbench: A unified library for evaluation of large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14314","last_updated":"2025-05-30T10:32:39Z","snapshot_observed_at":"2026-08-07T15:34:24.396766Z","submitted_at":"2025-05-20T13:00:59Z","title":"Low-Cost FlashAttention with Fused Exponential and Multiplication Hardware Operators","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:48.583082Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2505.14314"},"observation_digest":"sha256:28256a388e9b1754d4226504a580b49590bad358c7dfa83d26522d21be573532","observation_id":"e66f864b-18c8-497f-86bf-0902a7c6d8fd","resolution":{"observed_at":"2026-08-07T15:42:48.583082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":"2312.07910","doi":"10.48550/arxiv.2312.07910","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Available: https://arxiv.org/pdf/2312.07910","venue":"arXiv (Cornell University)","work_id":"011d2381-27dd-46a9-b560-d308963bc72b","year":2023},"citing_paper":{"arxiv_id":"2506.13510","last_updated":"2026-05-22T19:49:58Z","snapshot_observed_at":"2026-08-07T00:29:38.667255Z","submitted_at":"2025-06-16T14:04:54Z","title":"Safe-Child-LLM: A Developmental Benchmark for Evaluating LLM Safety in Child-LLM Interactions","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T09:31:14.739478Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2506.13510"},"observation_digest":"sha256:de8a074b8bd4c98a76b4eb02eb2cf014b89c6d3c79a4c00a2a6c2676ab45faf5","observation_id":"4c02b2ff-2e11-4657-82bd-5b6b40fc5fa1","resolution":{"observed_at":"2026-05-19T09:32:16.304711Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-06T18:40:53.310912Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.07735","last_updated":"2025-07-10T13:15:20Z","snapshot_observed_at":"2026-08-08T05:47:28.468443Z","submitted_at":"2025-07-10T13:15:20Z","title":"GuardVal: Dynamic Large Language Model Jailbreak Evaluation for Comprehensive Safety Testing","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T18:40:53.310912Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2507.07735"},"observation_digest":"sha256:1d7fcecbc799c419163ab76e8a082649fa85949490e8b499b5ddcc5f12022975","observation_id":"6472e16d-5097-4478-ba43-bbfb3f9c48e8","resolution":{"observed_at":"2026-08-06T18:40:53.310912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-06T14:13:06.237976Z","title":"Promptbench: A unified library for evaluation of large language models, December 2023 b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.19672","last_updated":"2025-07-25T20:52:58Z","snapshot_observed_at":"2026-08-07T12:02:14.124506Z","submitted_at":"2025-07-25T20:52:58Z","title":"Alignment and Safety in Large Language Models: Safety Mechanisms, Training Paradigms, and Emerging Challenges","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-06T14:13:06.237976Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2507.19672"},"observation_digest":"sha256:97d26cd8cb2555bbb8baab35dedf68ba7e5a6124268d65c302f738ef93a7a93b","observation_id":"0c1af361-7a19-48a6-bc2f-77de003b6a73","resolution":{"observed_at":"2026-08-06T14:13:06.237976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-05T10:27:28.018193Z","title":"Promptbench: A unified library for evaluation of large language models.arXiv preprint arXiv:2312.07910,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.05375","last_updated":"2025-09-04T11:52:19Z","snapshot_observed_at":"2026-08-09T16:09:15.396679Z","submitted_at":"2025-09-04T11:52:19Z","title":"Characterizing Fitness Landscape Structures in Prompt Engineering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:27:28.018193Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2509.05375"},"observation_digest":"sha256:15ec13d3c2b1115a74c0668179e2f36c510f893f3f68872495c43dafaeedb699","observation_id":"05aaff4a-e3e7-4ee0-ba8a-84952cae68f1","resolution":{"observed_at":"2026-08-05T10:27:28.018193Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":"2312.07910","doi":"10.48550/arxiv.2312.07910","metadata_source":"arxiv_reference","pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Available: https://arxiv.org/pdf/2312.07910","venue":"arXiv (Cornell University)","work_id":"011d2381-27dd-46a9-b560-d308963bc72b","year":2023},"citing_paper":{"arxiv_id":"2606.22797","last_updated":"2026-06-22T03:16:34Z","snapshot_observed_at":"2026-08-08T13:55:15.383033Z","submitted_at":"2026-06-22T03:16:34Z","title":"Measuring Behavior Portability in Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-26T08:59:20.724868Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2606.22797"},"observation_digest":"sha256:0c4f6e218e7f9fbf24e2873a61b311d6388a0456f994ce9293278ab5cff8b77a","observation_id":"7366d3af-7c6c-43b4-8f03-19f983a2ae43","resolution":{"observed_at":"2026-06-26T09:09:16.242891Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-02T14:42:46.785295Z","title":"PromptBench: A unified library for evaluation of large language models.Journal of Machine Learning Research, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.14109","last_updated":"2026-05-07T21:11:51Z","snapshot_observed_at":"2026-08-08T06:32:48.904917Z","submitted_at":"2026-05-07T21:11:51Z","title":"Simplicity Paradox: Debunking myths about prompting and datasets for LLM evaluation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-02T14:42:46.785295Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2607.14109"},"observation_digest":"sha256:b0a1c27c3b05d1965f90c8c068580cef3b7591d32905a24964c7c2c1368d5880","observation_id":"ab524a00-2979-4d1d-8413-3f01fdfb7fa5","resolution":{"observed_at":"2026-08-02T14:42:46.785295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.07910","snapshot_observed_at":"2026-08-05T04:16:59.551189Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.00393","last_updated":"2026-08-01T02:08:01Z","snapshot_observed_at":"2026-08-06T23:12:46.158074Z","submitted_at":"2026-08-01T02:08:01Z","title":"MolecularCanvas: LLM-assisted Small-Molecule Drug Discovery via Structure-Guided Constraints","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-05T04:16:59.551189Z"},"links":{"cited_paper":"/paper/2312.07910","citing_paper":"/paper/2608.00393"},"observation_digest":"sha256:bb7d45dd51e5519ff882d1bb94f2f4f07f5d0d090ceff0fca5c75304315d9de3","observation_id":"082da28f-b19c-4774-b6d8-a87b3d697200","resolution":{"observed_at":"2026-08-05T04:16:59.551189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2312.07910/citation-record","integrity":"/paper/2312.07910/integrity","json":"/paper/2312.07910/citation-record.json","paper":"/paper/2312.07910"},"outbound":[],"paper":{"arxiv_id":"2312.07910","last_updated":"2024-08-20T00:28:45Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-05T04:16:54.399572Z","submitted_at":"2023-12-13T05:58:34Z","title":"PromptBench: A Unified Library for Evaluation of Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 11 inbound Pith citation observations for arXiv:2312.07910."}