{"as_of":"2026-08-10T19:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1bd7760db3a6671b3fb65d2fbddd3da1a034e61dae0194383bb58503eacebe53","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":15,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-09T14:03:44.434667Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T19:50:11.115863Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-09T14:03:44.434667Z","title":"Y, and Lichao Sun","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.01926","last_updated":"2025-08-11T14:37:48Z","snapshot_observed_at":"2026-08-09T17:19:03.976853Z","submitted_at":"2025-02-04T01:56:28Z","title":"Fairness through Difference Awareness: Measuring Desired Group Discrimination in LLMs","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-09T14:03:44.434667Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2502.01926"},"observation_digest":"sha256:93e8cc4fbe84f4f74c4d31f520506a31e207fbf482c56951c7212fc9ca2bb68b","observation_id":"a5beb4ef-85cb-4626-be2f-77ddb7b527a6","resolution":{"observed_at":"2026-08-09T14:03:44.434667Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-07T20:11:11.994909Z","title":"Trustgpt: A benchmark for trustworthy and responsible large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.09897","last_updated":"2025-02-14T04:07:25Z","snapshot_observed_at":"2026-08-10T08:42:59.336562Z","submitted_at":"2025-02-14T04:07:25Z","title":"Artificial Intelligence in Spectroscopy: Advancing Chemistry from Prediction to Generation and Beyond","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T20:11:11.994909Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2502.09897"},"observation_digest":"sha256:6080387c6c87b8784415dbe8c0c251ea6eb22f5f0415d889ea985a2ba7936265","observation_id":"cd7d5d5c-ea78-42e4-b482-e3af89ecce4c","resolution":{"observed_at":"2026-08-07T20:11:11.994909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-07T14:22:55.580256Z","title":"Huang, Q","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19212","last_updated":"2026-07-24T14:18:32Z","snapshot_observed_at":"2026-08-10T00:32:01.048016Z","submitted_at":"2025-05-25T16:19:24Z","title":"When Ethics and Payoffs Diverge: LLM Agents in Morally Charged Social Dilemmas","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:55.580256Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2505.19212"},"observation_digest":"sha256:fd5d2fe05268003bb12ef1dd76a36f83425ef0fe47c7e8d5d557d4a4e0132268","observation_id":"162d771a-418c-4b4e-a320-87e3c17d1a75","resolution":{"observed_at":"2026-08-07T14:22:55.580256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-06T19:20:16.536212Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.05965","last_updated":"2025-07-08T13:19:00Z","snapshot_observed_at":"2026-08-08T21:20:33.389224Z","submitted_at":"2025-07-08T13:19:00Z","title":"OpenFActScore: Open-Source Atomic Evaluation of Factuality in Text Generation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T19:20:16.536212Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2507.05965"},"observation_digest":"sha256:05ba662657b373be392f49535f8d11cda121710c1b079cd523133f1f0ade4d0f","observation_id":"69224819-50eb-4cda-833f-5ad01ab6c371","resolution":{"observed_at":"2026-08-06T19:20:16.536212Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-05T23:13:00.005776Z","title":"arXiv preprint arXiv:2306.11507 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.05775","last_updated":"2026-07-27T20:50:40Z","snapshot_observed_at":"2026-08-10T01:02:48.484224Z","submitted_at":"2025-08-07T18:42:16Z","title":"Guardians and Offenders: A Survey on Harmful Content Generation and Safety Mitigation of LLM","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-05T23:13:00.005776Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2508.05775"},"observation_digest":"sha256:536733d79064141c4e7db22720956da3009963243f6606fab3c4fcd4a4ea6084","observation_id":"8b639068-14e2-43aa-bcb9-7271a1414879","resolution":{"observed_at":"2026-08-05T23:13:00.005776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-04T23:03:16.421385Z","title":"Trustgpt: A bench- mark for trustworthy and responsible large lan- guage models.arXiv preprint arXiv:2306.11507, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.06838","last_updated":"2025-09-08T16:08:31Z","snapshot_observed_at":"2026-08-09T03:57:38.609026Z","submitted_at":"2025-09-08T16:08:31Z","title":"EPT Benchmark: Evaluation of Persian Trustworthiness in Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T23:03:16.421385Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2509.06838"},"observation_digest":"sha256:188af47608d427093a7be09f1cc92cda64faa671772edc89bf356492450bd884","observation_id":"bb7343bc-d8fc-43bc-8867-3e4323e6d0e2","resolution":{"observed_at":"2026-08-04T23:03:16.421385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.11507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-07-04T19:50:11.115863Z","title":"Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":"f7da11ee-907e-43d8-91d0-694ba74288cc","year":2023},"citing_paper":{"arxiv_id":"2601.04389","last_updated":"2026-06-21T05:15:58Z","snapshot_observed_at":"2026-08-04T19:39:39.694972Z","submitted_at":"2026-01-07T20:53:18Z","title":"Safety Is Not Universal: The Selective Safety Trap in LLM Alignment","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T16:03:21.391883Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2601.04389"},"observation_digest":"sha256:e50bda0fc6b56c918f244b286ea8b38a0a36037ed9f6c1df72e6138ceac79efb","observation_id":"29799214-f1d3-4d1d-9649-d2b5ecd02cb2","resolution":{"observed_at":"2026-05-16T16:08:04.813096Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-03T12:08:44.317070Z","title":"Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.04389","last_updated":"2026-06-21T05:15:58Z","snapshot_observed_at":"2026-08-04T19:39:39.694972Z","submitted_at":"2026-01-07T20:53:18Z","title":"Safety Is Not Universal: The Selective Safety Trap in LLM Alignment","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T12:08:44.317070Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2601.04389"},"observation_digest":"sha256:f0e0ca1ccb79e053526260488458c67208f6aade33848d545db9d1821faa7f4f","observation_id":"f9420c9b-c3fc-4a4f-a9f3-13835ab1c1fa","resolution":{"observed_at":"2026-08-03T12:08:44.317070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-03T11:08:23.419771Z","title":"2306.11507v1","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.07528","last_updated":"2026-06-19T11:23:20Z","snapshot_observed_at":"2026-08-07T09:26:25.028209Z","submitted_at":"2026-01-12T13:28:28Z","title":"From RAG to Agentic RAG for Faithful Islamic Question Answering","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T11:08:23.419771Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2601.07528"},"observation_digest":"sha256:fff54cc099f01bd1aaba929ce8fe6d87ef3bbce19d406f9662c92a09313afb88","observation_id":"98745a4a-0145-48e9-b9ee-89b9cb6c67e5","resolution":{"observed_at":"2026-08-03T11:08:23.419771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.11507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-07-04T19:50:11.115863Z","title":"Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":"f7da11ee-907e-43d8-91d0-694ba74288cc","year":2023},"citing_paper":{"arxiv_id":"2605.09803","last_updated":"2026-05-10T22:51:44Z","snapshot_observed_at":"2026-07-06T23:21:49.499951Z","submitted_at":"2026-05-10T22:51:44Z","title":"Insight: Enhancing Mobile Accessibility for Blind and Visually Impaired Users with LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-12T02:11:09.787984Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2605.09803"},"observation_digest":"sha256:a0fef2c289b73f6830fdcfd256debbce6f2469156caa36f9ff6dcd522decf062","observation_id":"379c3a04-0776-476f-aa29-4ebb71d48d29","resolution":{"observed_at":"2026-05-12T02:11:15.302288Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.11507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-07-04T19:50:11.115863Z","title":"Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":"f7da11ee-907e-43d8-91d0-694ba74288cc","year":2023},"citing_paper":{"arxiv_id":"2605.10442","last_updated":"2026-05-12T10:07:26Z","snapshot_observed_at":"2026-07-06T23:22:23.287792Z","submitted_at":"2026-05-11T12:12:28Z","title":"StereoTales: A Multilingual Framework for Open-Ended Stereotype Discovery in LLMs","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-12T04:50:17.399580Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2605.10442"},"observation_digest":"sha256:309d13efd9a26614062916b3e7c96cbf90022dc49b9f9e23bb2f86ddbdcdf79e","observation_id":"051922d9-5140-4680-97b0-23317a76243a","resolution":{"observed_at":"2026-05-12T05:51:27.418348Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.11507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-07-04T19:50:11.115863Z","title":"Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":"f7da11ee-907e-43d8-91d0-694ba74288cc","year":2023},"citing_paper":{"arxiv_id":"2605.10442","last_updated":"2026-05-12T10:07:26Z","snapshot_observed_at":"2026-07-06T23:22:23.287792Z","submitted_at":"2026-05-11T12:12:28Z","title":"StereoTales: A Multilingual Framework for Open-Ended Stereotype Discovery in LLMs","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-13T07:20:32.494840Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2605.10442"},"observation_digest":"sha256:d595511b9b309c00b00fb01144b967ba496740df7b13ea847a3251924c2cba7c","observation_id":"79ca632e-1935-4bf4-88a9-a6ef4e3eb072","resolution":{"observed_at":"2026-05-13T07:22:29.071324Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":"2306.11507","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-07-04T19:50:11.115863Z","title":"Jiaming Ji, Mickel Liu, Josef Dai, Xuehai Pan, Chi Zhang, Ce Bian, Boyuan Chen, Ruiyang Sun, Yizhou Wang, and Yaodong Yang","venue":null,"work_id":"f7da11ee-907e-43d8-91d0-694ba74288cc","year":2023},"citing_paper":{"arxiv_id":"2606.25476","last_updated":"2026-07-21T11:09:35Z","snapshot_observed_at":"2026-08-10T19:09:23.623118Z","submitted_at":"2026-06-24T07:00:53Z","title":"A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-25T20:58:53.119386Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2606.25476"},"observation_digest":"sha256:db80075becd4be8f44baf5804b4bb0d62de7b02f118871c74617222c1646f9cd","observation_id":"1be6c546-25c7-4a0b-8668-7cfc56a920eb","resolution":{"observed_at":"2026-07-04T19:50:11.118037Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-02T10:16:36.314418Z","title":"arXiv preprint arXiv:2306.11507 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.25476","last_updated":"2026-07-21T11:09:35Z","snapshot_observed_at":"2026-08-10T19:09:23.623118Z","submitted_at":"2026-06-24T07:00:53Z","title":"A Red Teaming Framework for Large Language Models: A Case Study on Faithfulness Evaluation","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-02T10:16:36.314418Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2606.25476"},"observation_digest":"sha256:44e851322b7ec2b6d8e4ce693d42a387d737a230157d2dc910d33e707eabc3a6","observation_id":"efcd11f5-2eff-45e5-985a-5ec9819e94c7","resolution":{"observed_at":"2026-08-02T10:16:36.314418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.11507","snapshot_observed_at":"2026-08-03T00:55:28.889774Z","title":"arXiv preprint arXiv:2306.11507 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28636","last_updated":"2026-05-19T13:56:13Z","snapshot_observed_at":"2026-08-06T00:38:04.006327Z","submitted_at":"2026-05-19T13:56:13Z","title":"Chain-of-Models: Cross-Model Auditing for Bias-Robust LLM Judges","version":1},"reference_index":123,"source":"arxiv_source","source_observed_at":"2026-08-03T00:55:28.889774Z"},"links":{"cited_paper":"/paper/2306.11507","citing_paper":"/paper/2607.28636"},"observation_digest":"sha256:fe87906c76119ab1a60ce6877324db182c64533210281b87672bbb417f07807e","observation_id":"726877a8-a677-4263-843b-061db4ead206","resolution":{"observed_at":"2026-08-03T00:55:28.889774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.11507/citation-record","integrity":"/paper/2306.11507/integrity","json":"/paper/2306.11507/citation-record.json","paper":"/paper/2306.11507"},"outbound":[],"paper":{"arxiv_id":"2306.11507","last_updated":"2023-06-20T12:53:39Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-10T08:58:48.725907Z","submitted_at":"2023-06-20T12:53:39Z","title":"TrustGPT: A Benchmark for Trustworthy and Responsible Large Language Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 15 inbound Pith citation observations for arXiv:2306.11507."}