{"as_of":"2026-08-16T10:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bc018ac03c88640935d77db91ed02294d503df44ad824d59dbde79ad222dcb5d","coverage":[{"denominator":19,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T12:04:09.577795Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T11:52:24.750109Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04504","snapshot_observed_at":"2026-07-12T23:30:07.574017Z","title":"Behavioral fingerprinting of large language models.arXiv preprint arXiv:2509.04504,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2605.27382","last_updated":"2026-05-28T02:39:08Z","snapshot_observed_at":"2026-08-14T15:04:08.649211Z","submitted_at":"2026-04-10T08:04:41Z","title":"The Alignment Floor: How Persona Customization Breaks Safety in Weakly-Aligned LLMs","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-12T23:30:07.574017Z"},"links":{"cited_paper":"/paper/2509.04504","citing_paper":"/paper/2605.27382"},"observation_digest":"sha256:762b64ffb67488004296d578d60c5865e74d3c20e51e197fadec90d065753271","observation_id":"124d1761-fbd5-416d-b0d3-f73abc5eda1f","resolution":{"observed_at":"2026-07-12T23:30:07.574017Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"cited_work":{"arxiv_id":"2509.04504","doi":"10.48550/arxiv.2509.04504","metadata_source":"arxiv_reference","pith_arxiv_id":"2509.04504","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"ArXiv.org","work_id":"10019866-6614-4f97-ae66-03bc93120338","year":2025},"citing_paper":{"arxiv_id":"2605.30169","last_updated":"2026-07-02T23:58:01Z","snapshot_observed_at":"2026-08-15T21:45:32.718633Z","submitted_at":"2026-05-28T16:20:19Z","title":"Dissociative Identity: Language Model Agents Lack Grounding for Reputation Mechanisms","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-06-29T00:26:54.019256Z"},"links":{"cited_paper":"/paper/2509.04504","citing_paper":"/paper/2605.30169"},"observation_digest":"sha256:0815111b86f530f9118df1af15ad5eccec98aabd57c5ac5f7fdff54e512d5272","observation_id":"7351c9bf-9528-4d79-88ab-9236f5bf24dc","resolution":{"observed_at":"2026-06-29T00:32:53.253917Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04504","snapshot_observed_at":"2026-08-02T12:15:36.476876Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24765","last_updated":"2026-06-05T12:36:36Z","snapshot_observed_at":"2026-08-08T11:26:09.306176Z","submitted_at":"2026-06-05T12:36:36Z","title":"Measuring and Improving Behavioral Consistency in Large Language Models through Fact-Heuristic-Emotion State Enforcement","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-02T12:15:36.476876Z"},"links":{"cited_paper":"/paper/2509.04504","citing_paper":"/paper/2607.24765"},"observation_digest":"sha256:9ce54ec7f09837b9ba02ecf561a35f7ac167376b53fe5d9644fa2f19997b5ce7","observation_id":"72afae11-08a2-48b9-b27a-eb434ad90a19","resolution":{"observed_at":"2026-08-02T12:15:36.476876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04504","snapshot_observed_at":"2026-08-12T11:52:24.750109Z","title":"arXiv preprint arXiv:2509.04504 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.11027","last_updated":"2026-08-11T15:07:28Z","snapshot_observed_at":"2026-08-14T23:12:27.958263Z","submitted_at":"2026-08-11T15:07:28Z","title":"Mapping and Measuring the Behavioral Evolution of Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T11:52:24.750109Z"},"links":{"cited_paper":"/paper/2509.04504","citing_paper":"/paper/2608.11027"},"observation_digest":"sha256:2f91d4e6ed132ec0b9d10e911cabdbe4d73e11b0971630c96336980659d75805","observation_id":"117ac520-201a-4050-bc00-7f7a033673a2","resolution":{"observed_at":"2026-08-12T11:52:24.750109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2509.04504/citation-record","integrity":"/paper/2509.04504/integrity","json":"/paper/2509.04504/citation-record.json","paper":"/paper/2509.04504"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-05T12:04:07.725926Z","title":"Opt: Open pre-trained transformer language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:07.725926Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:6dc9cbc7f7aa91eac122a5422e42bad21ba3d225523636da0f595381c63075b4","observation_id":"27894d4b-329d-4aa4-af84-5d61342cbb8f","resolution":{"observed_at":"2026-08-05T12:04:07.725926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T12:04:07.805287Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:07.805287Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:e316e9673d8bad80e4cab0074180148e7b66f31fc9b6be60c39bffb1adbfdb31","observation_id":"527be7cc-77e9-4e5c-8d70-41edac7f6399","resolution":{"observed_at":"2026-08-05T12:04:07.805287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:04:07.879716Z","title":"Visual instruction tuning.Advances in neural information processing systems, 36, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:07.879716Z"},"links":{"citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:942510a71fc5671f4cd1a759208a4abf90c96e13ef93d95e6c7da04fa99f5398","observation_id":"3bf5cc7b-bdb9-4cd4-86d9-08da44344ef5","resolution":{"observed_at":"2026-08-05T12:04:07.879716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-05T12:04:07.951912Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:07.951912Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:f1f61acc12fa9294a017ad8df25fca6e3fe60e98deb5533eecd2df7ab0efa56c","observation_id":"07948307-46af-436b-911a-77dddad52066","resolution":{"observed_at":"2026-08-05T12:04:07.951912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-05T12:04:08.033770Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:08.033770Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:f42a4bac3bb2a605bdcf03a0b1705cd847a7d31c3bd5f7732dd37af8c40c44ca","observation_id":"1adc9ca0-d81c-4c94-bb3a-cdc3a6cded33","resolution":{"observed_at":"2026-08-05T12:04:08.033770Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1804.07461","last_updated":"2019-02-22T23:53:34Z","snapshot_observed_at":"2026-08-16T09:50:11.319379Z","submitted_at":"2018-04-20T06:35:04Z","title":"GLUE: A Multi-Task Benchmark and Analysis Platform for Natural Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1804.07461","snapshot_observed_at":"2026-08-05T12:04:08.126591Z","title":"Glue: A multi-task benchmark and analysis platform for natural language understanding","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:08.126591Z"},"links":{"cited_paper":"/paper/1804.07461","citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:0152f6afd18b81b53e7d1adbc235dd2115f936dc9666959dc9dabb3dbdd69765","observation_id":"5a63c54f-6fe2-4f30-ae94-b591328f53f7","resolution":{"observed_at":"2026-08-05T12:04:08.126591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:04:08.228418Z","title":"Superglue: A stickier benchmark for general-purpose language understanding systems","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:08.228418Z"},"links":{"citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:c37f70c59c97fb93b0a3ea12e71a595ec5fe4efc5531a7cc086a3bc62f132760","observation_id":"eb6b9a97-fff6-4b56-ad08-98fbaea5a516","resolution":{"observed_at":"2026-08-05T12:04:08.228418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-10T23:10:13.900680Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-05T12:04:08.369556Z","title":"Holistic evaluation of language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:08.369556Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:41d96ce90b9bcc4dee610e17ee4836ec9609a10e86f96d3b6caced7ae9206d9f","observation_id":"db3ddec0-ee3a-4b27-9d80-7eb0fe6fae23","resolution":{"observed_at":"2026-08-05T12:04:08.369556Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-05T12:04:08.460978Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:08.460978Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:9b1381638983740a6ce4c8483cb8e41341847c8c48412c28c5c516b70f33bba7","observation_id":"4fa7b725-b52d-45e0-8b72-29cddf72971e","resolution":{"observed_at":"2026-08-05T12:04:08.460978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:04:08.489296Z","title":"Judging llm-as-a-judge with mt-bench and chatbot arena","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:08.489296Z"},"links":{"citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:a74ef08a40b0180b72f013121e036830284ad2239773050154e5b1b016f0dfb2","observation_id":"089921d1-5279-466d-ba26-809c720e9e08","resolution":{"observed_at":"2026-08-05T12:04:08.489296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:04:10.671708Z","title":"Gifts differing: Understanding personality type","venue":null,"work_id":"1cd3c578-2d2e-423e-8204-97ea1b0dca5a","year":2010},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:08.605020Z"},"links":{"citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:0e78670f933a9c1e7b78305ded3e419110be0980203263e5c0d1dc7d78bfd7f7","observation_id":"5bb923c7-cf60-4dc3-9200-bdfc63772f7d","resolution":{"observed_at":"2026-08-05T12:04:10.678169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:04:08.734783Z","title":"Checkeval: A reliable llm-as-a-judge framework for evaluating text generation using checklists","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:08.734783Z"},"links":{"citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:8e720d17c62a213dc55f218d7cbcaa097999cf49dc6760aea52626844733ea28","observation_id":"4555e996-8f42-4382-8d3e-559df4a39d47","resolution":{"observed_at":"2026-08-05T12:04:08.734783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06003","last_updated":"2024-04-09T04:17:51Z","snapshot_observed_at":"2026-08-15T17:00:19.914157Z","submitted_at":"2024-04-09T04:17:51Z","title":"FreeEval: A Modular Framework for Trustworthy and Efficient Evaluation of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06003","snapshot_observed_at":"2026-08-05T12:04:08.940093Z","title":"Freeeval: A modular framework for trustworthy and efficient evaluation of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:08.940093Z"},"links":{"cited_paper":"/paper/2404.06003","citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:261098d9d4673c7314988aa04f3c3bed509d9c59fd12072bbc4cc04734553773","observation_id":"0c2c9326-3176-47d3-bd94-fa9397f04101","resolution":{"observed_at":"2026-08-05T12:04:08.940093Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07584","last_updated":"2024-07-22T07:07:06Z","snapshot_observed_at":"2026-08-13T00:32:51.282468Z","submitted_at":"2024-04-11T09:17:12Z","title":"UltraEval: A Lightweight Platform for Flexible and Comprehensive Evaluation for LLMs","version":3},"cited_work":{"arxiv_id":"2404.07584","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.07584","snapshot_observed_at":"2026-08-05T12:04:09.963820Z","title":"UltraEval: A Lightweight Platform for Flexible and Comprehensive Evaluation for LLMs","venue":"cs.CL","work_id":"2dcce785-353b-4204-9f21-dedcea6db3a8","year":2024},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:09.105197Z"},"links":{"cited_paper":"/paper/2404.07584","citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:1e11a10a6af743cb844c710359027f9e8b1783b1d3b30ac09941e11407f77875","observation_id":"6f138fb8-9bf2-42e6-b126-684a9c0efdcf","resolution":{"observed_at":"2026-08-05T12:04:10.150544Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:04:10.624444Z","title":"The waluigi effect","venue":null,"work_id":"01a8ebb5-a235-4d04-9cd4-8cf70677b268","year":2023},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:09.266832Z"},"links":{"citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:68f256d6b501baeecbdf3cc56874aa1ad39eb299d77c1f021a522835a1cd5f9f","observation_id":"9a928db3-6004-4dec-9b89-606bdd2a7e46","resolution":{"observed_at":"2026-08-05T12:04:10.632395Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00820","last_updated":"2024-11-28T22:01:57Z","snapshot_observed_at":"2026-08-14T01:54:50.530644Z","submitted_at":"2024-01-01T17:32:28Z","title":"A Computational Framework for Behavioral Assessment of LLM Therapists","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.00820","snapshot_observed_at":"2026-08-05T12:04:09.417454Z","title":"A computational framework for behavioral assessment of llm therapists","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:09.417454Z"},"links":{"cited_paper":"/paper/2401.00820","citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:90cef971df2247937c70f8385e474ec3586f5b2cf51c6f8be26b08bab57de0e4","observation_id":"849c67b7-9266-4733-b9aa-fbd0f4c6c464","resolution":{"observed_at":"2026-08-05T12:04:09.417454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:04:09.448435Z","title":"Learning on llm output signatures for gray-box behavior analysis","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:09.448435Z"},"links":{"citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:3e404873563abfe03e0d4f8f3d78304dfdf2f90ebef4137a6e95e7ebd302bde8","observation_id":"3b0ec61f-ec61-41ac-863a-513826aa83fd","resolution":{"observed_at":"2026-08-05T12:04:09.448435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14805","last_updated":"2024-02-22T18:57:20Z","snapshot_observed_at":"2026-08-13T04:12:37.302097Z","submitted_at":"2024-02-22T18:57:20Z","title":"Identifying Multiple Personalities in Large Language Models with External Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14805","snapshot_observed_at":"2026-08-05T12:04:09.501889Z","title":"Identifying multiple personalities in large language models with external evaluation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:09.501889Z"},"links":{"cited_paper":"/paper/2402.14805","citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:8c60ff9965a0a20e88a89f4b9c8f902dd7d2ea41500baa9179fb67184fb8b3f3","observation_id":"8de0819b-1298-4f83-8711-5f0370f25770","resolution":{"observed_at":"2026-08-05T12:04:09.501889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T12:04:10.603124Z","title":"behavioral fingerprint","venue":null,"work_id":"9978b97c-08b0-49ec-a196-1f9d57efe919","year":2025},"citing_paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T12:04:09.577795Z"},"links":{"citing_paper":"/paper/2509.04504"},"observation_digest":"sha256:f6cdb4e4029120d674d02408bd2c035714d00fcb7c02e27b28068c80642ede3e","observation_id":"930de71d-a330-491a-97db-56932d7a91e0","resolution":{"observed_at":"2026-08-05T12:04:10.609246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.04504","last_updated":"2025-09-02T07:03:20Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-05T12:04:06.559550Z","submitted_at":"2025-09-02T07:03:20Z","title":"Behavioral Fingerprinting of Large Language Models"},"reference_resolution":{"displayed":19,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":19},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 19 of 19 outbound references and 4 inbound Pith citation observations for arXiv:2509.04504."}