{"as_of":"2026-08-10T14:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bf0a81155c898c8f1649ae5bff2fc005d0a0e83185710d4a83b1d980f499f17e","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:41:58.026877Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T12:41:48.620040Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T12:42:36.874577Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"cited_work":{"arxiv_id":"2505.21399","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.21399","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Factual self-awareness in language models: Representation, robustness, and scaling","venue":null,"work_id":"5ac8feeb-39c6-4abb-b5b9-7cc7e585f414","year":2025},"citing_paper":{"arxiv_id":"2509.26238","last_updated":"2026-04-21T11:04:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-30T13:32:59Z","title":"Beyond Linear Probes: Dynamic Safety Monitoring for Language Models","version":4},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-18T12:41:48.620040Z"},"links":{"cited_paper":"/paper/2505.21399","citing_paper":"/paper/2509.26238"},"observation_digest":"sha256:503b4285ec44230402f8780b54605b10b8d0a5ab4be8e2573b1e5190c8a88528","observation_id":"ac32da1d-3dcd-44ee-8fef-00aa028b7c9d","resolution":{"observed_at":"2026-05-18T12:42:36.877686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.21399/citation-record","integrity":"/paper/2505.21399/integrity","json":"/paper/2505.21399/citation-record.json","paper":"/paper/2505.21399"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:54.922013Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:54.922013Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:473131e25ae1050fe2c0f11e3e839a2b5e35fc449a0e786835eee0d0b98dc992","observation_id":"5045ac70-1ca4-4d74-adf5-f1fe8fc5d34f","resolution":{"observed_at":"2026-08-07T13:41:54.922013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:55.019084Z","title":"A survey on hallucination in large language models: Principles, taxonomy, challenges, and open questions","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:55.019084Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:9ad50b62e8015e7a54ea35551ec0a13ccb4ad8ea014e20bdaf72c6219eb8bd15","observation_id":"95079b00-4a11-42cb-8cd0-f88c89075457","resolution":{"observed_at":"2026-08-07T13:41:55.019084Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.05221","last_updated":"2022-11-21T16:38:35Z","snapshot_observed_at":"2026-08-06T08:34:11.887259Z","submitted_at":"2022-07-11T22:59:39Z","title":"Language Models (Mostly) Know What They Know","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.05221","snapshot_observed_at":"2026-08-07T13:41:55.083026Z","title":"Language models (mostly) know what they know","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:55.083026Z"},"links":{"cited_paper":"/paper/2207.05221","citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:556b3287ea2b18b864aafeb476979443ee0392e07f7d83ad12bf0d2fef52e415","observation_id":"a799c9cc-f703-4a9c-9463-6c22227b0610","resolution":{"observed_at":"2026-08-07T13:41:55.083026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:42:02.183731Z","title":"Inference-time intervention: Eliciting truthful answers from a language model","venue":null,"work_id":"52427c27-d2bc-4458-b5de-31cb7c0f5205","year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:55.173773Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:d907f18a0aca3e4b502aca26ddafc9638b1ed44d280df7de9c3fe868cea060c4","observation_id":"ee4d5712-796c-4981-ac20-c75b398bf2f5","resolution":{"observed_at":"2026-08-07T13:42:02.264258Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:55.252095Z","title":"Mitchell","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:55.252095Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:046d95dc99fb7b9ab4bd129238aad49b60babfe00287714965eb5a35d8029a3d","observation_id":"f84fe498-cc02-4d7f-b284-b1aabbf0e920","resolution":{"observed_at":"2026-08-07T13:41:55.252095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:55.342908Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:55.342908Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:ffd1e7460b459406c5f948fc76c0843c4eb4a1fab28a614bb2e5cd2bd81de430","observation_id":"83f3f301-d68e-4604-bb25-815b443768cd","resolution":{"observed_at":"2026-08-07T13:41:55.342908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:42:01.949397Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":"dfc68c16-8bf7-4a2b-b0be-7a152a4618e7","year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:55.426542Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:98b9d93e95539753b5481714c97af4ec2db16ed4283b5f4cb7974025d6d444dd","observation_id":"f56b94f2-4d88-4257-8611-1a08d462c34b","resolution":{"observed_at":"2026-08-07T13:42:02.066993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03188","last_updated":"2023-08-30T03:47:34Z","snapshot_observed_at":"2026-08-09T17:18:47.922122Z","submitted_at":"2023-08-06T18:38:52Z","title":"Automatically Correcting Large Language Models: Surveying the landscape of diverse self-correction strategies","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.03188","snapshot_observed_at":"2026-08-07T13:41:55.503652Z","title":"Automatically correcting large language models: Surveying the landscape of diverse self-correction strategies","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:55.503652Z"},"links":{"cited_paper":"/paper/2308.03188","citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:d500fdf5e981a1d16435ac2d34ee268058c910ce5db22fe5398f7c9808272977","observation_id":"4045bb5e-1fa8-4628-a079-aaba7a2b878c","resolution":{"observed_at":"2026-08-07T13:41:55.503652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:42:01.803159Z","title":"On the self-verification limitations of large language models on reasoning and planning tasks","venue":null,"work_id":"9048da5d-9cc9-4b58-84a1-30176ea79684","year":2025},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:55.594958Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:70f58e5a6cef074913923e9772260fae6720ab6a454b808406eb039ff07d2c46","observation_id":"a76768c2-2c51-4a51-9972-26e4b63a0a21","resolution":{"observed_at":"2026-08-07T13:42:01.866647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14257","last_updated":"2025-02-08T12:50:42Z","snapshot_observed_at":"2026-07-06T19:53:52.079055Z","submitted_at":"2024-11-21T16:05:58Z","title":"Do I Know This Entity? Knowledge Awareness and Hallucinations in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.14257","snapshot_observed_at":"2026-08-07T13:41:55.687389Z","title":"Do i know this entity? knowledge awareness and hallucinations in language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:55.687389Z"},"links":{"cited_paper":"/paper/2411.14257","citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:6587b3b6f9bc4e187e79acf3600130d1ff0cd2de49ab960676bb2b9e8f116116","observation_id":"5c728957-0b90-44ff-a5be-e5dca66e38c2","resolution":{"observed_at":"2026-08-07T13:41:55.687389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T13:41:55.766792Z","title":"Gemma 2: Improving open language models at a practical size, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:55.766792Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:5fdfcdb68f976384bf0770ed32ab4dc928df4f6b7c1ee899b0cf6546a2b58b49","observation_id":"4b5ccc3e-88c8-4cbf-abce-a2b5428b5c0d","resolution":{"observed_at":"2026-08-07T13:41:55.766792Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.01373","last_updated":"2023-05-31T17:54:07Z","snapshot_observed_at":"2026-08-07T23:49:29.478548Z","submitted_at":"2023-04-03T20:58:15Z","title":"Pythia: A Suite for Analyzing Large Language Models Across Training and Scaling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.01373","snapshot_observed_at":"2026-08-07T13:41:55.859164Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:55.859164Z"},"links":{"cited_paper":"/paper/2304.01373","citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:c98fc357318f000f8819ff32aaadf3b37d438c0b52e066b209c8037427ff8b5c","observation_id":"46919ae5-1328-4c8f-bc5b-e61b9faef080","resolution":{"observed_at":"2026-08-07T13:41:55.859164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:55.934804Z","title":"Do large language models know what they don't know? In Anna Rogers, Jordan L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:55.934804Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:208972c43dbc83fd3ea69e7c7e3f9da408687b280749e728c9503d33c028e636","observation_id":"d3d9f668-9bfd-4716-8cc8-22f4b6bdd7e4","resolution":{"observed_at":"2026-08-07T13:41:55.934804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:42:01.632764Z","title":"Can llms replace neil degrasse tyson? evaluating the reliability of llms as science communicators","venue":null,"work_id":"b35b5684-ecac-4a9a-8f4a-51196f9e6509","year":2024},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.014565Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:a9ee9aefb7a03232c4d7cccd08236dd9e91d77c71a189296610bb6c8f54e5216","observation_id":"1435aefa-5906-41c2-9302-88904de0310f","resolution":{"observed_at":"2026-08-07T13:42:01.722803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.11120","last_updated":"2025-01-19T17:28:12Z","snapshot_observed_at":"2026-08-06T11:16:35.945498Z","submitted_at":"2025-01-19T17:28:12Z","title":"Tell me about yourself: LLMs are aware of their learned behaviors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.11120","snapshot_observed_at":"2026-08-07T13:41:56.079078Z","title":"Tell me about yourself: Llms are aware of their learned behaviors","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.079078Z"},"links":{"cited_paper":"/paper/2501.11120","citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:5e1ec6068fac8ed1f87dcf1ca7d08b77270bce4fd4a8881a0359d9b429769ced","observation_id":"d0d69705-22b9-400f-9c5b-10aa758c6c34","resolution":{"observed_at":"2026-08-07T13:41:56.079078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:42:01.452890Z","title":"Large language models must be taught to know what they don't know","venue":null,"work_id":"4f4fbd71-f7d1-428c-b7f8-9a1dc548654d","year":2024},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.157169Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:70cc418501cd4f8acc0dfc248309c088bbe17c26d38f52d575c6faa9b7438635","observation_id":"74ac85e9-4d5a-4ec5-8eab-ff3a8220d745","resolution":{"observed_at":"2026-08-07T13:42:01.535613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:56.211670Z","title":"Self-contrast: Better reflection through inconsistent solving perspectives","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.211670Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:54e094652283aed44def857436d10fa219f2defeab123f947311e068fc4c103d","observation_id":"b0c82315-5687-4828-ac7c-c2605c140cdc","resolution":{"observed_at":"2026-08-07T13:41:56.211670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:56.322903Z","title":"Le, Ed H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.322903Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:a2c3129a5838aad6f1ebdbe7d02372fc7d45460a297f23236b9268780ed7ad27","observation_id":"e39c096e-4c3d-465c-8d3b-2320e0d0e305","resolution":{"observed_at":"2026-08-07T13:41:56.322903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:42:01.228043Z","title":"INSIDE: llms' internal states retain the power of hallucination detection","venue":null,"work_id":"373d8a54-7514-42ce-b463-693e79a39e83","year":2024},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.394138Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:ad98bcfcb6bca20e4c3ab0324fd5efb4c6eb94f0ebe3743b7e8ce8975b690ff7","observation_id":"40b70064-f8b2-4784-a08a-9267955e4055","resolution":{"observed_at":"2026-08-07T13:42:01.364663Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.03282","last_updated":"2024-09-29T13:05:16Z","snapshot_observed_at":"2026-08-06T11:30:09.308345Z","submitted_at":"2024-07-03T17:08:52Z","title":"LLM Internal States Reveal Hallucination Risk Faced With a Query","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.03282","snapshot_observed_at":"2026-08-07T13:41:56.531343Z","title":"LLM internal states reveal hallucination risk faced with a query","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.531343Z"},"links":{"cited_paper":"/paper/2407.03282","citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:f0c057e545d21f5483d4871edf67db7fe2c0001ed73f3dbb2bf22deeb85144a5","observation_id":"3a49852b-fe53-4d74-bed8-9d2c72b837df","resolution":{"observed_at":"2026-08-07T13:41:56.531343Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:42:00.946545Z","title":"Towards monosemanticity: Decomposing language models with dictionary learning","venue":null,"work_id":"11159bff-c080-4439-a7b8-112e50e2ffe6","year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.618679Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:c66913e5b71ce39dd9d5ea3043b252696e55ddabf710a6a66bfdaeb4c0800d0a","observation_id":"d8969fa5-38c4-4dee-8492-0f0e4b1c466e","resolution":{"observed_at":"2026-08-07T13:42:01.064969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:42:00.689933Z","title":"Sparse autoencoders find highly interpretable features in language models","venue":null,"work_id":"2bb713b7-c279-4465-990f-8283a5e47011","year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.701728Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:ece02875b5dd11e490b02a0d288d90d52c9d5f3f1fbebbd8d38f9d16762db826","observation_id":"18e1fe59-6afe-43e3-ad00-56cc4f4ddfbb","resolution":{"observed_at":"2026-08-07T13:42:00.814319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.03658","last_updated":"2024-07-17T22:24:27Z","snapshot_observed_at":"2026-07-06T16:43:58.947915Z","submitted_at":"2023-11-07T01:59:11Z","title":"The Linear Representation Hypothesis and the Geometry of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.03658","snapshot_observed_at":"2026-08-07T13:41:56.759530Z","title":"The linear representation hypothesis and the geometry of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.759530Z"},"links":{"cited_paper":"/paper/2311.03658","citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:35224a0124cc863259e24c7e00cf976deb238871638482cabc0991ed2f8c231d","observation_id":"c2605246-cce2-4e1f-b418-c1bc61096cce","resolution":{"observed_at":"2026-08-07T13:41:56.759530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:42:00.378606Z","title":"Distributed representations of words and phrases and their compositionality","venue":null,"work_id":"681ce14c-d1c8-442d-9df2-8a96428d6e1c","year":2013},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.842522Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:bd4cbdabc82e4f18b442876ebf655ef1fe38f0f086048745ed2ab5981dda9c07","observation_id":"80809f29-14ec-41f4-8724-15384c72dda1","resolution":{"observed_at":"2026-08-07T13:42:00.486762Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:42:00.067487Z","title":"Inference-time intervention: Eliciting truthful answers from a language model","venue":null,"work_id":"f4e2505b-b6fb-408d-b76b-738bae9122e0","year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.895234Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:4c44fee2ba059e0ea5263a980622cdc2577ce9adf586434b0013528a2e976d06","observation_id":"2de16871-de4d-4537-92f0-386ec1ca6cf2","resolution":{"observed_at":"2026-08-07T13:42:00.205306Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.01405","last_updated":"2025-03-03T06:14:14Z","snapshot_observed_at":"2026-07-06T16:26:38.284922Z","submitted_at":"2023-10-02T17:59:07Z","title":"Representation Engineering: A Top-Down Approach to AI Transparency","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.01405","snapshot_observed_at":"2026-08-07T13:41:56.958567Z","title":"Representation engineering: A top-down approach to ai transparency","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:56.958567Z"},"links":{"cited_paper":"/paper/2310.01405","citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:35be42c141a9b53dda0f043e5353328bbdfcc7e97362271a379a9aa214b3415a","observation_id":"fca1fa49-5ef5-4762-a9dd-a33bef740c6e","resolution":{"observed_at":"2026-08-07T13:41:56.958567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:59.794468Z","title":"Saes are highly dataset dependent: A case study on the refusal direction","venue":null,"work_id":"fa1365c8-995f-4303-b2de-c8bff7cdf9a9","year":2024},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:57.071901Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:98ccf1cfb496a573703e6e9e6e7fca4a2a7ac116bc866597d83a2a52e3a290ba","observation_id":"02af764a-c886-4edf-b031-c47dbbe9f001","resolution":{"observed_at":"2026-08-07T13:41:59.918261Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.16496","last_updated":"2025-01-27T20:57:18Z","snapshot_observed_at":"2026-07-06T20:27:04.664873Z","submitted_at":"2025-01-27T20:57:18Z","title":"Open Problems in Mechanistic Interpretability","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.16496","snapshot_observed_at":"2026-08-07T13:41:57.279860Z","title":"Michaud, Stephen Casper, Max Tegmark, William Saunders, David Bau, Eric Todd, Atticus Geiger, Mor Geva, Jesse Hoogland, Daniel Murfet, and Tom McGrath","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:57.279860Z"},"links":{"cited_paper":"/paper/2501.16496","citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:3de629e3158a8b2d9c696c060aed9dfb7461fd0a8c9a64284fd1a60649038126","observation_id":"44b7442f-32c0-4d6c-94e5-e38f4619f4be","resolution":{"observed_at":"2026-08-07T13:41:57.279860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.17547","last_updated":"2025-03-21T21:43:28Z","snapshot_observed_at":"2026-08-07T16:44:55.194788Z","submitted_at":"2025-03-21T21:43:28Z","title":"Learning Multi-Level Features with Matryoshka Sparse Autoencoders","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.17547","snapshot_observed_at":"2026-08-07T13:41:57.359666Z","title":"Learning multi-level features with matryoshka sparse autoencoders","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:57.359666Z"},"links":{"cited_paper":"/paper/2503.17547","citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:d1252a115c2841e5fff85c708ac4c2b8bac145a9c5d63c85f290f4f3d33a705b","observation_id":"ac1a8290-6e72-4e91-b7c7-0be9661cf1d1","resolution":{"observed_at":"2026-08-07T13:41:57.359666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:59.452529Z","title":"Wikidata","venue":null,"work_id":"6ace3d91-3d0e-40a0-9cc7-0fb323da852c","year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:57.426826Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:5fad0b63f183945fdb396f9cb6e2d09723a07c7d112d7225c11cc36fcc5e7f9a","observation_id":"1bd34682-fb12-48c0-9375-f95742b16791","resolution":{"observed_at":"2026-08-07T13:41:59.592995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:57.483957Z","title":"Locating and editing factual associations in gpt","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:57.483957Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:46fe7b6d039adb7b20e49498cf9e43f5b9608c7db4848970fd75e42c2912bdfd","observation_id":"0ef15772-cb0b-4702-99c0-973fe07912dd","resolution":{"observed_at":"2026-08-07T13:41:57.483957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:57.563000Z","title":"Dissecting recall of factual associations in auto-regressive language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:57.563000Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:e395abdc70d82d09f15c986ae8dd3f4418405a0cfef31d91d0080ce9ef9ed4e8","observation_id":"c9ddcc0a-8290-4535-943c-e19cc527156b","resolution":{"observed_at":"2026-08-07T13:41:57.563000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:59.152212Z","title":"Fact finding: Attempting to reverse-engineer factual recall on the neuron level","venue":null,"work_id":"cec79609-b9d0-4bd0-aa23-b697fdb3054c","year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:57.626024Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:8ae67c5b946ba26b95aa73382f7b31ce4bc71631e5f4a1a41a30cf392c899d16","observation_id":"0ab8ae9d-8d99-4149-a193-745371acf754","resolution":{"observed_at":"2026-08-07T13:41:59.304081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05147","last_updated":"2024-08-19T07:51:05Z","snapshot_observed_at":"2026-08-04T11:44:14.524984Z","submitted_at":"2024-08-09T16:06:42Z","title":"Gemma Scope: Open Sparse Autoencoders Everywhere All At Once on Gemma 2","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.05147","snapshot_observed_at":"2026-08-07T13:41:57.703508Z","title":"Gemma scope: Open sparse autoencoders everywhere all at once on gemma 2","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:57.703508Z"},"links":{"cited_paper":"/paper/2408.05147","citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:a2582371661e330f1d6bdae334cc5a99a8e6ff38fd363bf2aa9bfcecc61dd714","observation_id":"43462163-784f-44bf-9fc6-bb51c38f0bd3","resolution":{"observed_at":"2026-08-07T13:41:57.703508Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:58.954129Z","title":"Demystifying prompts in language models via perplexity estimation","venue":null,"work_id":"f191c84e-af0f-48a5-b15a-11964d6b941a","year":2023},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:57.790715Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:0d45a5d8438fdda19c46e4f1c327739dc07089a525cf4847db2489fa615e46bf","observation_id":"8aae4ff6-b5b1-447c-81c9-52862d1dc857","resolution":{"observed_at":"2026-08-07T13:41:59.060236Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:58.701272Z","title":"Quantifying lms’ sensitivity to spurious prompt formatting","venue":null,"work_id":"264d58a7-4ecd-4975-ac16-9edda02341e5","year":2024},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:57.881070Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:2599f3419cdc1bfb2794d1a4a7e60ab20696a67deaefb312f27febd6f76b94b3","observation_id":"c2c99ab0-6d7d-46bd-aecb-c24bcdb66f87","resolution":{"observed_at":"2026-08-07T13:41:58.791245Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:57.969695Z","title":"Large language models are zero-shot reasoners","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:57.969695Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:f2268a9d6f133e282da2cb870ca584651dbe6053f7e4423ef57f380c332f756c","observation_id":"d79d578e-579d-48af-9254-5a36e8241f4a","resolution":{"observed_at":"2026-08-07T13:41:57.969695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:41:58.405400Z","title":"State of what art? a call for multi-prompt llm evaluation","venue":null,"work_id":"789bf602-34ef-4003-8355-0f38efe0ce73","year":2024},"citing_paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T13:41:58.026877Z"},"links":{"citing_paper":"/paper/2505.21399"},"observation_digest":"sha256:72e179231f4f642a94bdae047c92e72f551416f5e3571ce400ab55cdf3e3edc9","observation_id":"f2b5bb3c-52ef-42c6-ae7b-52705c704dba","resolution":{"observed_at":"2026-08-07T13:41:58.547664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.21399","last_updated":"2025-05-27T16:24:02Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T17:19:27.700339Z","submitted_at":"2025-05-27T16:24:02Z","title":"Factual Self-Awareness in Language Models: Representation, Robustness, and Scaling"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2505.21399."}