{"as_of":"2026-08-18T21:35:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3d647ee48ca5ade8fbdf0ceaa78eb1fe292ace2a5d8d0922f9a2870e3ebb37db","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T17:41:37.839642Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":6,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":6,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T05:53:49.268919Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":2,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12405","snapshot_observed_at":"2026-08-16T05:53:49.268919Z","title":"Evaluating the prompt steerability of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.19521","last_updated":"2025-08-21T07:12:54Z","snapshot_observed_at":"2026-08-18T01:04:30.301872Z","submitted_at":"2025-04-28T06:40:01Z","title":"Security Steerability is All You Need","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T05:53:49.268919Z"},"links":{"cited_paper":"/paper/2411.12405","citing_paper":"/paper/2504.19521"},"observation_digest":"sha256:2cc05035dbf556c50a626e348d71d5b77628b0b036b161b5601925803a7bbb25","observation_id":"b06137df-9d8d-4cec-8aef-ab9f3d0727af","resolution":{"observed_at":"2026-08-16T05:53:49.268919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12405","snapshot_observed_at":"2026-08-07T10:54:57.988680Z","title":"Daly, Pierre Dognin, Jesus Rios, Djallel Bouneffouf, and Miao Liu","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.04018","last_updated":"2026-06-22T12:47:48Z","snapshot_observed_at":"2026-08-17T17:07:51.786602Z","submitted_at":"2025-06-04T14:46:47Z","title":"AgentMisalignment: Measuring the Propensity for Misaligned Behaviour in LLM-Based Agents","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:54:57.988680Z"},"links":{"cited_paper":"/paper/2411.12405","citing_paper":"/paper/2506.04018"},"observation_digest":"sha256:b1a5aedd177c6336b74a6ee44f92fbc1047ebad6dd43ea336fa212dad6c8aaf8","observation_id":"9f869a5d-b89e-4782-a86e-4c4706e7bba7","resolution":{"observed_at":"2026-08-07T10:54:57.988680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12405","snapshot_observed_at":"2026-08-06T04:32:30.391727Z","title":"Evaluating the prompt steerability of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.03444","last_updated":"2025-08-05T13:41:32Z","snapshot_observed_at":"2026-08-12T14:58:57.753700Z","submitted_at":"2025-08-05T13:41:32Z","title":"An Auditable Agent Platform For Automated Molecular Optimisation","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-06T04:32:30.391727Z"},"links":{"cited_paper":"/paper/2411.12405","citing_paper":"/paper/2508.03444"},"observation_digest":"sha256:5c90afdbb636871cab335bbe8f009c869bc5983c6bca88403eb875e1a4f91244","observation_id":"bfba1236-9f15-4436-8e5c-85856d5dc69c","resolution":{"observed_at":"2026-08-06T04:32:30.391727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.12405","snapshot_observed_at":"2026-08-15T17:27:30.505364Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.13323","last_updated":"2026-05-29T04:50:24Z","snapshot_observed_at":"2026-08-16T15:15:00.472411Z","submitted_at":"2025-08-17T11:24:31Z","title":"AI Behavioral Science","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-15T17:27:30.505364Z"},"links":{"cited_paper":"/paper/2411.12405","citing_paper":"/paper/2509.13323"},"observation_digest":"sha256:9bef399f4bf197324228fcd6c4c647899b492041fdd83b55ae5b55ccf7d50a4d","observation_id":"dc0fad67-1014-46d3-a6d6-fdae6d6cfddb","resolution":{"observed_at":"2026-08-15T17:27:30.505364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"cited_work":{"arxiv_id":"2411.12405","doi":"10.48550/arxiv.2411.12405","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.12405","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2411.12405 (2025)","venue":"arXiv (Cornell University)","work_id":"e52e44d0-6ec2-41c9-afa3-e85e0256513d","year":2025},"citing_paper":{"arxiv_id":"2604.24079","last_updated":"2026-06-11T02:53:17Z","snapshot_observed_at":"2026-08-13T19:43:02.639903Z","submitted_at":"2026-04-27T06:01:47Z","title":"The Pragmatic Persona: Discovering LLM Persona through Bridging Inference","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-08T04:05:13.050792Z"},"links":{"cited_paper":"/paper/2411.12405","citing_paper":"/paper/2604.24079"},"observation_digest":"sha256:d59c1526499b0b7daa78304d5bbed282275e01a67488f327ecba265a4fdc4f43","observation_id":"ef0fd661-6cec-4f75-a1db-3df998ac2229","resolution":{"observed_at":"2026-05-09T00:14:27.138161Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"cited_work":{"arxiv_id":"2411.12405","doi":"10.48550/arxiv.2411.12405","metadata_source":"arxiv_reference","pith_arxiv_id":"2411.12405","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2411.12405 (2025)","venue":"arXiv (Cornell University)","work_id":"e52e44d0-6ec2-41c9-afa3-e85e0256513d","year":2025},"citing_paper":{"arxiv_id":"2606.20572","last_updated":"2026-04-28T12:14:30Z","snapshot_observed_at":"2026-08-14T05:21:43.746370Z","submitted_at":"2026-04-28T12:14:30Z","title":"Investigating Linguistic Steering: An Analysis of Adjectival Effects Across Large Language Model Architectures","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-01T09:01:34.038992Z"},"links":{"cited_paper":"/paper/2411.12405","citing_paper":"/paper/2606.20572"},"observation_digest":"sha256:e79a10c61f1fac428657756a6f648f71c55dc2299da291e777edf271456247da","observation_id":"273bc998-9712-4cde-af61-d363b7159f12","resolution":{"observed_at":"2026-07-01T09:05:36.554423Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.12405/citation-record","integrity":"/paper/2411.12405/integrity","json":"/paper/2411.12405/citation-record.json","paper":"/paper/2411.12405"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:37.607742Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.607742Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:29a7e25fcb85334294e8a36b0cbaf721ee718fbd11f9007a06678403df8c07d7","observation_id":"8aa62f06-3458-4eb8-a094-f29c9ce12d93","resolution":{"observed_at":"2026-08-12T17:41:37.607742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:37.613844Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.613844Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:588b7d9855b64bd5faeda8347296918530a08ad4fa3ad6bac66fea4d287b5ac3","observation_id":"f4158f4f-1a87-45f0-b754-4d8651d2951c","resolution":{"observed_at":"2026-08-12T17:41:37.613844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15337","last_updated":"2023-10-23T20:05:37Z","snapshot_observed_at":"2026-08-17T22:39:22.309092Z","submitted_at":"2023-10-23T20:05:37Z","title":"Moral Foundations of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15337","snapshot_observed_at":"2026-08-12T17:41:37.619963Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.619963Z"},"links":{"cited_paper":"/paper/2310.15337","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:41b9193170100f88511c2bcb21fc17636f7e816dadb105abea073abf74b2340b","observation_id":"d4b367cf-ba58-4054-ad75-43c4ca4b123c","resolution":{"observed_at":"2026-08-12T17:41:37.619963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13448","last_updated":"2023-10-20T12:29:51Z","snapshot_observed_at":"2026-08-16T14:50:25.203839Z","submitted_at":"2023-10-20T12:29:51Z","title":"Steering Large Language Models for Machine Translation with Finetuning and In-Context Learning","version":1},"cited_work":{"arxiv_id":"2310.13448","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.13448","snapshot_observed_at":"2026-08-12T17:41:38.471154Z","title":"Steering Large Language Models for Machine Translation with Finetuning and In-Context Learning","venue":"cs.CL","work_id":"d5ad54b3-2fc0-4c84-8b8e-2c3273d5e344","year":2023},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.626504Z"},"links":{"cited_paper":"/paper/2310.13448","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:c69182f58cc2b3a6dfd319eaf748e3f309e4f949d0a83eed066110e46497188d","observation_id":"4108345e-5975-4b9e-b15d-e753c19b757d","resolution":{"observed_at":"2026-08-12T17:41:38.478629Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:37.631940Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.631940Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:40c79c32470d5a490c5876f2e1f5adaa92af22804952700ec70865e4432aa441","observation_id":"fbe38eae-e774-42f4-8e7f-dbde6e44bc1f","resolution":{"observed_at":"2026-08-12T17:41:37.631940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-12T17:41:37.637083Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.637083Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:4c64aa1ef39e40e8ccfd08018d0d98acf95999e4f03d6a09c6298a565f3f6738","observation_id":"84153e73-afdc-497a-98d1-b965948ea50d","resolution":{"observed_at":"2026-08-12T17:41:37.637083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.04444","last_updated":"2024-07-03T22:23:50Z","snapshot_observed_at":"2026-08-16T14:55:40.245133Z","submitted_at":"2023-10-02T22:35:40Z","title":"What's the Magic Word? A Control Theory of LLM Prompting","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.04444","snapshot_observed_at":"2026-08-12T17:41:37.642442Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.642442Z"},"links":{"cited_paper":"/paper/2310.04444","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:c0ab7909eaf908d70a181675fbcf4ba34795d136938d1a3ac52d5b13885e4103","observation_id":"26394716-dd3c-4216-b0e2-dc57ce2ecee6","resolution":{"observed_at":"2026-08-12T17:41:37.642442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2005.14165","last_updated":"2020-07-22T19:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-05-28T17:29:03Z","title":"Language Models are Few-Shot Learners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.14165","snapshot_observed_at":"2026-08-12T17:41:37.647636Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.647636Z"},"links":{"cited_paper":"/paper/2005.14165","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:11a076d28a4dfc1818040c7e2bc3eff01a7c7c6675fe91aaab2a3a01f876ce75","observation_id":"ba842455-332c-4e74-91c3-c538a86e91c9","resolution":{"observed_at":"2026-08-12T17:41:37.647636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04070","last_updated":"2025-03-13T13:37:57Z","snapshot_observed_at":"2026-08-18T09:03:16.309421Z","submitted_at":"2024-10-05T08:00:55Z","title":"PAD: Personalized Alignment of LLMs at Decoding-Time","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04070","snapshot_observed_at":"2026-08-12T17:41:37.653815Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.653815Z"},"links":{"cited_paper":"/paper/2410.04070","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:a98db58e34f2a9f7eec9055b86d1dc5065b364bb3db2481e9c06fc51a842ff85","observation_id":"040ff7b4-a903-489b-8824-232af3fd036f","resolution":{"observed_at":"2026-08-12T17:41:37.653815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18189","last_updated":"2023-05-29T16:29:22Z","snapshot_observed_at":"2026-08-16T15:28:37.115358Z","submitted_at":"2023-05-29T16:29:22Z","title":"Marked Personas: Using Natural Language Prompts to Measure Stereotypes in Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18189","snapshot_observed_at":"2026-08-12T17:41:37.659054Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.659054Z"},"links":{"cited_paper":"/paper/2305.18189","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:c4d72dd67f9137e3b8f625bde7c13255b6629bfde01b5528344e65a4069fbd07","observation_id":"08ea60ec-06a1-4052-912e-4e5117b58840","resolution":{"observed_at":"2026-08-12T17:41:37.659054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10271","last_updated":"2024-06-04T14:34:38Z","snapshot_observed_at":"2026-08-16T14:00:38.756250Z","submitted_at":"2024-04-16T03:59:33Z","title":"Social Choice Should Guide AI Alignment in Dealing with Diverse Human Feedback","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10271","snapshot_observed_at":"2026-08-12T17:41:37.664353Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.664353Z"},"links":{"cited_paper":"/paper/2404.10271","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:f199c991f9183252a3e1001425462ad730da18fbd217cfd4fccdcc0cab7eef10","observation_id":"070c05e0-ce12-4b55-b779-1afc724a0749","resolution":{"observed_at":"2026-08-12T17:41:37.664353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15951","last_updated":"2024-10-11T00:05:03Z","snapshot_observed_at":"2026-08-16T13:40:28.103117Z","submitted_at":"2024-06-22T22:07:40Z","title":"Modular Pluralism: Pluralistic Alignment via Multi-LLM Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15951","snapshot_observed_at":"2026-08-12T17:41:37.669774Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.669774Z"},"links":{"cited_paper":"/paper/2406.15951","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:a6834df2f41e935d6a6edf6e3412fb6191fb4f3916d2e18850558dde0c68c665","observation_id":"d71f37de-ed6d-4b74-afa8-508ac0b48d95","resolution":{"observed_at":"2026-08-12T17:41:37.669774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:37.674861Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.674861Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:bf882d335e524756c140337f41a23f2170f0e3d5dcd5fdba70322b7d4a8c8560","observation_id":"42b2fa4d-3b1d-40d0-a900-2eb5da1c9ab5","resolution":{"observed_at":"2026-08-12T17:41:37.674861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.11009","last_updated":"2024-06-25T22:35:07Z","snapshot_observed_at":"2026-08-16T13:39:36.735870Z","submitted_at":"2024-06-25T22:35:07Z","title":"CharED: Character-wise Ensemble Decoding for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.11009","snapshot_observed_at":"2026-08-12T17:41:37.679520Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.679520Z"},"links":{"cited_paper":"/paper/2407.11009","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:3b678f67d5a36ab526fdcc9bd29d35ce79d97f9eab236cead19064462fbe7c6e","observation_id":"12ae1958-6f04-4460-aa79-e72512fd0f21","resolution":{"observed_at":"2026-08-12T17:41:37.679520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:37.684478Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.684478Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:4573a3a8ca93c9ff7aee1a76b4ae48892dc2d83592ed17f43edd8e2cfad1474b","observation_id":"b0a16491-0bee-4d25-939c-83c562d27c7b","resolution":{"observed_at":"2026-08-12T17:41:37.684478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.01768","last_updated":"2025-02-06T03:33:08Z","snapshot_observed_at":"2026-08-16T13:55:47.418882Z","submitted_at":"2024-05-02T22:37:38Z","title":"Context Steering: Controllable Personalization at Inference Time","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.01768","snapshot_observed_at":"2026-08-12T17:41:37.689178Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.689178Z"},"links":{"cited_paper":"/paper/2405.01768","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:bfa7fa0a23a898f009c395ffaf8c6ae7bc76f0cf78957729bf949aa022f54e57","observation_id":"d5e45457-3610-4a40-b429-ef9bb8a5b89c","resolution":{"observed_at":"2026-08-12T17:41:37.689178Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:37.693988Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.693988Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:76f78d3ba0d51c78071411d32a2ab18b89b727266ad6b1cc25d78557a5a15680","observation_id":"06c59bec-ccff-46f2-b23a-0d1713794b69","resolution":{"observed_at":"2026-08-12T17:41:37.693988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:38.624672Z","title":null,"venue":null,"work_id":"25232401-f3da-4bb7-8b2f-dbbdd67a5c5a","year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.699814Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:1465cf8af74e1afaa014601829df63e5b369e0e08581c073b12ec5184c146413","observation_id":"2961b6b9-3d7d-4332-bae9-52ff9e9c9a30","resolution":{"observed_at":"2026-08-12T17:41:38.631681Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.10636","last_updated":"2024-04-17T16:27:37Z","snapshot_observed_at":"2026-08-18T13:07:45.505268Z","submitted_at":"2024-03-27T18:12:02Z","title":"What are human values, and how do we align AI to them?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.10636","snapshot_observed_at":"2026-08-12T17:41:37.704779Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.704779Z"},"links":{"cited_paper":"/paper/2404.10636","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:043496d780e767cd34f7ff98db065f4c04f68f201e35e0a685173cc965f446a1","observation_id":"2608deb9-74c1-44bc-b8b7-e10bce25842b","resolution":{"observed_at":"2026-08-12T17:41:37.704779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.07870","last_updated":"2023-11-07T16:28:33Z","snapshot_observed_at":"2026-08-16T15:16:00.040207Z","submitted_at":"2023-07-15T19:04:33Z","title":"Large Language Models as Superpositions of Cultural Perspectives","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.07870","snapshot_observed_at":"2026-08-12T17:41:37.709708Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.709708Z"},"links":{"cited_paper":"/paper/2307.07870","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:fa95a47996335eb7ef871bfdf76070430b76f6b09926a5b2c13d0e20914bae6e","observation_id":"fb6015f3-3ac4-4e8f-85c2-4c5f6ca3c189","resolution":{"observed_at":"2026-08-12T17:41:37.709708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.10927","last_updated":"2024-12-15T17:38:58Z","snapshot_observed_at":"2026-08-16T13:17:56.436250Z","submitted_at":"2024-09-17T06:51:59Z","title":"Propulsion: Steering LLM with Tiny Fine-Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.10927","snapshot_observed_at":"2026-08-12T17:41:37.714827Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.714827Z"},"links":{"cited_paper":"/paper/2409.10927","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:359328a10c1477d4d58cf039dbedf6f16f64e78638f577d2f9d3f2a3e126ec74","observation_id":"9e8cedc7-2aaf-4101-84fc-ced3eba60610","resolution":{"observed_at":"2026-08-12T17:41:37.714827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05907","last_updated":"2025-02-17T20:23:19Z","snapshot_observed_at":"2026-08-16T13:20:42.975625Z","submitted_at":"2024-09-06T15:47:40Z","title":"Programming Refusal with Conditional Activation Steering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05907","snapshot_observed_at":"2026-08-12T17:41:37.719599Z","title":"Lee, Inkit Padhi, Karthikeyan Natesan Ramamurthy, Erik Miehling, Pierre Dognin, Manish Nagireddy, and Amit Dhurandhar","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.719599Z"},"links":{"cited_paper":"/paper/2409.05907","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:6fbf1d51c50075b8dddfa699a9f4ef416b739c8f1e0242c01d6648f0cc4224e5","observation_id":"59a40dfb-8f62-4a62-94d8-4271a014cbdf","resolution":{"observed_at":"2026-08-12T17:41:37.719599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-16T20:01:36.160048Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-12T17:41:37.724304Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.724304Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:3c78e7223031033cf559d33358118c77471040a17fb02d9ac072d8d082eae706","observation_id":"ca2d3d15-dc02-4225-a0be-8cb1858bceb2","resolution":{"observed_at":"2026-08-12T17:41:37.724304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:38.608199Z","title":"How do nonlinear transformers learn and generalize in in-context learning? In Forty-first International Conference on Machine Learning","venue":null,"work_id":"8ebb9b28-6d7e-4b6a-9424-f75ecd493f32","year":null},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.729246Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:f01ca057c4cd2d81f86bb146e8494267e178c48aa97d20fe7b30855bba0da4ae","observation_id":"1e953fee-b4a4-4740-88a9-47e5b3ec9edc","resolution":{"observed_at":"2026-08-12T17:41:38.613522Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.04978","last_updated":"2024-04-02T18:29:52Z","snapshot_observed_at":"2026-08-16T14:44:50.862516Z","submitted_at":"2023-11-08T19:01:13Z","title":"On the steerability of large language models toward data-driven personas","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.04978","snapshot_observed_at":"2026-08-12T17:41:37.734102Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.734102Z"},"links":{"cited_paper":"/paper/2311.04978","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:729225f34f43b02e3617cc5b59419721514cd4b1a9677be049ce4b31b496c709","observation_id":"28dbff7e-8f6e-49c1-aecc-7db35f08032f","resolution":{"observed_at":"2026-08-12T17:41:37.734102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:38.592659Z","title":null,"venue":null,"work_id":"aba603fa-6eea-42b2-b81b-822b23227334","year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.739151Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:267767e8aeeff83b4ccb3ba2440f306471f504b05f0d9d42313fcdc4a0a37a26","observation_id":"5a08b799-4132-4fd3-9f6d-8e0c892225ab","resolution":{"observed_at":"2026-08-12T17:41:38.597211Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20253","last_updated":"2024-05-30T17:06:03Z","snapshot_observed_at":"2026-08-16T13:47:40.066503Z","submitted_at":"2024-05-30T17:06:03Z","title":"Evaluating Large Language Model Biases in Persona-Steered Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20253","snapshot_observed_at":"2026-08-12T17:41:37.744071Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.744071Z"},"links":{"cited_paper":"/paper/2405.20253","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:286f817636ff835a6a59e30e491b4d557cfb71b3f13c2e3af4ebc2c88e4af545","observation_id":"a5c00417-40fd-42d9-9c2d-a9cf022520d1","resolution":{"observed_at":"2026-08-12T17:41:37.744071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.15115","last_updated":"2024-06-22T12:17:38Z","snapshot_observed_at":"2026-08-16T14:07:23.040562Z","submitted_at":"2024-03-22T11:16:43Z","title":"Language Models in Dialogue: Conversational Maxims for Human-AI Interactions","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.15115","snapshot_observed_at":"2026-08-12T17:41:37.749236Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.749236Z"},"links":{"cited_paper":"/paper/2403.15115","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:def92c1d4d57be0790967ec0a0d7de9bdea3dd939de4d2560c158fec84c7f0cf","observation_id":"fcb4f6f1-7bd9-4b4d-bdc5-5f50c3ce60d8","resolution":{"observed_at":"2026-08-12T17:41:37.749236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.09251","last_updated":"2022-12-19T05:13:52Z","snapshot_observed_at":"2026-08-18T16:15:54.291044Z","submitted_at":"2022-12-19T05:13:52Z","title":"Discovering Language Model Behaviors with Model-Written Evaluations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.09251","snapshot_observed_at":"2026-08-12T17:41:37.754124Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.754124Z"},"links":{"cited_paper":"/paper/2212.09251","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:6836d0968ec9d3c3d9420fb2e057c3c5a01c21764ed8cd3fa6a1828a46b857e7","observation_id":"3c7e512d-8568-430e-bb5d-4f7248282633","resolution":{"observed_at":"2026-08-12T17:41:37.754124Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06681","last_updated":"2024-07-05T15:30:45Z","snapshot_observed_at":"2026-08-15T08:04:06.283165Z","submitted_at":"2023-12-09T04:40:46Z","title":"Steering Llama 2 via Contrastive Activation Addition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06681","snapshot_observed_at":"2026-08-12T17:41:37.759134Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.759134Z"},"links":{"cited_paper":"/paper/2312.06681","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:f2def748095145c17a6b81cbadf3db13041477f4e9eb702d3416ad1aea97b256","observation_id":"592d5477-45f9-4c4f-8636-ae2fd93e5012","resolution":{"observed_at":"2026-08-12T17:41:37.759134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.18416","last_updated":"2025-09-05T16:33:46Z","snapshot_observed_at":"2026-08-18T16:04:07.837707Z","submitted_at":"2024-07-25T22:24:45Z","title":"PersonaGym: Evaluating Persona Agents and LLMs","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.18416","snapshot_observed_at":"2026-08-12T17:41:37.764144Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.764144Z"},"links":{"cited_paper":"/paper/2407.18416","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:1b16142db90ff70eaafb8c8f9cae4e796808ffdc592fcc61d062bf1286aa72ca","observation_id":"407674b5-dcd3-4ab3-a452-59a50cfc42f3","resolution":{"observed_at":"2026-08-12T17:41:37.764144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:37.769206Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.769206Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:14920e74769bffe58a74767bdfb8bcdd96788172d067e73ca414505852e5c131","observation_id":"7de1a0d9-f186-416b-a3ab-d83fe393a83b","resolution":{"observed_at":"2026-08-12T17:41:37.769206Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:38.566363Z","title":null,"venue":null,"work_id":"6a02964f-80d8-442d-9e7f-f88db145218d","year":2012},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.774452Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:0132b07f3029996e582a4ee12936bae4902dfbf852df594f6a1fb810d7146d56","observation_id":"a2083548-c992-489e-8e43-446888144444","resolution":{"observed_at":"2026-08-12T17:41:38.571810Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:38.550898Z","title":null,"venue":null,"work_id":"9eddadfb-eba8-489a-bb2a-dca45eb779c1","year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.779199Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:11647aa546c7c96b02e53b1c278ffa28aeb19ae68d9735c7c0d6a0cf606fc2ca","observation_id":"0f9709d4-ee51-4b12-b4c9-72c17f22477b","resolution":{"observed_at":"2026-08-12T17:41:38.555721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:38.534419Z","title":null,"venue":null,"work_id":"6ca73497-1979-4368-acdf-60f68066190e","year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.783952Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:23d9767db43664db6d05b6da6bd180de23c1785fdb7f8fa2b6ef8f517364d386","observation_id":"c4d5d47c-c1fc-42f5-80b5-dbe911ae4c92","resolution":{"observed_at":"2026-08-12T17:41:38.539854Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.05070","last_updated":"2024-08-20T19:14:31Z","snapshot_observed_at":"2026-08-14T17:53:51.886327Z","submitted_at":"2024-02-07T18:21:17Z","title":"A Roadmap to Pluralistic Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.05070","snapshot_observed_at":"2026-08-12T17:41:37.789564Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.789564Z"},"links":{"cited_paper":"/paper/2402.05070","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:4de9c3544061c06575434d52b91bc8e9030767f7882f7fbecbf72732a1f558a6","observation_id":"bd8d25af-9e42-447a-a9ff-111ca1b4eccb","resolution":{"observed_at":"2026-08-12T17:41:37.789564Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15518","last_updated":"2024-06-21T01:37:39Z","snapshot_observed_at":"2026-08-16T13:40:54.065206Z","submitted_at":"2024-06-21T01:37:39Z","title":"Steering Without Side Effects: Improving Post-Deployment Control of Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15518","snapshot_observed_at":"2026-08-12T17:41:37.794346Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.794346Z"},"links":{"cited_paper":"/paper/2406.15518","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:cc8742026273e47633b049a904a49e31cce1514c7febfd820978ce44d528d92f","observation_id":"0022fd8b-2d63-4a0c-8137-4484d851c965","resolution":{"observed_at":"2026-08-12T17:41:37.794346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.17345","last_updated":"2024-06-06T11:53:23Z","snapshot_observed_at":"2026-08-16T13:48:57.789745Z","submitted_at":"2024-05-27T16:49:22Z","title":"Exploring and steering the moral compass of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.17345","snapshot_observed_at":"2026-08-12T17:41:37.799331Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.799331Z"},"links":{"cited_paper":"/paper/2405.17345","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:f2937d8ed748b2e59b8bec30130b4b58d2dd858894811141d0f497f4594e4bfc","observation_id":"af7dd123-e1d1-4b7c-ae57-80e3020b858e","resolution":{"observed_at":"2026-08-12T17:41:37.799331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.10248","last_updated":"2024-10-10T13:20:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-20T12:21:05Z","title":"Steering Language Models With Activation Engineering","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.10248","snapshot_observed_at":"2026-08-12T17:41:37.804325Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.804325Z"},"links":{"cited_paper":"/paper/2308.10248","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:9682df4ff316fcdae23225e281f7762c6a98296ca9639fe47d4f56cb9171c856","observation_id":"4ac29ab4-4652-421c-9f98-8ef1804a0dd0","resolution":{"observed_at":"2026-08-12T17:41:37.804325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14499","last_updated":"2024-07-04T12:51:29Z","snapshot_observed_at":"2026-08-16T14:16:16.163983Z","submitted_at":"2024-02-22T12:47:33Z","title":"\"My Answer is C\": First-Token Probabilities Do Not Match Text Answers in Instruction-Tuned Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14499","snapshot_observed_at":"2026-08-12T17:41:37.809204Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.809204Z"},"links":{"cited_paper":"/paper/2402.14499","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:70522c814e00bfbec9495f65bf7d6878b9425b05a9c33376569b295f00716f67","observation_id":"af6b22c8-9651-44a9-a4c5-fe9dc290e71e","resolution":{"observed_at":"2026-08-12T17:41:37.809204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-08-18T13:27:58.239266Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-12T17:41:37.814156Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.814156Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:46f47ed308e1721a76d3d37d2371050470043dba7cbc9d4dd65c2887e281a049","observation_id":"2d15a519-9ab5-4c5d-9b26-06ce2aaf7a31","resolution":{"observed_at":"2026-08-12T17:41:37.814156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:37.818994Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.818994Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:baa5b5f2a2d1b6236df78286e9a2ee51e86ab3bda2d1d58ee7a40efb89ba8ab7","observation_id":"7158f4f1-e44e-4713-b4e7-ca9e648f6fe9","resolution":{"observed_at":"2026-08-12T17:41:37.818994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.11082","last_updated":"2024-06-03T12:19:16Z","snapshot_observed_at":"2026-08-16T15:39:11.892424Z","submitted_at":"2023-04-19T17:50:09Z","title":"Fundamental Limitations of Alignment in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.11082","snapshot_observed_at":"2026-08-12T17:41:37.823892Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.823892Z"},"links":{"cited_paper":"/paper/2304.11082","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:40419d25d756435db777c955e7a9829267aea44b26bc4fa89f057dbf23e83143","observation_id":"396802aa-a2a3-4cc7-91d3-2eeab30d07ca","resolution":{"observed_at":"2026-08-12T17:41:37.823892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03642","last_updated":"2024-12-15T21:40:35Z","snapshot_observed_at":"2026-08-16T13:12:29.668319Z","submitted_at":"2024-10-04T17:48:29Z","title":"Aligning LLMs with Individual Preferences via Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03642","snapshot_observed_at":"2026-08-12T17:41:37.829646Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.829646Z"},"links":{"cited_paper":"/paper/2410.03642","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:372aa459746e12c0f80d150c5fe4d2eee194506ad0d0932f5aabc8a87db6c1a9","observation_id":"ed24eca5-6458-4407-a22c-d7375c01932d","resolution":{"observed_at":"2026-08-12T17:41:37.829646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.10766","last_updated":"2023-11-15T10:29:28Z","snapshot_observed_at":"2026-08-18T04:14:33.431089Z","submitted_at":"2023-11-15T10:29:28Z","title":"Value FULCRA: Mapping Large Language Models to the Multidimensional Spectrum of Basic Human Values","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.10766","snapshot_observed_at":"2026-08-12T17:41:37.834841Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.834841Z"},"links":{"cited_paper":"/paper/2311.10766","citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:580fcc04005ff5caac4143ceeb0da8befc783cb1430da6474599fe9e5b347771","observation_id":"a4700da1-00d5-4eb2-82a0-837e43fb0b3b","resolution":{"observed_at":"2026-08-12T17:41:37.834841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T17:41:38.507648Z","title":null,"venue":null,"work_id":"fee4742d-108f-4457-a89e-644adf788f8e","year":2022},"citing_paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-12T17:41:37.839642Z"},"links":{"citing_paper":"/paper/2411.12405"},"observation_digest":"sha256:b021c45ea3668b8a64dfc8b772f8e18d62c5ee97fab0f5e802bcc63d54ea36ff","observation_id":"a23900c1-73a1-44f4-ba2e-17545e2bd10a","resolution":{"observed_at":"2026-08-12T17:41:38.513075Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.12405","last_updated":"2025-02-15T15:34:26Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T17:10:03.145194Z","submitted_at":"2024-11-19T10:41:54Z","title":"Evaluating the Prompt Steerability of Large Language Models"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 6 inbound Pith citation observations for arXiv:2411.12405."}