{"as_of":"2026-08-10T01:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4d9d8e0ddea20ebc03f30e840f985394d21f7943b67059cf403ddde835d659b5","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:44:21.494870Z","state":"measured"},{"denominator":34,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":34,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-07T16:37:58.860183Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T23:36:36.042184Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"cited_work":{"arxiv_id":"2505.23729","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23729","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Bounded rationality for LLMs : Satisficing alignment at inference-time","venue":null,"work_id":"44a6f3ca-f25f-4682-aba4-5bd8f20d1bed","year":2025},"citing_paper":{"arxiv_id":"2604.25088","last_updated":"2026-04-28T00:48:20Z","snapshot_observed_at":"2026-07-06T23:11:02.043135Z","submitted_at":"2026-04-28T00:48:20Z","title":"Cooperate to Compete: Strategic Coordination in Multi-Agent Conquest","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-07T16:37:58.860183Z"},"links":{"cited_paper":"/paper/2505.23729","citing_paper":"/paper/2604.25088"},"observation_digest":"sha256:37b2904b8072adcd32b15b521b2cb8c225fa005c5e72e10aa7fdea034b56ff3d","observation_id":"8f601549-2e01-452d-b487-9eec480b1316","resolution":{"observed_at":"2026-05-11T23:36:36.044970Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.23729/citation-record","integrity":"/paper/2505.23729/integrity","json":"/paper/2505.23729/citation-record.json","paper":"/paper/2505.23729"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:44:19.523685Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:19.523685Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:06d5e29e8c4683742e94a7e4f045499f6ce97c64a1d9cd58bf0bef7e7f1df1ae","observation_id":"891401d7-bf5f-47c7-9988-f9ac8ed458a0","resolution":{"observed_at":"2026-08-07T12:44:19.523685Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-07T12:44:19.570449Z","title":"A general language assistant as a laboratory for alignment","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:19.570449Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:a0adf5ec77e9c5a49f71e788fd86fc414618730c65d5e65675dec883fb045238","observation_id":"ee71dafe-1d62-4a28-8fbe-9dbfed2a7323","resolution":{"observed_at":"2026-08-07T12:44:19.570449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T12:44:19.670874Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:19.670874Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:4862d840d1c49bfeb035766d23c5e47c00fc4317f00fb187aec452c433192e8b","observation_id":"337d917b-3659-4729-a39a-759dfda77eb1","resolution":{"observed_at":"2026-08-07T12:44:19.670874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:19.715883Z","title":null,"venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:19.715883Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:22c6f67e6bcc6c6ada1d50a33e97e3bc73032f8aff3af02729d2428c64d0a8ef","observation_id":"1c67c8a4-6df2-4479-8e87-fd1722545232","resolution":{"observed_at":"2026-08-07T12:44:19.715883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20495","last_updated":"2024-05-30T21:36:12Z","snapshot_observed_at":"2026-08-09T07:26:50.208136Z","submitted_at":"2024-05-30T21:36:12Z","title":"Transfer Q Star: Principled Decoding for LLM Alignment","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20495","snapshot_observed_at":"2026-08-07T12:44:19.777137Z","title":"S., Yin, M., Manocha, D., Wang, M., Bedi, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:19.777137Z"},"links":{"cited_paper":"/paper/2405.20495","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:92655befdd0ca1108973c05d3be72e9832fa1e6bd7af48956d43485e51f7dbe2","observation_id":"3402ccd8-14fa-4630-85fb-68f2df3180cb","resolution":{"observed_at":"2026-08-07T12:44:19.777137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.01335","last_updated":"2024-06-14T21:17:17Z","snapshot_observed_at":"2026-07-06T17:10:56.398607Z","submitted_at":"2024-01-02T18:53:13Z","title":"Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.01335","snapshot_observed_at":"2026-08-07T12:44:19.813333Z","title":"Self-play fine-tuning converts weak language models to strong language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:19.813333Z"},"links":{"cited_paper":"/paper/2401.01335","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:ca3455f02aeb9a125eafc7d38ca913bc90c3a9653898fc00564b09c0b4ec317b","observation_id":"c8a48e54-160c-4bad-be69-9dc30f79c723","resolution":{"observed_at":"2026-08-07T12:44:19.813333Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:23.448314Z","title":"Safe rlhf: Safe reinforcement learning from human feedback","venue":null,"work_id":"e963613e-7b1f-4fea-87a4-53ef7c12f8e6","year":null},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:19.848413Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:4cb96cd1c36a329dd7797f51e754702906ebc28c5a44c986746ff40a66fac00a","observation_id":"2b558640-201d-451f-865b-bbbced157d82","resolution":{"observed_at":"2026-08-07T12:44:23.483038Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06767","last_updated":"2023-12-01T14:28:06Z","snapshot_observed_at":"2026-08-07T04:02:54.504761Z","submitted_at":"2023-04-13T18:22:40Z","title":"RAFT: Reward rAnked FineTuning for Generative Foundation Model Alignment","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06767","snapshot_observed_at":"2026-08-07T12:44:19.890936Z","title":"Raft: Reward ranked finetuning for generative foundation model alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:19.890936Z"},"links":{"cited_paper":"/paper/2304.06767","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:bc18e88ca78badc5502e99ae640449b4ee88b978711b7adf26cfdccf2c789cd4","observation_id":"f8a887c8-851c-46d3-9390-2239f5b8c0b1","resolution":{"observed_at":"2026-08-07T12:44:19.890936Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.14393","last_updated":"2024-01-19T17:33:44Z","snapshot_observed_at":"2026-07-06T16:23:30.533693Z","submitted_at":"2023-09-25T14:50:04Z","title":"LLMCarbon: Modeling the end-to-end Carbon Footprint of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.14393","snapshot_observed_at":"2026-08-07T12:44:19.930035Z","title":"Llmcarbon: Modeling the end-to-end carbon footprint of large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:19.930035Z"},"links":{"cited_paper":"/paper/2309.14393","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:5e41f6e9add9d5e32be81dfc70d75b3299dfef3ee53668061374af53fb613908","observation_id":"54d9b4db-9fb7-4734-9ae9-fff583816ab7","resolution":{"observed_at":"2026-08-07T12:44:19.930035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.14375","last_updated":"2022-09-28T19:04:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-28T19:04:43Z","title":"Improving alignment of dialogue agents via targeted human judgements","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.14375","snapshot_observed_at":"2026-08-07T12:44:19.989378Z","title":"Improving alignment of dialogue agents via targeted human judgements","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:19.989378Z"},"links":{"cited_paper":"/paper/2209.14375","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:5a1529f8a5778457899be64ea8a36aeb54ff5248e5ac323d8a564b4674dc9f5a","observation_id":"ffc54cc7-49e8-4bb7-aa0c-757e345d2a40","resolution":{"observed_at":"2026-08-07T12:44:19.989378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:20.011975Z","title":"Y., Sengupta, S., Bonadiman, D., Lai, Y.-a., Gupta, A., Pappas, N., Mansour, S., Kirchhoff, K., and Roth, D","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.011975Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:ec3d5d0beaf2bb04a3b26344cee6cb567d647a153ccc83f4de92002ed0afe6f7","observation_id":"ceadafea-0f80-4831-9f45-f568c50a5e4a","resolution":{"observed_at":"2026-08-07T12:44:20.011975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19544","last_updated":"2024-11-22T05:55:58Z","snapshot_observed_at":"2026-07-06T18:22:18.644161Z","submitted_at":"2024-05-29T22:12:52Z","title":"One-Shot Safety Alignment for Large Language Models via Optimal Dualization","version":3},"cited_work":{"arxiv_id":"2405.19544","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.19544","snapshot_observed_at":"2026-08-07T12:44:21.840636Z","title":"One-Shot Safety Alignment for Large Language Models via Optimal Dualization","venue":"cs.AI","work_id":"e7aa38da-c4e4-4a60-8d7e-f1d540857a55","year":2024},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.062006Z"},"links":{"cited_paper":"/paper/2405.19544","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:4b95f9bff9ce2334a273a77cfb1e2c80cc73efc4ecccdef39188541c7e272514","observation_id":"61a98890-281d-4596-b4b6-033b3d05fab0","resolution":{"observed_at":"2026-08-07T12:44:21.936517Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11564","last_updated":"2023-10-17T20:22:13Z","snapshot_observed_at":"2026-07-06T16:34:42.650324Z","submitted_at":"2023-10-17T20:22:13Z","title":"Personalized Soups: Personalized Large Language Model Alignment via Post-hoc Parameter Merging","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11564","snapshot_observed_at":"2026-08-07T12:44:20.132271Z","title":"Y., Wang, Y., Hessel, J., Zettlemoyer, L., Hajishirzi, H., Choi, Y., and Ammanabrolu, P","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.132271Z"},"links":{"cited_paper":"/paper/2310.11564","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:29054d585ac7b374673080eaa527e0cdc3d70e9284833e30b9fecf86d4ae070c","observation_id":"4abcb6a1-a83f-4656-9288-eb089b4004cb","resolution":{"observed_at":"2026-08-07T12:44:20.132271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15513","last_updated":"2025-06-14T16:04:31Z","snapshot_observed_at":"2026-08-03T06:34:42.243765Z","submitted_at":"2024-06-20T18:37:36Z","title":"PKU-SafeRLHF: Towards Multi-Level Safety Alignment for LLMs with Human Preference","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15513","snapshot_observed_at":"2026-08-07T12:44:20.174221Z","title":"Pku-saferlhf: Towards multi-level safety alignment for llms with human preference","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.174221Z"},"links":{"cited_paper":"/paper/2406.15513","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:71fd2f94700d87c323622cb50e82a8091178991342ddc644187c5b5d54ba31f9","observation_id":"75620268-4462-4d24-b277-de0d52d9690e","resolution":{"observed_at":"2026-08-07T12:44:20.174221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.01694","last_updated":"2024-01-23T23:42:41Z","snapshot_observed_at":"2026-07-06T17:24:29.001170Z","submitted_at":"2024-01-23T23:42:41Z","title":"ARGS: Alignment as Reward-Guided Search","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.01694","snapshot_observed_at":"2026-08-07T12:44:20.211826Z","title":"Args: Alignment as reward-guided search","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.211826Z"},"links":{"cited_paper":"/paper/2402.01694","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:8c1fe487eb011dea8ea901f6a93a9603114352e697f1c38b112d0861494a3988","observation_id":"c3258aed-6092-456c-8e05-fe4a1ca085de","resolution":{"observed_at":"2026-08-07T12:44:20.211826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.02676","last_updated":"2023-10-18T07:11:12Z","snapshot_observed_at":"2026-08-04T10:05:48.268152Z","submitted_at":"2023-02-06T10:28:16Z","title":"Chain of Hindsight Aligns Language Models with Feedback","version":8},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.02676","snapshot_observed_at":"2026-08-07T12:44:20.272639Z","title":"Chain of hindsight aligns language models with feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.272639Z"},"links":{"cited_paper":"/paper/2302.02676","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:5e62735de59aa9112dea900a9a59dc344eb0dd0fd452cd568472b16d8ac6b791","observation_id":"e7c2b313-9bb8-48d7-872c-9e44e93999a4","resolution":{"observed_at":"2026-08-07T12:44:20.272639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:20.378678Z","title":"L., Daly, R","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.378678Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:a06230f2ef1f8754b29cd57243f4d91f4aa68b709d4ae527d390df07f0983710","observation_id":"c4a2c54a-ce43-422a-8f00-1e73656fbb5c","resolution":{"observed_at":"2026-08-07T12:44:20.378678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17022","last_updated":"2024-06-03T20:50:26Z","snapshot_observed_at":"2026-08-09T12:39:32.277152Z","submitted_at":"2023-10-25T22:00:05Z","title":"Controlled Decoding from Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17022","snapshot_observed_at":"2026-08-07T12:44:20.437302Z","title":"Controlled decoding from language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.437302Z"},"links":{"cited_paper":"/paper/2310.17022","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:d8dd9359638a5b2f1fa5c6f545a1cc5ed2051070d6ee1bea56616e37b3197513","observation_id":"22dfaf66-14ba-4494-a9a8-68b624cc6a72","resolution":{"observed_at":"2026-08-07T12:44:20.437302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-07T17:14:39.278754Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-07T12:44:20.495851Z","title":"Webgpt: Browser-assisted question-answering with human feedback","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.495851Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:7657bae510856e49925027f8034d3f8f5b05900b1d7dfac822c3d4d122c47da8","observation_id":"15dd78a4-4dfc-4755-8df5-edf90a34b73e","resolution":{"observed_at":"2026-08-07T12:44:20.495851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:23.336080Z","title":"and Ozdaglar, A","venue":null,"work_id":"7ac77847-675f-40a7-90fb-1de9ff4c7dbb","year":2009},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.531442Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:bff8ba65df53f26f003733edf08c1d115d8e04c3607d12a24d05f9c6ca625d4f","observation_id":"65e6c99c-b9f3-4de9-8e2f-26867fc6a3e0","resolution":{"observed_at":"2026-08-07T12:44:23.367957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:20.625568Z","title":"Training language models to follow instructions with human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.625568Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:e5432f2bc5fa9c67c111601a365f700f694b2f4ab4b5fbb413c76a10e8301b3f","observation_id":"203f129a-4eb8-476a-89f7-a4d8295f03b5","resolution":{"observed_at":"2026-08-07T12:44:20.625568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:20.716463Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.716463Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:e3546da27aa9ce4abcf29fb0fe5d34d2891bf96e35254a54ced5f0241a4f2367","observation_id":"40b10372-d403-445e-adc2-30945b7b7ae3","resolution":{"observed_at":"2026-08-07T12:44:20.716463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:23.155433Z","title":"D., Ermon, S., and Finn, C","venue":null,"work_id":"2e3ac24e-4a8b-47ef-be97-17507cd94473","year":2024},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.846734Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:214d5b582feffc251934766cf1a0348c65568232a5dd34f1557c09e5c46f9040","observation_id":"5ebeae0c-190a-4e3c-80ce-7337da08b8dd","resolution":{"observed_at":"2026-08-07T12:44:23.230777Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:20.920937Z","title":"D., Ermon, S., and Finn, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.920937Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:cd4346f94cb649d97443d6dcd1e67094a2730bd61cfc6a7a8e9e34b3ed46c073","observation_id":"13965ca7-aa9b-49e0-8301-5245044ce286","resolution":{"observed_at":"2026-08-07T12:44:20.920937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:22.968897Z","title":"A., and Du, S","venue":null,"work_id":"ca778db2-7385-458c-929d-76d597484329","year":2024},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:20.960306Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:dd6b59f6cdc92a1ba8a85ba9df8330bdfa2d5c8c2a4d701d52f50f0b49908bf6","observation_id":"0db0aa03-e18c-47eb-abb0-17911a8b4930","resolution":{"observed_at":"2026-08-07T12:44:23.044947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:22.813572Z","title":null,"venue":null,"work_id":"763af4be-cc32-4243-a7a2-322a66041146","year":1956},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:21.004124Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:8e0f202a4686b71f8658026d4d6fe0eb7d52594c9d2bfcbdd0fdb1a680c64dfc","observation_id":"741c5dab-a3fa-48ca-bc1b-d8a5fa8bd3ea","resolution":{"observed_at":"2026-08-07T12:44:22.879347Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:21.054411Z","title":"S., Tang, X., and Bogunovic, I","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:21.054411Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:d499e5b43e9d94173d160aa355f183638469a22ba4f7b6e50eca7aac3cbbe72d","observation_id":"dd9d3a93-36f1-439e-9f1b-53c7170e4048","resolution":{"observed_at":"2026-08-07T12:44:21.054411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:22.602093Z","title":null,"venue":null,"work_id":"ed46f68c-b52a-4580-86a9-caacb0a01cb9","year":2020},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:21.100780Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:63a5077ad6924e00ed3cbd7c49b38e7d3c6766471354d05ad2c2f4f14acd7449","observation_id":"24c55602-d5f2-498e-abe4-7162cafa0752","resolution":{"observed_at":"2026-08-07T12:44:22.669996Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:22.471825Z","title":null,"venue":null,"work_id":"2ed2ee51-8f10-4221-b5fd-22c3140a54cb","year":2020},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:21.296915Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:f716689c8d4dcea5f255a0617453b7a6b7b528ac39fab3e4a63547545e16be4e","observation_id":"f7f74f73-2063-42e7-9102-3bc219834832","resolution":{"observed_at":"2026-08-07T12:44:22.525760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:22.299256Z","title":null,"venue":null,"work_id":"1c833489-9580-44f8-b495-8e7b70b4ba31","year":2023},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:21.338251Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:5724180ec8f8bf93cbd9e8743b09265e543e976550fecf9d8c73fa92ffc22543","observation_id":"51c96f80-76e3-460b-8126-d49253d2555d","resolution":{"observed_at":"2026-08-07T12:44:22.365506Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T12:44:21.380872Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:21.380872Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:2f8d86707fcd4713b0671e1313301ce9ccb8743d54cfc18383a462b510268430","observation_id":"7a22bb6e-889f-4edf-9875-f3ce74226827","resolution":{"observed_at":"2026-08-07T12:44:21.380872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:21.446086Z","title":"M., and Wolf, T","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:21.446086Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:27ff83f64124b75e67cfbfcf3893fb6fa14a68f764f8c33b68ae482c12390fbf","observation_id":"c601bb67-6395-46bb-bcef-466d80a3ef90","resolution":{"observed_at":"2026-08-07T12:44:21.446086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:44:21.494870Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T12:44:21.494870Z"},"links":{"citing_paper":"/paper/2505.23729"},"observation_digest":"sha256:91eccd8d9089ef4d385888a6b25e5a48c89e0aed8c16bcd0aa1f3eb1affe62f3","observation_id":"95c77aef-c487-46b2-87fe-2c1dbbb47ae5","resolution":{"observed_at":"2026-08-07T12:44:21.494870Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.23729","last_updated":"2025-05-31T23:47:06Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T07:27:39.615878Z","submitted_at":"2025-05-29T17:56:05Z","title":"Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":1,"verified_fuzzy":4},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 1 inbound Pith citation observation for arXiv:2505.23729."}