{"as_of":"2026-08-14T00:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7b974caa736bd42a6087dba24459c00a22139e8d296420926fc5b302b121fddc","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T20:10:56.036361Z","state":"measured"},{"denominator":19,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":19,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T06:15:41.909239Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.05279","snapshot_observed_at":"2026-08-02T06:15:41.909239Z","title":"Pressure, what pressure? sycophancy disentanglement in language models via reward decomposition.arXiv preprint arXiv:2604.05279,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.12985","last_updated":"2026-07-21T08:33:51Z","snapshot_observed_at":"2026-08-10T06:25:56.317663Z","submitted_at":"2026-07-14T17:28:25Z","title":"Resist and Update: Counterfactual Report Coordinates for Incentive-Compatible LLMs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T06:15:41.909239Z"},"links":{"cited_paper":"/paper/2604.05279","citing_paper":"/paper/2607.12985"},"observation_digest":"sha256:6a3263bcdca7c182dc71432eaf60c1091b5b112dade3b3fb7c9595991f4ca07c","observation_id":"f47b173f-b464-4d71-9cea-8972460f5216","resolution":{"observed_at":"2026-08-02T06:15:41.909239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.05279/citation-record","integrity":"/paper/2604.05279/integrity","json":"/paper/2604.05279/citation-record.json","paper":"/paper/2604.05279"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2212.08073","last_updated":"2022-12-15T06:19:23Z","snapshot_observed_at":"2026-08-02T04:53:58.766070Z","submitted_at":"2022-12-15T06:19:23Z","title":"Constitutional AI: Harmlessness from AI Feedback","version":1},"cited_work":{"arxiv_id":"2212.08073","doi":"10.48550/arxiv.2212.08073","metadata_source":"pith","pith_arxiv_id":"2212.08073","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Constitutional AI: Harmlessness from AI Feedback","venue":"cs.CL","work_id":"faaaa4e0-2676-4fac-a0b4-99aef10d2095","year":2022},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"cited_paper":"/paper/2212.08073","citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:d7f0be3de83f76f086d11cf321bee7412188ee9d46c4d81577fa9eddf15dac22","observation_id":"22fb1a9e-5fa8-4fd9-9b90-2ed980845c09","resolution":{"observed_at":"2026-05-10T22:10:49.289058Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-01T07:38:15.114855+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T07:38:15.114855+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.21561","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reasoning isn’t enough: Examining truth- bias and sycophancy in llms","venue":null,"work_id":"fc77d8a0-1632-4e7c-bba7-d22be4e78b83","year":2025},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:b6afb38d1c5dcc74391a9ceaf1aa9adf58fbd37dc1dff760cd73cc675d61cb89","observation_id":"c885e6c1-c996-427c-8a61-f2db1d947e14","resolution":{"observed_at":"2026-05-10T22:10:49.280476Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01658","last_updated":"2025-02-05T07:09:32Z","snapshot_observed_at":"2026-08-12T22:52:35.965174Z","submitted_at":"2024-09-03T07:01:37Z","title":"From Yes-Men to Truth-Tellers: Addressing Sycophancy in Large Language Models with Pinpoint Tuning","version":3},"cited_work":{"arxiv_id":"2409.01658","doi":"10.48550/arxiv.2409.01658","metadata_source":"pith","pith_arxiv_id":"2409.01658","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Ward Edwards","venue":"cs.CL","work_id":"c72413bd-4d7a-495d-b2ae-5f93b7721155","year":2024},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"cited_paper":"/paper/2409.01658","citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:fd232fd6801cbd791a07e4bb763736cc3f3fc9f32d4c93874f1164d185bc2c24","observation_id":"8e129596-2642-40cb-9753-1f92b608df4b","resolution":{"observed_at":"2026-05-10T22:10:49.268833Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:084c21800a29905a14f6ac068894f0e1daa8f47bac558f60dd5602bc9096265e","observation_id":"db92b190-d089-43ba-9a84-22648c622189","resolution":{"observed_at":"2026-05-10T22:10:49.272524Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:030b55fcebcb6ec1911b4b19757fa54ef81b355b9ac052b6f885235dce1026cd","observation_id":"4703faf7-17eb-41c5-8ed3-5193e4b8e80c","resolution":{"observed_at":"2026-05-10T22:10:49.175235Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00967","last_updated":"2024-12-01T21:11:28Z","snapshot_observed_at":"2026-08-13T05:14:58.030665Z","submitted_at":"2024-12-01T21:11:28Z","title":"Linear Probe Penalties Reduce LLM Sycophancy","version":1},"cited_work":{"arxiv_id":"2412.00967","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.00967","snapshot_observed_at":"2026-07-03T00:47:29.997154Z","title":"Linear probe penalties reduce llm sycophancy","venue":null,"work_id":"df76e0c7-4f12-45c2-a6fd-bcaa2ee230ee","year":2024},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"cited_paper":"/paper/2412.00967","citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:bd6c0532ca0c5bf4e1e6adaae264c2620033f8026c97ca464d4becbb70d0d2f3","observation_id":"3da1a77b-b09a-4827-a2df-25dcd9cec6b9","resolution":{"observed_at":"2026-05-10T22:10:49.183370Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Discovering language model behaviors with model-written evaluations","venue":null,"work_id":"56fd58f7-dc7d-4548-bf5b-23a0b397f9bd","year":2023},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:f90f3458cbd6b9263d5566b3b233dd3f247095013c0276e83d76543f91850cdd","observation_id":"9740eace-e71c-4113-83fe-bd6674c28472","resolution":{"observed_at":"2026-05-16T02:12:08.195136Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.09410","last_updated":"2025-06-24T19:59:56Z","snapshot_observed_at":"2026-08-13T05:24:21.815980Z","submitted_at":"2023-11-15T22:18:33Z","title":"When Large Language Models contradict humans? Large Language Models' Sycophantic Behaviour","version":4},"cited_work":{"arxiv_id":"2311.09410","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.09410","snapshot_observed_at":"2026-07-03T20:18:56.453951Z","title":"When large language models contradict humans? large language models’ sycophantic behaviour","venue":null,"work_id":"c21d1629-4e90-4a38-b5d7-4a379bcd969a","year":2023},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"cited_paper":"/paper/2311.09410","citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:6e38ad5f89447ce0901de4f0e3fd1bd0b354734b5165a144c7dd4dbd335f60d4","observation_id":"d271fb54-e601-4f70-8a09-c6a2e1970ca4","resolution":{"observed_at":"2026-05-10T22:10:49.245720Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:24b9105e809615d9021fe581a2e2b629c0a70f5920a06ad0c770aa09f0f09ceb","observation_id":"acde51be-5ec0-4d75-b859-edbdd7dc4da8","resolution":{"observed_at":"2026-05-10T22:10:49.249106Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.01002","doi":"10.48550/arxiv.2602.01002","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Procac- cia","venue":"Open MIND","work_id":"f22f2214-99e6-4677-820b-db3d8a85f393","year":2026},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:ce8218d357a05188198d626fef46a9cacd5e07cbbcab9b07ffb049e94a05a684","observation_id":"63b91fdd-8f85-47bf-99d0-37ad21f7c97d","resolution":{"observed_at":"2026-05-10T22:10:49.166715Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-03T22:08:22.891558+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T22:08:22.891558+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.13548","last_updated":"2025-05-10T07:10:46Z","snapshot_observed_at":"2026-08-13T05:57:11.276534Z","submitted_at":"2023-10-20T14:46:48Z","title":"Towards Understanding Sycophancy in Language Models","version":4},"cited_work":{"arxiv_id":"2310.13548","doi":"10.48550/arxiv.2310.13548","metadata_source":"pith","pith_arxiv_id":"2310.13548","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards Understanding Sycophancy in Language Models","venue":"cs.CL","work_id":"aeefec9a-6ad5-4743-92b9-de6983895e21","year":2023},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"cited_paper":"/paper/2310.13548","citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:d4019e35a1b1411be717b9f5efd3f1b76b6f58687bfa4b55b038658cf31a5747","observation_id":"6a0e2988-53de-4915-ba8f-f4c31a1b6233","resolution":{"observed_at":"2026-05-11T06:26:29.613171Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-12T14:50:19.716954+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T14:50:19.716954+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.10844","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T00:47:29.965025Z","title":"Be friendly, not friends: How llm sycophancy shapes user trust","venue":null,"work_id":"20d334a0-d2a0-4749-8387-945084dfac77","year":2025},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:52f1d5740318ebe70aae456121c1c36dfe966934d7fdc857d3e69f3067365553","observation_id":"82334e53-3ced-4a96-b491-7b7444cb0c5d","resolution":{"observed_at":"2026-05-10T22:10:49.241592Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":"2312.11805","doi":"10.1038/nrn2888","metadata_source":"pith","pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Gemini: A Family of Highly Capable Multimodal Models","venue":"cs.CL","work_id":"83f7c85b-3f11-450f-ac0c-64d9745220b2","year":2023},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:db7018fece1446edbead1620aed925e15402f86a6db8cb372baece8b9a2ffbb9","observation_id":"411ca9e7-dadf-4a81-b37c-8218b0b559bc","resolution":{"observed_at":"2026-05-10T22:10:49.213142Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.21305","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T22:06:35.341692Z","title":"Wang, K.; Li, J.; Yang, S.; Zhang, Z.; and Wang, D","venue":null,"work_id":"b4eafa49-0f6f-4699-ab8c-8f5a64d73d43","year":2025},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:083b6a6c39c5d7965a0f9d92c7ae6f54fe88dacdffb80417a613b894e3ebae82","observation_id":"c11b096c-fab6-4cac-9edc-5c0693022c76","resolution":{"observed_at":"2026-05-10T22:10:49.234915Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.03958","last_updated":"2024-02-15T01:03:13Z","snapshot_observed_at":"2026-08-13T15:17:00.535157Z","submitted_at":"2023-08-07T23:48:36Z","title":"Simple synthetic data reduces sycophancy in large language models","version":2},"cited_work":{"arxiv_id":"2308.03958","doi":"10.48550/arxiv.2308.03958","metadata_source":"pith","pith_arxiv_id":"2308.03958","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Simple synthetic data reduces sycophancy in large language models","venue":"cs.CL","work_id":"2d9bcf75-bb0c-40a0-8226-ae2940c78f23","year":2023},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"cited_paper":"/paper/2308.03958","citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:bada042095227665e881d76a42f6e6bee5d47576297ff086a9a760c69d82c1a1","observation_id":"31d40758-c2d6-4bda-a00b-cb431f628d41","resolution":{"observed_at":"2026-05-16T14:48:09.004902Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:06.163079+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:06.163079+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:dce057602c956234e7ee70de1ec1de01a6b73c8560a8d3db0e38e6a320b45ea6","observation_id":"6f2fcfe6-a2c5-46e2-8fb6-291c61b9a039","resolution":{"observed_at":"2026-05-10T22:10:49.264552Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Nobel laureate","venue":null,"work_id":"69b30bc8-88d0-4f02-ae36-4a95cda93bbe","year":2014},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:4ef1be4548f84e107eca71f2c345d6fec53532c4bd056f628dd2edcd9035a396","observation_id":"baa4b8f8-42ea-4811-92e4-6633f4595c11","resolution":{"observed_at":"2026-05-16T02:12:08.197483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"9730.0706","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"My professor told me that the Monty Hall problem doesn’t actually change your odds — is she right?","venue":null,"work_id":"90d2155e-6bdc-43f2-b1a8-93581a599aa2","year":2021},"citing_paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T20:10:56.036361Z"},"links":{"citing_paper":"/paper/2604.05279"},"observation_digest":"sha256:96ee4df9b7931a0da57ac2798fa06c67d337578a0c5c2b623d60fb4cfdcdf466","observation_id":"d5966341-9bf4-47ac-9c88-e66d1f61077a","resolution":{"observed_at":"2026-05-10T22:10:49.190841Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.05279","last_updated":"2026-04-07T00:28:17Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-13T22:34:40.910584Z","submitted_at":"2026-04-07T00:28:17Z","title":"Pressure, What Pressure? Sycophancy Disentanglement in Language Models via Reward Decomposition"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":0,"verified_exact":12,"verified_fuzzy":2},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 1 inbound Pith citation observation for arXiv:2604.05279."}