{"as_of":"2026-08-15T19:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:675da4a430402ceb108d9123898d998dc0244750ed3e0a5b4f19a74f8848d250","coverage":[{"denominator":39,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:59:08.348136Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T03:04:44.276275Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-30T04:54:16.756504Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03923","snapshot_observed_at":"2026-08-03T03:04:44.276275Z","title":"More or less wrong: A benchmark for directional bias in llm comparative reasoning.arXiv preprint arXiv:2506.03923,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.09305","last_updated":"2026-06-28T18:13:37Z","snapshot_observed_at":"2026-08-12T17:14:29.445906Z","submitted_at":"2026-02-10T00:45:24Z","title":"Reward Modeling for Reinforcement Learning-Based LLM Reasoning: Design, Challenges, and Evaluation","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-03T03:04:44.276275Z"},"links":{"cited_paper":"/paper/2506.03923","citing_paper":"/paper/2602.09305"},"observation_digest":"sha256:821e9325ead40cc109d5efc5e1ff6f8b467d262b301b55c9c31515858fdabe18","observation_id":"e33ce7b7-8213-4ac5-8b1b-8e87331d47aa","resolution":{"observed_at":"2026-08-03T03:04:44.276275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"cited_work":{"arxiv_id":"2506.03923","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03923","snapshot_observed_at":"2026-06-30T04:54:16.756504Z","title":"More or less wrong: A benchmark for directional bias in llm comparative reasoning,","venue":null,"work_id":"4586a862-dbf8-4b94-9042-dfaa543a7e7a","year":2025},"citing_paper":{"arxiv_id":"2606.30587","last_updated":"2026-06-29T17:31:10Z","snapshot_observed_at":"2026-08-03T01:57:39.092439Z","submitted_at":"2026-06-29T17:31:10Z","title":"Words Speak Louder Than Code: Investigating Cognitive Heuristics in LLM-Based Code Vulnerability Detection","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-30T04:52:35.384665Z"},"links":{"cited_paper":"/paper/2506.03923","citing_paper":"/paper/2606.30587"},"observation_digest":"sha256:5782abe048ae20e7ccc41140b930f42f032776437ac59962155b9ab0c285c2b4","observation_id":"2bd616bb-7040-4cf3-88ac-cf8f6bfa407d","resolution":{"observed_at":"2026-06-30T04:54:16.758027Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03923/citation-record","integrity":"/paper/2506.03923/integrity","json":"/paper/2506.03923/citation-record.json","paper":"/paper/2506.03923"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.00157","last_updated":"2024-09-16T19:20:59Z","snapshot_observed_at":"2026-08-14T23:03:16.281379Z","submitted_at":"2024-01-31T20:26:32Z","title":"Large Language Models for Mathematical Reasoning: Progresses and Challenges","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00157","snapshot_observed_at":"2026-08-07T10:59:03.671310Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:03.671310Z"},"links":{"cited_paper":"/paper/2402.00157","citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:bbd38f60569a276faba3154a7b44396b844296756dd7af9319fdac4f988c131d","observation_id":"2029e78c-c795-4bb7-9a6e-ae7d46f2f301","resolution":{"observed_at":"2026-08-07T10:59:03.671310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10248","last_updated":"2024-10-30T09:48:52Z","snapshot_observed_at":"2026-08-12T23:47:19.714056Z","submitted_at":"2024-06-08T13:40:38Z","title":"On the Worst Prompt Performance of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10248","snapshot_observed_at":"2026-08-07T10:59:03.731271Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:03.731271Z"},"links":{"cited_paper":"/paper/2406.10248","citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:da87df4b89ea3e24b28cf8361f68541d4a29ddbfab07beb8054d4a9ecedc7021","observation_id":"93eb09a3-fb8f-4a6c-bbb5-4e418bbd4ad0","resolution":{"observed_at":"2026-08-07T10:59:03.731271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:11.103259Z","title":null,"venue":null,"work_id":"5372e5e6-6aa0-42eb-a933-f40ef0682ca5","year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:03.858605Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:c3d39e845d25dcc473db0e8997d773cfc39a8edc7622bdc08b14fda7438e1df9","observation_id":"9c50a102-b85f-40df-9da7-996f19b0d3a6","resolution":{"observed_at":"2026-08-07T10:59:11.161920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:10.901862Z","title":null,"venue":null,"work_id":"80a9b166-4346-43ee-b651-d17a44f2f31b","year":2025},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:03.982679Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:f780bf362941d4b90fc3f12cf816e68c33f23ec1c0fb3642c6c62a16dfc8f36b","observation_id":"8be3ad81-28a2-40f2-aacf-54bc92d60046","resolution":{"observed_at":"2026-08-07T10:59:11.033052Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:10.667070Z","title":null,"venue":null,"work_id":"31d49687-ae8b-40a7-b98b-1b70441a3d2e","year":2001},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:04.122724Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:9d3764dd47bbf622f3d537ab50fd6a525d1a11038621105ec7759664c3b2a35d","observation_id":"4182eb43-d50f-49d9-ba16-ef085a218dfb","resolution":{"observed_at":"2026-08-07T10:59:10.794456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:10.483232Z","title":null,"venue":null,"work_id":"9c378d48-5c8a-457e-ad8a-7eaf2c9dff9b","year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:04.235661Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:2b29f6f41332f37f5e0e2d03840899c19e0ff62f6a51004b7aaecef560c80dd4","observation_id":"8e491cff-e21f-4dbf-800a-f8f6c8f157a8","resolution":{"observed_at":"2026-08-07T10:59:10.559318Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:04.303885Z","title":"Gallegos, Ryan A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:04.303885Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:a6e89f909bd83cc91cfe9810801c6fa10c1d436ad43334135e63d39dc47b8015","observation_id":"6fedf50d-47f1-4ddf-ad54-d952ddd63c53","resolution":{"observed_at":"2026-08-07T10:59:04.303885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:10.300890Z","title":null,"venue":null,"work_id":"2d757dbc-cf6b-4121-9c4d-b26ab55f441a","year":2013},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:04.437677Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:d310c8554c248e6fc9cae7eaf9ab9955eb23062dbe211399b912c94f962b4d57","observation_id":"1c0d5958-57f5-41a5-8fe8-3c497e1a2b26","resolution":{"observed_at":"2026-08-07T10:59:10.383765Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:04.496441Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:04.496441Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:7f7796355b132cde6dea18a36a1f926a7d6d06e5395ba2e9ae7572e0358ca397","observation_id":"81097b6f-cc56-4cc6-841c-ec4d7ccfa15c","resolution":{"observed_at":"2026-08-07T10:59:04.496441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:10.106522Z","title":null,"venue":null,"work_id":"4f9fcd9e-14a1-4e65-9a65-8ed1d1db4506","year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:04.617781Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:19e3e3f5993960f212ce5983f79f1631db7c631671e303c1d1a7c19ded371fd5","observation_id":"57be3c9d-903f-4699-ab7e-0859efc82d58","resolution":{"observed_at":"2026-08-07T10:59:10.183141Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.05398","last_updated":"2023-03-04T04:43:49Z","snapshot_observed_at":"2026-08-13T12:32:18.384526Z","submitted_at":"2023-03-04T04:43:49Z","title":"MathPrompter: Mathematical Reasoning using Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.05398","snapshot_observed_at":"2026-08-07T10:59:04.705154Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:04.705154Z"},"links":{"cited_paper":"/paper/2303.05398","citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:a9673d7f9f7e6019bafe661ec48d2b5cdf63dedfc52790eaf67dcaad674306e3","observation_id":"9ec5b8ff-bdb8-4a23-b3fe-d7cc9259516f","resolution":{"observed_at":"2026-08-07T10:59:04.705154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:04.803957Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:04.803957Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:401e0be15cbc1d7f607047d25804c90a484d0c90b709e0ea618a7eca261e3c8f","observation_id":"0c5f7e4b-ba64-45e4-b793-b859632779b7","resolution":{"observed_at":"2026-08-07T10:59:04.803957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15585","last_updated":"2024-01-28T06:50:10Z","snapshot_observed_at":"2026-08-15T04:04:25.867350Z","submitted_at":"2024-01-28T06:50:10Z","title":"Evaluating Gender Bias in Large Language Models via Chain-of-Thought Prompting","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15585","snapshot_observed_at":"2026-08-07T10:59:04.917391Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:04.917391Z"},"links":{"cited_paper":"/paper/2401.15585","citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:9abe20231497f634aa509a608196e243f975b3930809f79f1ce2866fad24b01c","observation_id":"7200a673-5290-4466-87d8-7dc2f35e7f2b","resolution":{"observed_at":"2026-08-07T10:59:04.917391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:04.958985Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:04.958985Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:dc247676342a4bc5ca6f27f33c68c028dbb8fe730aaf33812906332b8aef0f6f","observation_id":"2622d872-118d-4193-8b87-10655848487a","resolution":{"observed_at":"2026-08-07T10:59:04.958985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:05.116473Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:05.116473Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:9c2509cbce087a90ada726a9e3dd3bf62999dfb44a68590870b5a14515d91e43","observation_id":"d8f5b555-5bab-4353-af59-10676552427d","resolution":{"observed_at":"2026-08-07T10:59:05.116473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:05.242830Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:05.242830Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:9be538efdbf4d55c870ae570a8ca3922ff1b0712bc7f6fd5a4aba55b9834d974","observation_id":"ec79e4fc-526b-4024-913f-1961af1a1fcc","resolution":{"observed_at":"2026-08-07T10:59:05.242830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-naacl.258","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":"Middleton, and Mahesan Niranjan","venue":null,"work_id":"59c85e67-817f-4796-9f2d-1c252995490f","year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:05.434049Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:9f904ef4a3f4af1156f2aa38ac956c9255a3f0ed903765149e57efcdf735263a","observation_id":"6c9e67a1-bae1-4e94-93f9-9383dda5b406","resolution":{"observed_at":"2026-08-07T10:59:09.048140Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:05.546682Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:05.546682Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:bd81b4d3a6c52309989d55ebd5626f077e3d83787d046e9269cce15f2355ca77","observation_id":"9fcbf4af-5719-4871-97dd-86f89cf5fa44","resolution":{"observed_at":"2026-08-07T10:59:05.546682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:05.730500Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:05.730500Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:51524c296b80d7ba8cb53ed96585607ab0e50eb347515cf47dc4c4543c4f1f8c","observation_id":"85674bff-d569-4dca-89f9-474cd0b58c15","resolution":{"observed_at":"2026-08-07T10:59:05.730500Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:05.937415Z","title":"Mohammad","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:05.937415Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:7cc74995ae963920ea02d68f0f6f175fb530988420780070252d6ed779313f6f","observation_id":"ec745306-406d-417c-ae4c-d5bd1eaf01a0","resolution":{"observed_at":"2026-08-07T10:59:05.937415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:06.051530Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:06.051530Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:10f1c95c019cd0aabe018e1910913685a2b622cefdb33e65566299c0f79c4977","observation_id":"ff333273-41c7-4749-bdae-b50ce153f8e7","resolution":{"observed_at":"2026-08-07T10:59:06.051530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:09.880407Z","title":null,"venue":null,"work_id":"f1ef56f5-a8e0-4579-b1a1-8120c59e590b","year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:06.179901Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:11ffe9879d4155ad06f556b83ed9b273c0eca6ea2addbb3b79548ecd0519de25","observation_id":"4f03af5a-2f29-4aa3-a534-1366f8809ec0","resolution":{"observed_at":"2026-08-07T10:59:09.990485Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:06.364610Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:06.364610Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:a5306b1799d65e8f889696b8c5f75061c6816858acedb2718875c2ecbc70d721","observation_id":"24f84214-8c1e-43b1-8ce6-602689d0ad88","resolution":{"observed_at":"2026-08-07T10:59:06.364610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:06.511769Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:06.511769Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:bbe7bc54841d1cefcb4944ed943afc45d34532c848628f73e1253826d5aeeeff","observation_id":"a567ff22-34db-40d1-a793-deba42ddeaf1","resolution":{"observed_at":"2026-08-07T10:59:06.511769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:09.680782Z","title":null,"venue":null,"work_id":"be0e11b7-c7e3-4515-8d28-7143049ff323","year":2025},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:06.688037Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:e800df55457e886454ddeca5df1942f1b6287bf57f4cebe2edcedde5e481f53d","observation_id":"e33fd979-e3a7-4982-8b0a-573d7b0ea03a","resolution":{"observed_at":"2026-08-07T10:59:09.771886Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.14875","last_updated":"2025-01-24T01:15:16Z","snapshot_observed_at":"2026-08-15T11:47:35.796445Z","submitted_at":"2024-02-21T18:25:25Z","title":"What's in a Name? Auditing Large Language Models for Race and Gender Bias","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.14875","snapshot_observed_at":"2026-08-07T10:59:06.783735Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:06.783735Z"},"links":{"cited_paper":"/paper/2402.14875","citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:82188251b855845c5753dc93b0f8c0e28409d5b350487cbe53c799bb846ce874","observation_id":"894d3775-e990-48ae-bdb4-2127c53fdeaa","resolution":{"observed_at":"2026-08-07T10:59:06.783735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11324","last_updated":"2024-07-01T22:28:01Z","snapshot_observed_at":"2026-08-12T15:05:30.306144Z","submitted_at":"2023-10-17T15:03:30Z","title":"Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11324","snapshot_observed_at":"2026-08-07T10:59:06.932061Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:06.932061Z"},"links":{"cited_paper":"/paper/2310.11324","citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:a185c70b2ea8b86500d3c627f519a02894dd0b0446aaa4b1787f012efeef3cdb","observation_id":"32d913c0-1673-4981-82e1-4f9a59691a1f","resolution":{"observed_at":"2026-08-07T10:59:06.932061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:07.130480Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:07.130480Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:b9006013052bcdf4f644bcefffa9c9a02c8fcc6700fc8c2eb35a6520fd62d2d7","observation_id":"ad6e70c7-acb6-4bfa-9734-21d933f89fea","resolution":{"observed_at":"2026-08-07T10:59:07.130480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.acl-long.838","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"e55e5d04-d3f6-4bff-bbcf-f0a7cc6baf2b","year":2023},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:07.295355Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:482e6112eb4a58ef82bff05e099b464fd532d05ecdf0117b7c134a52ba20504f","observation_id":"31a7bc6d-5cd3-4ce3-8bd0-0c1a214378fd","resolution":{"observed_at":"2026-08-07T10:59:08.813966Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:09.451635Z","title":null,"venue":null,"work_id":"06002a9e-5305-423c-a802-684813cab718","year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:07.407549Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:e2ba92ed4b9ca1f367bf913ef11a3b3d43b6f09105389a2cd7d14f92b88866eb","observation_id":"a5e091dc-eeab-418f-b4ee-1be745e2a0e3","resolution":{"observed_at":"2026-08-07T10:59:09.529404Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:07.505151Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:07.505151Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:7e0ccc6ace9fce1318ecae9fd8b005d6cfb6c919dc991ba9c2f90a75ade4c45c","observation_id":"cb71251d-e0ab-4049-ba72-c8813b0ae14f","resolution":{"observed_at":"2026-08-07T10:59:07.505151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:07.572507Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:07.572507Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:3c2919c9ec241a570052fbce673dc1a3ef83f85adb29a5554db12f7907212150","observation_id":"3ffd3beb-1b77-4b17-920b-af8e2159c106","resolution":{"observed_at":"2026-08-07T10:59:07.572507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:07.698154Z","title":"Chi, Quoc V Le, and Denny Zhou","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:07.698154Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:4d81bca60861658e2b7d1f2e8754ea83425f17b01b028da76c5337c15df35cf5","observation_id":"118819a0-30a0-4c52-ac85-cb0201da56d5","resolution":{"observed_at":"2026-08-07T10:59:07.698154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:07.767127Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:07.767127Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:3a1ebfb9ccb61469a8f7cb94739093b23131b95720e859b4dc904672452976d3","observation_id":"38c9e240-1713-422a-9a11-5a9a374cfe94","resolution":{"observed_at":"2026-08-07T10:59:07.767127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.13078","last_updated":"2023-10-11T12:21:30Z","snapshot_observed_at":"2026-08-13T10:08:47.001795Z","submitted_at":"2023-09-21T02:46:20Z","title":"LPML: LLM-Prompting Markup Language for Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.13078","snapshot_observed_at":"2026-08-07T10:59:07.866929Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:07.866929Z"},"links":{"cited_paper":"/paper/2309.13078","citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:4d0fc7c177e39634328efaf6df6b2c00fb219b60b3b0b247d4f60c3613a6b921","observation_id":"58e79156-0d7d-40d6-a1bf-dfdd8c343d3c","resolution":{"observed_at":"2026-08-07T10:59:07.866929Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2022.findings-naacl.104","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Findings of the Association for Computational Linguistics: NAACL 2022","work_id":"8313a67e-7f89-4cec-bf6a-7fc3afc459a4","year":2022},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:07.988801Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:e9da0cd58f3f04320a634de05b8214624949f703e05e468b922597c7304f1012","observation_id":"e27d4bdc-9e59-413e-851c-5f4f34f04562","resolution":{"observed_at":"2026-08-07T10:59:08.566408Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.17204","last_updated":"2025-03-03T06:29:31Z","snapshot_observed_at":"2026-08-07T17:53:06.700384Z","submitted_at":"2025-02-24T14:39:28Z","title":"Order Matters: Investigate the Position Bias in Multi-constraint Instruction Following","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.17204","snapshot_observed_at":"2026-08-07T10:59:08.115949Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:08.115949Z"},"links":{"cited_paper":"/paper/2502.17204","citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:255b4ec2995e07da0982a958a0e0b63a7917e714eb7759682348b84ddcac6736","observation_id":"cb32b20b-918f-4f99-92d7-cf1ed9bab134","resolution":{"observed_at":"2026-08-07T10:59:08.115949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:08.239730Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:08.239730Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:89be58845d447f5794c823934c43b8e55ecc03182f37ed34378c456104eb12a6","observation_id":"b756312c-638e-459c-abc7-70647469468a","resolution":{"observed_at":"2026-08-07T10:59:08.239730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T10:59:08.348136Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T10:59:08.348136Z"},"links":{"citing_paper":"/paper/2506.03923"},"observation_digest":"sha256:9fef5f3b995b3418384e0d4f03739f7bb14256a1e9ca25735cd83f083727f390","observation_id":"3ad43016-afbf-4768-8994-96634f359f06","resolution":{"observed_at":"2026-08-07T10:59:08.348136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.03923","last_updated":"2025-06-04T13:15:01Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T09:59:56.376817Z","submitted_at":"2025-06-04T13:15:01Z","title":"More or Less Wrong: A Benchmark for Directional Bias in LLM Comparative Reasoning"},"reference_resolution":{"displayed":39,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":36,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":39},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 39 of 39 outbound references and 2 inbound Pith citation observations for arXiv:2506.03923."}