{"as_of":"2026-08-07T03:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:73daabe6b02ae462de7e83bf028f46b42bc2cf94c8c42c13093212d23ed8d5cb","coverage":[{"denominator":59,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":59,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-13T07:32:58.404947Z","state":"measured"},{"denominator":59,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":59,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.11974/citation-record","integrity":"/paper/2605.11974/integrity","json":"/paper/2605.11974/citation-record.json","paper":"/paper/2605.11974"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:6128b7046355d3565ab024cd5065487b9d5b6b4fcb4fc4780d722a77edba2801","observation_id":"0362c18f-461b-491d-9018-31192185d143","resolution":{"observed_at":"2026-05-13T07:37:29.974011Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:d4bc4570ee3b24d5ae20e95a2c28d9c06bcbc48d5f08876477b64ba8c55674b6","observation_id":"06e54a4e-ca37-4498-9d21-88d01532a308","resolution":{"observed_at":"2026-05-13T07:37:29.963624Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:34b394f76399177b5c503bef45268141ac2e036bca8600dba77ded5d3e4dcac0","observation_id":"ae8ccd63-c0bc-4c16-9804-15bab25078da","resolution":{"observed_at":"2026-05-13T07:37:29.968523Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 47th international ACM SIGIR conference on research and development in information retrieval , pages=","venue":null,"work_id":"a5f9c721-a5b7-4992-8d56-68136cbe4f06","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:c3d129d747fafc6798a2c7c33cd326cbae1e0485cd1aabf68d8173a6941962e6","observation_id":"d1d65bf8-1161-4fc0-8ce0-56e0b2fb919f","resolution":{"observed_at":"2026-05-13T08:17:32.323535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the AAAI conference on artificial intelligence , pages=","venue":null,"work_id":"0f61cebb-193f-4a58-a6c2-be0b5ee3c28c","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:92eafab60a583843a6e2bbca75365c31378a2764ee21f2c63c5d8ebb529f066a","observation_id":"eee5ce83-11cb-4c95-b8dd-35a5018dc367","resolution":{"observed_at":"2026-05-13T08:17:32.335650Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2025 ACM Conference on Fairness, Accountability, and Transparency , pages=","venue":null,"work_id":"841be2aa-9644-41b1-8baa-0332674d6f25","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:5e73b6a460f3a00870bd5c33db53160b0a83bcae87eb432b55dec35f29850fe1","observation_id":"959e19b4-e66d-497e-93b9-591aa06dbd47","resolution":{"observed_at":"2026-05-13T08:17:32.327706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2506.17188","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.17188 , year=","venue":null,"work_id":"d669ef64-2a85-4a5f-a899-b6b9ea17b665","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:6e13965b9f60fae5cca27d5d0ef8367cf21208eeeb82d8ee7bc0dbe140f2a3cb","observation_id":"fafc6f86-061f-4ac5-b3ff-97c189fdd996","resolution":{"observed_at":"2026-05-13T07:37:29.957813Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 17th ACM International Conference on Web Search and Data Mining , pages=","venue":null,"work_id":"1703020c-cb9d-4b8c-a68e-ef52aaeb9de2","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:8224476f42f72ad9d4c532d3bd30b255ef94f7c6f623326515ec03bfcfa320ac","observation_id":"2f94ca3c-12f3-4bfd-a427-0c5ca5b2ec5b","resolution":{"observed_at":"2026-05-13T08:17:32.331615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14431","last_updated":"2025-05-28T06:18:34Z","snapshot_observed_at":"2026-07-06T20:25:31.304367Z","submitted_at":"2025-01-24T11:57:39Z","title":"Domaino1s: Guiding LLM Reasoning for Explainable Answers in High-Stakes Domains","version":2},"cited_work":{"arxiv_id":"2501.14431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14431","snapshot_observed_at":"2026-07-02T16:57:09.922347Z","title":"arXiv preprint arXiv:2501.14431 , year=","venue":null,"work_id":"0272dbf7-750d-49d6-af9f-4793b82a5562","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2501.14431","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:c770366db8db21ff34fe4a7291fea5628a31168bfd1a460edadf976c1eab6c18","observation_id":"2a949fc7-ad61-42f2-bd1f-849f64e4e844","resolution":{"observed_at":"2026-05-13T07:37:29.985874Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Annual Meeting of the Association for Computational Linguistics , year=","venue":null,"work_id":"29f89d66-fa35-48ce-a7ff-21f845eef4ea","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:16a356cc8573078660d4fc0c8ea2d3c15ec37da5aa91eb8862e777f5414f996f","observation_id":"7c2004d1-4194-45b3-8fb0-c54057773778","resolution":{"observed_at":"2026-05-13T08:17:32.318946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Transactions of the Association for Computational Linguistics , year=","venue":null,"work_id":"907416c6-d4a2-4718-9830-d398091d2716","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:c8ede0250536e10b3adc8d964ef36e5182fedb96077390890c6ed7252a8dfac0","observation_id":"0185bf1e-103b-4537-89a5-767e8531119e","resolution":{"observed_at":"2026-05-13T08:17:32.312155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"ca01b706-adcb-4dc9-a235-65e664e58583","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:093dd7e16dadd16474854536efaf25a753cb140ce03d1fb27721ce8ef9cb9eda","observation_id":"1ab875a2-f7f7-4d64-8f5e-8f021281e532","resolution":{"observed_at":"2026-05-13T08:17:32.315375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"f1d7e0db-7c1d-473e-a731-319f845da44d","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:0155eb6e6a98d9127adb337b6d29b132be80647533b258962b4b875eb4258f61","observation_id":"8ecd1e62-f088-4899-9c2d-8180c9e85dd6","resolution":{"observed_at":"2026-05-13T08:17:32.303993Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.16983","last_updated":"2024-10-22T13:05:11Z","snapshot_observed_at":"2026-07-06T19:37:47.763190Z","submitted_at":"2024-10-22T13:05:11Z","title":"Order Matters: Exploring Order Sensitivity in Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2410.16983","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.16983","snapshot_observed_at":"2026-07-04T20:40:07.562350Z","title":"Order matters: Exploring or- der sensitivity in multimodal large language models","venue":null,"work_id":"6abdd4e1-26e5-4271-8ad3-3f1cea6a0fc4","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2410.16983","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:8bff9cc98a84346c500f45e30e54b43a2adfb2a2e0838027707315b06554b4b1","observation_id":"95920722-c4a1-4df3-b8d9-5399024d2278","resolution":{"observed_at":"2026-05-13T07:37:29.979718Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"605c94bb-b1d1-439f-8405-6627092714bf","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:53f222e699b2ca786db3aade73821811d74655ad0013c970712f55f5e6b14e0e","observation_id":"04f98399-2412-448f-8d27-a2456fa272a5","resolution":{"observed_at":"2026-05-13T08:17:32.308442Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11364","last_updated":"2022-03-21T21:51:43Z","snapshot_observed_at":"2026-07-06T12:50:29.782287Z","submitted_at":"2022-03-21T21:51:43Z","title":"An Information-theoretic Approach to Prompt Engineering Without Ground Truth Labels","version":1},"cited_work":{"arxiv_id":"2203.11364","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2203.11364","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2203.11364 , year=","venue":null,"work_id":"9a9237f8-f49f-44b2-986d-50e0d9ebb78d","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2203.11364","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:64c9a419bf5b2de83457a0c437cd9206b4749fdee75398db108c61bd9d30eb0d","observation_id":"c027ac73-8602-49dd-8ff5-a588af6921a9","resolution":{"observed_at":"2026-05-13T07:37:29.991486Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Annual Meeting of the Association for Computational Linguistics , year=","venue":null,"work_id":"0f277551-7174-4210-9edb-c6583cfdf8a9","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:2a6521285daa7bc3ac1f5dd6f1b7937bd91e53d92ce6316c1dc197502ed3ed60","observation_id":"35476a24-3d20-4d64-8c2f-f1ee1f11bbf5","resolution":{"observed_at":"2026-05-13T08:17:32.241263Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"2856b886-a386-45a6-97d2-0335b99c298b","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:fccf028e6f8be13dfaf7ad8e002f658e3123a57af71da662deb65d60f600d224","observation_id":"1c3fe5e4-05d7-40a0-b807-d2bb03a72065","resolution":{"observed_at":"2026-05-13T08:17:32.270262Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"c25ee76e-3828-43bf-874d-6c7c57c45c11","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:4a6e58101bf157652636a83977f1afddc64cbd132e4a129986d7dd5bf677dd82","observation_id":"23cfb539-1254-4c46-b3bb-7c27938673dc","resolution":{"observed_at":"2026-05-13T08:17:32.257913Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , note =","venue":null,"work_id":"66c1a223-a9de-42e2-8617-8656a90db4d5","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:cc8ec1509d1f88621d147c18e3bc8f3186a7fa3abf354a6ef203f35ad51194c0","observation_id":"1cd9193f-6189-4db2-909a-a3b1fd9fbf99","resolution":{"observed_at":"2026-05-13T08:17:32.253722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:31:44.815808Z","title":"ArXiv , year=","venue":null,"work_id":"c4253c11-d5c7-40d6-bf37-fcae9623b44b","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:f87d4c7dab13728ba7242823db4e34260410f4e0886d06fc8db982ae6668d281","observation_id":"f091f349-633b-4d69-96d5-c6ec09f55695","resolution":{"observed_at":"2026-05-13T08:17:32.227942Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2024 , pages=","venue":null,"work_id":"df887d76-ebf3-4b09-a3f3-bffdd8975c31","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:6d4fe3d6a4cee34a90c81317fef939fcef17d256b40c6085660f6cb280db9fe2","observation_id":"d7b8a243-be82-4b97-b640-ee808be6c8bc","resolution":{"observed_at":"2026-05-13T08:17:32.223339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the AAAI Symposium Series , number=","venue":null,"work_id":"e465afec-3689-47bd-8569-3231a8651e67","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:a74cc95f50edadaf3234fd4890930f6e896517fb8cfb9f9c1f0cce560822a3b8","observation_id":"39277bbd-3b76-4088-baf2-022cbeaede7b","resolution":{"observed_at":"2026-05-13T08:17:32.274001Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":"3948bca8-60f9-4a73-b7e3-33a060289813","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:01df4c9354ffb3d53d70842dd67e14c40c2f618286d959a9c13d10de6b539f94","observation_id":"4c646333-71cf-4841-a174-ab96ca8692e3","resolution":{"observed_at":"2026-05-13T08:17:32.262203Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.02536","last_updated":"2025-05-23T10:01:57Z","snapshot_observed_at":"2026-08-06T08:12:55.523935Z","submitted_at":"2024-06-04T17:55:38Z","title":"Mitigate Position Bias in Large Language Models via Scaling a Single Dimension","version":3},"cited_work":{"arxiv_id":"2406.02536","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.02536","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2406.02536 , year=","venue":null,"work_id":"b3fec1b9-3d25-4084-a451-aae2ec524bd4","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2406.02536","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:b80fcc260a5023185aafe93efc5cade1e1dace39a06f4be0d9b7af10b5a4f964","observation_id":"fefbe4fd-a195-47d1-b00c-f0533076146c","resolution":{"observed_at":"2026-05-13T07:37:29.913435Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"c16b27c1-3c88-420b-84fd-d61cb49cb535","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:edecddd9d87a08372ce769a456350b8ea6cd1ed1fea62502e8178172409912df","observation_id":"6aa3cdd2-2321-4ec5-a7cf-ae64d63c28de","resolution":{"observed_at":"2026-05-13T08:17:32.291111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03009","last_updated":"2024-06-05T07:16:51Z","snapshot_observed_at":"2026-08-03T17:12:19.082790Z","submitted_at":"2024-06-05T07:16:51Z","title":"Unveiling Selection Biases: Exploring Order and Token Sensitivity in Large Language Models","version":1},"cited_work":{"arxiv_id":"2406.03009","doi":"10.48550/arxiv.2406.03009","metadata_source":"pith","pith_arxiv_id":"2406.03009","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2406.03009 , year=","venue":"cs.CL","work_id":"64649f87-b577-455b-9300-5dfe149fbe3e","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2406.03009","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:e1ab49f2df1bd301bd653ec41d3e3aa381af4dcf8aab86af79c8dce6b56cab28","observation_id":"eee701a0-3d6c-46f1-8b6d-884e3077443f","resolution":{"observed_at":"2026-05-13T07:37:29.831887Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 IEEE International Conference on Web Services (ICWS) , pages=","venue":null,"work_id":"9a3fe229-337f-41dc-aaa2-41b9b7e94ced","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:8f50dd5fb9aa4d0bc149d0040aa53c3d3a88bbda7e62e2d620e4a5702a9fe79b","observation_id":"07c141d9-e3fb-4af2-8bdf-d341136cebe4","resolution":{"observed_at":"2026-05-13T08:17:32.287213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14427","last_updated":"2025-02-12T01:33:00Z","snapshot_observed_at":"2026-07-31T21:52:16.125779Z","submitted_at":"2025-01-24T11:55:57Z","title":"GraphSOS: Graph Sampling and Order Selection to Help LLMs Understand Graphs Better","version":3},"cited_work":{"arxiv_id":"2501.14427","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14427","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2501.14427 , year=","venue":null,"work_id":"9d16bbcc-8112-42b8-8411-a86df6cb2b1c","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2501.14427","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:ff84bff130dc2e979e6b14388d32d7cd12c7468cf0beac441ca27d6cb9200c33","observation_id":"f37073eb-81db-4968-a4f2-ef937aa54969","resolution":{"observed_at":"2026-05-13T07:37:29.818585Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.15433","last_updated":"2025-05-21T12:14:26Z","snapshot_observed_at":"2026-07-06T21:27:47.396757Z","submitted_at":"2025-05-21T12:14:26Z","title":"Set-LLM: A Permutation-Invariant LLM","version":1},"cited_work":{"arxiv_id":"2505.15433","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.15433","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2505.15433 , year=","venue":null,"work_id":"590f7f38-c94e-4de9-88b8-a571265356a5","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2505.15433","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:24b5292fb14597ce84544dadad1c32529293c4b16c426a6af2a2f61164c213df","observation_id":"cb156072-3568-49d0-abda-e6c0d8b6697e","resolution":{"observed_at":"2026-05-13T07:37:29.928879Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"bb5c15d2-d66e-4e6e-8818-5248267aec37","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:e89c126185779271004cd867871b2475ad2099286796f11fa081bc8265fe538f","observation_id":"a18cb4a0-36a1-4e26-aac4-0a47b6e80192","resolution":{"observed_at":"2026-05-13T08:17:32.295049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:5932d2826dd612fa7da167b506ce4cba8f608bc95c8135514062ddeabd1f6cd4","observation_id":"42ea5fed-51e8-49d2-afe6-ee69b4fb1a02","resolution":{"observed_at":"2026-05-13T07:37:29.836589Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-07-06T19:17:41.512834Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":"2409.12122","doi":"10.18653/v1/2025.emnlp-main.712","metadata_source":"pith","pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","venue":"cs.CL","work_id":"a097c5d4-6d32-46ee-9826-57d532bbfc9c","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:8a2f2fbcb789217d68c75bdb8813b02edbf06bc64b233d6b0acc1942597fc330","observation_id":"d95be7c4-4c29-43f2-a4ad-0bafadbe4b76","resolution":{"observed_at":"2026-05-13T07:37:29.923782Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06332","last_updated":"2024-05-24T07:09:21Z","snapshot_observed_at":"2026-08-06T07:58:05.717753Z","submitted_at":"2024-02-09T11:22:08Z","title":"InternLM-Math: Open Math Large Language Models Toward Verifiable Reasoning","version":2},"cited_work":{"arxiv_id":"2402.06332","doi":"10.48550/arxiv.2402.06332","metadata_source":"pith","pith_arxiv_id":"2402.06332","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Internlm-math: Open math large language models toward verifiable reasoning","venue":"cs.CL","work_id":"da7fe877-735e-4436-9e53-837121a0b2d0","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2402.06332","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:19c2b570c8b8a1e1887aacd9107fc539699789515033b8e6d2eb21e3453745a9","observation_id":"9076d9d2-869e-42e8-baf6-73e554382b6c","resolution":{"observed_at":"2026-05-13T07:37:29.887905Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":"2409.12186","doi":"10.48550/arxiv.2409.12186","metadata_source":"pith","pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Coder Technical Report","venue":"cs.CL","work_id":"09ba463d-6377-4017-9801-444ffb94b056","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:25b9636cb4529233bbd0677eeaa66c5ce55a133386053089989de7ba79132d78","observation_id":"0b7c421d-921c-4f56-b5c0-8d242e25aee3","resolution":{"observed_at":"2026-05-13T07:37:29.933416Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:18:55.772185+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.16345","last_updated":"2025-02-14T09:32:11Z","snapshot_observed_at":"2026-07-06T19:56:30.344759Z","submitted_at":"2024-11-25T12:44:02Z","title":"Preference Optimization for Reasoning with Pseudo Feedback","version":2},"cited_work":{"arxiv_id":"2411.16345","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.16345","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Preference optimiza- tion for reasoning with pseudo feedback","venue":null,"work_id":"6a988540-d473-4683-b343-f74be1b17f35","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2411.16345","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:83e1479547cf58876a95e7e9d6eba1a3633e3bbc5bd4872c46af5fdddcc4aac0","observation_id":"1f28dbfd-d9dd-415e-8e08-3788e98bfeb9","resolution":{"observed_at":"2026-05-13T07:37:29.881455Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv , year=","venue":null,"work_id":"7342c2d1-3614-4bf4-9fea-a29bed041db7","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:45d9aae6bf767b7be264ddcdcce4c04c63cb6332e1bdca55025c01bf9cdf20c8","observation_id":"d9c77c58-691a-41e5-a802-469db297c38c","resolution":{"observed_at":"2026-05-13T08:17:32.237308Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16400","last_updated":"2025-06-05T17:59:12Z","snapshot_observed_at":"2026-07-06T21:28:24.644692Z","submitted_at":"2025-05-22T08:50:47Z","title":"AceReason-Nemotron: Advancing Math and Code Reasoning through Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2505.16400","doi":"10.48550/arxiv.2505.16400","metadata_source":"arxiv_reference","pith_arxiv_id":"2505.16400","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Acereason-nemotron: Advancing math and code reasoning through reinforcement learning","venue":"ArXiv.org","work_id":"428ad314-c120-41da-9db7-b8bc1918fffb","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2505.16400","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:e52d65a447eee65b1acc918dc889173f116e0dbd829b3f3a253d50456da1f37c","observation_id":"8cc6f019-6d8f-482f-924f-841fba0a9cdf","resolution":{"observed_at":"2026-05-13T07:37:29.841604Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05605","last_updated":"2025-06-03T09:19:46Z","snapshot_observed_at":"2026-07-06T19:29:27.705770Z","submitted_at":"2024-10-08T01:36:15Z","title":"CodeDPO: Aligning Code Models with Self Generated and Verified Source Code","version":2},"cited_work":{"arxiv_id":"2410.05605","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.05605","snapshot_observed_at":"2026-07-02T19:07:17.688200Z","title":"Codedpo: Aligning code models with self generated and verified source code.arXiv preprint arXiv:2410.05605, 2024a","venue":null,"work_id":"30b11c8b-9581-4f2f-93df-b6924fa36bbc","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2410.05605","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:9e7f3b8ebc0839e455d9977a26fb91edab3c77d8bc715a6e2af016e871d5eab7","observation_id":"903285d5-f30e-477b-99f6-3badcbb1d3b0","resolution":{"observed_at":"2026-05-13T07:37:29.939329Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:ce025746f348b1b69db6cc68d9148f1b502b7320a2ded1a54b0e23462dabf31e","observation_id":"c9042bc7-b01f-43a6-91d0-859b5e513e6c","resolution":{"observed_at":"2026-05-13T07:37:29.893688Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T17:56:26.096579Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"c25e8154-fab2-455c-8a26-56e40aed5d2b","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:eb258e67f201ca068b52d324417824688d6259c26146ee0f5dcba2b496e6909f","observation_id":"9147c6af-295b-4b83-831d-307ff1f6eeeb","resolution":{"observed_at":"2026-05-13T08:17:32.282944Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T02:47:55.730920Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":"b0092220-e738-45d3-97b1-bd1f0bd834c5","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:6311c423aabeafc6e475c9d640f49a5646138be7ff1a30772845423e628ef750","observation_id":"618675be-7fab-41c9-ab5b-b7dad2daad01","resolution":{"observed_at":"2026-05-13T08:17:32.233080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10571","last_updated":"2024-06-06T12:02:37Z","snapshot_observed_at":"2026-07-06T17:31:04.675896Z","submitted_at":"2024-02-16T10:55:38Z","title":"Direct Preference Optimization with an Offset","version":2},"cited_work":{"arxiv_id":"2402.10571","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2402.10571","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Direct preference optimization with an offset","venue":null,"work_id":"aca16f09-1a50-46c9-ba22-07ebf249d309","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2402.10571","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:104c4131dd86bb2444388315e3eb2e60ff538f6a028b2524c68edd84e8422573","observation_id":"104d1f22-4915-4274-ac35-a8d19d9c7e2b","resolution":{"observed_at":"2026-05-13T07:37:29.874766Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10858","last_updated":"2024-09-27T08:03:07Z","snapshot_observed_at":"2026-07-06T18:31:40.910349Z","submitted_at":"2024-06-16T09:06:17Z","title":"Step-level Value Preference Optimization for Mathematical Reasoning","version":2},"cited_work":{"arxiv_id":"2406.10858","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.10858","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Step-level value preference optimization for mathematical reasoning","venue":null,"work_id":"2523ac3a-94a4-4667-a2ce-de8ecadb2936","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2406.10858","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:39a6a221184e19f590da9cde24d4d12dd76b4952aae96469cb211b415c834545","observation_id":"3dd2b738-438b-4692-8fc8-673e0334ace8","resolution":{"observed_at":"2026-05-13T07:37:29.952562Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.10020","last_updated":"2025-03-28T00:06:51Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-01-18T14:43:47Z","title":"Self-Rewarding Language Models","version":3},"cited_work":{"arxiv_id":"2401.10020","doi":"10.48550/arxiv.2401.10020","metadata_source":"pith","pith_arxiv_id":"2401.10020","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Self-Rewarding Language Models","venue":"cs.CL","work_id":"b3903c9e-1bc7-4267-a171-6311902be2a4","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2401.10020","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:e72f4fc3e49702c87e16d5a5cb0edeadb4e056b2bf6ce022ffdf8e9e6ae4ef95","observation_id":"754e0a15-3f02-4279-b195-0293cbe81b07","resolution":{"observed_at":"2026-05-13T12:01:42.779186Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-24T14:25:11.326851+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T14:25:11.326851+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00168","last_updated":"2024-02-02T03:41:50Z","snapshot_observed_at":"2026-07-06T16:41:27.099792Z","submitted_at":"2023-10-31T21:52:41Z","title":"The Alignment Ceiling: Objective Mismatch in Reinforcement Learning from Human Feedback","version":2},"cited_work":{"arxiv_id":"2311.00168","doi":"10.48550/arxiv.2311.00168","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.00168","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2311.00168 , archiveprefix =","venue":"arXiv (Cornell University)","work_id":"c8842f79-72a6-4bd5-b060-22e797b4a71e","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2311.00168","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:8e692f2e48f164083c8b7ad8e50d202ce52f93bfa9b9d1925643b67a47dbb476","observation_id":"d37aecc7-4f51-4543-9e9a-8999ad36b06b","resolution":{"observed_at":"2026-05-13T07:37:29.854732Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.06080","last_updated":"2024-01-12T09:46:10Z","snapshot_observed_at":"2026-07-06T17:14:24.413664Z","submitted_at":"2024-01-11T17:56:59Z","title":"Secrets of RLHF in Large Language Models Part II: Reward Modeling","version":2},"cited_work":{"arxiv_id":"2401.06080","doi":"10.48550/arxiv.2401.06080","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.06080","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Secrets of RLHF in large language models part II: Reward modeling","venue":"arXiv (Cornell University)","work_id":"f37659bb-882a-46af-89a3-bf53a8c0969c","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2401.06080","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:d616952407ecfd5016179f4fdd4acca5f23c08aa4eecb031eebece6b6856f374","observation_id":"9e9cfa9b-6513-47ce-a9ae-ac8768437ab2","resolution":{"observed_at":"2026-05-13T07:37:29.945673Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":"2503.14476","doi":"10.48550/arxiv.2503.14476","metadata_source":"pith","pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","venue":"cs.LG","work_id":"64019d00-0b11-4bbd-b173-b46c8fad0157","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:bde20f679639c134c41ae31f2beb0afb6bd2989a3b9d20702d4d03a5c70acb26","observation_id":"46547bf7-8b40-4470-a8f0-60745dcae52a","resolution":{"observed_at":"2026-05-13T07:37:29.861770Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:06.254602+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23558","last_updated":"2025-05-30T07:37:34Z","snapshot_observed_at":"2026-07-06T21:33:02.686798Z","submitted_at":"2025-05-29T15:34:15Z","title":"Qwen Look Again: Guiding Vision-Language Reasoning Models to Re-attention Visual Information","version":2},"cited_work":{"arxiv_id":"2505.23558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23558","snapshot_observed_at":"2026-07-01T20:56:13.710075Z","title":"Qwen look again: Guiding vision-language reasoning mod- els to re-attention visual information","venue":null,"work_id":"cc9e5e98-c226-4e12-bf74-ff438225c4c0","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2505.23558","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:04adb948fd4df5c6a2bac01973f2f4173738a1d410ff7f2e42f05dfcceba3655","observation_id":"2b9c0382-4228-465e-8d9e-8b8b7bad606c","resolution":{"observed_at":"2026-05-13T07:37:29.848712Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.01431","last_updated":"2021-07-03T13:14:58Z","snapshot_observed_at":"2026-08-05T23:06:33.263209Z","submitted_at":"2021-07-03T13:14:58Z","title":"Neural-Symbolic Solver for Math Word Problems with Auxiliary Tasks","version":1},"cited_work":{"arxiv_id":"2107.01431","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.01431","snapshot_observed_at":"2026-07-02T22:47:26.055795Z","title":"arXiv preprint arXiv:2107.01431 , year=","venue":null,"work_id":"99955ad5-a79a-4f36-81a1-4c147178ca70","year":2021},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2107.01431","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:81623de7b65745872ff216fc4bc30f23a7a6f4df930eb9ba267c7aab8e36b094","observation_id":"4439da91-bd72-4035-8751-93095a40737e","resolution":{"observed_at":"2026-05-13T07:37:29.868070Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the 2013 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":"1fa75c7c-fb00-4284-bca7-d57bef84d275","year":2013},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:44703bd73bc72ae8902cffbbb8def1e10a400eddf5687705b2ee2dfbd8c6017d","observation_id":"0a941f00-88e0-443b-9a98-151094ac51f8","resolution":{"observed_at":"2026-05-13T08:17:32.266220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.03822","last_updated":"2018-06-11T06:10:11Z","snapshot_observed_at":"2026-08-02T00:06:16.208560Z","submitted_at":"2018-06-11T06:10:11Z","title":"Know What You Don't Know: Unanswerable Questions for SQuAD","version":1},"cited_work":{"arxiv_id":"1806.03822","doi":"10.48550/arxiv.1806.03822","metadata_source":"pith","pith_arxiv_id":"1806.03822","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Know What You Don't Know: Unanswerable Questions for SQuAD","venue":"cs.CL","work_id":"0d268f3a-4ca4-4600-b238-9d35f0b3f691","year":2018},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/1806.03822","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:b20484d26d8075d455e902657ec5cadc6db563f85ec3531acecfffd2f57727d3","observation_id":"54900de6-464b-4bdd-bf27-8f128ab2e243","resolution":{"observed_at":"2026-05-13T07:37:29.908455Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.01100","last_updated":"2025-03-31T20:37:34Z","snapshot_observed_at":"2026-08-06T01:45:56.485973Z","submitted_at":"2024-07-01T09:06:57Z","title":"Eliminating Position Bias of Language Models: A Mechanistic Approach","version":3},"cited_work":{"arxiv_id":"2407.01100","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.01100","snapshot_observed_at":"2026-06-29T16:23:39.321459Z","title":"Hang Wu, Hongkai Chen, Yujun Cai, Chang Liu, Qingwen Ye, Ming-Hsuan Yang, and Yiwei Wang","venue":null,"work_id":"89fea47d-5a99-4d8a-af27-b46fa2460e27","year":2024},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2407.01100","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:0df89eb38d72ec13db4d471478ea41547fe99534fc2e59dbf2f405c146b394cf","observation_id":"088a2967-6062-4c44-b660-a3a96c2e2756","resolution":{"observed_at":"2026-05-13T07:37:29.918096Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T20:25:37.824930Z","title":"Qwen2.5: A Party of Foundation Models , url =","venue":null,"work_id":"22515bae-5281-424a-a494-4f952e1ee0c3","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:bee1e9e4e18992a40361a598be8044bcdb606f5d5220487c00d1452d7955e3db","observation_id":"f5af5d75-332c-4192-8ec7-1c89e6281408","resolution":{"observed_at":"2026-05-13T08:17:32.277998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00200","last_updated":"2025-03-03T19:53:28Z","snapshot_observed_at":"2026-08-04T16:59:22.807968Z","submitted_at":"2024-04-30T21:06:52Z","title":"In-Context Learning with Long-Context Models: An In-Depth Exploration","version":2},"cited_work":{"arxiv_id":"2405.00200","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2405.00200","snapshot_observed_at":"2026-07-03T09:17:48.381748Z","title":"Gormley, and Graham Neubig","venue":null,"work_id":"16af75a7-d946-4ab5-a85c-1a423767113b","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"cited_paper":"/paper/2405.00200","citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:e35db7389bc5dcf23345d1a83034825000b8cf30ad387ccfdaa25f9f01b2565c","observation_id":"67240abf-fa2e-4ba2-ae38-52d51a44508a","resolution":{"observed_at":"2026-05-13T07:37:29.901629Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"e0815f7b-aec9-4740-85d2-2eee98febc0b","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:5feb6498f65eff3a7a58181bd3df151c436a9d146637d1311d3a8d9becb2dca9","observation_id":"0d1d92ee-cd46-43f4-9788-2c0648c4691c","resolution":{"observed_at":"2026-05-13T08:17:32.299642Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"e3a6bba2-3926-414c-b3f3-54c5abb3827b","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:dae3cd43fd49fe2fa384f376feb8e66e4c6232255071d104f234a0e8e10689d1","observation_id":"df55ac3c-4b56-4a94-8271-19d8d5c51517","resolution":{"observed_at":"2026-05-13T08:17:32.245085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":"c7769c40-bf5a-40ba-95f6-6e017b44d711","year":null},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:e1c3510af5d46de8991d4a04795a28b9959bbfbc1319e56f348024354e2cb783","observation_id":"efcac845-91b7-4687-8860-e397f9c909fb","resolution":{"observed_at":"2026-05-13T08:17:32.249789Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.05111","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Arm-thinker: Reinforcing multimodal generative reward models with agentic tool use and visual reasoning","venue":null,"work_id":"1d33f4b0-de71-411a-9ec9-358b038fa3e0","year":2025},"citing_paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-05-13T07:32:58.404947Z"},"links":{"citing_paper":"/paper/2605.11974"},"observation_digest":"sha256:0c5c668af91d664146a6009f32f8605aa293073c6d6a0f6dab7599db0a6e6df7","observation_id":"1243ead2-91b6-4eb9-9fc9-a88278b240b1","resolution":{"observed_at":"2026-05-13T07:37:29.824883Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.11974","last_updated":"2026-05-12T11:31:18Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T23:23:44.276236Z","submitted_at":"2026-05-12T11:31:18Z","title":"Towards Order Fairness: Mitigating LLMs Order Sensitivity through Dual Group Advantage Optimization"},"reference_resolution":{"displayed":59,"state_counts":{"malformed_identifier":0,"metadata_mismatch":19,"parse_uncertain":0,"unresolved":0,"verified_exact":12,"verified_fuzzy":28},"total_outbound_references":59},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 59 of 59 outbound references and 0 inbound Pith citation observations for arXiv:2605.11974."}