{"as_of":"2026-08-11T15:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:94793712596638947c4b1d21393a5e369bb5d61fcc395d170dc30f29df5b34a3","coverage":[{"denominator":41,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":41,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:44:30.355862Z","state":"measured"},{"denominator":41,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":41,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.13972/citation-record","integrity":"/paper/2505.13972/integrity","json":"/paper/2505.13972/citation-record.json","paper":"/paper/2505.13972"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-07T15:44:25.515082Z","title":"Hewett, Mojan Javaheripi, Piero Kauffmann, James R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:25.515082Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:779bdc60bbcf50a5af9b845480f3bfc13dcf3529c4aae700f5d7d92468e44263","observation_id":"7088945a-d144-4f99-a60c-a4e592907fe0","resolution":{"observed_at":"2026-08-07T15:44:25.515082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:36.819825Z","title":null,"venue":null,"work_id":"8eb816fa-5a52-4c8b-9b5e-4288dc000e64","year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:25.554905Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:13da3f019c66ce380dd629e40466e2d60f0c6982acd76f51832c27be5652a774","observation_id":"6b00125d-17ca-40ed-958f-f67ebb09fba6","resolution":{"observed_at":"2026-08-07T15:44:36.893628Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:25.650892Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:25.650892Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:cabe9183885cab5ed6fa421decdb42d629c676910af371604bf72b91d89cf29e","observation_id":"638873ec-33a8-4e8d-972d-0f1f3ff97c97","resolution":{"observed_at":"2026-08-07T15:44:25.650892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.10","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"822217b2-4d28-4d61-9ea8-b29bd26f014e","year":2023},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:25.754515Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:22052a21c3b09a18815e83f696674197fb81c5c02294c2a1c6f74b3d315cf089","observation_id":"3117beef-c4f5-4366-830e-3d819b5959ee","resolution":{"observed_at":"2026-08-07T15:44:33.234735Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:25.825354Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:25.825354Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:1c8d4f86f520bb90b78319c193c7d42a71520e443e7f6eac32b02274b8098e72","observation_id":"0ad26ac0-38c0-4065-9fee-872b29b8807a","resolution":{"observed_at":"2026-08-07T15:44:25.825354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:36.465012Z","title":null,"venue":null,"work_id":"7e39463c-4cd7-4513-b471-99f20d447f52","year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:25.895584Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:4926ece5bb810fc7db0415f15ffcc24dfd7038fa5ed873ae156d97627bc170a0","observation_id":"d8f194de-3bf2-4e68-b873-3856962a54d0","resolution":{"observed_at":"2026-08-07T15:44:36.602773Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:26.043351Z","title":"Bowman, Gabor Angeli, Christopher Potts, and Christopher D","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.043351Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:a228638bccecda2261b4f4957111da248172c95427873855e3d5a9b4d6236388","observation_id":"fc89d7ea-351a-4353-9fcb-792951f9c937","resolution":{"observed_at":"2026-08-07T15:44:26.043351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:26.234743Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.234743Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:c4d5806e166bdb92bd1c8ad238ec25c28c922d43298ceaffd75e5431e36643ea","observation_id":"cc147dd9-e4cd-4013-b9d9-72c468494670","resolution":{"observed_at":"2026-08-07T15:44:26.234743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:44:26.344047Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.344047Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:1398ca7d239ac151cde116b6fefbe440e7cb0a3b2ee78b09bb42d0e8d8f78bc7","observation_id":"fe638c10-8937-464a-b023-553114cc1164","resolution":{"observed_at":"2026-08-07T15:44:26.344047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.18156","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:34.602076Z","title":null,"venue":null,"work_id":"bdf3dbd9-912b-43ae-b43e-bf26c7d25546","year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.464746Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:7ec625881ebbd41d1d447807d4880a2c772a09795367d2d9b6e1202f2c07d964","observation_id":"a2dbc8b2-911f-4c08-9865-2eb3f5b69d05","resolution":{"observed_at":"2026-08-07T15:44:34.792167Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:26.614909Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.614909Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:cec35b39dca504ac1438175d6f8c757d6db43e5ad31d8e5dcfd4691e6d5fcc31","observation_id":"3aaacecc-76ec-49a5-9f24-cd84555444c4","resolution":{"observed_at":"2026-08-07T15:44:26.614909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:26.794865Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.794865Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:372786d373f02f3c7f3e25f6329897559234956aa5dfc8c952f1de813342bd56","observation_id":"1e9f694f-152b-46cb-a716-8a5945f3453b","resolution":{"observed_at":"2026-08-07T15:44:26.794865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v39i15.33791","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"acff485e-8313-4131-b053-7b6a595c9721","year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:26.907496Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:d797398b7a16f0b17f604a6b165b2c33a9cc26b804cd5260b7a4ad7c32b595c3","observation_id":"48b6081e-2c53-4b88-9cc9-8022c0bb897c","resolution":{"observed_at":"2026-08-07T15:44:32.734870Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.359","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"b5e8214e-3e1c-4ffe-adb7-bb8c3b79d56c","year":2023},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.034846Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:55d83b0d5eb6a3b7e04cb2fc65b25ca39d33407e613b81ef6f41bea78967b7c3","observation_id":"f340d044-a703-418a-86c7-ac949718d152","resolution":{"observed_at":"2026-08-07T15:44:32.470377Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.emnlp-main.452","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing","work_id":"7aa3c91c-21ba-4c52-86ca-9e165ff40966","year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.181806Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:4b14473550f7be8000ea514ee849d4d09eb54ee414ba4d29294d024f2ab13e71","observation_id":"8d43f7c0-349e-4f77-93e2-8761bc39f687","resolution":{"observed_at":"2026-08-07T15:44:32.192332Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:27.316254Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.316254Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:7c7463b4aa7eae6bc51d366682986263a60973306a920add83b355d21651302d","observation_id":"1e4f6d65-a1f8-4117-b92b-c4dfced02546","resolution":{"observed_at":"2026-08-07T15:44:27.316254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.01962","last_updated":"2021-09-05T01:38:49Z","snapshot_observed_at":"2026-08-10T08:11:22.998999Z","submitted_at":"2021-09-05T01:38:49Z","title":"Counterfactual Evaluation for Explainable AI","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.01962","snapshot_observed_at":"2026-08-07T15:44:27.488639Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.488639Z"},"links":{"cited_paper":"/paper/2109.01962","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:49ba2d01457137a67de55cb8279f8bef34132884f3575740f7f01da302c48e14","observation_id":"1d5c8c3d-0cc8-4dfa-8459-bf1d4712e4e3","resolution":{"observed_at":"2026-08-07T15:44:27.488639Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T15:44:27.624972Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.624972Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:dce74d4e0cbc901d1500b1b2066b34bb98d7782166289832214641ed70b82ff5","observation_id":"c883d8c2-6b6d-41c0-aaa4-67e1144eef69","resolution":{"observed_at":"2026-08-07T15:44:27.624972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:27.764919Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.764919Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:9f2902cee5e3c51c1e6cbc138480f2289e094f697c9f61412e44a76556daa7a9","observation_id":"da3e824a-30f2-4312-95ce-38c4b92815ab","resolution":{"observed_at":"2026-08-07T15:44:27.764919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:27.933864Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:27.933864Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:3d4a5553a0cdbf4c0a61495e5a227ecc22a6c076d6288c92708f11bb09d78917","observation_id":"33d3ae11-6940-4465-b6d2-45ae956f336a","resolution":{"observed_at":"2026-08-07T15:44:27.933864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:36.134814Z","title":null,"venue":null,"work_id":"12574797-3e8c-4e80-be2e-60a64e391f10","year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.036650Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:f821b5c27f1b8d55d2e3a6020a64687a7607543b74a51bab930929045258e51a","observation_id":"407b9831-af7a-4d0d-bdb0-005d367a5b30","resolution":{"observed_at":"2026-08-07T15:44:36.215754Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:28.195340Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.195340Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:d82fe5190a45811714ea7914db1d74bd480d05482a9dc44cf21c24c8cd952628","observation_id":"16425e82-50fb-4e09-a141-ac9f9cdcab17","resolution":{"observed_at":"2026-08-07T15:44:28.195340Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v35i15.17594","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":"Proceedings of the AAAI Conference on Artificial Intelligence","work_id":"945cb3c3-86c0-4aa0-857b-851e7932d6a8","year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.379835Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:9ee84737220d66301bf291373cacfef728a30c24ea17e63720c6d8ccd18efe76","observation_id":"cdccff1e-2b2b-4eb6-9712-161ec3114885","resolution":{"observed_at":"2026-08-07T15:44:31.814757Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:28.515999Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.515999Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:c2db9b351e47e40c1b9de82626b7cfba72ccc21c28e28e47504c8166e42107b4","observation_id":"6fdca278-8915-419d-99ac-7a4f2ac5cd0e","resolution":{"observed_at":"2026-08-07T15:44:28.515999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:35.804748Z","title":null,"venue":null,"work_id":"b14ebff2-2987-4d93-912e-e14ac5f30d13","year":2019},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.603647Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:e47391d321d4068089e8c68868e6ba3b27a00b28cfa78b1a7e4d589101f43098","observation_id":"26a1e29f-cc54-4e23-92df-211cbde78ee0","resolution":{"observed_at":"2026-08-07T15:44:35.885737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:35.505475Z","title":"o rg Schl \\","venue":null,"work_id":"1e2a185b-073c-42ac-9bea-81472139725c","year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.696386Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:ca4e3f29aaf4aac49f06e4a3de8863ccc80d30a4bc728c6213bd3cc9a840464d","observation_id":"c1b0b121-01e2-4bd5-aac0-1e849049c49e","resolution":{"observed_at":"2026-08-07T15:44:35.626161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:28.804745Z","title":"o rg Schl \\","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.804745Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:97a90a4d9df76a0145bc78118607600b1f86187f95f89e20e5aaf71c0faba167","observation_id":"486c2ae8-00d4-41b9-89a5-34263a8594c1","resolution":{"observed_at":"2026-08-07T15:44:28.804745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T15:44:28.900244Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.900244Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:d27c965b9ca4eb369db3f8e0eb10271579b9e6d186cd7a9b8bf480298cb7ca33","observation_id":"b4933804-24fb-4fbf-8316-58d2a8644657","resolution":{"observed_at":"2026-08-07T15:44:28.900244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.findings-emnlp.306","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"c579ac99-0735-45bc-9b02-cee755198495","year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:28.994748Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:e63166d05521ff19b3cfc0bca992aaa31d63fb69c4a9ec15412513b9396dcdd3","observation_id":"af6cf771-22be-4748-8787-37cac2b2425a","resolution":{"observed_at":"2026-08-07T15:44:31.447121Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:29.085098Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.085098Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:abad192247e54a7e99407f008ab9015cd6a72f2fee79d55c8c8bd10077aefaa3","observation_id":"82ec1ccd-cc26-484e-ba3c-7125d2f6a1f3","resolution":{"observed_at":"2026-08-07T15:44:29.085098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:29.236695Z","title":"Manning, Andrew Ng, and Christopher Potts","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.236695Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:b1b921f5aa14745acf05fffad42b5b28c633c7f6a53ccdbc5841138719af39b4","observation_id":"16614cd7-9449-4205-b7a3-8ff8858f5041","resolution":{"observed_at":"2026-08-07T15:44:29.236695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:29.354746Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.354746Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:da63fa3e84a8e3bccb6c3dcca7967ad33b66b2bb4a3b578f13e556351467ae24","observation_id":"c66d15c2-8c8d-463c-94d2-158f024682d0","resolution":{"observed_at":"2026-08-07T15:44:29.354746Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11830","last_updated":"2025-02-17T14:25:54Z","snapshot_observed_at":"2026-08-07T18:12:22.280387Z","submitted_at":"2025-02-17T14:25:54Z","title":"Text Classification in the LLM Era -- Where do we stand?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11830","snapshot_observed_at":"2026-08-07T15:44:29.464953Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.464953Z"},"links":{"cited_paper":"/paper/2502.11830","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:4b1c0b6cde281f1cf7e37caaa1b4875e7080651072cec983f966f3df7addc977","observation_id":"dba62b38-02ae-4262-9393-235e83889d6a","resolution":{"observed_at":"2026-08-07T15:44:29.464953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.hcinlp-1.9","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"b5e33cea-638e-4a31-bc16-d3d178520d54","year":2024},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.564834Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:e35f5e49b16e13ee6891f8a478e28eea4ebff7aae8fc03dce6d9ef06e2421564","observation_id":"731fe4f2-593d-4e92-a1d4-25975a6519c1","resolution":{"observed_at":"2026-08-07T15:44:31.092070Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00777","last_updated":"2025-05-28T15:18:07Z","snapshot_observed_at":"2026-08-10T22:40:38.603644Z","submitted_at":"2025-01-01T09:00:10Z","title":"FitCF: A Framework for Automatic Feature Importance-guided Counterfactual Example Generation","version":3},"cited_work":{"arxiv_id":"2501.00777","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.00777","snapshot_observed_at":"2026-08-07T15:44:33.533795Z","title":"FitCF: A Framework for Automatic Feature Importance-guided Counterfactual Example Generation","venue":"cs.CL","work_id":"d599e176-b016-4db9-92e8-c040b53f2585","year":2025},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.684825Z"},"links":{"cited_paper":"/paper/2501.00777","citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:71e7149c7a494fa6ff4255ab9290d799e1c5a7945faece608d782aa1b4bfbf89","observation_id":"6397cb28-4e40-4d5b-a9d6-ca31560ef29f","resolution":{"observed_at":"2026-08-07T15:44:33.641915Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:29.765292Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.765292Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:5e9abb0082e98b33fd9028ba8bb6343d071be2d0450cfa244e3a05e59a6e3d55","observation_id":"19508210-7d82-4a4a-9420-83a7bf1da4ff","resolution":{"observed_at":"2026-08-07T15:44:29.765292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2021.acl-long.523","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-10T05:30:23.456663Z","title":null,"venue":null,"work_id":"fb57e993-a153-4d13-9a88-c6dc96587e1a","year":2021},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:29.915421Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:2c3e01ef91802b3e97f046d07ece139c5eeb58a37bf55e724f34291df70441fd","observation_id":"17e3b136-49ab-40e2-9eee-3141a776c9cb","resolution":{"observed_at":"2026-08-07T15:44:30.787790Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:30.023875Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:30.023875Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:8ac9d2c9379b028f8eb88c887d49c7e8fae67d965111741d34e1ce6a31452549","observation_id":"a0e27e0f-4ef5-4a0e-a53b-3228ffd9b74a","resolution":{"observed_at":"2026-08-07T15:44:30.023875Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:30.124745Z","title":"Hedderich, Fangzhou Zhai, David Ifeoluwa Adelani, and Dietrich Klakow","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:30.124745Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:580391ef868e6ad1656b0fad4a7e3adce29f16dcc48fa32a6ce34b5be25185d9","observation_id":"f771dca3-1144-4307-86df-76a604f22cd0","resolution":{"observed_at":"2026-08-07T15:44:30.124745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:30.255876Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:30.255876Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:abb64e5ee3baebb2f9051b6f52792b510320af73341f8c9b2d0a3b68c2560ca2","observation_id":"579fd5d3-a216-4301-9e5c-09af59736928","resolution":{"observed_at":"2026-08-07T15:44:30.255876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:44:30.355862Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals","version":3},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:44:30.355862Z"},"links":{"citing_paper":"/paper/2505.13972"},"observation_digest":"sha256:8ee50ea61843d83539a0202d6c809ebb075bd0070ccabd27d3ab635573784893","observation_id":"a8f8babd-db04-427c-8d59-44abe76985ea","resolution":{"observed_at":"2026-08-07T15:44:30.355862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.13972","last_updated":"2025-08-27T14:04:13Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T04:06:17.175053Z","submitted_at":"2025-05-20T06:12:17Z","title":"Truth or Twist? Optimal Model Selection for Reliable Label Flipping Evaluation in LLM-based Counterfactuals"},"reference_resolution":{"displayed":41,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":30,"verified_exact":10,"verified_fuzzy":1},"total_outbound_references":41},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 41 of 41 outbound references and 0 inbound Pith citation observations for arXiv:2505.13972."}