{"as_of":"2026-08-16T21:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:35f4feef719861e1525ec9403384ba2cae261dcbb711083514fc2bd83268d1d3","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T19:30:47.313467Z","state":"measured"},{"denominator":28,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":28,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.24273/citation-record","integrity":"/paper/2607.24273/integrity","json":"/paper/2607.24273/citation-record.json","paper":"/paper/2607.24273"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:45.680312Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:45.680312Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:819b6a6c3fcb2c1dc2641dc3438fbdf1d67747f6225105d8c7c0e09d1b233a24","observation_id":"d3899e85-923a-4eb6-a95e-4cec861ac791","resolution":{"observed_at":"2026-07-31T19:30:45.680312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:45.724972Z","title":"Proceedings of the 60th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:45.724972Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:dde284196a11f58644575359bcfac37ac26d35bab7e45a818534cfe732fd40c6","observation_id":"2aa5536a-f6c7-4b3d-8507-761779d175cb","resolution":{"observed_at":"2026-07-31T19:30:45.724972Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:45.788036Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:45.788036Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:da75ec02862a1d82305d6aa380154cf0d121331fb4df39af9d41ee96610a0ac2","observation_id":"81702f14-babb-40d6-84cb-0712e6ed79e9","resolution":{"observed_at":"2026-07-31T19:30:45.788036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:45.852069Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:45.852069Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:0882e8e9d2ab3eab03dabe45675a2003be04e643b54ac721ad7979e19f2f5925","observation_id":"bb90880a-6656-45ce-a8c1-54d8d0b40c37","resolution":{"observed_at":"2026-07-31T19:30:45.852069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:45.910590Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:45.910590Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:a1129be4f1a8cbfac8c632137cfe3ad06e1c65301fe347629a00652ee7518829","observation_id":"d4e45446-f2c4-42bf-bc89-e2a2f829ced5","resolution":{"observed_at":"2026-07-31T19:30:45.910590Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10943","last_updated":"2025-01-19T04:53:20Z","snapshot_observed_at":"2026-08-15T21:11:22.925727Z","submitted_at":"2025-01-19T04:53:20Z","title":"InsQABench: Benchmarking Chinese Insurance Domain Question Answering with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.10943","snapshot_observed_at":"2026-07-31T19:30:45.989599Z","title":"arXiv preprint arXiv:2501.10943 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:45.989599Z"},"links":{"cited_paper":"/paper/2501.10943","citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:63ba6f4c5fb0b6a9a8edc1f4b37e1fcae8e64ac41e1143618f2c8a9e3c8a8447","observation_id":"7dc76271-86b2-4b7b-86de-3ed745b33092","resolution":{"observed_at":"2026-07-31T19:30:45.989599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04455","last_updated":"2025-08-27T03:13:40Z","snapshot_observed_at":"2026-08-15T16:48:32.176016Z","submitted_at":"2025-08-27T03:13:40Z","title":"INSEva: A Comprehensive Chinese Benchmark for Large Language Models in Insurance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04455","snapshot_observed_at":"2026-07-31T19:30:46.079681Z","title":"arXiv preprint arXiv:2509.04455 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.079681Z"},"links":{"cited_paper":"/paper/2509.04455","citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:859a178ff797c67c85a0e66f3246ed91cc4130e71ea7c4d7cc63fa967ae2567c","observation_id":"47f6cb9c-2cb7-4ddc-9934-307efd54dbb6","resolution":{"observed_at":"2026-07-31T19:30:46.079681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.120045Z","title":"arXiv preprint arXiv:2511.07794 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.120045Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:dddddff4523ad44ee8f5957e50228d336076d7330d54654b384ffe8d665cb49f","observation_id":"a2789164-643b-4ed2-a5da-de53b96dd7f2","resolution":{"observed_at":"2026-07-31T19:30:46.120045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.164146Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.164146Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:adf6084b857edfe41bca44218f8656dc01b8e204c958786957e93f7a01b086d3","observation_id":"3ce75931-1e8b-496f-8043-01de660f8373","resolution":{"observed_at":"2026-07-31T19:30:46.164146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.203448Z","title":"British Actuarial Journal , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.203448Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:ac2f06e5673cc18733c7b4ebb56c7298ce1088965f2ab3ce6c010da8e56ba3c0","observation_id":"eabd5823-d10f-428c-bbdc-0398d81e138f","resolution":{"observed_at":"2026-07-31T19:30:46.203448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.240586Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.240586Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:50a6dd36c815d8ee2c269e06c96e2e06dfab848880d05f4f0590ccb499696376","observation_id":"adbe69b1-e637-4da3-8073-e4ab71dfa331","resolution":{"observed_at":"2026-07-31T19:30:46.240586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.283987Z","title":"Proceedings of the 32nd ACM SIGKDD Conference on Knowledge Discovery and Data Mining V","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.283987Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:15a2f670bcbca4bb22b69991a67a94b3ad0a6fb08a9f01a27511c996fddda62a","observation_id":"2b51979f-0aa7-4ff6-82b3-0a3f9feb81e9","resolution":{"observed_at":"2026-07-31T19:30:46.283987Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.335481Z","title":"Proceedings of the 33rd ACM International Conference on Multimedia , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.335481Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:4ed360409ef5a31081ba68ffb0f5dc9007d78a3a403272ce0dac8bb6c3fafc4a","observation_id":"27f08a79-426e-4b0e-9562-4fc517e0b255","resolution":{"observed_at":"2026-07-31T19:30:46.335481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.392709Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.392709Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:6d22dfb0729ec4376eff02cc7fe68fb421b9d7c68d3f3de40eae3cca945e2eaf","observation_id":"efeb2dcc-bacf-4c22-b4e8-a03a6b495ff5","resolution":{"observed_at":"2026-07-31T19:30:46.392709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.447495Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.447495Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:e91cfdc2152379cdc1260d5a927a9d3242b431a293c3c4a6be51ca94aff05661","observation_id":"fbc213e4-baa1-44a6-a969-06b763ac9f6a","resolution":{"observed_at":"2026-07-31T19:30:46.447495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.500855Z","title":"2017 , publisher=","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.500855Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:21ffee435cabee3e13393cf81e525b0ba6bdeeea88a0497bdbadc94eec71c47b","observation_id":"9b090139-8c17-4d57-86bf-2efe59280e09","resolution":{"observed_at":"2026-07-31T19:30:46.500855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.11944","last_updated":"2023-11-20T17:28:02Z","snapshot_observed_at":"2026-08-13T18:35:52.271946Z","submitted_at":"2023-11-20T17:28:02Z","title":"FinanceBench: A New Benchmark for Financial Question Answering","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.11944","snapshot_observed_at":"2026-07-31T19:30:46.558715Z","title":"arXiv preprint arXiv:2311.11944 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.558715Z"},"links":{"cited_paper":"/paper/2311.11944","citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:ce19b655557c98821fa603dde091dc9269928d57eab4dee7847490fd8d352d85","observation_id":"b4ccb06d-117d-43b9-a11a-eb8cf344a0ba","resolution":{"observed_at":"2026-07-31T19:30:46.558715Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.562005Z","title":"Proceedings of the 62nd Annual Meeting of the Association for Computational Linguistics (Volume 2: Short Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.562005Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:4cd1ce42a8bc7a8bfb4ee4a431ad822d34ad02d01344b3ed6e6fa5578a679894","observation_id":"fb017d84-86a3-4d28-935e-c19f98f52cb6","resolution":{"observed_at":"2026-07-31T19:30:46.562005Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.565434Z","title":"arXiv preprint arXiv:2603.07316 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.565434Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:c658035241baf92db8b7d3d3d7e799c2c367850401447b0d922f062d9b00117a","observation_id":"88a6c4db-4140-4b3c-a4af-65846e80a3f4","resolution":{"observed_at":"2026-07-31T19:30:46.565434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13168","last_updated":"2026-04-15T17:46:00Z","snapshot_observed_at":"2026-08-14T10:45:22.852297Z","submitted_at":"2025-12-15T10:28:45Z","title":"Finch: Benchmarking Finance & Accounting across Spreadsheet-Centric Enterprise Workflows","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13168","snapshot_observed_at":"2026-07-31T19:30:46.613565Z","title":"arXiv preprint arXiv:2512.13168 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.613565Z"},"links":{"cited_paper":"/paper/2512.13168","citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:ef3bb27a7edb46525e43501e8043337bd118adf92d1084aeebfaea87589189aa","observation_id":"d7b1547c-fef7-464c-9f3e-28b5abbe39dc","resolution":{"observed_at":"2026-07-31T19:30:46.613565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.696129Z","title":"Scientific Data , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.696129Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:1fc59f9b32c2fa8a1a9ac544a5189aff1e4e72793c2a097300c94b14bc5a3f95","observation_id":"f1de9ae5-2365-4ca8-8b34-be350bbc13fc","resolution":{"observed_at":"2026-07-31T19:30:46.696129Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.803582Z","title":"Proceedings of the 29th symposium on operating systems principles , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.803582Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:3bb2110c43e0a53466c2ccb61191b41e3434ce841488d46fc09478c4ab0b34bb","observation_id":"3b4d9300-ab0e-4e01-9ed1-5c17d5a97b7e","resolution":{"observed_at":"2026-07-31T19:30:46.803582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.23048","last_updated":"2026-04-03T14:01:42Z","snapshot_observed_at":"2026-08-11T02:44:07.522846Z","submitted_at":"2026-01-30T14:56:04Z","title":"From Abstract to Contextual: What LLMs Still Cannot Do in Mathematics","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.23048","snapshot_observed_at":"2026-07-31T19:30:46.892090Z","title":"arXiv preprint arXiv:2601.23048 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.892090Z"},"links":{"cited_paper":"/paper/2601.23048","citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:17cbe48e092e2dbb417a9e6c7f3b486b9496360fda878712d60e2bc1cf2e7b59","observation_id":"e2266c6f-e905-40b0-8074-c6ed2ce461cf","resolution":{"observed_at":"2026-07-31T19:30:46.892090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:46.952783Z","title":"NYU Stern School of Business , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:46.952783Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:ed5e5f1dd9981447f2de8800f2d964238f82ef6a5217dd1da133f6b208a75f71","observation_id":"17b8c6e2-9cd0-4e8d-91e6-d48a5bb09d3f","resolution":{"observed_at":"2026-07-31T19:30:46.952783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:47.036841Z","title":"Journal of Artificial Societies and Social Simulation , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:47.036841Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:e41c1cdee42359f850d2de453b4ddb21c343bcee31385a96329ea3c2867ccaaa","observation_id":"5121772f-673e-4af6-91fa-0a5ed56458ca","resolution":{"observed_at":"2026-07-31T19:30:47.036841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:47.129097Z","title":"British Actuarial Journal , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:47.129097Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:6a44368d08e83f2cb768e9ec42bb0d5fa5cd0e0fc6e2700abb8c774ee1a9561d","observation_id":"77800c3e-9e14-4d5c-a984-c24e11b9c71a","resolution":{"observed_at":"2026-07-31T19:30:47.129097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:47.223107Z","title":"Actuarial Practice Forum , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:47.223107Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:d4ab1ef81c219a5b5eea3d6525a50acc3048cde79c6cae26d17fb8691109ace7","observation_id":"b635c8ff-b8af-4100-8b50-4e21cbd3d73d","resolution":{"observed_at":"2026-07-31T19:30:47.223107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T19:30:47.313467Z","title":"Journal of Statistical software , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-07-31T19:30:47.313467Z"},"links":{"citing_paper":"/paper/2607.24273"},"observation_digest":"sha256:ae76d5a0a73b2579c89ab031e06ad70f301a98dee2705524fa095bb7a8d07e74","observation_id":"4056c7f6-5d7b-48af-8b5b-17e56aa9b0d5","resolution":{"observed_at":"2026-07-31T19:30:47.313467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.24273","last_updated":"2026-07-27T11:12:50Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-13T08:23:04.802589Z","submitted_at":"2026-07-27T11:12:50Z","title":"INS-ActBench: A Comprehensive Benchmark for Assessing Professional Actuarial Capability of Large Language Models"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":28,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 0 inbound Pith citation observations for arXiv:2607.24273."}