{"as_of":"2026-08-17T02:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1527a880cfca4ea9410b8b9c6946e3a999fb6a8de619d22cd1ef443727efe831","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:27:19.557506Z","state":"measured"},{"denominator":37,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":37,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18105/citation-record","integrity":"/paper/2506.18105/integrity","json":"/paper/2506.18105/citation-record.json","paper":"/paper/2506.18105"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.397378Z","title":"online\" 'onlinestring :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.397378Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:428b49bfed5690b4dc714459ab71cac51a5676b003e0dbc3a5452bcf25b55616","observation_id":"04413bc8-ef2d-46f2-8f86-defac231cffd","resolution":{"observed_at":"2026-08-06T23:27:19.397378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.402020Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.402020Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:c9b815112a84648f598bcb93ce9887ca17f43b529b8dcdb7998f713dfb320a32","observation_id":"849161ce-f034-4894-8b50-ad5a1c43bf9f","resolution":{"observed_at":"2026-08-06T23:27:19.402020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.406440Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.406440Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:506cfaa613c8b3d9ccf8812445eb6026a777842ceb614fd77343338ef318ec1a","observation_id":"ac448605-d127-4f91-8f0f-eaeb41afbad7","resolution":{"observed_at":"2026-08-06T23:27:19.406440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.996250Z","title":null,"venue":null,"work_id":"55b31d4c-650c-43a2-a768-3e9b920a55bd","year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.411030Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:e85482ced898e006e255e827e2e1372d8cd2848732ddec4951f8634e69fd8f1a","observation_id":"35047579-0696-4bb0-8531-e816623e759c","resolution":{"observed_at":"2026-08-06T23:27:20.000812Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-15T17:27:11.980940Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T23:27:19.415168Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.415168Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:861b2d373ea21e20626f735e233531205dc1c7f4636d90d75adad0ad40f929c5","observation_id":"f146693c-c2c7-42ec-b931-7daced7f5c54","resolution":{"observed_at":"2026-08-06T23:27:19.415168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09407","last_updated":"2024-10-12T07:28:10Z","snapshot_observed_at":"2026-08-16T13:10:06.846600Z","submitted_at":"2024-10-12T07:28:10Z","title":"CAMPHOR: Collaborative Agents for Multi-input Planning and High-Order Reasoning On Device","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09407","snapshot_observed_at":"2026-08-06T23:27:19.420079Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.420079Z"},"links":{"cited_paper":"/paper/2410.09407","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:c1ea16294c9833ca2da6151cd0ee4c0a72e3cba4833fb716d3e9b2896654ace1","observation_id":"ccadc2d8-02ee-40ce-984e-1df9d00c976f","resolution":{"observed_at":"2026-08-06T23:27:19.420079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.983910Z","title":null,"venue":null,"work_id":"061406c2-3877-4aa0-aca7-584c049ae7f8","year":2025},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.424225Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:c274f5781358b2578e38e1c2354c00f1e112fadd0c4a569745cc8a165998b03a","observation_id":"f809f70e-d6ab-42bd-b67c-880ee6dd4e54","resolution":{"observed_at":"2026-08-06T23:27:19.988535Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:27:19.428449Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.428449Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:054c0de1cb7cba577585e6fdf50e05b0f0657f3f7859faa657121244b7cde1ea","observation_id":"efc816de-e1b5-4359-9e90-78a2eaa3dee9","resolution":{"observed_at":"2026-08-06T23:27:19.428449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.970454Z","title":null,"venue":null,"work_id":"6fdfce3d-5d91-4d5a-8b75-af5c238e0ed2","year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.432735Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:8b77530ebbbc2355b9d79a66d0c91df02c6dd505d5c7cd23b446dc37e41b2cc0","observation_id":"22ea5a89-3bb0-4648-a4fa-75790734a573","resolution":{"observed_at":"2026-08-06T23:27:19.975510Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.957544Z","title":null,"venue":null,"work_id":"5782ab92-e547-4b49-b9dd-1050d4e6201c","year":2016},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.436610Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:a27785cc5efd52c863caa204d8f80161d863850489ea161d4dbcfd8df2a41432","observation_id":"dceaf9eb-e7a9-415b-adc8-2964541a23e9","resolution":{"observed_at":"2026-08-06T23:27:19.961544Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-06T23:27:19.440450Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.440450Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:f20031e81cab3609858351e371a491a5aac199550144c5b82665b924cb11612e","observation_id":"35d3ddb8-2ae8-49f8-a9dc-ab036894fc70","resolution":{"observed_at":"2026-08-06T23:27:19.440450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.945898Z","title":null,"venue":null,"work_id":"dedf00a3-a45c-412c-aed9-0966a2fa672e","year":2023},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.444781Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:d3e8d6cf1ae3fb8363af41070ee26316bef253f787043bf537713b2c5b6574dd","observation_id":"9081a0d3-1eec-4a64-8759-10faa09f6064","resolution":{"observed_at":"2026-08-06T23:27:19.949598Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-06T23:27:19.449045Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.449045Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:e12ffeed1810a4f1dc4fee94f07d3cb0c0804e6a91ba4f26829f6cb983de8730","observation_id":"ba1ad1bd-04f2-4e23-ad95-fd2053997328","resolution":{"observed_at":"2026-08-06T23:27:19.449045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.934092Z","title":null,"venue":null,"work_id":"4a5d6c74-98cf-4a4c-9366-441543973b8b","year":2018},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.453364Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:98738645f30dfa3b45764370a5c00377450bc6775182cdb1aad52eb7c5ece61b","observation_id":"eead1e61-97ef-4f4f-aa7b-5deb68b8d0ef","resolution":{"observed_at":"2026-08-06T23:27:19.938059Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.921921Z","title":null,"venue":null,"work_id":"977a59cd-19e9-49e5-8048-a163fae6e547","year":1991},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.456976Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:7dbe9da39d1f0da746fb15320e63823dd7c106972de5a3a26fcefdc53c3124f8","observation_id":"401143fa-1dc4-43c7-8e06-c6830a59730a","resolution":{"observed_at":"2026-08-06T23:27:19.926328Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.910722Z","title":null,"venue":null,"work_id":"65add0c0-6fd5-4a33-84e3-b6a0cfe48d5d","year":2022},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.460875Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:85b802013d0231c7681901847d447cba628440013017739497da032b670499b1","observation_id":"035a6d34-df02-4b63-84cb-db978f293733","resolution":{"observed_at":"2026-08-06T23:27:19.914368Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.465510Z","title":"u ttler, Mike Lewis, Wen-tau Yih, Tim Rockt \\","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.465510Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:968b7121b44b516bd2b8372620ed262d84c5f7745e8f49a0dc009c21b0f8fe88","observation_id":"d89bdce5-8eac-4bba-b641-83d347a71a66","resolution":{"observed_at":"2026-08-06T23:27:19.465510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09212","last_updated":"2024-01-17T19:09:57Z","snapshot_observed_at":"2026-08-04T18:52:19.083847Z","submitted_at":"2023-06-15T15:49:51Z","title":"CMMLU: Measuring massive multitask language understanding in Chinese","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09212","snapshot_observed_at":"2026-08-06T23:27:19.469771Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.469771Z"},"links":{"cited_paper":"/paper/2306.09212","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:05beafd509624c5060f2803559b42c7d4c41c248307fb6ca092f52982e3bd712","observation_id":"525fa696-d1d1-4883-9e5b-9a68e08b77f1","resolution":{"observed_at":"2026-08-06T23:27:19.469771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.891110Z","title":null,"venue":null,"work_id":"e5252a42-c845-4898-a023-c0f1d409a507","year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.473823Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:99a38eb90881a630b25cbaf7e8a41ca3ebe728b0bd38b5a77fd2e362a6c797cc","observation_id":"7761565b-a739-4122-a099-b71078d3d68d","resolution":{"observed_at":"2026-08-06T23:27:19.895050Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05459","last_updated":"2024-05-08T06:16:23Z","snapshot_observed_at":"2026-08-02T13:57:57.119489Z","submitted_at":"2024-01-10T09:25:45Z","title":"Personal LLM Agents: Insights and Survey about the Capability, Efficiency and Security","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05459","snapshot_observed_at":"2026-08-06T23:27:19.477730Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.477730Z"},"links":{"cited_paper":"/paper/2401.05459","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:3304e2eb985b08efd0c64af45c7a825766cff6e298811a61363c81a8c0b6b8c5","observation_id":"b17ed3ff-c810-4bc7-b5b4-11140e475e74","resolution":{"observed_at":"2026-08-06T23:27:19.477730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.878719Z","title":null,"venue":null,"work_id":"600d8715-41c8-409d-aa01-787761942885","year":2023},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.482310Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:b979ee4970f1eb2c8dfdf581fa7f46a4b26988b8288dd2baaa1093a81b4e4ac5","observation_id":"9c0eab0a-2cf5-4b55-b0f0-7dd9750603ad","resolution":{"observed_at":"2026-08-06T23:27:19.882756Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.18743","last_updated":"2024-08-25T09:58:57Z","snapshot_observed_at":"2026-08-16T18:50:13.740912Z","submitted_at":"2023-11-30T17:41:30Z","title":"AlignBench: Benchmarking Chinese Alignment of Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.18743","snapshot_observed_at":"2026-08-06T23:27:19.485869Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.485869Z"},"links":{"cited_paper":"/paper/2311.18743","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:0626e0f8796d84562ce4365a09bae1b2a676a3ead979ebecfe4532c73be4e50e","observation_id":"71fbc989-12a5-4017-a47c-e9e65b85ced1","resolution":{"observed_at":"2026-08-06T23:27:19.485869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.490352Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.490352Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:8c111408935b7b447a06af3f1167790a1016f004e7de0e8b1bd312af0418a25b","observation_id":"2b5bdc34-6c34-45f5-b31c-c27b129661bf","resolution":{"observed_at":"2026-08-06T23:27:19.490352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.07646","last_updated":"2018-02-20T07:21:43Z","snapshot_observed_at":"2026-08-14T20:11:38.669290Z","submitted_at":"2017-11-21T06:34:06Z","title":"Evaluating Machine Translation Performance on Chinese Idioms with a Blacklist Method","version":3},"cited_work":{"arxiv_id":"1711.07646","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.07646","snapshot_observed_at":"2026-08-06T23:27:19.693199Z","title":"Evaluating Machine Translation Performance on Chinese Idioms with a Blacklist Method","venue":"cs.CL","work_id":"6938bf76-fa78-4998-a2a0-ba3795815bf8","year":2017},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.498255Z"},"links":{"cited_paper":"/paper/1711.07646","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:6af64c1a9c814fd7812577ae1365fb23e9ab4a5ab434ce1cc8f6af9d4999425d","observation_id":"58a1e1d3-4ee7-44d6-b5fc-da1529c93754","resolution":{"observed_at":"2026-08-06T23:27:19.697757Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.865812Z","title":null,"venue":null,"work_id":"eddd4518-0085-4d34-a67b-09d95eb2ea57","year":2022},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.502520Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:425832249877ca74c8ca0a43bdfd5779c20a042da0fafee90f54103bac7217fa","observation_id":"232e6b05-9031-4c55-a7e6-d8ee29b4c4f0","resolution":{"observed_at":"2026-08-06T23:27:19.869494Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.853623Z","title":null,"venue":null,"work_id":"b3d497b6-b589-47c5-b6a4-15e76de321f4","year":2021},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.507082Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:b44ed9a30c7dbd317c18fe2f2ed58af4081d5d5b2aae0c5d27a40b1b8d94f0bf","observation_id":"76c217ea-250b-416e-a495-705ac9a684e2","resolution":{"observed_at":"2026-08-06T23:27:19.857454Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T23:27:19.513072Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.513072Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:8aef35746513b931ec1cbccd9e61aa76334f6ccc2b0bd23de79b4512cb334877","observation_id":"e40132cc-39a2-4757-b0e1-009bbf52f393","resolution":{"observed_at":"2026-08-06T23:27:19.513072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.840399Z","title":null,"venue":null,"work_id":"74e329f9-2d28-484b-b740-87c7f41c639a","year":2011},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.517628Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:096253a7fc15de25364c8c9b585de8617a538e29a2f9d0c79a7f83162d65b73b","observation_id":"a641bedc-4a20-4f61-bfca-d341e55646fe","resolution":{"observed_at":"2026-08-06T23:27:19.844750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.00289","last_updated":"2026-05-15T17:29:44Z","snapshot_observed_at":"2026-07-06T21:01:59.107101Z","submitted_at":"2025-03-31T23:19:08Z","title":"Do Chinese models speak Chinese languages?","version":3},"cited_work":{"arxiv_id":"2504.00289","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.00289","snapshot_observed_at":"2026-08-06T23:27:19.662909Z","title":"Do Chinese models speak Chinese languages?","venue":"cs.CL","work_id":"693c47a6-1bdc-4b69-b6c6-563219f339bd","year":2025},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.522151Z"},"links":{"cited_paper":"/paper/2504.00289","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:7e874eeb83faf12c4de37fc4837c5fba56ab4d82bac8f1587a6969b8a3284e1c","observation_id":"487b6ad6-c921-4738-af1d-1361b9aa09b4","resolution":{"observed_at":"2026-08-06T23:27:19.668179Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.827846Z","title":null,"venue":null,"work_id":"0182a56e-d883-4089-9f18-6d4271bb12e4","year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.526144Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:f34c4146e32f18b0bc582b43a75c34bb8e1cc40a9ed717b362fad802960c6dee","observation_id":"42d29557-68b5-421b-a1c8-eae26eaeab31","resolution":{"observed_at":"2026-08-06T23:27:19.832004Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2101.11131","last_updated":"2021-01-26T23:16:29Z","snapshot_observed_at":"2026-08-16T18:49:46.404452Z","submitted_at":"2021-01-26T23:16:29Z","title":"CLiMP: A Benchmark for Chinese Language Model Evaluation","version":1},"cited_work":{"arxiv_id":"2101.11131","doi":null,"metadata_source":"pith","pith_arxiv_id":"2101.11131","snapshot_observed_at":"2026-08-06T23:27:19.642794Z","title":"CLiMP: A Benchmark for Chinese Language Model Evaluation","venue":"cs.CL","work_id":"6765d8a4-237a-4872-aec3-7f16489565d8","year":2021},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.530607Z"},"links":{"cited_paper":"/paper/2101.11131","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:207cddfc537e1e999f5b3fe2effc918e800f1c29f6f0e98fbd05c1e351c8eb47","observation_id":"0cdb88b6-2129-48cd-9880-b5f906f3b90d","resolution":{"observed_at":"2026-08-06T23:27:19.649033Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2004.05986","last_updated":"2020-11-05T14:46:45Z","snapshot_observed_at":"2026-08-15T13:01:59.880479Z","submitted_at":"2020-04-13T15:02:29Z","title":"CLUE: A Chinese Language Understanding Evaluation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2004.05986","snapshot_observed_at":"2026-08-06T23:27:19.534563Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.534563Z"},"links":{"cited_paper":"/paper/2004.05986","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:01da7323ccdeccb65882de5a399bcbcde11c50352c957499bce89b83e354a616","observation_id":"fbe35e14-7b6a-4b41-a36e-39b84838104d","resolution":{"observed_at":"2026-08-06T23:27:19.534563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-06T23:27:19.539565Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.539565Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:ae0024ec82f4dcdd27cee2dcdca39ccfe4f6608f1b790cf2ede52d6286df1ef4","observation_id":"a28b2128-4da8-4007-b8bf-3ccb1833a011","resolution":{"observed_at":"2026-08-06T23:27:19.539565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.815224Z","title":null,"venue":null,"work_id":"fe241d04-8fad-4b76-9858-e3e6d5886ac2","year":2006},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.543359Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:90d4dae41638e00571ab73ccb15f216f9c0b1eb88e884349dc282cf2bf343782","observation_id":"2e57d838-b2c7-4689-9e23-79b0a374ceea","resolution":{"observed_at":"2026-08-06T23:27:19.819433Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-06T23:27:19.548426Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.548426Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:f85274ef875e87e69d242abe525af11f00f159ecd34fd4f715d6ad5e46db82ec","observation_id":"5ef479e5-2345-4011-aa44-e23cdc1a126e","resolution":{"observed_at":"2026-08-06T23:27:19.548426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.12369","last_updated":"2021-04-26T06:59:36Z","snapshot_observed_at":"2026-08-16T18:29:09.523528Z","submitted_at":"2021-04-26T06:59:36Z","title":"PanGu-$\\alpha$: Large-scale Autoregressive Pretrained Chinese Language Models with Auto-parallel Computation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.12369","snapshot_observed_at":"2026-08-06T23:27:19.553332Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.553332Z"},"links":{"cited_paper":"/paper/2104.12369","citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:4030e2e079abcdd901da3740e18cd12be1959f9bb955e8c93cf71e2deed5bdf6","observation_id":"29c79227-7137-4cda-a89f-732ea61f9406","resolution":{"observed_at":"2026-08-06T23:27:19.553332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:19.557506Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-06T23:27:19.557506Z"},"links":{"citing_paper":"/paper/2506.18105"},"observation_digest":"sha256:94ab947c469996f2ec50b830fe6e7a736d124c6eeb226d41eea07a7364a5f146","observation_id":"d211fab5-57cc-4f54-b746-98ad62c25e72","resolution":{"observed_at":"2026-08-06T23:27:19.557506Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.18105","last_updated":"2025-06-22T17:26:09Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T21:07:29.885393Z","submitted_at":"2025-06-22T17:26:09Z","title":"Chengyu-Bench: Benchmarking Large Language Models for Chinese Idiom Understanding and Use"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 17 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 0 inbound Pith citation observations for arXiv:2506.18105."}