{"as_of":"2026-08-15T23:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1f05c54c8263877472a529843cbea211b8de68249888b50cbd937be923851ee5","coverage":[{"denominator":240,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:55:42.739229Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.09329/citation-record","integrity":"/paper/2506.09329/integrity","json":"/paper/2506.09329/citation-record.json","paper":"/paper/2506.09329"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:33.779711Z","title":"Explanations for commonsenseqa: New dataset and models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:33.779711Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:0bfca32b63504c4c354447bc201239aea3a43f58f542689cd1c17106c4892118","observation_id":"2984a716-55b6-4c05-b1c8-2b424716993a","resolution":{"observed_at":"2026-08-07T04:55:33.779711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.20541","last_updated":"2024-05-30T23:50:20Z","snapshot_observed_at":"2026-08-14T13:38:48.547601Z","submitted_at":"2024-05-30T23:50:20Z","title":"Perplexed by Perplexity: Perplexity-Based Data Pruning With Small Reference Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.20541","snapshot_observed_at":"2026-08-07T04:55:33.838406Z","title":"Perplexed by perplexity: Perplexity-based data pruning with small reference models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:33.838406Z"},"links":{"cited_paper":"/paper/2405.20541","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:9debedc1b8bc935b84f15110563f8b44643b0284ec75d858a3fb65ce3a62e097","observation_id":"3f267181-8541-4f56-8cc2-a05b3561a99d","resolution":{"observed_at":"2026-08-07T04:55:33.838406Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:33.926249Z","title":"arxiv dataset, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:33.926249Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:85791abea1dc889c726b8704303b72fb3fd7aec963ebb289ee30cf2da3016d9e","observation_id":"db1cb79b-10f6-44c7-8f30-7c5326d99938","resolution":{"observed_at":"2026-08-07T04:55:33.926249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.00861","last_updated":"2021-12-09T21:40:22Z","snapshot_observed_at":"2026-08-10T12:03:10.373653Z","submitted_at":"2021-12-01T22:24:34Z","title":"A General Language Assistant as a Laboratory for Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.00861","snapshot_observed_at":"2026-08-07T04:55:33.990438Z","title":"A general language assistant as a laboratory for alignment","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:33.990438Z"},"links":{"cited_paper":"/paper/2112.00861","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:2584bca024c886f3185d2094e919f16b7c16dacd22ca46bbfbcd76a9acc34695","observation_id":"cb4f1d21-4f1b-402d-8515-1dec66a8baf6","resolution":{"observed_at":"2026-08-07T04:55:33.990438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07732","last_updated":"2021-08-16T03:57:30Z","snapshot_observed_at":"2026-08-15T17:40:38.050939Z","submitted_at":"2021-08-16T03:57:30Z","title":"Program Synthesis with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07732","snapshot_observed_at":"2026-08-07T04:55:34.066154Z","title":"Program synthesis with large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.066154Z"},"links":{"cited_paper":"/paper/2108.07732","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:100650789ec9cda07816f8ab4a43041bb17745a2ba73494c950acf46a773dbaa","observation_id":"f7fd65e2-7744-48f4-8cae-8451897ae442","resolution":{"observed_at":"2026-08-07T04:55:34.066154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.132829Z","title":"A general theoretical paradigm to understand learning from human preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.132829Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:b7934209c85d550659537fcb23eeaa5349b80846558b923e126622db26da94f3","observation_id":"2a2f7029-2d82-4d25-aec4-2ffc1fea85c2","resolution":{"observed_at":"2026-08-07T04:55:34.132829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.205526Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.205526Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:d432e4a96b37c0082f3018b1e61f7390e2a0edf53855d5a56fc7fd8ae8f3dbcd","observation_id":"6ddee455-f96b-4ce2-bf8e-d8d01ce24816","resolution":{"observed_at":"2026-08-07T04:55:34.205526Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T04:55:34.295599Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.295599Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:827593855e56682100cb53ec43f06c1fffd66fa8f2d06ab4bec1950638a4db96","observation_id":"ae4a5deb-b684-4c43-9b55-2da9714a0fc7","resolution":{"observed_at":"2026-08-07T04:55:34.295599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-07T04:55:34.409645Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.409645Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:d5d9951db764161b9ee154b254fd4ff0b4788942f06bd7a2810694894b8c31c7","observation_id":"472e8260-1600-4b07-bc77-c0c6e79bd3a3","resolution":{"observed_at":"2026-08-07T04:55:34.409645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.497941Z","title":"Constitutional ai: Harmlessness from ai feedback","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.497941Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:490cfc9c1c568a56209d47a86c11b91d0f0e0eb251a8fd502be32b5039c0b6c5","observation_id":"9141b438-901d-4072-85d8-052d26f42ca4","resolution":{"observed_at":"2026-08-07T04:55:34.497941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.10305","last_updated":"2025-04-17T08:34:42Z","snapshot_observed_at":"2026-08-14T19:59:05.307983Z","submitted_at":"2023-09-19T04:13:22Z","title":"Baichuan 2: Open Large-scale Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.10305","snapshot_observed_at":"2026-08-07T04:55:34.572378Z","title":"Baichuan 2: Open large-scale language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.572378Z"},"links":{"cited_paper":"/paper/2309.10305","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:7f50a632f129b4dcac1c0175615b21645e28787bfa8d5c9dd93946563382fdc4","observation_id":"bc625a8d-77c2-4461-a291-d2866151238f","resolution":{"observed_at":"2026-08-07T04:55:34.572378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.641856Z","title":"PIQA: reasoning about physical commonsense in natural language","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.641856Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:5a7bb69c4e1317eb5c9ba7ba35bb04b7d1e1db188826b0fcdb028e10ab3909cc","observation_id":"a4795861-b5bd-4e17-ac48-cd90fe38235d","resolution":{"observed_at":"2026-08-07T04:55:34.641856Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.07258","last_updated":"2022-07-12T23:45:14Z","snapshot_observed_at":"2026-08-02T09:20:40.804790Z","submitted_at":"2021-08-16T17:50:08Z","title":"On the Opportunities and Risks of Foundation Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.07258","snapshot_observed_at":"2026-08-07T04:55:34.712793Z","title":"On the opportunities and risks of foundation models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.712793Z"},"links":{"cited_paper":"/paper/2108.07258","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:1e1603eada79efd749734514e803f56e1cb2532444fae13f30e27463eaca4d00","observation_id":"f2613a1f-022c-4fcb-ac75-997afd90fee9","resolution":{"observed_at":"2026-08-07T04:55:34.712793Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.771786Z","title":"Rank analysis of incomplete block designs: I","venue":null,"work_id":null,"year":1952},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.771786Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:52bdfb102023dc83d350e8e0abcb8e751b0004a48bb35f0ea4d766a4a2d760af","observation_id":"cf7bd0d9-897a-407f-8a08-5f12ee0be21f","resolution":{"observed_at":"2026-08-07T04:55:34.771786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.834771Z","title":"On the resemblance and containment of documents","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.834771Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:d72826b3567693de926364cbba82709a19c21bef3999229f5c29857e6ed96876","observation_id":"243e65c4-9ddc-4074-a351-1794a3c2c60f","resolution":{"observed_at":"2026-08-07T04:55:34.834771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:34.894603Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.894603Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:6d61ff45ec606a47a7d4641af41e810fb5b8ad1f978533ae0c4f8a80fb48512c","observation_id":"9cb5a7d5-bc30-470d-a784-98838ae56b84","resolution":{"observed_at":"2026-08-07T04:55:34.894603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.14736","last_updated":"2024-11-11T13:58:11Z","snapshot_observed_at":"2026-08-13T05:20:10.732785Z","submitted_at":"2023-11-21T19:12:18Z","title":"Data Diversity Matters for Robust Instruction Tuning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.14736","snapshot_observed_at":"2026-08-07T04:55:34.979788Z","title":"Data diversity matters for robust instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:34.979788Z"},"links":{"cited_paper":"/paper/2311.14736","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:a5176d6ccfd1a6b727ddd978e8bcba417984ecc816a13c63bac39d293c51df9e","observation_id":"ca627d7f-b4dc-44e0-b650-d68c428947e6","resolution":{"observed_at":"2026-08-07T04:55:34.979788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.044766Z","title":"Drlc: Reinforcement learning with dense rewards from llm critic","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.044766Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:471376e755b338547993cf1dba96fac6f4b07577bb5b70418cdf1f20e17873b0","observation_id":"6833eeb0-05f9-4dac-bc72-f0be0760cb3f","resolution":{"observed_at":"2026-08-07T04:55:35.044766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.06290","last_updated":"2024-07-26T18:09:11Z","snapshot_observed_at":"2026-08-15T01:55:26.051681Z","submitted_at":"2023-07-12T16:37:31Z","title":"Instruction Mining: Instruction Data Selection for Tuning Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.06290","snapshot_observed_at":"2026-08-07T04:55:35.093796Z","title":"Instruction mining: High-quality instruc- tion data selection for large language models.arXiv preprint arXiv:2307.06290, 1(3):6, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.093796Z"},"links":{"cited_paper":"/paper/2307.06290","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:cc447f53c5782cb9d9546fe2e0670765fc0f6bda7513255285499b9ac3e901ba","observation_id":"dcf1a6d7-877f-4d33-8226-a98385e3554e","resolution":{"observed_at":"2026-08-07T04:55:35.093796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.134788Z","title":"Wit3: Web inventory of transcribed and translated talks","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.134788Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:acb7e21444625681984dbea1f47e12f80cfac9b93166846e1aef04cde09c5eeb","observation_id":"48a84e31-6eba-420c-a629-95694fd796b3","resolution":{"observed_at":"2026-08-07T04:55:35.134788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.190976Z","title":"Dense reward for free in reinforcement learning from human feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.190976Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:809e08541701459274b9281160df50bc78f2e4ea730b3c3cbdd43319fbe4521e","observation_id":"86d7480e-1b5e-40eb-ac40-e92c2671b1f0","resolution":{"observed_at":"2026-08-07T04:55:35.190976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09246","last_updated":"2023-05-16T07:52:57Z","snapshot_observed_at":"2026-08-13T11:41:53.693568Z","submitted_at":"2023-05-16T07:52:57Z","title":"Maybe Only 0.5% Data is Needed: A Preliminary Exploration of Low Training Data Instruction Tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09246","snapshot_observed_at":"2026-08-07T04:55:35.255414Z","title":"Maybe only 0.5% data is needed: A preliminary exploration of low training data instruction tuning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.255414Z"},"links":{"cited_paper":"/paper/2305.09246","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:057e1bad7dda9ef43dc23356af93a245d0a5b7e8a1ee1ab7b570b312c7913e0e","observation_id":"f5508cc0-8a67-49c5-9e72-5f3b9356a530","resolution":{"observed_at":"2026-08-07T04:55:35.255414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10466","last_updated":"2022-12-20T17:39:21Z","snapshot_observed_at":"2026-08-13T13:17:56.349114Z","submitted_at":"2022-12-20T17:39:21Z","title":"Controllable Text Generation with Language Constraints","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10466","snapshot_observed_at":"2026-08-07T04:55:35.310420Z","title":"Controllable text generation with language constraints","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.310420Z"},"links":{"cited_paper":"/paper/2212.10466","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:43aa241de40954b6fc2ae456add53ae54e9181580662d6c2df327913a46a66b2","observation_id":"c2bc87fc-1d24-4014-87b0-f5b109d3af90","resolution":{"observed_at":"2026-08-07T04:55:35.310420Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.08701","last_updated":"2024-02-13T18:37:25Z","snapshot_observed_at":"2026-08-13T10:54:00.274565Z","submitted_at":"2023-07-17T17:59:40Z","title":"AlpaGasus: Training A Better Alpaca with Fewer Data","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.08701","snapshot_observed_at":"2026-08-07T04:55:35.362349Z","title":"Alpagasus: Training a better alpaca with fewer data","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.362349Z"},"links":{"cited_paper":"/paper/2307.08701","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e3300a426cfe75b72f49b735f5d1be1b4cf67e6a814d2bf0745c18455de7a2ff","observation_id":"4fc93f12-58ed-420f-af94-e0141db37032","resolution":{"observed_at":"2026-08-07T04:55:35.362349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.427244Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.427244Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:30dae0d4f43163981208ce9fdf3143d9136c02434697e4e14fccd671a49383d0","observation_id":"e8374c56-37a3-4279-ad72-ec912cf5ccd9","resolution":{"observed_at":"2026-08-07T04:55:35.427244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.481196Z","title":"DoG- instruct: Towards premium instruction-tuning data via text-grounded instruction wrapping","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.481196Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:d4f3804d04424e9968b5b6cc2004aee0ed064e7fc0ef20b2e751b753ee745b90","observation_id":"3a881804-68d0-4530-bfb3-cc9bd2359f82","resolution":{"observed_at":"2026-08-07T04:55:35.481196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.556877Z","title":"Improving large language models via fine-grained 111 reinforcement learning with minimum editing constraint","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.556877Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:c8ffe424f026b96e2a7e374c73c13c3523b16e28f8a05201e1e1147e479f6af4","observation_id":"2a12aa9c-f84a-4aa2-9cd0-4835b5f0dbaa","resolution":{"observed_at":"2026-08-07T04:55:35.556877Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.620977Z","title":"Low-redundant optimization for large language model alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.620977Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:ead8c501b514841977d274b878abeed987aeab4d46676defb941c55bea0854b7","observation_id":"4d6f2caf-d786-4d3a-81c4-dba3f2d71162","resolution":{"observed_at":"2026-08-07T04:55:35.620977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.07343","last_updated":"2024-02-28T12:51:09Z","snapshot_observed_at":"2026-08-15T17:36:07.906484Z","submitted_at":"2022-11-14T13:35:55Z","title":"Replacing Language Model for Style Transfer","version":2},"cited_work":{"arxiv_id":"2211.07343","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.07343","snapshot_observed_at":"2026-08-07T04:55:44.355988Z","title":"Replacing Language Model for Style Transfer","venue":"cs.CL","work_id":"7495fc02-e109-435b-9630-9cfe5ed5a007","year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.694409Z"},"links":{"cited_paper":"/paper/2211.07343","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:9087b8b29da44ca50de5556a7accef9938b930d0409263cf7aa7273690daec08","observation_id":"80803c46-36c0-48d6-889f-552a222edb19","resolution":{"observed_at":"2026-08-07T04:55:44.360440Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.762417Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.762417Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:28c86ab6612f804d1551d226853a787c41f15e73c1bc9b94a59817d0abd9463f","observation_id":"eb703fef-2a92-40c8-9583-3552aeafc88b","resolution":{"observed_at":"2026-08-07T04:55:35.762417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.823540Z","title":"Gonzalez, Ion Stoica, and Eric P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.823540Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:278f8ea5e2b759e9f5c876a29f5fd2178ab861caa0cfff072a4ca1ba0691839c","observation_id":"7b778db6-1805-49c2-997e-dad6126a2f32","resolution":{"observed_at":"2026-08-07T04:55:35.823540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1406.1078","last_updated":"2014-09-03T00:25:02Z","snapshot_observed_at":"2026-08-15T13:36:27.756066Z","submitted_at":"2014-06-03T17:47:08Z","title":"Learning Phrase Representations using RNN Encoder-Decoder for Statistical Machine Translation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.1078","snapshot_observed_at":"2026-08-07T04:55:35.891868Z","title":"Learning phrase representa- tions using rnn encoder-decoder for statistical machine translation","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.891868Z"},"links":{"cited_paper":"/paper/1406.1078","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:1e3c5ee4d1d1ae746a7cbfa0adf224be51e4e09ebe8080c161cfb326a73a4f99","observation_id":"311459ef-77b8-4637-859b-a47450733117","resolution":{"observed_at":"2026-08-07T04:55:35.891868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:35.953346Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:35.953346Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:4945bd2c046d576c62ed8ba4a6cf3006191460b8062b0fef8b53d336ebfbaf78","observation_id":"bae9199e-0e62-4fbf-aadf-6df4203faff9","resolution":{"observed_at":"2026-08-07T04:55:35.953346Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:36.019095Z","title":"Christiano, Jan Leike, Tom B","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.019095Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:162ff87fd27cc49b072cdf6c0bdfb196fbe56d6dd067c30a5296b69e606b240f","observation_id":"e0423424-6cce-4c0b-801a-cbe6ae3f682c","resolution":{"observed_at":"2026-08-07T04:55:36.019095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.00061","last_updated":"2021-07-07T06:07:22Z","snapshot_observed_at":"2026-08-13T18:54:01.384756Z","submitted_at":"2021-06-30T19:00:25Z","title":"All That's 'Human' Is Not Gold: Evaluating Human Evaluation of Generated Text","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.00061","snapshot_observed_at":"2026-08-07T04:55:36.134233Z","title":"All that’s’ human’is not gold: Evaluating human evaluation of generated text","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.134233Z"},"links":{"cited_paper":"/paper/2107.00061","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:45729707a35c4bad12136a41452f4c352b599e6c7ae36e956ddb834de658ee56","observation_id":"29a15694-57eb-46dc-b94e-a18d5928a149","resolution":{"observed_at":"2026-08-07T04:55:36.134233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:36.238033Z","title":"Think you have solved question answering? try arc, the ai2 reasoning challenge, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.238033Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:235d7266fa59959fcb3ff19909f468eabfd24844132941e9bdf6dbedef47433b","observation_id":"d4a9d89c-da52-47f0-a837-41137e909365","resolution":{"observed_at":"2026-08-07T04:55:36.238033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:36.387177Z","title":"The future landscape of large language models in medicine","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.387177Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:172f198be185c849ee966497f56353cf85729beb6a9fc321d92361c374361cda","observation_id":"21c9fbf6-ba16-4326-9e2f-0c82a5569734","resolution":{"observed_at":"2026-08-07T04:55:36.387177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-14T02:43:01.480086Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-08-07T04:55:36.542461Z","title":"Training verifiers to solve math word prob- lems","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.542461Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:f9ef7eeda8a7ffea417d5c087d0e2bf7bba9eb53e52ced439ad1bd74b15a7a8b","observation_id":"ef90d198-6b0c-4258-a85e-cdeaa7796aa6","resolution":{"observed_at":"2026-08-07T04:55:36.542461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12976","last_updated":"2023-12-20T11:52:41Z","snapshot_observed_at":"2026-08-13T10:48:53.310156Z","submitted_at":"2023-07-24T17:52:46Z","title":"Evaluating the Ripple Effects of Knowledge Editing in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12976","snapshot_observed_at":"2026-08-07T04:55:36.652970Z","title":"Evaluating the ripple effects of knowledge editing in language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.652970Z"},"links":{"cited_paper":"/paper/2307.12976","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:161b7065d73fc2321301bd99bf5196e82b9b212ddd160e63b003eabdf2e65266","observation_id":"5da014c8-c844-4ace-b009-5c6e0c6f2402","resolution":{"observed_at":"2026-08-07T04:55:36.652970Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:36.715510Z","title":"Redpajama: An open source recipe to reproduce llama training dataset, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.715510Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:629cd0d90546cbdffef42ecc7ed810f33f41af9c1713d2b742587fc917f2dd7d","observation_id":"56000ff9-8ca0-450d-9a6f-ce458accef52","resolution":{"observed_at":"2026-08-07T04:55:36.715510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:36.803603Z","title":"Free dolly: Introducing the world’s first truly open instruction-tuned llm, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.803603Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:fd68ab508ad51a8aec4dd4e200b296cd259318f72995417863dc34858c199565","observation_id":"f103fa79-936b-48a6-abe1-a63c7af4b37c","resolution":{"observed_at":"2026-08-07T04:55:36.803603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:36.895228Z","title":"Opencompass: A universal evaluation platform for foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:36.895228Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:322e35377ecc1ef7ca9ea0410efdcaa869a8624e0dfeb0e572680901f88cfbd2","observation_id":"90f2194c-0d28-45a6-b9dc-84946743b6f0","resolution":{"observed_at":"2026-08-07T04:55:36.895228Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:37.011778Z","title":"Ultrafeedback: Boosting language models with high-quality feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.011778Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:cade599430ae898ecaef13526d4e9e7af195ad090db440e24e82db339881c94a","observation_id":"ed021ca8-dc4c-448c-97f5-7cc5f5219fe0","resolution":{"observed_at":"2026-08-07T04:55:37.011778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:37.123213Z","title":"Knowl- edge neurons in pretrained transformers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.123213Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:a9a56f195ec8898ba1c73b28ac6bc5bbc4be9e746594ca5023e8bd385b6f5497","observation_id":"06bbaec5-b94b-4928-b947-72112cd1f1ff","resolution":{"observed_at":"2026-08-07T04:55:37.123213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:37.253184Z","title":"Editing factual knowledge in language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.253184Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:f33ca3c165a0d70a68f0e8a06ab1f1bc6e9890207b2daf6352be481cf406bba9","observation_id":"285a82bf-21c0-4aa3-9128-acd15a55a0ee","resolution":{"observed_at":"2026-08-07T04:55:37.253184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:37.420192Z","title":"Bert: Pre- training of deep bidirectional transformers for language understanding","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.420192Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:2240f461fc361e812f34032de233bc055c2ae495da17df54e887121062354d51","observation_id":"1f7ab59e-699c-43a4-a443-7ed6b901c578","resolution":{"observed_at":"2026-08-07T04:55:37.420192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:37.579671Z","title":"Enhancing chat language models by scaling high-quality instructional conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.579671Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:9f1f2ead413429900f3b6e91813638dedfb0518d5290d357d36373de94aa0d9f","observation_id":"d2bb9c16-8a0e-46ed-80da-cfd566084634","resolution":{"observed_at":"2026-08-07T04:55:37.579671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-07T04:55:37.750155Z","title":"A survey on in-context learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.750155Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:5350767e8d2345ac16e497bcf61912ef760dbf95def8da9c9c92a08c1226b168","observation_id":"0137709e-846f-4ca1-b11d-d3229c43b3ec","resolution":{"observed_at":"2026-08-07T04:55:37.750155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-08-13T14:19:26.598265Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T04:55:37.923690Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:37.923690Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:4de3b6f5ae64a64d0cca8dca283f30cf58de56db6c02c238e3ef1a6391989e44","observation_id":"1eeede9d-3cf9-4718-b778-117133eeae85","resolution":{"observed_at":"2026-08-07T04:55:37.923690Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:38.091691Z","title":"Glm: General language model pretraining with autoregressive blank infilling","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:38.091691Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:7482f64b64f2b38ef4769526c9adf6b9f4bc9790fc9f6f822ad96d53fd2c7936","observation_id":"3d846989-825f-4387-9fb5-8017ae6e716c","resolution":{"observed_at":"2026-08-07T04:55:38.091691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:38.245201Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:38.245201Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:3590e311049b830220ff1b7f9f18cb730706d3d0f04f895f0c536d0ce33fc8af","observation_id":"94750fad-64cb-41c8-a149-6fe7389653da","resolution":{"observed_at":"2026-08-07T04:55:38.245201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:38.319172Z","title":"Length- controlled alpacaeval: A simple way to debias automatic evaluators","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:38.319172Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:c08dd5aaf95669cda4d6528006c1c3c849a4997033e094d91bd30ffd4506e5f5","observation_id":"88326315-d97e-440e-bab5-8670052f5ef2","resolution":{"observed_at":"2026-08-07T04:55:38.319172Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:38.532163Z","title":"Fact-checking the output of large language models via token-level uncertainty quantification","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:38.532163Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:5d18343a363c654cf810e3a5454b378da5879260f729956302779f8f35b137af","observation_id":"c0c4a996-b02b-436b-b6bf-e7557988e64a","resolution":{"observed_at":"2026-08-07T04:55:38.532163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:38.690711Z","title":"Hierarchical neural story generation","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:38.690711Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:8ce8e588a49090bd6b9ccf663bfd19fe35fc519c9d5a571ed07a555b996889c9","observation_id":"75ea9cfe-0741-4625-847a-1ea5d49c56ba","resolution":{"observed_at":"2026-08-07T04:55:38.690711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1912.11006","last_updated":"2020-03-02T12:12:43Z","snapshot_observed_at":"2026-08-14T02:55:22.370407Z","submitted_at":"2019-12-23T18:08:33Z","title":"Data-Free Adversarial Distillation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1912.11006","snapshot_observed_at":"2026-08-07T04:55:38.892082Z","title":"Data-free adversarial distillation","venue":null,"work_id":null,"year":1912},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:38.892082Z"},"links":{"cited_paper":"/paper/1912.11006","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e60f0f06e7dddb523b1b39eaf4b0d4fd69a95fbbad3ed2e604ac60e4fb4451d0","observation_id":"99594ee3-0f6e-4faa-b7e4-7a21323074c8","resolution":{"observed_at":"2026-08-07T04:55:38.892082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:39.059708Z","title":"Gptscore: Evaluate as you desire","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.059708Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:7e63d75abf6d8eca5ac77d775fb9d1b8217134e0847ad0740e195c2e65478ad5","observation_id":"1527546f-9b1d-4030-ac77-7fc2bc4d7c9f","resolution":{"observed_at":"2026-08-07T04:55:39.059708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:39.136611Z","title":"Preference learning and ranking by pairwise comparison","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.136611Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:2b7392c4dde6c3204b356ceef859c5760ce12cdbe5cdd003e01c7e0b566ecbeb","observation_id":"dc021117-b897-4423-bbb1-ab96af9c2935","resolution":{"observed_at":"2026-08-07T04:55:39.136611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.20094","last_updated":"2025-05-08T00:24:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-28T17:59:01Z","title":"Scaling Synthetic Data Creation with 1,000,000,000 Personas","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.20094","snapshot_observed_at":"2026-08-07T04:55:39.303687Z","title":"Scaling synthetic data creation with 1,000,000,000 personas","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.303687Z"},"links":{"cited_paper":"/paper/2406.20094","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:018883b064d265d1b53d1b2064c243d0ce2755ac483481c854224e6ae5aa8d09","observation_id":"806fc54d-e1b9-4b59-9b4b-40a701927a5f","resolution":{"observed_at":"2026-08-07T04:55:39.303687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:39.386153Z","title":"Koala: A dialogue model for academic research","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.386153Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:726c8a4de5896de703e8581db01bd3a6b16c2d8ecbe7184df130858ec6e0b2e7","observation_id":"45258c39-e762-4c0e-9870-47c535fa60f4","resolution":{"observed_at":"2026-08-07T04:55:39.386153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:39.471185Z","title":"Did aristotle use a laptop? A question answering benchmark with implicit rea- soning strategies","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.471185Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:7ae9f56979d8be302abffecf06e898008914a34b44d6ad66466dc7fde20b2a8d","observation_id":"c395c387-ca5e-4b6f-9322-8e9065136efc","resolution":{"observed_at":"2026-08-07T04:55:39.471185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15056","last_updated":"2023-07-19T14:10:55Z","snapshot_observed_at":"2026-08-15T00:25:42.772261Z","submitted_at":"2023-03-27T09:59:48Z","title":"ChatGPT Outperforms Crowd-Workers for Text-Annotation Tasks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15056","snapshot_observed_at":"2026-08-07T04:55:39.571857Z","title":"Chatgpt outperforms crowd- workers for text-annotation tasks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.571857Z"},"links":{"cited_paper":"/paper/2303.15056","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:77ede716e727e4e4c4dc4fb9812877b674276fa79a9cfd21879c69d005956ab6","observation_id":"05ffb229-30b1-4835-97db-4bc9ddd22642","resolution":{"observed_at":"2026-08-07T04:55:39.571857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:39.649815Z","title":"SAMSum corpus: A human-annotated dialogue dataset for abstractive summarization","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.649815Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:dcec065a51660d9ac9410e870fb91b6127867329eb4090c8dda01ac6445d8390","observation_id":"a597135c-ec96-4b60-8f72-8079c0c7de82","resolution":{"observed_at":"2026-08-07T04:55:39.649815Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:39.744866Z","title":"English gigaword","venue":null,"work_id":null,"year":2003},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.744866Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:004cf3349c0b56677f96636768a697eb4a2bad2893b5e6bbf641e7dde9378432","observation_id":"4b054aa4-b404-47a1-9c83-d2591fb12aba","resolution":{"observed_at":"2026-08-07T04:55:39.744866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15594","last_updated":"2025-10-19T10:32:43Z","snapshot_observed_at":"2026-08-13T06:43:22.011336Z","submitted_at":"2024-11-23T16:03:35Z","title":"A Survey on LLM-as-a-Judge","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.15594","snapshot_observed_at":"2026-08-07T04:55:39.813545Z","title":"A survey on llm-as-a-judge","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.813545Z"},"links":{"cited_paper":"/paper/2411.15594","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:cbd1712bf0b293416404b33c4aa843078d1992f71a024276f1403de3e41dd153","observation_id":"5bf6af9f-735a-4f6d-bb65-7038a8c7026c","resolution":{"observed_at":"2026-08-07T04:55:39.813545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15717","last_updated":"2023-05-25T05:00:12Z","snapshot_observed_at":"2026-08-12T18:39:37.539896Z","submitted_at":"2023-05-25T05:00:12Z","title":"The False Promise of Imitating Proprietary LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15717","snapshot_observed_at":"2026-08-07T04:55:39.919359Z","title":"The false promise of imitating proprietary llms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:39.919359Z"},"links":{"cited_paper":"/paper/2305.15717","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:a2ee6a60ce520418652d035823dd269384dc45eb1aa18e90c93c38af3e855ed1","observation_id":"67e14756-5e5a-4a91-b91d-d0c912ee003d","resolution":{"observed_at":"2026-08-07T04:55:39.919359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-15T12:33:55.451951Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T04:55:40.067581Z","title":"Deepseek-r1: Incentivizing rea- soning capability in llms via reinforcement learning.arXiv preprint arXiv:2501.12948, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.067581Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:b1a6ab1f47344531984e0efea4be5d4372f4c1e8d8b7410a43ae8c54eb20feda","observation_id":"17e89c8a-7a3a-467e-92e7-67759058212c","resolution":{"observed_at":"2026-08-07T04:55:40.067581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.217742Z","title":"Beyond imita- tion: Leveraging fine-grained quality signals for alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.217742Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:215b9added616ae3a938e6414def7305e243cb37a4a52dd44f542b39454c745d","observation_id":"a1c3bdf8-4bdc-444b-ba66-8bc874dd732a","resolution":{"observed_at":"2026-08-07T04:55:40.217742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.344439Z","title":"Coopera- tive inverse reinforcement learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.344439Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:159dd3bb2ca72b08e46c5f7c4863cb15c487ee05169a0b0ab54ac23695ba7ba9","observation_id":"7c130163-e5d2-404b-b541-1bd4e4c5ed9d","resolution":{"observed_at":"2026-08-07T04:55:40.344439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.428933Z","title":"Aging with grace: Lifelong model editing with discrete key- value adaptors","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.428933Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:cd85d2fb2c5eb5c8a9796a35eeb73b4cfcc2da942dc3ab73677fb48dd7157fc1","observation_id":"2a29c6f4-e4a9-45d9-9aaa-af8afe755c70","resolution":{"observed_at":"2026-08-07T04:55:40.428933Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.544821Z","title":"Does localization inform editing? surprising differences in causality-based localization vs","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.544821Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:574b4b5cf17fef49a2b37370fbb0956c56e9dd1535eb214755c86fbea1e60bf9","observation_id":"6da72c2a-db4f-40a8-8c63-0693d739ca3b","resolution":{"observed_at":"2026-08-07T04:55:40.544821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.625109Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.625109Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:d086e1a64c13830166b21bdee0a3c7acf076ff01a1bd829b788a31e56fd32b6c","observation_id":"26507359-384b-4a0d-96e1-0992e7bf13a5","resolution":{"observed_at":"2026-08-07T04:55:40.625109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.743384Z","title":"Measuring mathematical problem solving with the math dataset","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.743384Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:a4d219a8b3351f464a5d1019d1f762b8f0779f0a91f509c9c0bab6e2d3f02515","observation_id":"c7e206f8-3635-444a-b363-ff65ccab6c83","resolution":{"observed_at":"2026-08-07T04:55:40.743384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.833002Z","title":"Knowledge distil- lation with adversarial samples supporting decision boundary","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.833002Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:cc8b637aefb6b1a6bf48910dfb96c0715028e30bbc999f190583d1ad8d6044cd","observation_id":"d7a15b53-fe4c-4178-897d-94d96d60c1cc","resolution":{"observed_at":"2026-08-07T04:55:40.833002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:40.937312Z","title":"Orpo: Monolithic preference optimiza- tion without reference model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:40.937312Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:1fc2810195731b013eb45d7e037411b47754652018d615bcfe27556bc2e0c4b5","observation_id":"7e6670d9-1673-4f20-884d-4131418befcc","resolution":{"observed_at":"2026-08-07T04:55:40.937312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.059879Z","title":"Parameter- efficient transfer learning for nlp","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.059879Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:35eae4dd06976870703a421df9187c59f39a4c68419098850bb63fe40d778a80","observation_id":"0087c7e8-a8ad-4ebe-b022-d24ee74472cd","resolution":{"observed_at":"2026-08-07T04:55:41.059879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.200362Z","title":"LoRA: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.200362Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:68bb85d0bc7e8601035e64f64d38f2072f68334325d0bf83ad84e34ccb1988bb","observation_id":"402a4af6-40ad-40e3-a551-ea01e5a81b92","resolution":{"observed_at":"2026-08-07T04:55:41.200362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.313569Z","title":"Is chatgpt better than human annotators? potential and limitations of chatgpt in explaining implicit hate speech","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.313569Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:a9ebc41a5b747f67a9fb183dd0c75b68dccf358f68de6680572b94c333010500","observation_id":"ee0fa57b-89d2-4bf9-b945-d8b416985796","resolution":{"observed_at":"2026-08-07T04:55:41.313569Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.513883Z","title":"Deep q-networks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.513883Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:09d5db49a4e1d97632be1f306e15f4c10b74e423fb0bd45524c0a1d610308658","observation_id":"ee95b239-2885-4582-8cd6-4481d5800d58","resolution":{"observed_at":"2026-08-07T04:55:41.513883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.661806Z","title":"C-eval: A multi-level multi-discipline chinese evaluation suite for foundation models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.661806Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:db96f6210dc7f5146ab42ecbea8e2f9f7cc0821645cec942fa14fc9df6e4e531","observation_id":"7daef58a-0866-472a-995f-316f8004916c","resolution":{"observed_at":"2026-08-07T04:55:41.661806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.747410Z","title":"Smith, Iz Beltagy, and Han- naneh Hajishirzi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.747410Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:2d5c340d9d860869e10c8d5ea30703db98a5e5d4e0012b1cc8cad1b5bc67cca9","observation_id":"1abe27ca-14dd-4c0e-8082-b16488d5c3ce","resolution":{"observed_at":"2026-08-07T04:55:41.747410Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.824542Z","title":"Aligner: Achieving efficient alignment through weak-to-strong correction","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.824542Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:86065752f70904a53d2515331eeb7b5bf272907761a11b2619cc60809a9bd40e","observation_id":"180d9a92-bf39-47c3-beb0-9ec2378a5c96","resolution":{"observed_at":"2026-08-07T04:55:41.824542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.891033Z","title":"Mistral 7b","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.891033Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:468f3fb44899b79bf0027b90a18443158c7ee0c204911652cb20d44008b49e4a","observation_id":"4476b5a5-3f25-4d18-b90f-72717c8a72c8","resolution":{"observed_at":"2026-08-07T04:55:41.891033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:41.993198Z","title":"What disease does this patient have? a large-scale open domain ques- tion answering dataset from medical exams","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:41.993198Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:c928d26c8accf36bb29402b1c2cbe400fd982f6cb585c15dd9319db60b1abf8b","observation_id":"1b7b75c7-ae68-4aa3-9b3a-c2a82a818f46","resolution":{"observed_at":"2026-08-07T04:55:41.993198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.122707Z","title":"Plus disease in retinopathy of prematurity: im- proving diagnosis by ranking disease severity and using quantitative image analy- sis","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.122707Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:fb6060414d2526a48e8b033465c5aab2ca6c940bedc9ab4d7f56438b86d8af90","observation_id":"122b1fbb-215f-463c-b615-4a683574074e","resolution":{"observed_at":"2026-08-07T04:55:42.122707Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-07T04:55:42.209573Z","title":"Scaling laws for neural language models","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.209573Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:4b59dcd73d936cb5ad2429ff549c3abe42240089cd16617b7aab76f040ac7c44","observation_id":"20d8c7ec-1a6b-4cbc-b948-e40b86c96ebf","resolution":{"observed_at":"2026-08-07T04:55:42.209573Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.300537Z","title":"A survey of reinforcement learning from human feedback","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.300537Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:3ae9542c7ece8846cdf43873b46b7472149176ec9c6075657b5b744b5c8d11a4","observation_id":"99a690e2-d9ff-46a8-83b2-0e764f46df61","resolution":{"observed_at":"2026-08-07T04:55:42.300537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.373458Z","title":"QASC: A dataset for question answering via sentence composition","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.373458Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:d60e6d95cf14802318ca04e2c35b577dbf1fce7aa2ef1110aa48785d2906f063","observation_id":"7d79b45b-d7eb-497d-961b-2158e8f2b86f","resolution":{"observed_at":"2026-08-07T04:55:42.373458Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.435240Z","title":"Adam: A method for stochastic optimization","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.435240Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:dabf86034d69ae0c909383aa1df114a0ce37a97532a1e5a3cefc0627d8e7bb43","observation_id":"fccded32-3950-43d9-ae9e-e1a1d997972a","resolution":{"observed_at":"2026-08-07T04:55:42.435240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.491049Z","title":"MAWPS: A math word problem repository","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.491049Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:a52ce8feafcbe9c892b5a8a9dcf991b7600ed6b80c502a734922cab2d719d571","observation_id":"1037a898-9a40-4c2b-a389-d9ed6a1b4821","resolution":{"observed_at":"2026-08-07T04:55:42.491049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.554902Z","title":"Openassistant conversations-democratizing large language model alignment","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.554902Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:66ab38396fb85d3181d0c0d5589974d7372cb034e11a61c65770e77e9807fc98","observation_id":"f79c7443-f797-4bc8-9e2e-e91697403498","resolution":{"observed_at":"2026-08-07T04:55:42.554902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.671056Z","title":"Spoc: Search-based pseudocode to code","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.671056Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:2e14b9a5ec93d03bc8fa24394f3980609bf8ab950ea2fc92271ab8742e908bcb","observation_id":"755e83e5-26cb-425e-92d1-4a0bbda2db33","resolution":{"observed_at":"2026-08-07T04:55:42.671056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.16745","last_updated":"2024-01-30T04:50:28Z","snapshot_observed_at":"2026-08-14T20:50:23.354301Z","submitted_at":"2024-01-30T04:50:28Z","title":"MT-Eval: A Multi-Turn Capabilities Evaluation Benchmark for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.16745","snapshot_observed_at":"2026-08-07T04:55:42.704868Z","title":"Mt-eval: A multi-turn capabilities evaluation benchmark for large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.704868Z"},"links":{"cited_paper":"/paper/2401.16745","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:c45467a4e4755314e6eda1c9704805075daf114242271a44b689f50db0a7691f","observation_id":"372e1cc8-c5a1-4a4b-b150-799272fb5cfa","resolution":{"observed_at":"2026-08-07T04:55:42.704868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.709802Z","title":"Large language models in law: A survey","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.709802Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:ca4a6ab54e6218f431a9aecc92167a9386693e4b540b0ade88b64ce95266493d","observation_id":"dfbe63b4-05e6-4cb6-b276-20b88d796c00","resolution":{"observed_at":"2026-08-07T04:55:42.709802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.713868Z","title":"Ds-1000: A natural and reliable benchmark for data science code generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.713868Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:e93637927253e5d75fd34c6af6ef2923d1092917d03bff8fc02d2c96d1448c2a","observation_id":"db55201a-1d75-436c-ab20-2d0a6f6d4370","resolution":{"observed_at":"2026-08-07T04:55:42.713868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.718727Z","title":"RLAIF vs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.718727Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:3ca3fb13c798aef58d97978cbfd9227643ad9b81b16393046882de449f1a8a70","observation_id":"94a113b0-53e8-43f2-a4fd-ce0854cdf8a7","resolution":{"observed_at":"2026-08-07T04:55:42.718727Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.07871","last_updated":"2018-11-19T18:48:04Z","snapshot_observed_at":"2026-08-15T21:31:17.600844Z","submitted_at":"2018-11-19T18:48:04Z","title":"Scalable agent alignment via reward modeling: a research direction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.07871","snapshot_observed_at":"2026-08-07T04:55:42.722920Z","title":"Scalable agent alignment via reward modeling: a research direction","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.722920Z"},"links":{"cited_paper":"/paper/1811.07871","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:9520c265eef1d6d9d00a1d20abb0dba80c98ea6e5652e1ae1d25844552565042","observation_id":"4fc3d327-5031-45a9-bc38-86ab82cea280","resolution":{"observed_at":"2026-08-07T04:55:42.722920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.727112Z","title":"Zero-shot relation extraction via reading comprehension","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.727112Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:0a9b3ee8c4ea9dce6fc9399086186475eff63bf7c4c947c226505f5f99795738","observation_id":"7d2b17f9-d8ae-44a0-89d7-61cf01e0f55f","resolution":{"observed_at":"2026-08-07T04:55:42.727112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:55:42.731509Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.731509Z"},"links":{"citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:d9db5e7a9de06757a729ad2bf73c830b67a3614c2133d85a54ff2cf6548c14cf","observation_id":"b1f96cdb-4c54-4951-9213-17ec4f5c7fdc","resolution":{"observed_at":"2026-08-07T04:55:42.731509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09212","last_updated":"2024-01-17T19:09:57Z","snapshot_observed_at":"2026-08-04T18:52:19.083847Z","submitted_at":"2023-06-15T15:49:51Z","title":"CMMLU: Measuring massive multitask language understanding in Chinese","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09212","snapshot_observed_at":"2026-08-07T04:55:42.735264Z","title":"Cmmlu: Measuring massive multitask language un- derstanding in chinese","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.735264Z"},"links":{"cited_paper":"/paper/2306.09212","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:1acdb22adb3eb333a9a49a1bfce37348d82f9538024caf85729817ebe1ee6c85","observation_id":"8ce389d0-653d-4a00-8892-d18212bab4e2","resolution":{"observed_at":"2026-08-07T04:55:42.735264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13064","last_updated":"2024-02-20T15:00:35Z","snapshot_observed_at":"2026-08-13T04:14:27.645630Z","submitted_at":"2024-02-20T15:00:35Z","title":"Synthetic Data (Almost) from Scratch: Generalized Instruction Tuning for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13064","snapshot_observed_at":"2026-08-07T04:55:42.739229Z","title":"Synthetic data (almost) from scratch: Generalized instruction tuning for language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-08-07T04:55:42.739229Z"},"links":{"cited_paper":"/paper/2402.13064","citing_paper":"/paper/2506.09329"},"observation_digest":"sha256:cbb96a4c0d514cc867497db4081b4f0c8becb9fc9d958405a88e3f6c1c8fd2ee","observation_id":"dcb59c4d-3e81-407a-8581-e3209625dafb","resolution":{"observed_at":"2026-08-07T04:55:42.739229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.09329","last_updated":"2025-06-11T02:08:52Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T18:14:32.655685Z","submitted_at":"2025-06-11T02:08:52Z","title":"Towards Efficient and Effective Alignment of Large Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":240},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 100 of 240 outbound references and 0 inbound Pith citation observations for arXiv:2506.09329."}