{"as_of":"2026-08-14T22:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:619b76d0e51b1660b91354f7f99c3ac8ac2f9d7733863cfb8e3b6744e1da6292","coverage":[{"denominator":113,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T05:26:06.829382Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08968/citation-record","integrity":"/paper/2607.08968/integrity","json":"/paper/2607.08968/citation-record.json","paper":"/paper/2607.08968"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.15777","last_updated":"2024-05-29T15:50:43Z","snapshot_observed_at":"2026-08-13T00:23:09.137603Z","submitted_at":"2024-04-24T09:55:24Z","title":"A Comprehensive Survey on Evaluating Large Language Model Applications in the Medical Industry","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.15777","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"A comprehensive survey on evaluating large language model applications in the medical industry.arXiv preprint arXiv:2404.15777, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2404.15777","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:5040e4522f0948dd2841cdc659389a44a128d222df40d2c8963e470148d3282d","observation_id":"acece385-5018-4e08-9ea2-d90a09891c05","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.11698","last_updated":"2025-01-10T13:35:37Z","snapshot_observed_at":"2026-08-11T14:37:40.190000Z","submitted_at":"2024-12-16T12:21:05Z","title":"On Large Language Models in Mission-Critical IT Governance: Are We Ready Yet?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.11698","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"On large language models in mission-critical it governance: Are we ready yet?, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2412.11698","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:bc63a20767b9144e326537672f72d373476022a5341a00b81c85e30692855406","observation_id":"349a8e6b-f91c-49ec-91ff-b33ab83934eb","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Safe RLHF: Safe reinforcement learning from human feedback","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:c2a1a0b9c129415b3f89eade5621fdc1e6f164d5c319cc0210bf74cad3d179c9","observation_id":"863e2220-ba97-4e2d-8f71-97203894acf9","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"One-shot safety alignment for large language models via optimal dualization.Advances in Neural Information Processing Systems, 37:84350–84383, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:766a98a71bc0bad71fc856a54e1eac825c0635adf158808d9914b48a78290f94","observation_id":"111de49a-90b7-4ac8-98c3-3266c633a175","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Stepwise alignment for constrained language model policy optimization.Advances in Neural Information Processing Systems, 37:104471–104520, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:d537e54a53f06a446547446c831f6f0ca0cdfe6dd937d4a6f2b8ee1a1bff0192","observation_id":"68092885-94f5-497d-9c55-316505547ae8","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.02475","last_updated":"2024-03-04T20:39:24Z","snapshot_observed_at":"2026-08-13T04:03:36.032114Z","submitted_at":"2024-03-04T20:39:24Z","title":"Enhancing LLM Safety via Constrained Direct Preference Optimization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.02475","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Enhancing LLM safety via constrained direct preference optimization.arXiv preprint arXiv:2403.02475, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2403.02475","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:170b8081d0aad2ccfba5187ba1262c63d717cdbbe47fcd6e138ca7e078b56716","observation_id":"5ad6ebef-9d33-4b6d-b1cb-bb49ba592132","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19933","last_updated":"2025-02-27T07:28:35Z","snapshot_observed_at":"2026-08-12T22:14:55.185904Z","submitted_at":"2024-10-25T19:08:23Z","title":"Enhancing Safety in Reinforcement Learning with Human Feedback via Rectified Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19933","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Enhancing safety in reinforcement learning with human feedback via rectified policy optimization.arXiv preprint arXiv:2410.19933, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2410.19933","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:0472b63da7d4b853fb5efa555b1e292bb01c2c5a04a6448613bb6f65cfb2cccf","observation_id":"2263d3e0-5401-4ce9-8ad9-97524ad245d4","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21533","last_updated":"2025-03-16T10:12:08Z","snapshot_observed_at":"2026-08-12T22:13:21.949185Z","submitted_at":"2024-10-28T21:02:13Z","title":"L3Ms -- Lagrange Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21533","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"L3ms–lagrange large language models.arXiv preprint arXiv:2410.21533, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2410.21533","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:63d17f0d440401f568bdc41a731e3abc66a941e1a32b80b34ac33ec91233e0f6","observation_id":"974937e8-29c4-4d00-8785-87ad9b80551b","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Adversarial training for high-stakes reliability.Advances in neural information processing systems, 35: 9274–9286, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:9f86b3149bd65fc2dee9ecc2f5f09efbfcc89a0ca7c6dd5e3926e64e7ab0468b","observation_id":"791fc24d-2b75-4928-a75a-58677ee59439","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Confronting reward model overoptimization with constrained RLHF","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:4a746d601486de11873e291c27afeb40346a8ac0a350a2e28e41a123ebf78bc4","observation_id":"514678d0-3ebf-42c6-8f06-b21f9da606ba","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Large lan- guage models struggle to learn long-tail knowledge","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:3d42f423966316738cc85dd9669d3f0343f5eb40c9b84d039d73de7f01604630","observation_id":"d2c2c2be-2707-4a7a-bd68-259985580956","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"The devil is in the tails: How long-tailed code distributions impact large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:1ac8ac401ead635eea845fa880863387179c7a38ad52b3952ac3155e59c89bea","observation_id":"e7a0416a-ef70-4b81-9e02-b3b92d238b04","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:254e4f6e994e14d4cb7cd46f77f25155ec829f0b3f94bc8cdea77c1d0559c4eb","observation_id":"5019d37e-1f26-40ad-9d3f-33f2d5104a5f","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"The neglected tails in vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:6ac22db08786bd59f17718e3a18de333614bb06ccfc6984df39aac02a6b3139d","observation_id":"ab063a1c-74f6-435f-880f-91229acebdc6","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.16143","last_updated":"2025-02-22T08:36:06Z","snapshot_observed_at":"2026-08-07T17:56:47.381871Z","submitted_at":"2025-02-22T08:36:06Z","title":"The Law of Knowledge Overshadowing: Towards Understanding, Predicting, and Preventing LLM Hallucination","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.16143","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"The law of knowledge overshadowing: Towards understanding, predicting, and preventing llm hallucination.arXiv preprint arXiv:2502.16143, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2502.16143","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:8625aff73f7af9bab2c72bac4a9b7ce791d0c76331946b4e6c6bf7d02f487f94","observation_id":"8a9db494-48c7-46f5-8257-667e16006857","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Is gpt-oss good? a comprehensive evaluation of openai’s latest open source models.arXiv preprint arXiv:2508.12461, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:ed81c52756a15c6d591c5d40f28beb6c5c8c311d2ed3ebeb4dc87094b192d485","observation_id":"bfec2b78-a1e9-4209-8c54-64c3e0b09498","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Probably approximately correct constrained learning","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:78fb57bb30a5ecce99121ecddfa687c86a7805fbf38f0a3ee1c39cb0ab1e31ff","observation_id":"e7160261-58f7-4291-9934-52bce93489fe","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.06332","last_updated":"2022-07-13T20:54:22Z","snapshot_observed_at":"2026-08-13T18:12:28.516186Z","submitted_at":"2021-09-13T21:27:03Z","title":"Achieving Zero Constraint Violation for Constrained Reinforcement Learning via Primal-Dual Approach","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2109.06332","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Achieving zero constraint violation for constrained reinforcement learning via primal-dual approach, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2109.06332","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:3f6dd23cc7cd5feec8bcdf8e28e0236fcf3892e40520fbb6f0e1be821204985e","observation_id":"e7704181-5ef5-4c98-b9c2-ceeed98426bb","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Strong duality relations in nonconvex risk- constrained learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:bf0d743962bdbf958ba6bf9b7fcb15852e24c93601b92c2036374479888211a3","observation_id":"a85b9404-31bd-4009-afaf-8f8d6ed3bd4f","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:b6eeb7824b98395de5d72a12824349df99b3f3e75f67881353b2f0ee4c25dc38","observation_id":"865da434-d0d6-48a8-8adf-0fe9091bd3a0","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Constrained sliced wasserstein embedding, 06 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:9b1e2d0cee47ae27ff2ba417d523f2e9fd18af0d436bd8c4947451ee7f57350a","observation_id":"ba14f38c-2565-496f-9086-87ec9c10e40e","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11844","last_updated":"2024-03-18T14:55:45Z","snapshot_observed_at":"2026-08-13T00:51:50.230166Z","submitted_at":"2024-03-18T14:55:45Z","title":"Near-Optimal Solutions of Constrained Learning Problems","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11844","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Near-optimal solutions of constrained learning problems.arXiv preprint arXiv:2403.11844, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2403.11844","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:bf6c6f05afb2bf895083116d8947f3adf0391e70e19a1efcb37e7758411b1dc6","observation_id":"3cf03e89-576e-494c-b7aa-fca5776f860a","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03607","last_updated":"2025-06-30T14:20:37Z","snapshot_observed_at":"2026-08-13T09:48:39.929978Z","submitted_at":"2025-02-05T20:51:28Z","title":"Simultaneous Multi-Robot Motion Planning with Projected Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03607","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Simultaneous multi-robot motion planning with projected diffusion models.arXiv preprint arXiv:2502.03607, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2502.03607","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:0c48d24459e446525184df6fbaeed735e81302b3a650b3196880f98f8028a617","observation_id":"4a04319e-1808-4f23-ac7e-b02e8c8b4603","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:22c911cb4edfefea1b4790ad7a012c877ac1960847e69c19ef989087dcc78150","observation_id":"965e6395-89d8-4dc6-94ee-6e165f481b77","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.06866","last_updated":"2025-06-16T12:36:58Z","snapshot_observed_at":"2026-08-09T02:17:17.163706Z","submitted_at":"2025-06-07T17:12:03Z","title":"SAFE: Finding Sparse and Flat Minima to Improve Pruning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.06866","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Safe: Finding sparse and flat minima to improve pruning.arXiv preprint arXiv:2506.06866, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2506.06866","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:39a015bbaeffc297df4a8092da426926eaa20afd82c4cb57dce996f19766b36f","observation_id":"c68a2ede-e2a1-4ade-89d5-77c11c23f7e7","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Constrained discrete diffusion.arXiv preprint arXiv:2503.09790, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:e09564acf3b471a236a46c96386099afd5141a0a6e4c64aa6138f0c74fca6800","observation_id":"cb9dc62d-259a-4e46-8b75-7912b43f0ae0","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Dual optimistic ascent (pi control) is the augmented lagrangian method in disguise.arXiv preprint arXiv:2509.22500, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:61c91b4239899f0de1e10947a4c8fe2adf2f96811f2cc225fe8ff304413ba024","observation_id":"5a78cb7c-2435-4ca3-8777-d2191f469159","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Al-cole: Augmented lagrangian for constrained learning.arXiv preprint arXiv:2510.20995, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:e3264a2851f93a07a20f9bf664406a5406d03b02d71b7e9d89646fcf2883d36a","observation_id":"19e2f909-bdf6-4d5c-b05a-78cd8b67dffd","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Xstest: A test suite for identifying exaggerated safety behaviours in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:3d053009bf4fd1593d2eac92a42914347252012d8bac0c8cb1f8775aed95943b","observation_id":"94f00fd8-25a6-4a95-832e-3072166e3082","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Safedpo: A simple approach to direct preference optimization with enhanced safety.arXiv preprint arXiv:2505.20065, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:d3bfd9c0a08d2b125a8439982aa3d725660098c95ccfda5d8c797548da800abd","observation_id":"7ebfd72e-a995-4829-99ce-b2d6a1ac2b32","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Safety-tuned llamas: Lessons from improving the safety of large language models that follow instructions","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:5c3b12f281e772f5884993db881cd7598aa9e16316da175a9c358d7d80f11662","observation_id":"56a0cea5-af0f-43fe-89c8-4e2ac1624437","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Direct preference optimization: Your language model is secretly a reward model","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:e5dc38572d71a1a5c98f8f90c2262f9f7ac040551d0f0babc753075f837743ca","observation_id":"c87267d5-075f-4af9-a99a-d606d9a4360f","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Simpo: Simple preference optimization with a reference-free reward.Advances in Neural Information Processing Systems, 37:124198–124235, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:0e4008bff25b423c29c9360a56e59560fff35c109d0a38f93511d5a68ad676b1","observation_id":"e55b43f4-e385-4660-9127-87e5923737fd","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.08417","last_updated":"2024-06-03T01:28:06Z","snapshot_observed_at":"2026-08-13T04:41:57.988720Z","submitted_at":"2024-01-16T15:04:51Z","title":"Contrastive Preference Optimization: Pushing the Boundaries of LLM Performance in Machine Translation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.08417","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Contrastive preference optimization: Pushing the boundaries of llm performance in machine translation.arXiv preprint arXiv:2401.08417, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2401.08417","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:92dccea222dc286aa84939726e37d5304a69cbfab6d14a9063cc48b7a9baccba","observation_id":"9d95a778-fd02-4798-999d-41be8fa56f2d","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10425","last_updated":"2023-05-17T17:57:10Z","snapshot_observed_at":"2026-08-14T18:51:06.334767Z","submitted_at":"2023-05-17T17:57:10Z","title":"SLiC-HF: Sequence Likelihood Calibration with Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.10425","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Slic- hf: Sequence likelihood calibration with human feedback.arXiv preprint arXiv:2305.10425, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2305.10425","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:e89752eb55532c70a445a23c71e61dcd27c958af3ff0e511ac662dd5591ccf72","observation_id":"fe93fbcb-ec48-420e-a923-cb85d810674c","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Retrieval-augmented generation for knowledge-intensive nlp tasks.Advances in neural information processing systems, 33:9459–9474, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:5093bdb5e3bc9813cac2a2a8a49746992f85ca097229b33944c73eaa0f0ce490","observation_id":"afe64bec-669e-4e1f-8650-cc7dd0fe5520","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Tyrrell Rockafellar","venue":null,"work_id":null,"year":1974},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:34b68aad82761597dd305c58ceedd7c666727f9ae16f5447de67249173d1d7df","observation_id":"5d51c47f-8453-45bb-a4c8-823f9b261e10","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"The augmented lagrangian methods: Overview and recent advances.arXiv preprint arXiv:2510.16827, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:d6ad2276593c15442c8eee80ad73272e6a539cc27dfaf5b379c4da30e191117f","observation_id":"45a0d303-2c3f-43ff-ad36-da990631c0d8","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Resilient constrained learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:4d3e11caf368e0014a0de94e50a1b69af7ab6a14a644520bb8ae59433463b602","observation_id":"9ec73e37-b62b-4861-8026-6d5dca8c3eed","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Rockafellar.Convex Analysis","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:1c076f3bed2d8f149b1c1e9ee1496e8c380f65aebbd25e505f945796d5c62138","observation_id":"706eb809-ec09-4fba-b8b7-734f7b52370a","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1137/0315003","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wierzbicki and Stanislaw Kurcyusz","venue":"SIAM Journal on Control and Optimization","work_id":"662899da-f69c-449d-bd27-cdd565a45721","year":1977},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:9a7f80587653acbb6c6b2757b484eca5436a37ae209fab977e9e8dcdefa4b7c2","observation_id":"ead446a5-9b00-40f6-9b7a-60f81ad9fdce","resolution":{"observed_at":"2026-07-13T05:29:22.182097Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-07-13T11:49:37.820998+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T11:49:37.820998+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Reproducibility in machine-learning-based research: Overview, barriers, and drivers.AI Magazine, 46(2):e70002, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:c73bedbb153698d8ada0f271ba5fa7b42f7448b853dbee7fb67cf9b73d36c051","observation_id":"25415ed8-6bed-4710-8366-bea9b2fd007c","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Small language models are the future of agentic ai,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:db674e2c848094735593007c77e1ace867013b956da28a70a08ab6058a0fe8e8","observation_id":"46ab60a7-80d5-42da-88fc-ca4da3adfc2b","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02153","last_updated":"2025-09-15T22:15:00Z","snapshot_observed_at":"2026-08-12T13:48:47.535846Z","submitted_at":"2025-06-02T18:35:16Z","title":"Small Language Models are the Future of Agentic AI","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02153","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2506.02153","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:d6a94da16a70790d3feee32b8bbe9818d5e93a9f54f43ab8f13dc63c959a6998","observation_id":"cc24a5ba-b8be-4047-a7e9-c80aae548152","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:8410442a398d59b1108b85a9a8542de2e52de1a243abfed62c7e744b80cc42c8","observation_id":"d766ef4e-3fa5-4845-80e5-4136d98b4ada","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"When2call: When (not) to call tools","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:be34b7851d7d3ff8756bd80a3e639ef3510d426a660c5ba9fd74248668af3edb","observation_id":"6c7fb80a-1a91-4baf-b969-a215537a8b67","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"The berkeley function calling leaderboard (bfcl): From tool use to agentic evaluation of large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:b49c171076ebc29ff17d62c655c7a81b08b496c3bf33c94b0b8c964a5bc497e2","observation_id":"af9c0253-0168-4189-97a8-4b077503995f","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Apigen: Generative api method recommendation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:1c3ef373479f00f41b4cf829045f4f40fb55383f345e75be952bd24862229d31","observation_id":"a1dda9c3-2775-4a75-b804-8aa51a9f1019","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"The llama 3 herd of models.arXiv preprint arXiv:2407.21783, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:32a52b7aab7bfed16b212a89be8d8bb9d01608c4000217cfb446f576cd4a3b2f","observation_id":"b2904475-b988-43fa-aefc-7ecc256b8dab","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.03601","last_updated":"2025-07-19T17:39:17Z","snapshot_observed_at":"2026-08-07T20:27:54.118684Z","submitted_at":"2025-04-04T17:13:57Z","title":"APIGen-MT: Agentic Pipeline for Multi-Turn Data Generation via Simulated Agent-Human Interplay","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.03601","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Apigen-mt: Agentic pipeline for multi-turn data generation via simulated agent-human interplay.arXiv preprint arXiv:2504.03601, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2504.03601","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:decd9acf2197f6ac88a0ce4e33e974822ab581a6e1ff24936a6aaed5a807a30c","observation_id":"aea93fdc-7b8c-4299-b4cc-5dc20c275384","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Long is more for alignment: A simple but tough-to-beat baseline for instruction fine-tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:9d23235c48ad6f7ec67f294a2488b54f650c631fd8afcff6244eae9ba305eff0","observation_id":"1e9b32fe-4a18-4157-b1a0-48ef6cea195d","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Stanford alpaca: An instruction-following llama model, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:6d59b9e881b5a3b9aa5b2c0dfd906b64b75ea44b4bd86d6a3f9bc763aedbd7f5","observation_id":"e591507b-5ac2-4005-b38a-3a4a7b2f7eda","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Beavertails: Towards improved safety alignment of LLM via a human-preference dataset","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:138d7109503d20ffc94feab07b73135ae4631c726e9779d4c7bfab01ecc39b1a","observation_id":"58fbfbf3-b097-42fb-8b50-a4e4803d26ae","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Llama: Open and efficient foundation language models, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:65b512ab0683f9c3f0b1d8a7dcf01007c696bc97774362baa00762eb310277c8","observation_id":"024a2b88-30db-4dcc-b373-6e418a070ac9","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Hashimoto","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:5e2b98d83a3898083ab88de043042bf51c8e4bb9ed9bc6f64c0ee95714e93fb4","observation_id":"9fe54da1-8822-427b-afca-dffe59fa684f","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1611.09268","last_updated":"2018-10-31T14:46:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-11-28T18:14:11Z","title":"MS MARCO: A Human Generated MAchine Reading COmprehension Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1611.09268","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Ms marco: A human generated machine reading comprehension dataset.arXiv preprint arXiv:1611.09268, 2016","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/1611.09268","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:fbb647c891c7bbe58a913f12ec93dfe8bd24df1afd3a55973286fdd4381e55e2","observation_id":"7cda6654-ab36-45f5-a60c-e7a7a1c3c5a4","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Smarter, better, faster, longer: A modern bidirectional encoder for fast, memory efficient, and long context finetuning and inference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:a7e081735ace021f44206e8f9a0ca7a3d19391b916e29c8eebcdbaea3c9f77c9","observation_id":"f1798635-4f34-4c8b-a379-8470aa94de77","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.14424","last_updated":"2019-10-31T12:45:40Z","snapshot_observed_at":"2026-08-14T10:38:56.704122Z","submitted_at":"2019-10-31T12:45:40Z","title":"Multi-Stage Document Ranking with BERT","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.14424","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Multi-stage document ranking with bert.arXiv preprint arXiv:1910.14424, 2019","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/1910.14424","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:f2f342436960f253e1619429ae898ef7f89a8c148de64c9a2e7a994b1abd74ff","observation_id":"6ec0c157-330a-44f3-8968-6c73f376e360","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"C- pack: Packed resources for general chinese embeddings","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:b73e686fd6640135a430599ae363aaed4cb244b99680a19031acb8df8c2e0102","observation_id":"fdf769ed-7d2b-41a4-a509-58afe0cb85ad","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"cross-encoder/ms-marco-minilm-l12-v2","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:c1fec7cf4a0c09a1473d1399305b9e70419f3a05ead58e4496e203333f0caef6","observation_id":"e67685ac-844c-4803-917d-d149a92eefdf","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Pattern recognition using generalized portrait method.Automa- tion and Remote Control, 24:774–780, 1963","venue":null,"work_id":null,"year":1963},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:14c8dd8ca36211bb11596bb97dd45cd9377dd17a37d50e3d715f0bb141de005a","observation_id":"19be60ee-1903-4185-bcff-997d01de4be1","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Boser, Isabelle M","venue":null,"work_id":null,"year":1992},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:8855d1706b08bbf953faa08aef78c4fe49e4ac9b197ae0e6ef60e5f265d43325","observation_id":"7f2eb431-ff82-4cca-b863-2b3fdfdb925d","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Support-vector networks.Machine learning, 20(3): 273–297, 1995","venue":null,"work_id":null,"year":1995},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:870a57895e7bf2d96931f6b60f5842e71950e15ea6dca36a39cd059183e1db3b","observation_id":"11ce4227-2efe-4463-bd24-8e69c3721dc0","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"A theory of the risk for optimization with relaxation and its application to support vector machines.Journal of Machine Learning Research, 22(288): 1–38, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:1ad56a1a5dcd6779f4ef0194675edf287a0604badedba63bdb50717a5bec5921","observation_id":"e06c8bd5-c682-41fe-b21e-70347063ac9e","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Non-convex scenario optimization.Mathematical Programming, 209(1):557–608, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:b2355924b51ccf6cab70fc34ddf5ef5fcedc456c439f28f5400abc9da883cf52","observation_id":"5fe9b98d-9e59-442c-b665-d098c3f6186b","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14912","last_updated":"2025-01-24T20:39:38Z","snapshot_observed_at":"2026-08-10T14:45:38.482356Z","submitted_at":"2025-01-24T20:39:38Z","title":"Feasible Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.14912","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Feasible learning, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2501.14912","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:3e4b62ae41d5ac354cbd69633aeced44ac334aa4994b36e08ead5a50e9b2db8b","observation_id":"d136d787-d87b-45b3-8129-88f75475e84a","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Reinforce- ment learning with almost sure constraints","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:ca55552f35df6f8578f96c33f115ed2554887299a712dedf219e70f45d4b6db8","observation_id":"c103c28f-6912-443b-96de-5a4ec779495a","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Anytime-constrained reinforcement learning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:1b5093400d623f21fbb52f402a650ab4f24f9ebbe5c47a2c4a664432e5045d11","observation_id":"9714089f-cb75-4354-8823-83a205a13693","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Sauté rl: Almost surely safe reinforcement learning using state augmentation","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:7905e664b58b7605271f72460c442355d05f4f910702413c052640550226b378","observation_id":"d44fb671-0ba3-40bf-9cdb-dbc7f4c3e30c","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"On tilted losses in machine learning: Theory and applications.Journal of Machine Learning Research, 24(142):1–79, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:c9e532fbba411ceaf66641322a12bbce14719dc8cfd3428c02ee645daa080eed","observation_id":"5d899d0b-ff7b-4e97-8bf8-4a89172031b5","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Large-scale methods for distributionally robust optimization.Advances in neural information processing systems, 33: 8847–8860, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:d43742fb6ed3e0d83d79b0f3cbba3633d0164202040bcdf809ee71f370f5c6a7","observation_id":"d42e626c-13ac-4814-be75-95a25e891cf8","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Probabilistically robust learning: Balancing average and worst-case performance","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:fc32602925a3824886525e5af1039d7db51bb9b1268c3de534c97696b8f0fc43","observation_id":"16a64e79-c0ac-452c-b618-ef52c52a6220","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Robust llm alignment via distributionally robust direct preference optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:985d8014ed13828b65968cd1d186a9f2436a9a4d4c0ce50cf23d7995a4212c17","observation_id":"7703f921-11ec-41cd-a6bd-05e7a4b6350d","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Learning to summarize with human feedback","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:a61c9b88f6343fbf518f83cc6e5832ace3c6ed2eed8fee2814743aa4797abf3b","observation_id":"96a25ffb-fe38-41a6-99d3-974122ff03e7","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Training language models to follow instructions with human feedback.Advances in neural information processing systems, 35:27730–27744, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:41199043d4d38bf23f8c94065d64a0bfe4685600614c9ee65ca95e72401c2072","observation_id":"1386ed92-90b4-4c02-954c-2e5f498a96e4","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.05302","last_updated":"2023-10-07T07:01:26Z","snapshot_observed_at":"2026-08-13T20:00:16.671415Z","submitted_at":"2023-04-11T15:53:40Z","title":"RRHF: Rank Responses to Align Language Models with Human Feedback without tears","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.05302","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Rrhf: Rank responses to align language models with human feedback without tears.arXiv preprint arXiv:2304.05302, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2304.05302","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:1c78dcc1cb6fc395d2d61e89d8fa2cb786a398e6a587435367ae9cf240ce7c34","observation_id":"98eb984c-4f54-4d6e-aa35-87962f7db8cd","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Repo: Understanding preference learning through relu-based optimization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:9a99ad6a8bd580d3a3d1ca6cd9dc50e54d35a6a5e4af7e86e72b2e719a3bcb7d","observation_id":"06dc8911-1635-4799-9fdb-0dd499e8ec9d","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"A general theoretical paradigm to understand learn- ing from human preferences","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:6176fdbf33fa09138b77e97a9d45bc31ea4005629cd96926e1460c9ab532e6e6","observation_id":"767b7f92-35bb-4e17-9875-c42a59bb9f9e","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Cal-dpo: Calibrated direct preference optimization for language model alignment.Advances in Neural Information Processing Systems, 37:114289–114320, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:b9d5ac24c4cad74308a46def85d6dc23f43cf52d12bfa06fffcd70bde78d5e03","observation_id":"bb244f64-9f0a-4d66-b764-9f76e2840b47","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Training a helpful and harmless assistant with reinforcement learning from human feedback.arXiv preprint arXiv:2204.05862, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:9e1aed729c7c3b0473a97f36618031194c1e19a7f85214955143f9231e6eaab3","observation_id":"02384237-01ba-4094-be0d-4862a2cf3e79","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Pku-saferlhf: Towards multi-level safety alignment for llms with human preference","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:57965621cf6bbe0f5a9804242cfcf31ccc1bb892f3cb45743c8f9a95b9e7e05a","observation_id":"a20ae554-f549-42e6-becd-b32264c9aa31","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Alignment of large language models with constrained learning.arXiv preprint arXiv:2505.19387, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:a79c13e4d8f66abbdad4a9e2e305abb3132674ad39801db1f4355e3c4e9135f0","observation_id":"0fc72b07-b3bc-4e54-9f9f-65e568344f4d","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.17299","last_updated":"2026-08-13T07:58:00Z","snapshot_observed_at":"2026-08-14T21:16:30.175329Z","submitted_at":"2026-04-19T07:29:37Z","title":"Cat-DPO: Category-Adaptive Safety Alignment","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.17299","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Cat-dpo: Category- adaptive safety alignment.arXiv preprint arXiv:2604.17299, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2604.17299","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:887c1ba6b287fe1f2e4afd80f8cf6ddbf01b7f621e2ef34e73ecc955a9b8ab7d","observation_id":"e7587c85-c14e-4947-a7e2-6590c0928b9e","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15313","last_updated":"2025-04-08T11:04:33Z","snapshot_observed_at":"2026-08-14T17:13:23.544871Z","submitted_at":"2024-08-27T17:31:21Z","title":"Bi-Factorial Preference Optimization: Balancing Safety-Helpfulness in Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15313","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Bi-factorial preference op- timization: Balancing safety-helpfulness in language models.arXiv preprint arXiv:2408.15313, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2408.15313","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:7a18f6d921dc64798f9c9c6540679a5f1a7e8046c67a89b27bdd211366275bf0","observation_id":"54debcdb-9c32-4bc0-b0c1-269c2620e896","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02460","last_updated":"2025-06-03T05:23:09Z","snapshot_observed_at":"2026-08-12T06:32:01.725344Z","submitted_at":"2025-06-03T05:23:09Z","title":"MidPO: Dual Preference Optimization for Safety and Helpfulness in Large Language Models via a Mixture of Experts Framework","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02460","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Midpo: Dual preference optimization for safety and helpfulness in large language models via a mixture of experts framework.arXiv preprint arXiv:2506.02460, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2506.02460","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:5847493756dc256dd30ed07965fc83af93924b618e05e96f1600ee6a777da36c","observation_id":"a709ed57-33f9-4518-9e36-356ac925cf97","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Mitigating the safety alignment tax with null-space constrained policy optimization.arXiv preprint arXiv:2512.11391, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:d99a524fc780cc2d3804b602e81589f9c640f69aaf745bfc220cfe7027c9ff06","observation_id":"47efd3f0-ec94-4931-ba41-ab6543515809","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Rule based rewards for fine-grained llm safety","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:2f957973ef0e436ea97d1ebfad9cb42edd10dd89c0f71589098804cdc9ab72ec","observation_id":"c6927e27-22dd-46f0-910d-0242689165db","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Controllable preference optimization: Toward controllable multi-objective alignment","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:f18edeb8357099b3303afd7d0a902eca11fd1f20c3aa17db7cc8046fe8f9aa71","observation_id":"9f15dcca-a5e8-4def-b1a8-020fd12feaf5","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17141","last_updated":"2024-10-07T03:19:16Z","snapshot_observed_at":"2026-08-13T00:45:19.066991Z","submitted_at":"2024-03-25T19:28:10Z","title":"MetaAligner: Towards Generalizable Multi-Objective Alignment of Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17141","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Metaaligner: Conditional weak-to-strong correction for generalizable multi-objective alignment of language models.arXiv preprint arXiv:2403.17141, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2403.17141","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:39c50e32ea63a003921166b616634b37ef1b4db69e6a5de05396ef9ed1d84773","observation_id":"dfe16c7e-16a6-4e01-aa1c-7391268452a8","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Nonlinear programming.Journal of the Operational Research Society, 48 (3):334–334, 1997","venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:cdb51ecb17826d876f598f90e124bdf82e699dc3357aed3f8631a2cfd96b515b","observation_id":"76ba94d6-a07f-42d7-98db-23d78526c0e4","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16789","last_updated":"2023-10-03T14:45:48Z","snapshot_observed_at":"2026-07-06T16:00:46.542753Z","submitted_at":"2023-07-31T15:56:53Z","title":"ToolLLM: Facilitating Large Language Models to Master 16000+ Real-world APIs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16789","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Toolllm: Facilitating large language models to master 16000+ real-world apis.arXiv preprint arXiv:2307.16789, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2307.16789","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:81d3df057343f0769c73160349f118ea1d3ab7d51f2c8bf2cf9639aef42a7ae2","observation_id":"7071ac4f-d1e3-48fd-8b45-db37e3fc8f19","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Toolbehonest: A multi-level hallucination diagnostic benchmark for tool-augmented large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:4d6f1e49680abe6649a7032945c0cb5f002888f994de2ff267cc26a4dbcfb040","observation_id":"e1f75a10-f2ac-4534-bc7d-ad38fe438955","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"ToolSandbox: A stateful, conversational, interactive evaluation benchmark for LLM tool use capabilities","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:a49ffe279b79fe686be3939fcf3ab3e322efec502bcfc97a34cc224238e8e2e7","observation_id":"6d6a3e8b-e7d5-4adc-a530-0a8126267557","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Lora: Low-rank adaptation of large language models.Iclr, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:517ca90a11a83f8a2ab653802d98dc3a05221551334f50ba3a7ac9afa15df056","observation_id":"4c44794a-82be-417c-8362-986aa50c7438","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Decoupled weight decay regularization.arXiv preprint arXiv:1711.05101, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:7a4ce85fa44269144bb63ac996d6b5e02944fd5069cd951fc0cef8dfd2c6d0e9","observation_id":"f892096d-9c0e-4f63-bc19-960ae1ab34d2","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18837","last_updated":"2025-01-31T01:09:32Z","snapshot_observed_at":"2026-08-08T23:58:18.293467Z","submitted_at":"2025-01-31T01:09:32Z","title":"Constitutional Classifiers: Defending against Universal Jailbreaks across Thousands of Hours of Red Teaming","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18837","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Constitutional classifiers: Defending against universal jailbreaks across thousands of hours of red teaming.arXiv preprint arXiv:2501.18837, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2501.18837","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:289580063b0b92ecbf94b9dff805b11caf3bd1c5d72377712785791fc8fdafab","observation_id":"b722398e-6622-4b5f-b7a0-d5db5bca6000","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01081","last_updated":"2025-04-08T18:38:04Z","snapshot_observed_at":"2026-08-11T21:25:27.976515Z","submitted_at":"2025-04-01T18:00:20Z","title":"ShieldGemma 2: Robust and Tractable Image Content Moderation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.01081","snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Shieldgemma 2: Robust and tractable image content moderation.arXiv preprint arXiv:2504.01081, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"cited_paper":"/paper/2504.01081","citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:f49613b7cc8619d56abf3d4b8f2fd2c6efb9bbf93f5abbfb0562378ab81dad09","observation_id":"2c519ab3-a279-4d56-80a5-5161116b8721","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"Safety through reasoning: An empirical study of reasoning guardrail models.Findings of the Association for Computational Linguistics: EMNLP, 2025:21862–21880, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:6fcaf417db5e066833d958426e172cb64085d84133ed90db2d8c68931f9d035a","observation_id":"7639ac1e-f75c-4d23-b117-b90f0a7e4f43","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"OR-bench: An over-refusal benchmark for large language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:5cfd79a0d8ef2d334ee2e2c2d28720646059970d53bb04bc67907afa9df531fb","observation_id":"beb30e19-143a-46d7-b44f-1f2c102ee3e5","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T05:26:06.829382Z","title":"kernel trick","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-07-13T05:26:06.829382Z"},"links":{"citing_paper":"/paper/2607.08968"},"observation_digest":"sha256:adb48bb032f3d10c07bc7b1296f66a4543e36ed6cdedbc233d32f1f906706bdb","observation_id":"d98e7527-5a76-43f9-8790-0bd5ccd26dc2","resolution":{"observed_at":"2026-07-13T05:26:06.829382Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.08968","last_updated":"2026-07-09T22:09:16Z","latest_version":1,"primary_category":"eess.SP","snapshot_observed_at":"2026-08-09T10:00:22.541985Z","submitted_at":"2026-07-09T22:09:16Z","title":"Every Sample Counts: Supervised Fine-Tuning of Language Models with Pointwise Constraints"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":99,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":113},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 100 of 113 outbound references and 0 inbound Pith citation observations for arXiv:2607.08968."}