{"as_of":"2026-08-08T20:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9ff2e10378cdd606c07192e2ef240fbefc762b24762333c49cc864af149c3364","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T23:05:32.142129Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-22T19:52:25.871351Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-22T19:55:05.166262Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"cited_work":{"arxiv_id":"2502.08977","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.08977","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Text-driven 3d human generation via contrastive preference optimization","venue":null,"work_id":"d2735bf3-f561-4620-afe2-b218fe710b3f","year":2025},"citing_paper":{"arxiv_id":"2504.13378","last_updated":"2026-04-09T03:17:26Z","snapshot_observed_at":"2026-08-07T19:25:08.924148Z","submitted_at":"2025-04-17T23:28:38Z","title":"SMPL-GPTexture: Dual-View 3D Human Texture Estimation using Text-to-Image Generation Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-22T19:52:25.871351Z"},"links":{"cited_paper":"/paper/2502.08977","citing_paper":"/paper/2504.13378"},"observation_digest":"sha256:e11bbd45316f706b4cf5532cfa789fb3c5a2cfb43d595244587a4be52a6983c8","observation_id":"fd2313ff-bf60-4716-bfd1-3fc11c31c611","resolution":{"observed_at":"2026-05-22T19:55:05.169340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2502.08977/citation-record","integrity":"/paper/2502.08977/integrity","json":"/paper/2502.08977/citation-record.json","paper":"/paper/2502.08977"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.887746Z","title":"Dream Fusion: Text- to-3D using 2D Diffusion,","venue":null,"work_id":"a12a08a6-ca48-4afa-8307-e6b2c7860a04","year":2023},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:31.951782Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:f52d276564b54634cf3e9402bc38d3ada6d4fb26cb76ed099631679d88d4f4e6","observation_id":"cb574912-b4b2-4b77-9230-a7ad189abe4e","resolution":{"observed_at":"2026-08-07T23:05:32.892386Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.873995Z","title":"TADA! Text to Animatable Digital Avatars,","venue":null,"work_id":"df516e62-e3aa-468b-a67e-deaff8ee5171","year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:31.957208Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:181362bce15e75cb118fbbbabd3ff47f425aa6a368d8b5175c020c119b0e27f4","observation_id":"15421573-e731-4717-8bcf-d648ee97755e","resolution":{"observed_at":"2026-08-07T23:05:32.878579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.859662Z","title":"Expressive body capture: 3d hands , face, and body from a single image,","venue":null,"work_id":"b6c5272f-7af0-48bc-9e65-e1ff3ab9a1e4","year":null},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:31.962316Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:082abc1cab0ee1b0ab11e350189227bbdeb83dfad9b75ddd426bf4fb83bdeca8","observation_id":"82a9fa62-2686-4dcf-9b20-583c595882b0","resolution":{"observed_at":"2026-08-07T23:05:32.864280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.845680Z","title":"DreamWaltz: Make a Scene with Complex 3D Animatab le Avatars,","venue":null,"work_id":"9cdd7216-09c4-48db-a9f9-e7cbba673c4a","year":2023},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:31.967448Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:6af6cf4f09ee88386a6f1ad419c5e67a24a3cec1939edb72f6c48b2ab4100815","observation_id":"9da356f7-2a0c-4028-b950-30a3b704b376","resolution":{"observed_at":"2026-08-07T23:05:32.850343Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.831869Z","title":"Adding conditional co ntrol to text-to-image diffusion models,","venue":null,"work_id":"72fc115f-03cf-4c09-83ee-323a519851d8","year":2023},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:31.972016Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:4ed60d72c2ec60cf32250a743a059bb6e295e9632db9facc659738fd97f0ce0c","observation_id":"e4d8cdaa-3407-4b0b-9f9a-3218549bb28a","resolution":{"observed_at":"2026-08-07T23:05:32.836500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.817889Z","title":"HumanGaussian: Text-Driven 3D Human Generation with Gaus sian Splatting,","venue":null,"work_id":"f191dee5-7e73-4675-9dae-4a8da7cf4afc","year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:31.976945Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:e2247f83645ef9a2b7cd7c0ad7b01bd331832afc2b4c8dff8657388fb96dbc38","observation_id":"6164ca21-6d33-4a75-bdbf-9a16f1cb38b9","resolution":{"observed_at":"2026-08-07T23:05:32.822560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.803568Z","title":"3 D Gaussian Splatting for Real-Time Radiance Field Rendering,","venue":null,"work_id":"f8bc14c8-c375-4fca-9ecf-2c19ebffa991","year":2023},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:31.981737Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:4a46b15f92b3bfd021e35813b3d5a426582d23b707a66b7f9a114df277dc8d58","observation_id":"1d671aaf-e284-46fe-a711-3f69bb65d775","resolution":{"observed_at":"2026-08-07T23:05:32.808100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.789509Z","title":"HumanNorm: Learning Normal Diffusion Model for High - quality and Realistic 3D Human Generation,","venue":null,"work_id":"f3df85bb-a677-4370-97da-ef0bb396ef87","year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:31.987053Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:54198ea6c71102c1efd046b81043e39c78ab432bb692bb15f4d2234ae6f54733","observation_id":"76ae1cff-0030-4556-8211-6cab41f85d8d","resolution":{"observed_at":"2026-08-07T23:05:32.794167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.775846Z","title":"Image reward: Learning and evaluating human preferences for text-to-ima ge genera- tion,","venue":null,"work_id":"c9f1358f-db94-49c5-bd9c-85d2f6b0ab8b","year":2023},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:31.991597Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:6912b822a98c4d077c4247414f6ad6e20a9ed955ffd6b45ba21adf97a82027d5","observation_id":"e1193df9-b0f2-4790-a977-0184da4027a2","resolution":{"observed_at":"2026-08-07T23:05:32.780554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.761998Z","title":"Pick-a-pic: An open dataset of user preferences for text-t o-image generation,","venue":null,"work_id":"5db2a6f5-551a-43ff-b53a-3aaa905c0762","year":null},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:31.996151Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:f3d23f2d659980161b67c863b1af8e54316727a70bf45d468a1cf9de620f6bce","observation_id":"0b073125-2dd2-443f-ac83-7ebb618bf5e5","resolution":{"observed_at":"2026-08-07T23:05:32.766494Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-07-06T15:43:07.989730Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-07T23:05:32.001030Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.001030Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:59506c86fb0898f7534f13130802427e81b2b6f50581c39861f095fed1fe686d","observation_id":"4da9a722-472c-45bc-9f4f-a3bf8e1eee52","resolution":{"observed_at":"2026-08-07T23:05:32.001030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.748074Z","title":"Magic3D: High-Resolut ion Text- to-3D Content Creation,","venue":null,"work_id":"c2f7292a-bdce-4868-9fcb-cc507df3c942","year":2023},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.006424Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:0a914b7aa5da109ec671fb81380d333e26e4b0618bed1a2cf8816612ba9cba3f","observation_id":"6eb61e11-8993-4b9f-b623-447417f63c38","resolution":{"observed_at":"2026-08-07T23:05:32.752548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.734055Z","title":"Proli ﬁcdreamer: High-ﬁdelity and diverse text-to-3d generation with varia tional score distillation,","venue":null,"work_id":"f75a13b1-1ffd-4408-9504-e3c134c9c57e","year":2023},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.011191Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:6c3bca1a9adfe75e1ad050899e5e4a29094022bbd49670aaf42b3b4e4c8a2b16","observation_id":"26ca2fb0-f48f-4bf5-a1b3-67a8851dd3fd","resolution":{"observed_at":"2026-08-07T23:05:32.738505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.720899Z","title":null,"venue":null,"work_id":"71058713-130a-409f-90a6-fc626bcc9b3f","year":2023},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.016199Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:4dbf2145c48c21602ab640740702df72b3dce2ed61363fa0aee2e9d29937a6f6","observation_id":"aa32fd88-ceb3-4941-b4fa-43de739ee5bb","resolution":{"observed_at":"2026-08-07T23:05:32.725060Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.706744Z","title":"DreamGauss ian: Generative Gaussian Splatting for Efﬁcient 3D Content Crea tion,","venue":null,"work_id":"59c8145e-e343-4344-ab38-b96a75784856","year":null},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.021132Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:bc734b39710ca54fae4d63c79f0f33ff2c2b86a79873ab7f75c320f07a16e1b6","observation_id":"53f27b54-cd43-4db9-9394-d11d9d17dad1","resolution":{"observed_at":"2026-08-07T23:05:32.711903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.692507Z","title":"Mvdream: Multi-view diffusion for 3d generation,","venue":null,"work_id":"06f9538d-2a98-43a0-a311-20d0ebd77cc0","year":2023},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.025883Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:4d68a0575d23aa27bf388c046975dfc34de2a87a5962fe721be9cefff1b41600","observation_id":"57bf1424-14ca-4593-8d3f-26237be43e7f","resolution":{"observed_at":"2026-08-07T23:05:32.697162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.678190Z","title":"MVGaussian : High- Fidelity text-to-3D Content Generation with Multi-View Gu idance and Surface Densiﬁcation,","venue":null,"work_id":"300ab7a6-d280-486a-8dba-09566f97b920","year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.030534Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:ae1b13b21b969cf7d015fe088e8b29741752dbd928d8893cf7d75f88c0bd2cb2","observation_id":"5614597a-f089-42c1-84ed-ef2f0deacdcb","resolution":{"observed_at":"2026-08-07T23:05:32.683189Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.663642Z","title":"DreamCouple: Exploring High Qual ity Text- to-3D Generation Via Rectiﬁed Flow,","venue":null,"work_id":"ad5fd074-a7b7-4667-b489-842b86818d0f","year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.035142Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:93bdcf4a82a49cd7b5861232fe09e41d72247d423e1e5b2c31893750bfce1c4f","observation_id":"4110d654-4d62-49f5-9e55-4d5d75a787b0","resolution":{"observed_at":"2026-08-07T23:05:32.668971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.649347Z","title":"DreamMapping: High-Fidelity Text-to-3D Generation via V ariational Distribution Mapping,","venue":null,"work_id":"342e6c00-e811-4aee-bc70-e5ac805f4d1d","year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.040010Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:e35327a8c42432573c7ebad9c694403ec38b93deb363f2081e75509d3b23fa2c","observation_id":"24338744-9382-420c-9cdb-019d40cd51c6","resolution":{"observed_at":"2026-08-07T23:05:32.654319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.635717Z","title":"Deep Marching Tetrahedra: A Hybrid Representation for High-resolution 3D Shape Synth esis,","venue":null,"work_id":"f947dacb-af95-4c69-9c4b-ebf629e9cded","year":null},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.044586Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:af9a067879bd560d46ac5553880a5f288139d459005e35a64ff01ea34d75b1ed","observation_id":"4b819a81-5c1a-41ef-9b33-66456515cc77","resolution":{"observed_at":"2026-08-07T23:05:32.640269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.622129Z","title":"Ava tarCLIP: Zero-Shot Text-Driven Generation and Animation of 3D Avata rs,","venue":null,"work_id":"77f6464f-27cd-44d6-850a-9a4377ebaf93","year":2022},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.049212Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:d44502abc4da3323b180bc8785a89c464b1392be4bc272025d9dc58a17561fb0","observation_id":"17bfba7b-031c-4519-8c48-78a45d3af77f","resolution":{"observed_at":"2026-08-07T23:05:32.626600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.608391Z","title":"CLIPMesh: Generating textured meshes from text using pretrained imag e-text models,","venue":null,"work_id":"a341409d-cbd3-410c-b027-a70a57151462","year":2022},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.054071Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:5d5ef65e48dbb58b0223296a60c5311b1656a4c10069a5965679876d74445c51","observation_id":"6a03c351-a1b1-484f-b48f-68112b948638","resolution":{"observed_at":"2026-08-07T23:05:32.612995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.594787Z","title":"Sanghi, C","venue":null,"work_id":"32ef05a8-1a19-4721-90b2-ab609c656a52","year":null},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.058492Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:24b50608d391eb9fa6828780b28176b58e47f8d0ec1f509b1ecec9946674ea07","observation_id":"9963e9ca-e718-45bf-8acb-a4da5a31538c","resolution":{"observed_at":"2026-08-07T23:05:32.599460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.580400Z","title":"Building efﬁcient, accurate c haracterskins from examples,","venue":null,"work_id":"6869dc52-5b38-4d8c-938b-8d550a1a8466","year":2003},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.063568Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:2df2c86ab9a00f95ac024d14bafb0c5291e8863944aeb9635534af9778a2d84e","observation_id":"72fcdd8e-f758-4f97-b3d6-6283c3bc1927","resolution":{"observed_at":"2026-08-07T23:05:32.585139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.566128Z","title":"SMPL: a skinned multi-person linear mode,","venue":null,"work_id":"54edd269-ca96-42a2-b34c-9ca528f18117","year":2015},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.068198Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:f5f27785b3e8cfa07a1257bd81607bac5710db33cf0610585f4f14c9b771f86d","observation_id":"a2a7dc7c-4350-4525-96d6-63a3b0b6a1b7","resolution":{"observed_at":"2026-08-07T23:05:32.570769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.551090Z","title":"Photoreali stic text-to-image diffusion models with deep language underst anding,","venue":null,"work_id":"1d6365ed-09a1-45be-b78b-26432f8e972a","year":null},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.072572Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:a31738f120e8d98e41c9390e9b7a5f174e300fc86d7a23621cf98641034cce79","observation_id":"0f30d4c4-394d-4927-a703-4fe0dcac6587","resolution":{"observed_at":"2026-08-07T23:05:32.556574Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.537854Z","title":"NeRF: Representing Scenes as NeuralRadiance Fields fo r View Synthesis,","venue":null,"work_id":"eb3c89d1-e3da-4fc6-9f10-54180e248fa5","year":2021},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.077552Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:595a07c977f58dea65155a38dd9c7cadb8fb603c340f2edff71e1f8e8467274c","observation_id":"d1147623-87d8-4d56-ae69-da8214684fa0","resolution":{"observed_at":"2026-08-07T23:05:32.542197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.524019Z","title":"NeuS: Learning Neural Implicit Surfaces by V olume Rendering for Multi-view Reconstruction,","venue":null,"work_id":"b4c2ec67-00da-4b99-8138-28a08e75c095","year":2021},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.082157Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:609edc8a6534d6d8ce39aba0d133afd2389c5492c60beb21af4b5612528bbe53","observation_id":"7ca7f843-e2a7-4d80-9cc6-702b59f1f6cd","resolution":{"observed_at":"2026-08-07T23:05:32.528417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.509679Z","title":"DreamAvatar: Text-and-Shape Guided 3D Human Avatar Generation via Diffu sion Models,","venue":null,"work_id":"614ff5cd-a13e-4dee-bf8d-30599a87dbf4","year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.086641Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:066fe29137af6db668fff25f467cedd10402479347a5577459e3c7a951658643","observation_id":"865820d3-e311-4593-bfbc-1eb87e9241ce","resolution":{"observed_at":"2026-08-07T23:05:32.514127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.495662Z","title":"AvatarCraft: Transforming Text into Neural Human Av atars with Parameterized Shape and Pose Control,","venue":null,"work_id":"1a230b66-8b2f-4f81-8ef2-f833053d8fd3","year":null},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.091192Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:08159c871c0a5c27100e044e06a06e9521a24ff6925a75fec9215a304fc695e4","observation_id":"80336dbf-2094-4e46-bd80-28f3e7929e2a","resolution":{"observed_at":"2026-08-07T23:05:32.500361Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.17145","last_updated":"2024-09-25T17:59:45Z","snapshot_observed_at":"2026-08-07T06:05:52.363342Z","submitted_at":"2024-09-25T17:59:45Z","title":"DreamWaltz-G: Expressive 3D Gaussian Avatars from Skeleton-Guided 2D Diffusion","version":1},"cited_work":{"arxiv_id":"2409.17145","doi":null,"metadata_source":"pith","pith_arxiv_id":"2409.17145","snapshot_observed_at":"2026-08-07T23:05:32.359130Z","title":"DreamWaltz-G: Expressive 3D Gaussian Avatars from Skeleton-Guided 2D Diffusion","venue":"cs.CV","work_id":"54b33db1-7ab2-4730-a9fb-0cd7983796bd","year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.095637Z"},"links":{"cited_paper":"/paper/2409.17145","citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:707cc995366aceb5dce0ebfb1a3d0d2a32f7bc210e9a6abb6bde7e7cc5ca9f1b","observation_id":"4b03b582-a959-4cd0-8ca6-1f666854a5bb","resolution":{"observed_at":"2026-08-07T23:05:32.364144Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.480910Z","title":"DreamHuman: Animatable 3D Avatars from T ext,","venue":null,"work_id":"947426b3-cc97-4c2c-8e6a-29862aa2fc04","year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.100327Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:17dc9e98e78fdf2cd956ae9eed18426cb25437437aab8146d299046a2c6fe006","observation_id":"23826b43-41b9-4c0b-9f34-9fa47f508e40","resolution":{"observed_at":"2026-08-07T23:05:32.486147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.465308Z","title":"imGHUM: Impli cit Genera- tive Models of 3D Human Shape and Articulated Pose,","venue":null,"work_id":"74ae1975-d51d-45e0-a847-c922ac3c8d23","year":2021},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.104701Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:cfd097d533288927d8566de1b7064c5991fef1973fc852ad17620235359e3da1","observation_id":"4fe07d35-aaec-4e44-a798-413e220ce40b","resolution":{"observed_at":"2026-08-07T23:05:32.470160Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09864","last_updated":"2023-06-16T14:18:51Z","snapshot_observed_at":"2026-07-06T15:43:27.458645Z","submitted_at":"2023-06-16T14:18:51Z","title":"AvatarBooth: High-Quality and Customizable 3D Human Avatar Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09864","snapshot_observed_at":"2026-08-07T23:05:32.109040Z","title":"Avatarbooth : High- quality and Customizable 3D Human Avatar Generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.109040Z"},"links":{"cited_paper":"/paper/2306.09864","citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:aec9d2debb7cabea895b3e82f4976b1fc390b4c1f005e7b0353e5e8e0d037fb9","observation_id":"65145e86-e29d-4edc-bd6d-c00d8e567a66","resolution":{"observed_at":"2026-08-07T23:05:32.109040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.449743Z","title":"AvatarV erse: High-quality & Sta ble 3D Avatar Creation from Text and Pose,","venue":null,"work_id":"6c318de8-f98e-4d26-8136-05f58cf71194","year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.113438Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:eb4e39938b84fcdd4c3ce6aed7c611716622c352b9a4fcf5223932bcb3bc1e5c","observation_id":"64df8f08-7232-48ae-bb08-8bc06ca7d234","resolution":{"observed_at":"2026-08-07T23:05:32.454453Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.419714Z","title":"DensePose: D ense Human Pose Estimation in the Wild,","venue":null,"work_id":"1274b6b9-b102-4b3f-a095-708848ba7479","year":null},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.121484Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:a9d0580c67933f2ef8e78711d32830251953a824ed0119c24224a94ed5b0e110","observation_id":"939e751c-1acf-4dad-8826-4471e4301c5b","resolution":{"observed_at":"2026-08-07T23:05:32.424422Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00954","last_updated":"2024-05-02T02:30:39Z","snapshot_observed_at":"2026-07-06T18:08:30.875909Z","submitted_at":"2024-05-02T02:30:39Z","title":"X-Oscar: A Progressive Framework for High-quality Text-guided 3D Animatable Avatar Generation","version":1},"cited_work":{"arxiv_id":"2405.00954","doi":null,"metadata_source":"pith","pith_arxiv_id":"2405.00954","snapshot_observed_at":"2026-08-07T23:05:32.322641Z","title":"X-Oscar: A Progressive Framework for High-quality Text-guided 3D Animatable Avatar Generation","venue":"cs.CV","work_id":"91a2e34c-cd3a-4120-9fc7-8822aee9de98","year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.125452Z"},"links":{"cited_paper":"/paper/2405.00954","citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:dac30fb84390bc9b0ecb07ff41b666a612e372884b085d47c08cfd0e07314512","observation_id":"bb7e165e-c56b-4695-a617-018248055ea1","resolution":{"observed_at":"2026-08-07T23:05:32.327885Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.405100Z","title":"GAvatar: Animatable 3D Gaussian Avatars with Impli cit Mesh Learning,","venue":null,"work_id":"9cd4135c-0b90-465c-a880-c4b0eb0f9d05","year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.129789Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:0f7071380812ce492f39f22c3f337c95f2125c10cdcfdd4bf096717a75714760","observation_id":"bb35e227-71c2-4afd-b4d8-7835b89032b6","resolution":{"observed_at":"2026-08-07T23:05:32.409860Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2404.1510","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.295013Z","title":"Multimodal large language mode l is a human-aligned annotator for text-to-image generation,","venue":null,"work_id":"7717e309-e6ad-4c71-9332-e60df7387d07","year":null},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.133596Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:cc58b1a1f81a38b760843d29ae96a4ec6bde0554b29a02e83aba67cc08348465","observation_id":"17a55bb8-f99a-41f8-b3d0-29d9b229d97c","resolution":{"observed_at":"2026-08-07T23:05:32.304508Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.18058","last_updated":"2024-01-31T18:29:39Z","snapshot_observed_at":"2026-07-06T17:23:14.388964Z","submitted_at":"2024-01-31T18:29:39Z","title":"LongAlign: A Recipe for Long Context Alignment of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.18058","snapshot_observed_at":"2026-08-07T23:05:32.137599Z","title":"Longal ign: A recipe for long context alignment of large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.137599Z"},"links":{"cited_paper":"/paper/2401.18058","citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:dcdc98b5789e854c4189791cc98079812b46befa18e486683a9ad942c19bbf31","observation_id":"0ddbdbc4-0770-47e4-a812-04cda851e676","resolution":{"observed_at":"2026-08-07T23:05:32.137599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.390189Z","title":"Learning T ransferable Visual Models From Natural Language Supervision,","venue":null,"work_id":"2b082609-e29d-4826-951c-0b27c7b026ee","year":2021},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.142129Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:20f5b9d78196de2ad3864d63885e5b5905995e336ce400a127269f36176aea85","observation_id":"f78a5f51-4f76-46e7-aa3f-af340943a3eb","resolution":{"observed_at":"2026-08-07T23:05:32.394869Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T23:05:32.434816Z","title":null,"venue":null,"work_id":"5782037c-acdc-4b37-a149-391494de81b5","year":2020},"citing_paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization","version":3},"reference_index":7132,"source":"pdf_text","source_observed_at":"2026-08-07T23:05:32.117730Z"},"links":{"citing_paper":"/paper/2502.08977"},"observation_digest":"sha256:09e20ee660ba9084d7e1f13ce3b9f6096cb9f44af6bc4f827dd4de269936d1c6","observation_id":"6840bf8b-eeb8-45a8-a2ab-dd18e96a93c6","resolution":{"observed_at":"2026-08-07T23:05:32.439705Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2502.08977","last_updated":"2025-03-25T09:27:35Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:59:44.705070Z","submitted_at":"2025-02-13T05:27:50Z","title":"Text-driven 3D Human Generation via Contrastive Preference Optimization"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":3,"verified_fuzzy":34},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 1 inbound Pith citation observation for arXiv:2502.08977."}