{"as_of":"2026-08-07T10:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:83769c255c3151e1f249b202e5933be503d54ac25f31e21e06fd89d03410bd2d","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T04:53:37.628619Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.02890/citation-record","integrity":"/paper/2508.02890/integrity","json":"/paper/2508.02890/citation-record.json","paper":"/paper/2508.02890"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:34.894169Z","title":"A survey on large language model (LLM) security and privacy: The good, the bad, and the ugly,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:34.894169Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:a9853f78c1f88ecb3bf573928e386df7473e19fbca653438495633d8a483ad23","observation_id":"eacd1369-8811-4dcd-9407-3544730b7617","resolution":{"observed_at":"2026-08-06T04:53:34.894169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:34.986182Z","title":"Visual in-context learning for large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:34.986182Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:35051ad9d1b27ad880bfc259a63b538a3ac86f70475cbdce1870d7cd953a3c1a","observation_id":"67d1f37a-008c-42ba-b9c5-debfddbbffd3","resolution":{"observed_at":"2026-08-06T04:53:34.986182Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.19732","last_updated":"2024-12-20T16:19:17Z","snapshot_observed_at":"2026-08-03T16:04:58.991344Z","submitted_at":"2024-10-25T17:59:09Z","title":"Rethinking Visual Dependency in Long-Context Reasoning for Large Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.19732","snapshot_observed_at":"2026-08-06T04:53:35.120481Z","title":"Rethinking visual dependency in long-context reasoning for large vision-language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.120481Z"},"links":{"cited_paper":"/paper/2410.19732","citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:d6fc9ab5771b0906f274cc290fc6d221f8517b64567059dab8694669e50a6151","observation_id":"0962754c-97cf-4730-b35d-56094bab93e2","resolution":{"observed_at":"2026-08-06T04:53:35.120481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:35.196450Z","title":"Lvlm-ehub: A comprehensive evaluation bench- mark for large vision-language models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.196450Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:0be96201a9171f5fc90b6c95ed8224878d4e7d0192519a449bdc91870b94413f","observation_id":"4cd8ca6d-60f0-4e0d-b59e-1ceb8e04ed31","resolution":{"observed_at":"2026-08-06T04:53:35.196450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:41.461480Z","title":"COVID-19 detection in chest x-ray images using swin-transformer and transformer in transformer,","venue":null,"work_id":"c146984c-6d2c-48c1-9ae6-e683d22f1f7d","year":2021},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.291408Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:2665c51b0b72c8493f78093c842818e3a140d3f7a8e1ecb19a04f8ecbe0cd9ab","observation_id":"0a48374c-605f-402b-b0db-dd7b6f8c2224","resolution":{"observed_at":"2026-08-06T04:53:41.530111Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.07398","last_updated":"2024-06-20T14:44:14Z","snapshot_observed_at":"2026-07-06T17:28:43.842260Z","submitted_at":"2024-02-12T04:13:16Z","title":"VisLingInstruct: Elevating Zero-Shot Learning in Multi-Modal Language Models with Autonomous Instruction Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.07398","snapshot_observed_at":"2026-08-06T04:53:35.394791Z","title":"Vislinginstruct: Elevating zero-shot learning in multi-modal lan- guage models with autonomous instruction optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.394791Z"},"links":{"cited_paper":"/paper/2402.07398","citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:efd2a46314e8689962e25f9a24c99fff7546446f61f34d491545821345c7be4d","observation_id":"7b4fd9af-f854-4bd5-94be-b70a285af3c1","resolution":{"observed_at":"2026-08-06T04:53:35.394791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:41.311097Z","title":"Video-llava: Learning united visual representation by alignment before projection,","venue":null,"work_id":"2825af68-0d9b-4cc9-81ce-f6a147bbe286","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.485118Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:8b78b65f7f6163af688189e167d1a4f5950da26b8bf9807f42b380e493f74d28","observation_id":"de0e6c6d-196f-41f6-aa53-35a691c99a37","resolution":{"observed_at":"2026-08-06T04:53:41.380749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:35.663480Z","title":"Imagenet: A large-scale hierarchical image database,","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.663480Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:a929af7d4d776981d950e7a8baa847bdc016b58ae8f05cbd301265020d566ac0","observation_id":"88c032e3-ca13-4403-b252-b3389c4eb7f7","resolution":{"observed_at":"2026-08-06T04:53:35.663480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:41.004443Z","title":"Microsoft COCO: common objects in context,","venue":null,"work_id":"5eff56d6-67c3-416d-b230-9304276391f0","year":2014},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.751725Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:eab13e14d746023c62b1488a191adae8b8ce3f72d09e1865f87be70a8be44894","observation_id":"1e874e69-2cb8-41cb-ab70-51f0da3545d7","resolution":{"observed_at":"2026-08-06T04:53:41.056036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:40.851051Z","title":"The open images dataset V4: unified image classification, object detection, and visual relationship detection at scale,","venue":null,"work_id":"df223433-4a51-49ce-98f8-6ab7bbbc0b46","year":2018},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.818007Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:bb9c1f0cda6a047b5fc60a29e3ca282f6e7d3a1ee537566a45802cb8d2945dcf","observation_id":"d3527ab6-69f5-41b4-8ea9-d2a5892f8941","resolution":{"observed_at":"2026-08-06T04:53:40.924173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:40.686508Z","title":"A comprehensive survey and guide to multimodal large language models in vision-language tasks,","venue":null,"work_id":"651f9cff-e14f-47e7-9350-5ce3f3524499","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.919605Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:0f17878767ea76e8bfb85327b7cdfe49c1d0a39fc373dc374c0fe2b19b66a244","observation_id":"ed814613-5818-414f-8dc3-01fb428d10bc","resolution":{"observed_at":"2026-08-06T04:53:40.761105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:40.556249Z","title":"Foundational models defining a new era in vision: A survey and outlook,","venue":null,"work_id":"d52a692a-3319-49b6-8da4-a64253e0fd67","year":2023},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.016111Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:5c038d26c31f3951164a77948b630a4544939c9936696e990c85a2141ef66ad3","observation_id":"2f090265-cc99-4813-873d-a288cb0f037b","resolution":{"observed_at":"2026-08-06T04:53:40.613474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:40.387564Z","title":"Lmfusion: Adapting pretrained language models for multimodal generation,","venue":null,"work_id":"5a3d56fc-af71-48ac-886a-a0ac524dceb9","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.100031Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:8a51d1db1b8cb7b83ed3b59118be59ada17277f7d313036aabc4351a9e1fe233","observation_id":"7df7c4f8-10e2-4c8d-9c6e-b4b1bbf24111","resolution":{"observed_at":"2026-08-06T04:53:40.466056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:40.211089Z","title":"Multi-modal generation via cross-modal in-context learn- ing,","venue":null,"work_id":"011c1351-bfa9-43bc-95ef-a2267f6b827e","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.176805Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:037915f8a491c9611ba48359100232b339ea4a94e0eac8961acefe9b19f8c2b6","observation_id":"96dc4790-67af-47b5-8520-c34e922def86","resolution":{"observed_at":"2026-08-06T04:53:40.292168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:40.046300Z","title":"Improving cross-modal alignment for text- guided image inpainting,","venue":null,"work_id":"d10db253-5b7d-4ce8-8b02-95fe684d571d","year":2023},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.239263Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:046ccc56658102fb336e0fdc5eef47f4a82428b6b97067d2bce6d386fdd183b3","observation_id":"43505e43-816e-43cf-8d63-0c3a2c3d29f2","resolution":{"observed_at":"2026-08-06T04:53:40.111178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:39.900313Z","title":"Fine-grained distillation for long document retrieval,","venue":null,"work_id":"76d1123c-ebca-4422-b855-87a5972f70af","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.348068Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:d2202e8c0947c48d0baa43a6590cdc9af38e419cac7349d1562d6eec3989d506","observation_id":"2c8f32f5-25d1-4cb1-bf8d-433aa69b0d48","resolution":{"observed_at":"2026-08-06T04:53:39.975428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:36.418581Z","title":"Towards robust ranker for text retrieval,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.418581Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:ad64e331927759e9fa1d509a0fdd1adee9d5dd021a6c7cb760a44e528d20c02d","observation_id":"eaf2c7e2-1e71-43ef-b43e-d69726e675b8","resolution":{"observed_at":"2026-08-06T04:53:36.418581Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.03963","last_updated":"2024-06-14T03:42:17Z","snapshot_observed_at":"2026-07-06T14:02:32.637793Z","submitted_at":"2022-10-08T08:07:47Z","title":"SDA: Simple Discrete Augmentation for Contrastive Sentence Representation Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.03963","snapshot_observed_at":"2026-08-06T04:53:36.479833Z","title":"Sda: simple discrete augmentation for contrastive sentence representation learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.479833Z"},"links":{"cited_paper":"/paper/2210.03963","citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:d5e35b5be38fe37a18ebf51a7bb7bcdafa00481458309cc9e0ad6cf1c3481d11","observation_id":"157f1484-fb01-4970-b7fb-ebe9fd6d1c6c","resolution":{"observed_at":"2026-08-06T04:53:36.479833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:39.762683Z","title":"Improving zero-shot cross-lingual transfer for multilingual question answering over knowledge graph,","venue":null,"work_id":"3f8219b7-74f1-47d3-b471-46cfc33e8418","year":2021},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.567007Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:c51b03c90fa9ace142c5a5a388dfd3e6818f56c36107845ff130c0887fbcf948","observation_id":"2c442728-c6d9-4b40-b4ba-5f6ba05ec8d5","resolution":{"observed_at":"2026-08-06T04:53:39.805684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12432","last_updated":"2025-05-25T13:59:04Z","snapshot_observed_at":"2026-08-07T08:09:08.223198Z","submitted_at":"2025-01-21T16:49:08Z","title":"Divide-Then-Aggregate: An Efficient Tool Learning Method via Parallel Tool Invocation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12432","snapshot_observed_at":"2026-08-06T04:53:36.649064Z","title":"Divide-then-aggregate: An efficient tool learning method via parallel tool invocation,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.649064Z"},"links":{"cited_paper":"/paper/2501.12432","citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:eb4f08d812da8c22ccd90001fe14b0de2d21e460275fbe67a566955f3e67c4b4","observation_id":"15d4985d-36e9-49fe-b527-f69dcf189b0d","resolution":{"observed_at":"2026-08-06T04:53:36.649064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:39.605238Z","title":"Grounding multimodal large language models to the world,","venue":null,"work_id":"3c99afc7-64e6-4519-88da-a13c56a65f3a","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.730915Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:a655a6ef45218ddb7c830bfef27471ca6c687906f5d738037701378b152dc4b5","observation_id":"35d856bd-9541-4a29-a7be-9bec52a82681","resolution":{"observed_at":"2026-08-06T04:53:39.665546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:39.479497Z","title":"Minigpt-4: Enhancing vision-language understanding with advanced large language models,","venue":null,"work_id":"3d1f8e3f-ecc2-4263-a4de-33772055505c","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.795493Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:198b3d72432756746154a4b920114c0d562ebc94c3805e85b67304339f7b7d4c","observation_id":"d25c2a3b-aec9-4e7a-8f5d-ce7211e50d19","resolution":{"observed_at":"2026-08-06T04:53:39.527048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:39.265414Z","title":"Personalizing multimodal large language models for image captioning: An experimental analysis,","venue":null,"work_id":"d00df759-0332-402e-b09b-67d532d4a240","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.863690Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:1348120d5e5611741d238a5d0cb97b7c061ce737599da6cc0077a84b180bc0a4","observation_id":"2c0cf87d-4925-469f-8c93-220b39786aeb","resolution":{"observed_at":"2026-08-06T04:53:39.374295Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:39.136038Z","title":"Prompting AI art: An investigation into the creative skill of prompt engineering,","venue":null,"work_id":"750b550f-495c-425a-9129-5d7078b5c079","year":2023},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:36.947563Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:faa4aea7300b6531f401cff3e589158802436a32dbc04c0cd11d0109c42a6786","observation_id":"0a4e951c-3083-40e4-b0ed-14cf3a463498","resolution":{"observed_at":"2026-08-06T04:53:39.194005Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:38.959425Z","title":"Crafting effective prompts: A guideline for successful image generation,","venue":null,"work_id":"6ab7a216-5aef-45df-bbb4-b33d06b12ced","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.001337Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:ddfb5c13671dc4269938d5528f50f00b24d5ccb57e4678690b5797287b028253","observation_id":"5be41d56-15ec-4a8e-8b71-ebdecd01334d","resolution":{"observed_at":"2026-08-06T04:53:39.051718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:38.787989Z","title":"Prompt engineering for chatgpt: a quick guide to techniques, tips, and best practices,","venue":null,"work_id":"b02e3035-deb5-4bff-8fac-fa06735e4469","year":2023},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.090897Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:0265fa5ab5aa9a78d6d52fcd8053457e602c8da2022a32865d9a3309ad59ce08","observation_id":"4da03b30-da04-492c-92d0-56dafddc885c","resolution":{"observed_at":"2026-08-06T04:53:38.862316Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:38.647269Z","title":"Automatic generation of multimedia teaching materials based on generative AI: taking tang poetry as an example,","venue":null,"work_id":"1d617ba0-a724-4301-adfd-22f0823bd071","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.162301Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:4d982e558839ad116d05de0c841e43b6af8696834967597a4acf9fe56cd7679c","observation_id":"b0f82731-b673-48d1-8076-3bd13711f884","resolution":{"observed_at":"2026-08-06T04:53:38.707168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:38.464066Z","title":"STAR: boosting low-resource information extraction by structure-to- text data generation with large language models,","venue":null,"work_id":"7547def1-da9c-4394-9a47-3ad50310991c","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.260659Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:73029605d77a1a0e6d20dcf5a12765f8bafdffe2acc858de2205d8928969566d","observation_id":"4b7686c2-fd57-44f0-8a0c-fdeda47ec520","resolution":{"observed_at":"2026-08-06T04:53:38.527884Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:38.262005Z","title":"Knowgpt: Knowledge graph based prompting for large language models,","venue":null,"work_id":"a7c2f499-9d14-4022-8119-860cf6af7b93","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.342722Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:c606b97a516fbe30e3f2ba57a717892d540bae7f2b7db8923f95a9765a2510c9","observation_id":"501bffed-3bc6-43bb-b02f-37ee09846a26","resolution":{"observed_at":"2026-08-06T04:53:38.353597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:38.052178Z","title":"Prompt-based length controlled generation with multiple control types,","venue":null,"work_id":"268ae5d0-18ab-45b9-8609-4592d8580b15","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.436839Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:791ede82d0b9ccc5d159de6070c3e005247240ceca131621f1eeedb6dae3e236","observation_id":"12028a21-3dbe-4017-930c-a6ebd22d8b7f","resolution":{"observed_at":"2026-08-06T04:53:38.120165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:37.522270Z","title":"Weak to strong generalization for large language models with multi-capabilities,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.522270Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:bf3dc429c378ca0320047d9e3eb6c67f628117bd3eae2c33b7b2efea938bba67","observation_id":"60015dd5-5ff8-4881-a4a5-363548c3badb","resolution":{"observed_at":"2026-08-06T04:53:37.522270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:37.858961Z","title":"Prompting creativity: Tiered approach to copyright protection for ai-generated content in the digital age,","venue":null,"work_id":"0234f0d2-fa18-47fe-843c-595692985b05","year":2025},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:37.628619Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:68af820682569d0dad0d969193fdc86e8033b1b5b0be85e928ee19aacc297081","observation_id":"22b31d61-1b61-4853-ae7a-8350d205eb85","resolution":{"observed_at":"2026-08-06T04:53:37.911106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T04:53:41.154821Z","title":"5971–5984","venue":null,"work_id":"30cc2342-9694-42dc-bfcf-bdd40e65548b","year":2024},"citing_paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T04:53:35.584616Z"},"links":{"citing_paper":"/paper/2508.02890"},"observation_digest":"sha256:8caf3779c33d405b0dfef359b5d4627d20eb9b998e840c6e623e1d050713e2c0","observation_id":"1ba425d5-e40a-462b-99a1-f7f7ed80204e","resolution":{"observed_at":"2026-08-06T04:53:41.232114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.02890","last_updated":"2025-08-04T20:36:55Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T04:53:34.239796Z","submitted_at":"2025-08-04T20:36:55Z","title":"VisuCraft: Enhancing Large Vision-Language Models for Complex Visual-Guided Creative Content Generation via Structured Information Extraction"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":23},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2508.02890."}