{"about":{"non_affiliation":"Code with Papers and Syntology are not affiliated with, endorsed by, or sponsored by Papers with Code, Meta, or the pwc-archive mirror.","site":"https://codewithpapers.app","licence":"CC BY-SA 4.0","licence_url":"https://creativecommons.org/licenses/by-sa/4.0/legalcode","attribution":"https://codewithpapers.app/attribution","modified":"archive material modified by Syntology; see the attribution page","syntology":{"site":"https://syntology.ai","developers":"https://syntology.ai/developers","mcp":{"server":"https://syntology.ai/mcp","transport":"streamable-http","server_card":"https://syntology.ai/.well-known/mcp/server-card.json","auth":{"type":"trial token, no account","trial_token":"https://syntology.ai/api/oauth/trial/token","method":"POST","docs":"https://syntology.ai/developers"}},"have":"https://syntology.ai/api/graph/have?x=<method, arXiv id or title> (free, answers coverage only)","paper_base":"https://syntology.ai/paper/","atlas_base":"https://app.syntology.ai/?focus="},"machine_readable":[{"url":"https://codewithpapers.app/llms.txt","what":"the machine catalog: every machine-readable file, counted"},{"url":"https://codewithpapers.app/index/manifest.json","what":"paper-to-code index by arXiv id, with Syntology's counts"},{"url":"https://codewithpapers.app/search/manifest.json","what":"site search index (titles, authors) and its files"},{"url":"https://codewithpapers.app/download","what":"bulk files: Syntology's layer, described there"},{"url":"https://codewithpapers.app/build_manifest.json","what":"the build record: inputs, counts, exclusions, probes"}]},"url":"/task/semantic-textual-similarity/papers/9","list_of":"/task/semantic-textual-similarity","task":"Semantic Textual Similarity","archive":{"snapshot":"2025-07-28"},"key_notes":{"n_ran_checked":"legacy name, kept unchanged so existing readers do not break: it counts the samples that ran with no instrument failure (honoured, violated, and ran with no contract checked); it does not mean a contract was checked, and the pages print it as 'K with no instrument failure', not 'K checked'","n_constructed":"a sub-count of the samples that ran, never subtracted from them and never a failure: an executed sample whose run returned an instance of its own class (fixture_out_type equals the entry name): the run built an object and did not compute a result (Syntology's RAN record, counts.constructed)"},"syntology_read_at":"2026-09-28T10:30:06+00:00","order":"archive","order_definition":"repositories listed in the archive (most first), then date (newest first), then slug","page":9,"pages_in_order":24,"rows_per_page":100,"rows":[801,900],"of":2381,"counts":{"archive_papers_tagged":2381,"with_a_code_link":693,"where_syntology_ran_a_sample":144,"not_listed_spam_title":0,"listed":2381,"listed_where_code_ran":144,"where_syntology_ran_a_sample_split":{"with_a_run_with_no_instrument_failure":118,"every_run_a_failure_of_syntologys_instrument":26,"listed_with_a_run_with_no_instrument_failure":118,"listed_every_run_a_failure_of_syntologys_instrument":26,"filter":{"states":["a run with no instrument failure","any run, instrument failures included"],"default":"a run with no instrument failure","note":"on the 'only where code ran' pages the default hides, in the browser, the rows where every run was a failure of Syntology's instrument; the second state shows them again. Rows are hidden, never re-ordered; these twins list every row"}},"definition":"distinct papers the archive tags; 'where Syntology ran a sample' counts papers with at least one harvested sample that ran, which is not a correctness claim"},"first_page":"/task/semantic-textual-similarity","prev":"/task/semantic-textual-similarity/papers/8","next":"/task/semantic-textual-similarity/papers/10","papers":[{"url":null,"slug":"reverse-probing-evaluating-knowledge-transfer","title":"Reverse Probing: Evaluating Knowledge Transfer via Finetuned Task Embeddings for Coreference Resolution","date":"2025-01-31","arxiv_id":"2501.19316","repositories_listed":0,"syntology":null},{"url":null,"slug":"transformer-semantic-genetic-programming-for","title":"Transformer Semantic Genetic Programming for Symbolic Regression","date":"2025-01-30","arxiv_id":"2501.18479","repositories_listed":0,"syntology":null},{"url":null,"slug":"feedback-aware-monte-carlo-tree-search-for","title":"Feedback-Aware Monte Carlo Tree Search for Efficient Information Seeking in Goal-Oriented Conversations","date":"2025-01-25","arxiv_id":"2501.15056","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-comprehensive-framework-for-semantic","title":"A Comprehensive Framework for Semantic Similarity Analysis of Human and AI-Generated Text Using Transformer Architectures and Ensemble Techniques","date":"2025-01-24","arxiv_id":"2501.14288","repositories_listed":0,"syntology":null},{"url":null,"slug":"recommending-actionable-strategies-a-semantic","title":"Recommending Actionable Strategies: A Semantic Approach to Integrating Analytical Frameworks with Decision Heuristics","date":"2025-01-24","arxiv_id":"2501.14634","repositories_listed":0,"syntology":null},{"url":null,"slug":"2-tier-simcse-elevating-bert-for-robust","title":"2-Tier SimCSE: Elevating BERT for Robust Sentence Embeddings","date":"2025-01-23","arxiv_id":"2501.13758","repositories_listed":0,"syntology":null},{"url":null,"slug":"sequence-spreading-based-semantic","title":"Sequence Spreading-Based Semantic Communication Under High RF Interference","date":"2025-01-21","arxiv_id":"2501.12502","repositories_listed":0,"syntology":null},{"url":null,"slug":"legalguardian-a-privacy-preserving-framework","title":"LegalGuardian: A Privacy-Preserving Framework for Secure Integration of Large Language Models in Legal Practice","date":"2025-01-19","arxiv_id":"2501.10915","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-genai-for-simplifying-texts-for","title":"Evaluating GenAI for Simplifying Texts for Education: Improving Accuracy and Consistency for Enhanced Readability","date":"2025-01-15","arxiv_id":"2501.09158","repositories_listed":0,"syntology":null},{"url":null,"slug":"consistency-of-responses-and-continuations","title":"Consistency of Responses and Continuations Generated by Large Language Models on Social Media","date":"2025-01-14","arxiv_id":"2501.08102","repositories_listed":0,"syntology":null},{"url":null,"slug":"contextual-asr-error-handling-with-llms","title":"Contextual ASR Error Handling with LLMs Augmentation for Goal-Oriented Conversational AI","date":"2025-01-10","arxiv_id":"2501.06129","repositories_listed":0,"syntology":null},{"url":null,"slug":"gear-generation-augmented-retrieval","title":"GeAR: Generation Augmented Retrieval","date":"2025-01-06","arxiv_id":"2501.02772","repositories_listed":0,"syntology":null},{"url":null,"slug":"universal-features-guided-zero-shot-category","title":"Universal Features Guided Zero-Shot Category-Level Object Pose Estimation","date":"2025-01-06","arxiv_id":"2501.02831","repositories_listed":0,"syntology":null},{"url":null,"slug":"protclip-function-informed-protein-multi","title":"ProtCLIP: Function-Informed Protein Multi-Modal Learning","date":"2024-12-28","arxiv_id":"2412.20014","repositories_listed":0,"syntology":null},{"url":null,"slug":"multiple-references-with-meaningful","title":"Multiple References with Meaningful Variations Improve Literary Machine Translation","date":"2024-12-24","arxiv_id":"2412.18707","repositories_listed":0,"syntology":null},{"url":null,"slug":"hashattention-semantic-sparsity-for-faster","title":"HashAttention: Semantic Sparsity for Faster Inference","date":"2024-12-19","arxiv_id":"2412.14468","repositories_listed":0,"syntology":null},{"url":null,"slug":"token-prepending-a-training-free-approach-for","title":"Token Prepending: A Training-Free Approach for Eliciting Better Sentence Embeddings from LLMs","date":"2024-12-16","arxiv_id":"2412.11556","repositories_listed":0,"syntology":null},{"url":null,"slug":"jina-clip-v2-multilingual-multimodal","title":"jina-clip-v2: Multilingual Multimodal Embeddings for Text and Images","date":"2024-12-11","arxiv_id":"2412.08802","repositories_listed":0,"syntology":null},{"url":null,"slug":"generating-knowledge-graphs-from-large","title":"Generating Knowledge Graphs from Large Language Models: A Comparative Study of GPT-4, LLaMA 2, and BERT","date":"2024-12-10","arxiv_id":"2412.07412","repositories_listed":0,"syntology":null},{"url":"/paper/sirerag-indexing-similar-and-related","slug":"sirerag-indexing-similar-and-related","title":"SiReRAG: Indexing Similar and Related Information for Multihop Reasoning","date":"2024-12-09","arxiv_id":"2412.06206","repositories_listed":0,"syntology":{"n":5,"n_ran":5,"n_constructed":0,"n_ran_checked":3,"n_instrument":2,"n_unverified":0,"n_honours":1,"n_violates":1,"n_no_contract":1,"n_pointer_only":5,"phrase":"5 ran (of which 0 constructed an object rather than computing a result; 3 with no instrument failure: 1 honoured, 1 violated, 1 with no contract checked; 2 where Syntology's instrument failed) · 0 unverified","sample_list":"/paper/sirerag-indexing-similar-and-related#ran","syntology_url":"https://syntology.ai/paper/2412.06206","mcp":{"get_harvested_code_for_paper":{"arxiv_id":"2412.06206"}},"official":null}},{"url":null,"slug":"detecting-redundant-health-survey-questions","title":"Detecting Redundant Health Survey Questions Using Language-agnostic BERT Sentence Embedding (LaBSE)","date":"2024-12-05","arxiv_id":"2412.03817","repositories_listed":0,"syntology":null},{"url":null,"slug":"human-variability-vs-machine-consistency-a","title":"Human Variability vs. Machine Consistency: A Linguistic Analysis of Texts Generated by Humans and Large Language Models","date":"2024-12-04","arxiv_id":"2412.03025","repositories_listed":0,"syntology":null},{"url":null,"slug":"vidhalluc-evaluating-temporal-hallucinations","title":"VidHalluc: Evaluating Temporal Hallucinations in Multimodal Large Language Models for Video Understanding","date":"2024-12-04","arxiv_id":"2412.03735","repositories_listed":0,"syntology":null},{"url":null,"slug":"interpretable-company-similarity-with-sparse","title":"Interpretable Company Similarity with Sparse Autoencoders","date":"2024-12-03","arxiv_id":"2412.02605","repositories_listed":0,"syntology":null},{"url":null,"slug":"quantifying-perturbation-impacts-for-large","title":"Quantifying perturbation impacts for large language models","date":"2024-12-01","arxiv_id":"2412.00868","repositories_listed":0,"syntology":null},{"url":null,"slug":"generative-semantic-communication-for-joint","title":"Generative Semantic Communication for Joint Image Transmission and Segmentation","date":"2024-11-27","arxiv_id":"2411.18005","repositories_listed":0,"syntology":null},{"url":null,"slug":"isolating-authorship-from-content-with","title":"Isolating authorship from content with semantic embeddings and contrastive learning","date":"2024-11-27","arxiv_id":"2411.18472","repositories_listed":0,"syntology":null},{"url":null,"slug":"in-context-experience-replay-facilitates","title":"In-Context Experience Replay Facilitates Safety Red-Teaming of Text-to-Image Diffusion Models","date":"2024-11-25","arxiv_id":"2411.16769","repositories_listed":0,"syntology":null},{"url":null,"slug":"banglaembed-efficient-sentence-embedding","title":"BanglaEmbed: Efficient Sentence Embedding Models for a Low-Resource Language Using Cross-Lingual Distillation Techniques","date":"2024-11-22","arxiv_id":"2411.15270","repositories_listed":0,"syntology":null},{"url":null,"slug":"fast-splat-fast-ambiguity-free-semantics","title":"FAST-Splat: Fast, Ambiguity-Free Semantics Transfer in Gaussian Splatting","date":"2024-11-20","arxiv_id":"2411.13753","repositories_listed":0,"syntology":null},{"url":null,"slug":"advancing-large-language-models-for","title":"Advancing Large Language Models for Spatiotemporal and Semantic Association Mining of Similar Environmental Events","date":"2024-11-19","arxiv_id":"2411.12880","repositories_listed":0,"syntology":null},{"url":null,"slug":"hncse-advancing-sentence-embeddings-via","title":"HNCSE: Advancing Sentence Embeddings via Hybrid Contrastive Learning with Hard Negatives","date":"2024-11-19","arxiv_id":"2411.12156","repositories_listed":0,"syntology":null},{"url":null,"slug":"membership-inference-attack-against-long","title":"Membership Inference Attack against Long-Context Large Language Models","date":"2024-11-18","arxiv_id":"2411.11424","repositories_listed":0,"syntology":null},{"url":null,"slug":"everyone-deserves-their-voice-to-be-heard","title":"Everyone deserves their voice to be heard: Analyzing Predictive Gender Bias in ASR Models Applied to Dutch Speech Data","date":"2024-11-14","arxiv_id":"2411.09431","repositories_listed":0,"syntology":null},{"url":null,"slug":"gase-generatively-augmented-sentence-encoding","title":"GASE: Generatively Augmented Sentence Encoding","date":"2024-11-07","arxiv_id":"2411.04914","repositories_listed":0,"syntology":null},{"url":null,"slug":"leveraging-llms-to-enable-natural-language","title":"Leveraging LLMs to Enable Natural Language Search on Go-to-market Platforms","date":"2024-11-07","arxiv_id":"2411.05048","repositories_listed":0,"syntology":null},{"url":null,"slug":"securing-from-unseen-connected-pattern","title":"Securing from Unseen: Connected Pattern Kernels (CoPaK) for Zero-Day Intrusion Detection","date":"2024-11-07","arxiv_id":null,"repositories_listed":0,"syntology":null},{"url":null,"slug":"a-comparative-study-of-recent-large-language","title":"A Comparative Study of Recent Large Language Models on Generating Hospital Discharge Summaries for Lung Cancer Patients","date":"2024-11-06","arxiv_id":"2411.03805","repositories_listed":0,"syntology":null},{"url":null,"slug":"fine-grained-guidance-for-retrievers","title":"Fine-Grained Guidance for Retrievers: Leveraging LLMs' Feedback in Retrieval-Augmented Generation","date":"2024-11-06","arxiv_id":"2411.03957","repositories_listed":0,"syntology":null},{"url":null,"slug":"ragulator-lightweight-out-of-context","title":"RAGulator: Lightweight Out-of-Context Detectors for Grounded Text Generation","date":"2024-11-06","arxiv_id":"2411.03920","repositories_listed":0,"syntology":null},{"url":null,"slug":"nlp-and-education-using-semantic-similarity","title":"NLP and Education: using semantic similarity to evaluate filled gaps in a large-scale Cloze test in the classroom","date":"2024-11-02","arxiv_id":"2411.01280","repositories_listed":0,"syntology":null},{"url":null,"slug":"feddtpt-federated-discrete-and-transferable","title":"FedDTPT: Federated Discrete and Transferable Prompt Tuning for Black-Box Large Language Models","date":"2024-11-01","arxiv_id":"2411.00985","repositories_listed":0,"syntology":null},{"url":null,"slug":"ef-llm-energy-forecasting-llm-with-ai","title":"EF-LLM: Energy Forecasting LLM with AI-assisted Automation, Enhanced Sparse Prediction, Hallucination Detection","date":"2024-10-30","arxiv_id":"2411.00852","repositories_listed":0,"syntology":null},{"url":null,"slug":"exploiting-phonological-similarities-between","title":"Phonology-Guided Speech-to-Speech Translation for African Languages","date":"2024-10-30","arxiv_id":"2410.23323","repositories_listed":0,"syntology":null},{"url":null,"slug":"conjuring-semantic-similarity","title":"Conjuring Semantic Similarity","date":"2024-10-21","arxiv_id":"2410.16431","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-general-text-embedding-model","title":"Improving General Text Embedding Model: Tackling Task Conflict and Data Imbalance through Model Merging","date":"2024-10-19","arxiv_id":"2410.15035","repositories_listed":0,"syntology":null},{"url":null,"slug":"few-shot-joint-multimodal-entity-relation","title":"Few-Shot Joint Multimodal Entity-Relation Extraction via Knowledge-Enhanced Cross-modal Prompt Model","date":"2024-10-18","arxiv_id":"2410.14225","repositories_listed":0,"syntology":null},{"url":null,"slug":"optimizing-retrieval-augmented-generation","title":"Optimizing Retrieval-Augmented Generation with Elasticsearch for Enhanced Question-Answering Systems","date":"2024-10-18","arxiv_id":"2410.14167","repositories_listed":0,"syntology":null},{"url":null,"slug":"semsim-revisiting-weak-to-strong-consistency","title":"SemSim: Revisiting Weak-to-Strong Consistency from a Semantic Similarity Perspective for Semi-supervised Medical Image Segmentation","date":"2024-10-17","arxiv_id":"2410.13486","repositories_listed":0,"syntology":null},{"url":null,"slug":"promptexp-multi-granularity-prompt","title":"PromptExp: Multi-granularity Prompt Explanation of Large Language Models","date":"2024-10-16","arxiv_id":"2410.13073","repositories_listed":0,"syntology":null},{"url":null,"slug":"back-of-the-book-index-automation-for-arabic","title":"Back-of-the-Book Index Automation for Arabic Documents","date":"2024-10-14","arxiv_id":"2410.10286","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-legal-entity-recognition-using-a","title":"Improving Legal Entity Recognition Using a Hybrid Transformer Model and Semantic Filtering Approach","date":"2024-10-11","arxiv_id":"2410.08521","repositories_listed":0,"syntology":null},{"url":null,"slug":"vlm2vec-training-vision-language-models-for","title":"VLM2Vec: Training Vision-Language Models for Massive Multimodal Embedding Tasks","date":"2024-10-07","arxiv_id":"2410.05160","repositories_listed":0,"syntology":null},{"url":null,"slug":"suspiciousness-of-adversarial-texts-to-human","title":"Graded Suspiciousness of Adversarial Texts to Human","date":"2024-10-06","arxiv_id":"2410.04377","repositories_listed":0,"syntology":null},{"url":null,"slug":"metadata-based-data-exploration-with","title":"Metadata-based Data Exploration with Retrieval-Augmented Generation for Large Language Models","date":"2024-10-05","arxiv_id":"2410.04231","repositories_listed":0,"syntology":null},{"url":null,"slug":"evaluating-deduplication-techniques-for","title":"Evaluating Deduplication Techniques for Economic Research Paper Titles with a Focus on Semantic Similarity using NLP and LLMs","date":"2024-10-02","arxiv_id":"2410.01141","repositories_listed":0,"syntology":null},{"url":null,"slug":"uniadapt-a-universal-adapter-for-knowledge","title":"UniAdapt: A Universal Adapter for Knowledge Calibration","date":"2024-10-01","arxiv_id":"2410.00454","repositories_listed":0,"syntology":null},{"url":null,"slug":"semantic-driven-topic-modeling-using","title":"Semantic-Driven Topic Modeling Using Transformer-Based Embeddings and Clustering Algorithms","date":"2024-09-30","arxiv_id":"2410.00134","repositories_listed":0,"syntology":null},{"url":null,"slug":"t3-a-novel-zero-shot-transfer-learning","title":"T3: A Novel Zero-shot Transfer Learning Framework Iteratively Training on an Assistant Task for a Target Task","date":"2024-09-26","arxiv_id":"2409.17640","repositories_listed":0,"syntology":null},{"url":"/paper/exploring-semantic-clustering-in-deep","slug":"exploring-semantic-clustering-in-deep","title":"Exploring Semantic Clustering in Deep Reinforcement Learning for Video Games","date":"2024-09-25","arxiv_id":"2409.17411","repositories_listed":0,"syntology":{"n":17,"n_ran":9,"n_constructed":6,"n_ran_checked":7,"n_instrument":2,"n_unverified":8,"n_honours":0,"n_violates":1,"n_no_contract":6,"n_pointer_only":0,"phrase":"9 ran (of which 6 constructed an object rather than computing a result; 7 with no instrument failure: 0 honoured, 1 violated, 6 with no contract checked; 2 where Syntology's instrument failed) · 8 unverified","sample_list":"/paper/exploring-semantic-clustering-in-deep#ran","syntology_url":"https://syntology.ai/paper/2409.17411","mcp":{"get_harvested_code_for_paper":{"arxiv_id":"2409.17411"}},"official":null}},{"url":null,"slug":"unveiling-ontological-commitment-in-multi","title":"Unveiling Ontological Commitment in Multi-Modal Foundation Models","date":"2024-09-25","arxiv_id":"2409.17109","repositories_listed":0,"syntology":null},{"url":null,"slug":"brotherhood-at-wmt-2024-leveraging-llm","title":"Brotherhood at WMT 2024: Leveraging LLM-Generated Contextual Conversations for Cross-Lingual Image Captioning","date":"2024-09-23","arxiv_id":"2409.15052","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-to-localize-actions-in-instructional","title":"Learning to Localize Actions in Instructional Videos with LLM-Based Multi-Pathway Text-Video Alignment","date":"2024-09-22","arxiv_id":"2409.16145","repositories_listed":0,"syntology":null},{"url":null,"slug":"2409-14168","title":"Towards Building Efficient Sentence BERT Models using Layer Pruning","date":"2024-09-21","arxiv_id":"2409.14168","repositories_listed":0,"syntology":null},{"url":null,"slug":"towards-automated-patent-workflows-ai","title":"Towards Automated Patent Workflows: AI-Orchestrated Multi-Agent Framework for Intellectual Property Management and Analysis","date":"2024-09-21","arxiv_id":"2409.19006","repositories_listed":0,"syntology":null},{"url":null,"slug":"knowledge-based-domain-oriented-data","title":"Enhancing Unsupervised Sentence Embeddings via Knowledge-Driven Data Augmentation and Gaussian-Decayed Contrastive Learning","date":"2024-09-19","arxiv_id":"2409.12887","repositories_listed":0,"syntology":null},{"url":null,"slug":"prompt-obfuscation-for-large-language-models","title":"Prompt Obfuscation for Large Language Models","date":"2024-09-17","arxiv_id":"2409.11026","repositories_listed":0,"syntology":null},{"url":null,"slug":"cross-lingual-news-event-correlation-for","title":"Cross-Lingual News Event Correlation for Stock Market Trend Prediction","date":"2024-09-16","arxiv_id":"2410.00024","repositories_listed":0,"syntology":null},{"url":null,"slug":"an-unsupervised-dialogue-topic-segmentation","title":"An Unsupervised Dialogue Topic Segmentation Model Based on Utterance Rewriting","date":"2024-09-12","arxiv_id":"2409.07672","repositories_listed":0,"syntology":null},{"url":null,"slug":"ethereum-fraud-detection-via-joint","title":"Ethereum Fraud Detection via Joint Transaction Language Model and Graph Representation Learning","date":"2024-09-09","arxiv_id":"2409.07494","repositories_listed":0,"syntology":null},{"url":null,"slug":"languashrink-reducing-token-overhead-with","title":"LanguaShrink: Reducing Token Overhead with Psycholinguistics","date":"2024-09-01","arxiv_id":"2409.00855","repositories_listed":0,"syntology":null},{"url":null,"slug":"gmfl-net-a-global-multi-geometric-feature","title":"GMFL-Net: A Global Multi-geometric Feature Learning Network for Repetitive Action Counting","date":"2024-08-31","arxiv_id":"2409.00330","repositories_listed":0,"syntology":null},{"url":null,"slug":"contrastive-learning-subspace-for-text","title":"Contrastive Learning Subspace for Text Clustering","date":"2024-08-26","arxiv_id":"2408.14119","repositories_listed":0,"syntology":null},{"url":null,"slug":"rt-attack-jailbreaking-text-to-image-models","title":"HTS-Attack: Heuristic Token Search for Jailbreaking Text-to-Image Models","date":"2024-08-25","arxiv_id":"2408.13896","repositories_listed":0,"syntology":null},{"url":null,"slug":"the-russian-focused-embedders-exploration","title":"The Russian-focused embedders' exploration: ruMTEB benchmark and Russian embedding model design","date":"2024-08-22","arxiv_id":"2408.12503","repositories_listed":0,"syntology":null},{"url":null,"slug":"improving-embedding-with-contrastive-fine","title":"Improving embedding with contrastive fine-tuning on small datasets with expert-augmented scores","date":"2024-08-19","arxiv_id":"2408.11868","repositories_listed":0,"syntology":null},{"url":null,"slug":"extracting-sentence-embeddings-from","title":"Extracting Sentence Embeddings from Pretrained Transformer Models","date":"2024-08-15","arxiv_id":"2408.08073","repositories_listed":0,"syntology":null},{"url":null,"slug":"kgv-integrating-large-language-models-with","title":"KGV: Integrating Large Language Models with Knowledge Graphs for Cyber Threat Intelligence Credibility Assessment","date":"2024-08-15","arxiv_id":"2408.08088","repositories_listed":0,"syntology":null},{"url":null,"slug":"2408-01928","title":"A Semi-supervised Multi-channel Graph Convolutional Network for Query Classification in E-commerce","date":"2024-08-04","arxiv_id":"2408.01928","repositories_listed":0,"syntology":null},{"url":null,"slug":"ontological-relations-from-word-embeddings","title":"Ontological Relations from Word Embeddings","date":"2024-08-01","arxiv_id":"2408.00444","repositories_listed":0,"syntology":null},{"url":null,"slug":"2407-21139","title":"Enhancing Semantic Similarity Understanding in Arabic NLP with Nested Embedding Learning","date":"2024-07-30","arxiv_id":"2407.21139","repositories_listed":0,"syntology":null},{"url":null,"slug":"2407-21073","title":"Enhancing Adversarial Text Attacks on BERT Models with Projected Gradient Descent","date":"2024-07-29","arxiv_id":"2407.21073","repositories_listed":0,"syntology":null},{"url":null,"slug":"enhancing-taobao-display-advertising-with","title":"Enhancing Taobao Display Advertising with Multimodal Representations: Challenges, Approaches and Insights","date":"2024-07-28","arxiv_id":"2407.19467","repositories_listed":0,"syntology":null},{"url":null,"slug":"farssibert-a-novel-transformer-based-model","title":"FarSSiBERT: A Novel Transformer-based Model for Semantic Similarity Measurement of Persian Social Networks Informal Texts","date":"2024-07-27","arxiv_id":"2407.19173","repositories_listed":0,"syntology":null},{"url":null,"slug":"learning-robust-named-entity-recognizers-from","title":"Learning Robust Named Entity Recognizers From Noisy Data With Retrieval Augmentation","date":"2024-07-26","arxiv_id":"2407.18562","repositories_listed":0,"syntology":null},{"url":null,"slug":"neusemslice-towards-effective-dnn-model","title":"NeuSemSlice: Towards Effective DNN Model Maintenance via Neuron-level Semantic Slicing","date":"2024-07-26","arxiv_id":"2407.20281","repositories_listed":0,"syntology":null},{"url":null,"slug":"automatic-real-word-error-correction-in","title":"Automatic Real-word Error Correction in Persian Text","date":"2024-07-20","arxiv_id":"2407.14795","repositories_listed":0,"syntology":null},{"url":null,"slug":"berter-the-efficient-one","title":"BERTer: The Efficient One","date":"2024-07-19","arxiv_id":"2407.14039","repositories_listed":0,"syntology":null},{"url":null,"slug":"check-eval-a-checklist-based-approach-for","title":"Check-Eval: A Checklist-based Approach for Evaluating Text Quality","date":"2024-07-19","arxiv_id":"2407.14467","repositories_listed":0,"syntology":null},{"url":null,"slug":"is-contrasting-all-you-need-contrastive","title":"Is Contrasting All You Need? Contrastive Learning for the Detection and Attribution of AI-generated Text","date":"2024-07-12","arxiv_id":"2407.09364","repositories_listed":0,"syntology":null},{"url":null,"slug":"label-anticipated-event-disentanglement-for","title":"Label-anticipated Event Disentanglement for Audio-Visual Video Parsing","date":"2024-07-11","arxiv_id":"2407.08126","repositories_listed":0,"syntology":null},{"url":null,"slug":"uncovering-semantics-and-topics-utilized-by","title":"Uncovering Semantics and Topics Utilized by Threat Actors to Deliver Malicious Attachments and URLs","date":"2024-07-11","arxiv_id":"2407.08888","repositories_listed":0,"syntology":null},{"url":null,"slug":"hycir-boosting-zero-shot-composed-image","title":"HyCIR: Boosting Zero-Shot Composed Image Retrieval with Synthetic Labels","date":"2024-07-08","arxiv_id":"2407.05795","repositories_listed":0,"syntology":null},{"url":null,"slug":"jailbreakhunter-a-visual-analytics-approach","title":"JailbreakHunter: A Visual Analytics Approach for Jailbreak Prompts Discovery from Large-Scale Human-LLM Conversational Datasets","date":"2024-07-03","arxiv_id":"2407.03045","repositories_listed":0,"syntology":null},{"url":null,"slug":"how-to-learn-in-a-noisy-world-self-correcting","title":"How to Learn in a Noisy World? Self-Correcting the Real-World Data Noise on Machine Translation","date":"2024-07-02","arxiv_id":"2407.02208","repositories_listed":0,"syntology":null},{"url":null,"slug":"dynamic-few-shot-learning-for-knowledge-graph","title":"Dynamic Few-Shot Learning for Knowledge Graph Question Answering","date":"2024-07-01","arxiv_id":"2407.01409","repositories_listed":0,"syntology":null},{"url":null,"slug":"genderbias-emph-vl-benchmarking-gender-bias","title":"GenderBias-\\emph{VL}: Benchmarking Gender Bias in Vision Language Models via Counterfactual Probing","date":"2024-06-30","arxiv_id":"2407.00600","repositories_listed":0,"syntology":null},{"url":null,"slug":"protogmm-multi-prototype-gaussian-mixture","title":"ProtoGMM: Multi-prototype Gaussian-Mixture-based Domain Adaptation Model for Semantic Segmentation","date":"2024-06-27","arxiv_id":"2406.19225","repositories_listed":0,"syntology":null},{"url":null,"slug":"seeing-is-believing-black-box-membership","title":"Generating Is Believing: Membership Inference Attacks against Retrieval-Augmented Generation","date":"2024-06-27","arxiv_id":"2406.19234","repositories_listed":0,"syntology":null},{"url":null,"slug":"a-text-is-worth-several-tokens-text-embedding","title":"A Text is Worth Several Tokens: Text Embedding from LLMs Secretly Aligns Well with The Key Tokens","date":"2024-06-25","arxiv_id":"2406.17378","repositories_listed":0,"syntology":null}],"record_sha256":"f78d180971040dff812fd4420fef8318689678b790644c865ccd37308e31ff72","record_changed_at":"2026-09-28","record_changed_at_basis":"first_hashed"}