PulseExploreJournal ClubDebatesTrendingResearchersJournals
Instagram
HomeExploreJournal ClubTrending
Synapse
⌘+K
Synapse
August 26, 20250 citationsOpen Access

Code Generation in Unseen Robot Programming Languages using LLMs

View Full Paper
RARani Venkata Satya AnirudhBAB. AkshayARAdak Rajdeep

Key Points

  • Code generation achieved 88.5% Pass@1 for documentation-based retrieval, showing LLM potential in unseen languages.
  • Maximal Marginal Relevance enhanced retrieval relevance and reduced redundancy, contributing to better code generation outcomes.
  • Inadequate corpora in low-resource settings highlight the importance of using documentation effectively for code generation.
  • Advanced retrieval methods like Contextual Compression may unintentionally increase LLM bias towards popular languages like Python.

Abstract

While Large Language Models (LLMs) have demonstrated impressive code generation capabilities in widely used programming languages like Python, their effectiveness in domain specific languages (DSLs) introduced after their training cutoff remains limited. Specifically, code generation in unseen robot programming languages remains largely unexplored. Recent research has explored the use of in-context learning (ICL) combined with retrieval augmented generation (RAG) to bridge this gap, particularly for code generation in unseen languages. In low-resource settings, it is common to encounter an inadequate code corpus; in such scenarios documentation serves as a valuable resource. By dynamically balancing query relevance and reducing redundancy in retrieved demonstrations, we show that Maximal Marginal Relevance (MMR) based retrieval enables more contextually aligned and syntactically correct code generation, achieving 88.5% in Pass@1 for Documentation-based retrieval and 85.9% for Code-based retrieval on an unseen robot programming language. We also demonstrate how advanced retrieval strategies like Contextual Compression inadvertently amplify LLMs' inherent bias towards generating Python like code.

Ask AI
Helpful
Bookmark
Share
View Full Paper

Cite This Study

Anirudh et al. (2025) studied this question.

synapsesocial.com/papers/68af5f19ad7bf08b1eae23c4https://doi.org/10.36227/techrxiv.175616871.14339508/v1
Ask AI
Helpful
Bookmark
Share
View Full Paper

Also Consider

Synapse has enriched 5 closely related papers on similar clinical questions. Consider them for comparative context:

  1. 1Using large language models to generate and correct code written in low-resource and domain-specific programming languages2026 · 1 citations
  2. 2On the Effectiveness of Large Language Models in Domain-Specific Code Generation2024 · 49 citations
  3. 3Evaluating Large Language Models in Class-Level Code Generation2024 · 148 citations
  4. 4A Survey on Large Language Models for Code Generation2024 · 61 citations
  5. 5How Do Large Language Models Perform in Deep Learning Code Generation? An Empirical Study2026