Onderzoek Unconfirmed

PHITSBench: Benchmark voor AI-ondersteunde stralingstransportinvoer

Gepubliceerd 14 July 2026

AI-samenvatting, gecontroleerd door de redactie.

PHITSBench is een nieuwe benchmark voor het Monte Carlo Particle and Heavy Ion Transport code System (PHITS), bestaande uit 282 taken die zijn ingedeeld in parameterbewerking, syntaxisherstel en simulatiegeneratie vanuit natuurlijke taal. De evaluatie toont aan dat zonder specifieke domeinkennis het model goed presteert op bewerking en herstel, maar niet in staat is om correcte simulaties te genereren. Met een gestructureerde kenniscatalogus stijgt het succespercentage voor simulaties tot 57%. Verdere verbeteringen zijn mogelijk met agentische uitvoering, maar dit gaat gepaard met hogere computerkosten. De resultaten benadrukken het belang van machine-leesbare kennis en goed samengestelde trainingsdatasets voor de vooruitgang in AI-ondersteunde stralingsmodellering.

Betrouwbaarheid
70
Relevantie
80
Impact
75
Urgentie
50

Oorspronkelijke bronnen (1)

Deze pagina toont geen volledige brontekst - lees het origineel voor de volledige context.

  • Primaire bron PHITSBench: an execution-scored benchmark for AI-assisted PHITS radiation-transport input generation using natural language
    arXiv - cs.AI (testbron) · 14-07-2026 · ResearchPublication
    Lees origineel