PHITSBench: Benchmark voor AI-ondersteunde stralingstransportinvoer
Gepubliceerd 14 July 2026
PHITSBench is een nieuwe benchmark voor het Monte Carlo Particle and Heavy Ion Transport code System (PHITS), bestaande uit 282 taken die zijn ingedeeld in parameterbewerking, syntaxisherstel en simulatiegeneratie vanuit natuurlijke taal. De evaluatie toont aan dat zonder specifieke domeinkennis het model goed presteert op bewerking en herstel, maar niet in staat is om correcte simulaties te genereren. Met een gestructureerde kenniscatalogus stijgt het succespercentage voor simulaties tot 57%. Verdere verbeteringen zijn mogelijk met agentische uitvoering, maar dit gaat gepaard met hogere computerkosten. De resultaten benadrukken het belang van machine-leesbare kennis en goed samengestelde trainingsdatasets voor de vooruitgang in AI-ondersteunde stralingsmodellering.
Oorspronkelijke bronnen (1)
Deze pagina toont geen volledige brontekst - lees het origineel voor de volledige context.
-
Primaire bron PHITSBench: an execution-scored benchmark for AI-assisted PHITS radiation-transport input generation using natural languageLees origineelarXiv - cs.AI (testbron) · 14-07-2026 · ResearchPublication