跳到正文
原文
Hugging Face Blog·· 2024-12-05AI 评分42

Keras 与 TPU 实验:LLM 修复代码错误的能力评估

How good are LLMs at fixing their mistakes? A chatbot arena experiment with Keras and TPUs

AI 导读

Hugging Face 利用 Keras、JAX 和 TPU v5e 搭建聊天机器人竞技场,测试 LLM 在收到反馈后修复代码错误的能力。该环境支持同时加载五个约 8B 参数和三个约 2B 参数的模型进行对比。实验旨在验证 LLM 能否通过简短的自然语言指令高效修正生成代码中的失误。

来源:Hugging Face Blog · huggingface.co