RAGの評価をいい感じにできるようにしたい

最近こんな記事を見かけました。 zenn.dev zenn.dev zenn.dev 自分もRAGとかちょろっと勉強してたりしてLLMアプリケーションの評価周りはずっと気になるところではあったので、上記の記事を見てちょっと勉強してみる気になりました。 せっかくなので、色々作りながら評価について自分で考えてみようかと思います。