model-evaluation
| Topic | Replies | Views | Activity | |
|---|---|---|---|---|
| Prompt tester/evaluater/experimenter app |
|
0 | 13 | September 11, 2026 |
| Eval-relevant failure mode: surface-anchor tracking under pre-answer constraints |
|
0 | 47 | May 22, 2026 |
| AI Studio Confusion: Model Loops on Self-Comparison During Code Augmentation Evaluation |
|
3 | 241 | June 23, 2025 |