alphaparkinc/genpark-pairwise-bradley-terry-reward-model-skill
Bradley-Terry preference model computing choice probabilities, binary cross-entropy loss, and reward gradient updates
GitHub repository with 7 stars and 0 forks.
Language: Python
Topics: agent-skills, alignment, bradley-terry, developer-tools, loss-calculator, machine-learning, mcp, preference-learning, python-standard-library, reward-modeling