fix reward trainer calls for tokenization

2025-01-07 15:41:40 -05:00
parent ec4dfb02c8
commit 74d98ca6d8
1 changed files with 2 additions and 2 deletions
--- a/src/axolotl/prompt_strategies/bradley_terry/chat_template.py
+++ b/src/axolotl/prompt_strategies/bradley_terry/chat_template.py
@@ -39,7 +39,7 @@ class BTChatTemplateStrategy(ChatTemplateStrategy):
            )
        prompt[self.messages].append({"role": "user", "content": prompt["input"]})
        prompt[self.messages].append({"role": "assistant", "content": prompt["chosen"]})
-        chosen_tokenized = super().tokenize_prompt(prompt)
+        chosen_tokenized = super()._tokenize_single_prompt(prompt)

        if len(chosen_tokenized["input_ids"]) > max_length:
            LOG.warning(
@@ -62,7 +62,7 @@ class BTChatTemplateStrategy(ChatTemplateStrategy):
        prompt[self.messages].append(
            {"role": "assistant", "content": prompt["rejected"]}
        )
-        rejected_tokenized = super().tokenize_prompt(prompt)
+        rejected_tokenized = super()._tokenize_single_prompt(prompt)

        if len(rejected_tokenized["input_ids"]) > max_length:
            LOG.warning(