Data Science и Machine LearningNLPLLM
Готовим следующую карточку…
СобеседованиеСредняя
Вопрос

Модель обучалась на последовательностях до 8 тысяч токенов, но на инференсе ей выставили контекстное окно 32 тысячи. Будет ли она надёжно использовать информацию из начала такого длинного промпта? Объясните, от чего зависит результат.

Смахните карточку влево, чтобы повысить рейтинг, или вправо, чтобы понизить.