В настоящее время я получаю несколько ответов, или модель не знает, когда завершить ответ, и, кажется, повторяет системное приглашение в ответе (?). Я просто хочу получить один ответ. Моя настройка очень проста, поэтому я предполагаю, что мне не хватает деталей реализации, но что я могу сделать, чтобы вернуть только один ответ?
from langchain_community.llms import Ollama
llm = Ollama(model="llama3")
def get_model_response(user_prompt, system_prompt):
prompt = f"""
system
{ system_prompt }
user
{ user_prompt }
assistant
"""
response = llm.invoke(prompt)
return response
Подробнее здесь: https://stackoverflow.com/questions/784 ... d-response