Xích tư duy (tiếp tục)
Ngày nay, chúng ta có thể quan sát CoT có càng nhiều ứng dụng hơn như thế nào với cái gọi là các models
luận lí như o3-mini hay gemini-flash-thinking. Tới một chừng mực nhất định, các models này làm chính
xác điều tương tự (nhưng thường trong phong cách nâng cao hơn) – chúng nghĩ trước khi chúng trả lời,
và cái này được giành không chỉ bằng cách thay đổi prompt mà còn bằng cách chuẩn bị dữ liệu huấn luyện
(đôi khi là tổng hợp) cái đi theo một định dạng CoT.
Hãy chú ý rằng thay thế đối với sử dụng các mô hình luận lí, chúng ta có thể sử dụng điều chỉnh CoT
với các lệnh thêm bằng cách hỏi một LLM trước tiên khởi tạo các tokens đầu ra cái trình bày một quá
trình luận lí:
template = ChatPromptTemplate.from_messages([
(“system”, “””You are a problem-solving assistant that shows its
reasoning process. First, walk through your thought process step by step,
labeling this section as ‘THINKING:’. After completing your analysis,
provide your final answer labeled as ‘ANSWER:’.”””),
(“user”, “{problem}”)
])
