هاب پژوهشی
مقالات مرجع مسیر یادگیری، با خلاصهی ساختاریافته و گراف استنادی دوطرفه.
2 مقاله
2022Advances in Neural Information Processing Systems (NeurIPS) 2022, arXiv:2201.11903
Chain-of-Thought Prompting Elicits Reasoning in Large Language Models
Brian Ichter، Maarten Bosma، Fei Xia، Ed H. Chi، Jason Wei، Quoc V. Le، Denny Zhou، Dale Schuurmans، Xuezhi Wang
یافته: این روش در مسائل ریاضی، استدلال منطقی و پاسخگویی به پرسشهای پیچیده، دقت را بهطور قابلتوجهی افزایش داد و به مدلهای کوچکتر نیز اجازه داد تا به عملکرد بهتری دست یابند.
2022arXiv:2210.03629, DOI: 10.48550/arXiv.2210.03629
ReAct: Synergizing Reasoning and Acting in Language Models
Dian Yu، Shunyu Yao، Jeffrey Zhao
یافته: ReAct در وظایف تصمیمگیری تعاملی از روشهای قبلی بهتر عمل کرد و تفسیرپذیری و اعتمادپذیری را افزایش داد.