تولید پادکست از متون طولانی با استفاده از مدلهای زبانی بزرگ (LLM) حسابی داغ شده، اما یک مشکل بزرگ وجود دارد: «توهم» یا تولید اطلاعات نادرست! 🧐
محققان در یک پژوهش جدید، چالش «وفاداری به منبع» (Faithfulness) را در پادکستهای تولید شده بررسی کردند. نتیجه جالب اینکه حتی مدلهای قدرتمندی مثل GPT-4o هم گاهی اطلاعاتی را میسازند که در منبع اصلی وجود ندارد.
آنها برای حل این مشکل، فریمورک «Catch-n-Repair» را معرفی کردند که به صورت خودکار، محتوای غیرمستند را شناسایی و بازنویسی میکند تا بدون آسیب به روانی مکالمه، خروجی دقیقتری به ما تحویل دهد. گامی مهم برای حرفهایتر شدن محتواهای صوتیِ هوشمصنوعیساز! 🎧✨
منبع: arXiv NLP
