[{"data":1,"prerenderedAt":-1},["ShallowReactive",2],{"site-settings":3,"workflow-legal-pdf-llm-output-benchmark-evaluation-workflow-1056":7},["Reactive",4],{"analytics_enabled":5,"gtm_container_id":6},true,"GTM-WWB2TQFD",["Reactive",8],{"id":9,"slug":10,"title":11,"short_description":12,"category_key":13,"category_title":14,"workflow_type_key":15,"workflow_type_title":15,"workflow_type_icon":16,"price":17,"is_free":5,"cover_image":18,"description":19,"compatible_versions":18,"locked":5,"lock_reason":20,"purchased":21,"in_cart":21,"workflow_file":22},484,"legal-pdf-llm-output-benchmark-evaluation-workflow-1056","ارزیابی خودکار خروجی مدل‌های زبانی در اسناد حقوقی","ارزیابی خودکار خروجی مدل‌های زبانی در وظایف استخراج اطلاعات از PDFهای حقوقی و ثبت تصمیم و استدلال در Google Sheets.","ai-agents","ایجنت‌های هوش مصنوعی","n8n","https:\u002F\u002Faidock.s3.ir-thr-at1.arvanstorage.ir\u002Fworkflow_types\u002Fimage.webp",0,"","📄 این گردش‌کار، موارد آزمون ذخیره‌شده در Google Sheets را بررسی می‌کند و فقط ردیف‌های مرتبط با فایل‌های PDF را پردازش می‌کند.\n\n🔍 فایل PDF از Google Drive دریافت و متن آن استخراج می‌شود. سپس مدل زبانی از طریق OpenRouter، ورودی، متن منبع و خروجی مدل را از نظر کامل‌بودن، صحت factual و وجود اطلاعات پشتیبانی‌نشده ارزیابی می‌کند.\n\n⚖️ نتیجه ارزیابی به‌صورت `Pass` یا `Fail` همراه با توضیح کوتاه و ساختاریافته تولید می‌شود. داده‌های اصلی، تصمیم و استدلال داور در برگه نتایج Google Sheets ثبت می‌شوند و بین پردازش‌ها وقفه‌ای نیم‌ثانیه‌ای برای کاهش احتمال محدودیت نرخ API اعمال می‌شود.","login",false,null]