Prompt Engineering

تسلط بر حالت JSON: تضمین خروجی‌های ساختاریافته از مدل‌های زبانی بزرگ

در چشم‌انداز به‌سرعت در حال تحول هوش مصنوعی، توانایی استخراج داده‌های قطعی و قابل خواندن توسط ماشین از مدل‌های زبانی بزرگ (LLM) دیگر یک تجمل نیست، بلکه یک ضرورت است. در حالی که LLMها در نوشتن خلاقانه و گفتگوی باز عالی هستند، ادغام آن‌ها در خطوط تولید نرم‌افزار نیاز به کنترل دقیق بر قالب خروجی دارد. اینجاست که حالت JSON به ابزاری جدانشدنی در جعبه‌ابزار مهندس پرامپت تبدیل می‌شود.

حالت JSON چیست؟

حالت JSON یک پیکربندی یا تکنیک پرامپت‌دهی تخصصی است که به یک مدل زبانی بزرگ دستور می‌دهد خروجی خود را به‌طور انحصاری به JSON معتبر (نمادگذاری شیء جاوااسکریپت) محدود کند. برخلاف تولید استاندارد، جایی که مدل ممکن است بدون دستور صریح، مکالمات اضافی مانند «این داده‌های درخواستی شماست:» یا بلوک‌های قالب‌بندی مارک‌داون را به خروجی اضافه کند، حالت JSON انطباق ساختاری سخت‌گیرانه را اعمال می‌کند.

برای توسعه‌دهندگان، این تمایز حیاتی است. این حالت نیاز به منطق پیچیده تجزیه عبارت‌های منظم (Regex) برای حذف نویزهای مکالمه‌ای را از بین می‌برد. وقتی مدل به JSON محدود شود، می‌توانید به پارسرهای استاندارد (مانند ماژول json پایتون یا JSON.parse جاوااسکریپت) اعتماد کنید تا پاسخ را مستقیماً به ساختارهای داده بومی تبدیل کنند.

چرا خروجی ساختاریافته مهم است؟

ارزش اصلی حالت JSON در قابلیت اطمینان آن نهفته است. سناریویی را در نظر بگیرید که در آن یک ربات پشتیبانی مشتری مبتنی بر هوش مصنوعی می‌سازید که باید اطلاعات تیکت را استخراج کرده و سپس آن را به پایگاه داده مسیریابی کند. اگر LLM یک پاراگراف به زبان طبیعی خروجی دهد، کد بک‌اند شما باید کار سنگینی برای تفسیر نیت و موجودیت‌ها انجام دهد. با اعمال JSON، پیچیدگی را از کدبیس به پرامپت منتقل می‌کنید که منجر به برنامه‌های تمیزتر و قابل‌نگهداری‌تر می‌شود.

علاوه بر این، حالت JSON به کاهش توهم‌های مربوط به قالب کمک می‌کند. اگرچه این حالت دقت واقعی را تضمین نمی‌کند، اما دقت نحوی را تضمین می‌کند. این پیش‌بینی‌پذیری برای فرآیندهای بعدی، مانند اعتبارسنجی داده‌ها بر اساس یک طرح JSON قبل از ذخیره آن در پایگاه داده، ضروری است.

پیاده‌سازی حالت JSON در پرامپت‌ها

بسته به ارائه‌دهنده LLM که استفاده می‌کنید (مانند OpenAI، Anthropic یا Google)، حالت JSON را می‌توان به دو روش پیاده‌سازی کرد: از طریق پرچم‌های سطح API یا از طریق مهندسی پرامپت صریح.

۱. اعمال در سطح API (توصیه شده)
بیشتر APIهای مدرن LLM یک پارامتر خاص برای فعال‌سازی خروجی JSON سخت‌گیرانه ارائه می‌دهند. برای مثال، در API اوپن‌ای‌آی، می‌توانید response_format را روی { "type": "json_object" } تنظیم کنید. این دستور به مدل می‌دهد تا توکن‌هایی را نمونه‌برداری کند که با یک شیء JSON معتبر سازگار باشند.


import openai

client = openai.OpenAI()

response = client.chat.completions.create(
  model="gpt-4o-mini",
  messages=[
    {"role": "system", "content": "You are a helpful assistant that outputs only JSON."},
    {"role": "user", "content": "Extract the author and title from the following text: 'The Great Gatsby was written by F. Scott Fitzgerald.'"}
  ],
  response_format={ "type": "json_object" }
)

print(response.choices[0].message.content)

۲. رویکرد مهندسی پرامپت
اگر با مدل‌هایی کار می‌کنید که از پرچم‌های بومی JSON پشتیبانی نمی‌کنند، باید به دستورات سیستمی تکیه کنید. باید صریح و تکراری باشید.


User: "Extract entities from the text. Output ONLY valid JSON. Do not include markdown backticks or explanations."

System: "Your output must be strictly formatted as a JSON object. No text before or after the JSON block."

بهترین شیوه‌ها برای تولید JSON پایدار

  • تعریف یک طرح (Schema): همیشه ساختار JSON مورد انتظار را در پرامپت خود ارائه دهید. کلیدها، انواع داده و فیلدهای ضروری را مشخص کنید.
  • مدیریت خطاها به صورت شایسته: حتی با حالت JSON، خطاهای نحسی گاه به گاه رخ می‌دهد. همیشه منطق تجزیه خود را در بلوک‌های try-catch قرار دهید.
  • از اعتبارسنجی طرح JSON استفاده کنید: اگر API از آن پشتیبانی می‌کند، یک تعریف طرح JSON را همراه با پرامپت ارسال کنید. این به مدل اجازه می‌دهد تا خود را تصحیح کند و اطمینان حاصل کند که خروجی با الزامات مدل داده خاص شما مطابقت دارد.

نتیجه‌گیری

حالت JSON گام بزرگی در قابل اعتماد کردن LLMها به عنوان اجزای خطوط تولید مهندسی نرم‌افزار است. با اعمال خروجی‌های ساختاریافته، توسعه‌دهندگان می‌توانند شکاف بین درک زبان طبیعی غیرساختاریافته و پردازش داده‌های ساختاریافته را پر کنند. با بالغ‌تر شدن اکوسیستم، یکپارچه‌سازی‌های حتی نزدیک‌تری بین مهندسی پرامپت و اعتبارسنجی طرح خواهیم دید که استخراج داده‌های دقیق از مدل‌های هوش مصنوعی را هموار‌تر از همیشه می‌سازد.

Share: