آخرین اخبار

بازی با انتظارات؛ سلاحی خاموش در روابط ایران و آمریکا انتشار فهرست ۲۹۸۶ جان‌باخته حوادث اخیر با دستور پزشکیان؛ تأکید دولت بر شفافیت و پاسخگویی وال‌استریت ژورنال: عربستان و امارات حاضر نیستند سکوی حمله آمریکا به ایران باشند پزشکیان: نارسایی‌های داخلی باید شفاف شناسایی شود | دستور رئیس‌جمهور برای گفت‌وگوی ملی و پرهیز از برخورد سلبی وزارت دادگستری: ممنوعیت قانونی برای رانندگی بانوان با موتورسیکلت وجود ندارد سه روایت از لشکرکشی آمریکا به خلیج فارس؛ سناریوهای جنگ، پاسخ سخت ایران یا توصیه به آرامش؟ افشای دروغ‌پردازی رسانه‌ای رژیم صهیونیستی؛ زن اسرائیلی «کشته‌شده در اعتراضات ایران» زنده از آب درآمد سناتور دلاور: توییت‌های نیمه‌شب ترامپ «تهدید توخالی» و خطرناک است؛ خواستار مذاکره با مادورو شد امکان خرید با کالابرگ الکترونیکی در تمامی میادین میوه و تره‌بار تهران فراهم شد وزیر ارتباطات: معیشت مردم خط قرمز دولت است / قطع اینترنت تصمیمی دائمی نیست

سپینو

7

دیتاست یک میلیون آگهی املاک «دیوار» متن‌باز منتشر شد

  • کد خبر : 1561
  • 29 فروردین 1404 - 18:58
دیتاست یک میلیون آگهی املاک «دیوار» متن‌باز منتشر شد
پلتفرم «دیوار» دیتاست یک میلیون آگهی املاک منتشرشده در این پلتفرم را در Hugging Face به صورت متن‌باز و گمنام‌سازی‌شده منتشر کرد. این دیتاست نخستین مجموعهٔ ساختارمند در حوزهٔ املاک به زبان فارسی محسوب می‌شود.

به گزارش وفاق ملی، این اطلاعات بخشی از آگهی‌هایی را در بر می‌گیرد که در میانه سال ۱۴۰۳ فعال بوده و از میان شهرها و محله‌های مختلف، به‌صورت تصادفی انتخاب شده‌اند. دیوار در توضیح این اقدام خود می‌گوید: «این دیتاست نخستین مجموعه ساختارمند در حوزه املاک به زبان فارسی محسوب می‌شود و از نظر حجم، کیفیت و تمیز بودن داده‌ها، ابعاد قابل توجهی دارد.»

دیوار تأکید می‌کند که «برای حفظ حریم خصوصی کاربرانش، تمامی اطلاعات شخصی که ممکن بود به شناسایی افراد منجر شود، از این دیتاست حذف شده و صرفاً داده‌هایی که خود کاربر اجازه انتشار آن‌ها را داده بود، منتشر شده است.»

این داده‌ها می‌تواند پایه‌ای برای تیم‌های پژوهشی، محققان دانشگاهی و استارتاپ‌های فعال در حوزه پراپ‌تک (Property Tech) ایران باشد که در زمینه توسعه و ساخت مدل‌های هوشمند تخمین قیمت، طراحی سیستم‌های توصیه‌گر ملک، تحلیل متن و استخراج کلیدواژه‌ها و پژوهش‌های مرتبط با اقتصاد مسکن فعالیت می‌کنند. این حجم داده برای تقویت مدل زبانی فارسی نیز کاربرد دارد و می‌تواند در توسعه ابزارهای هوش مصنوعیِ فارسی مؤثر باشد.

برای استفاده از این مجموعه داده می‌توانید به وب‌سایت Hugging Face مراجعه کنید.

لینک کوتاه : https://vefaghemelli.com/?p=1561
  • منبع : دیجیاتو
انفرادی