عنوان انگلیسی مقاله: an
algorithm for fast and efficient text mining used to automatically
generate a database containing kinetic information of enzymes
عنوان فارسی مقاله: الگوریتمی برای داده کاوی سریع و کارآمد متن به منظور ایجاد اتوماتیک پایگاه داده حاوی اطلاعات سینتیک آنزیم ها
فرمت فایل ترجمه شده: فایل Word ورد 2007 یا 2003 (Docx یا Doc) قابل ویرایش
تعداد صفحات فایل ترجمه شده: 20
لینک دریافت رایگان نسخه انگلیسی مقاله:
دانلود_______________________________________
پیش
زمینه: مقدار اطلاعات بیولوژیکی در دسترس به سرعت رو به افزایش بوده و
تمرکز تحقیقات بیولوژیکی از بخش های مجزا به سمت شبکه ها و حتی پروژه های
بزرگتر کشانده شده که هدف آن ها تجزیه و تحلیل، مدلسازی و شبیه سازی شبکه
های بیولوژیکی و همچنین مقایسه در سطح بالای ویژگی های سلولی می باشد.
بنابراین ضروری است تا اطلاعات بیولوژیکی به آسانی در دسترس باشد. به هر
حال، بیشتر اطلاعات در تحقیقات انجام شده به صورت غیرساختاری بوده و به این
خاطر روش هایی برای استخراج نظامند اطلاعات، مستقیما از تحقیقات اولیه می
بایست توسعه یابد.
شرح مطلب: در اینجا ما الگوریتم داده کاوی را
برای استخراج اطلاعات سینتیک همانند و غیره و همچنین اطلاعات مربوطه
همانند نام آنزیم ها، تعداد EC، لیگاندها، ارگانیسم ها، مناطق، PH و دما
نشان می دهیم. با استفاده از این قوانین و رویکرد بر پایه واژه نامه، این
امکان وجود دارد تا به اندازه 514394 پارامتر سینتیک 13 دسته (فعالیت
های خاص) از حدود 17 میلیون مطالب نتتشر شده، استخراج کرده و آن ها را
با داده های دیگر خلاصه مطالب دیگر ترکیب کنیم. تایید دستی
تقریبا 1000 نتایج انتخاب شده تصادفی، موارد فراخوانی شده بین 51% و 84% و
محدوده دقیق 55% تا 96% را نشان داده که بستگی به فهرست های جستجو شده
دارد. نتایج در پایگاه داده ذخیره شده و توسط KID «یا پایگاه داده سینتیک» از طریق اینترنت در دسترس می باشد.
نتیجه
گیری: الگوریتم نشان داده شده، اطلاعات مهمی را ارائه می دهد و کمکی به
شتاب بخشیدن تحقیقات و تجزیه و تحلیل مورد نیاز برای روش های بیولوژی سیستم
های امروزی می باشد. پایگاه های داده حاصل شده از تجزیه و تحلیل چکیده
مقاله های منتشر شده می تواند کمک ارزشمندی در حوزه جنبش های بیولوژیکی و
شیمیایی باشد. این فرایند کاملا بر مبنای داده کاوی و همچنین تکمیل پایگاه
داده ایجاد شده می باشد. این پایگاه داده از سایت
http: //kid. tu-bs. de در دسترس است. کد مبدا الگوریتم تحت مجوز دولتی
GNU ایجاد شده و بنا به درخواست محققان در دسترس قرار می گیرد.
ادامه مطلب ...