دلفینها بهعنوان موجوداتی باهوش و اجتماعی، با استفاده از صداها و حرکات بدنی برای ارتباط با یکدیگر عمل میکنند. با وجود تلاشهای طولانیمدت برای فهم این ارتباطات، پیچیدگی و حجم بالای دادهها باعث دشواری در تجزیهوتحلیل شده است. اکنون، هوش مصنوعی میتواند به این چالش پاسخ دهد.
با همکاری گوگل و پروژه Wild Dolphin، مدل DolphinGemma توسعه یافته است که از الگوریتمهای یادگیری ماشین و پردازش زبان طبیعی بهره میبرد. این مدل، قادر به تحلیل سیگنالهای صوتی دلفینها و تجزیهوتحلیل رفتارهای آنها است. فناوریهای جدید و امکان استفاده این مدل بر روی گوشیهای موبایل، امکان تجزیهوتحلیل در زمان واقعی را فراهم میکند.
اگر پروژه DolphinGemma موفق باشد، درک ما از ارتباط دلفینها و رفتارهای اجتماعی آنها بهشدت گسترش مییابد. این دانش میتواند به بهبود رویکردهای حفاظتی و تعامل با حیاتوحش کمک کند. با این حال، نیاز به احتیاط در پژوهشها و مراقبت از تأثیرات جانبی وجود دارد.
دلفینها باهوشی کمنظیر و رفتارهای اجتماعی پیچیده شناخته میشوند. آنها هنگام شکار، جفتیابی یا تعامل با گروه، ترکیبی از کلیک، سوت و حرکات بدن را به کار میبرند. با وجود دههها مطالعه، حجم بیپایان دادههای صوتی و ظرافت این الگوها باعث شده رمزگشایی کامل آنها دشوار باشد.
پای هوش مصنوعی به میان میآید
الگوریتمهای یادگیری ماشین و پردازش زبان طبیعی اکنون میتوانند مجموعههای صدای دلفین را در مقیاسی پردازش کنند که از توان انسان خارج است. این مدلها نهتنها انواع صدا را از هم تفکیک میکنند؛ بلکه آنها را به رفتار، موقعیت یا حالت هیجانی خاصی متصل میکنند. برای نمونه، برخی سوتها بیشتر هنگام تعامل اجتماعی شنیده میشود و کلیکها غالباً به جهتیابی و اکولاکیشن ربط دارند.
DolphinGemma؛ محصول مشترک گوگل و Wild Dolphin Project
برای عبور از چالش داده و تحلیل، گوگل بههمراه Wild Dolphin Project و پژوهشگران مؤسسه فناوری جورجیا DolphinGemma را توسعه دادهاند. این مدل بر پایه Gemma گوگل و با ۴۰۰ میلیون پارامتر ساخته شده است. دادهی آموزشی آن، بانک صوتی دلفینهای لکهدار آتلانتیک است که از ۱۹۸۵ تاکنون گردآوری شده. فناوری SoundStream سیگنالها را به توکن تبدیل میکند تا مدل بتواند مثل یک مدل زبانی، «صدای بعدی» را پیشبینی کند؛ درست مانند پیشنهاد واژه بعدی در پیامک.
قابلیتهای ریل تایم روی گوشی
معماری سبک DolphinGemma اجازه میدهد مدل روی گوشیهای Pixel اجرا شود. پژوهشگر میتواند در قایق، با همان تلفن صدا را ضبط و بدون نیاز به تجهیزات گرانقیمت، ریل تایم تحلیل کند. افزون بر این، مدل در سامانه CHAT به کار گرفته شده تا صداهای ساختگی شبیه دلفین پخش و واکنش حیوانات ثبت شود که گامی به سوی ایجاد واژگان مشترک انسان–دلفین خواهد بود.
فراتر از دلفینها
گوگل قصد دارد تابستان ۲۰۲۵ DolphinGemma را به شکل باز در اختیار جامعه پژوهشی بگذارد و با ریزتنظیم روی گونههای دیگر نهنگسان مثل دلفین پوزهبطری یا اسپینر، دامنه استفاده را گسترش دهد. این رویکرد باز، همکاری جهانی در مطالعه ارتباط جانوران را تسهیل میکند.
ابهامات و نگاه انتقادی
دادههای اقیانوس آکنده از نویز پسزمینهاند؛ بنابراین پالایش سیگنال، مرحلهای حیاتی است. برخی دانشمندان نیز تردید دارند که الگوی صوتی دلفینها را بتوان «زبان» دانست. آنها هشدار میدهند نیروهای پژوهشی مراقب باشند ناخودآگاه حیوان را به تقلید از صداهایی که برایش پخش میشود، عادت ندهند.
کلام آخر
پروژه DolphinGemma راه تازهای برای شنیدن گفتوگوی دلفینها پیش پای پژوهشگران میگذارد. اگر این مسیر به نتیجه برسد، نهتنها شناخت ما از ساختار اجتماعی و نیازهای دلفینها را عمیقتر میکند، بلکه درک گستردهتری از شعور و ارتباط در جانوران به دست خواهیم آورد؛ دانشی که میتواند رویکردهای حفاظتی و تعامل ما با حیات وحش را دگرگون کند.














