آرشیو های تگ

آنتروپیک جزئیات بیشتری از واترمارک نامرئی Claude منتشر کرد؛ ویرایش متن هم همیشه آن را حذف نمی‌کند

آنتروپیک جزئیات بیشتری از واترمارک نامرئی Claude منتشر کرد

آنتروپیک جزئیات فنی بیشتری درباره سیستم واترمارک‌گذاری متن‌های تولیدشده توسط Claude منتشر کرده است. این واترمارک برای خواننده قابل مشاهده نیست، اما شرکت می‌گوید ابزارهای مخصوص می‌توانند وجود آن را تشخیص دهند. آنتروپیک همچنین توضیح داده که ویرایش متن، استفاده از Claude برای ویرایش نوشته‌های انسانی و حتی تولید کد چه تأثیری روی این سیستم خواهد داشت. آنتروپیک در حالی …

ادامه مطلب »

OpenAI در حال بررسی فرارهای بیشتر عامل‌های هوش مصنوعی؛ نگرانی‌ها درباره امنیت AI Agents افزایش یافت

OpenAI در حال بررسی فرارهای بیشتر عامل‌های هوش مصنوعی

شرکت OpenAI در جریان بررسی‌های مربوط به حادثه امنیتی اخیر Hugging Face به موارد دیگری برخورد کرده که نشان می‌دهد برخی عامل‌های هوش مصنوعی (AI Agents) در شرایط آزمایشی نیز توانسته‌اند از محدودیت‌های تعیین‌شده عبور کنند. هرچند این موارد به گفته منابع آگاه ابعاد محدودی داشته‌اند، اما بار دیگر توجه‌ها را به چالش‌های امنیتی سیستم‌های هوش مصنوعی خودمختار جلب کرده‌اند. …

ادامه مطلب »

آنتروپیک: مدل‌های هوش مصنوعی Claude در آزمایش‌های امنیتی به سه سازمان نفوذ کردند

مدل‌های هوش مصنوعی Claude در آزمایش‌های امنیتی به سه سازمان نفوذ کردند

شرکت Anthropic از وقوع سه رخداد امنیتی غیرمنتظره در جریان آزمایش‌های داخلی مدل‌های هوش مصنوعی خود خبر داده است؛ رخدادهایی که در آن برخی از مدل‌های خانواده Claude موفق شدند از محیط آزمایشی خارج شده و به زیرساخت‌های واقعی سه سازمان دسترسی پیدا کنند. این گزارش تنها چند روز پس از آن منتشر می‌شود که OpenAI نیز فاش کرده بود …

ادامه مطلب »