Новости #безопасность ИИ
Безопасность ИИ: последние новости
Все материалы по теме · 26 публикаций
По теме «безопасность ИИ» на In-Crypto 26 публикаций: первая — 27 августа 2026, последняя — 5 октября 2026. Чаще всего тема встречается в разделах «Технологии» и «Регуляции». Рядом обычно упоминаются OpenAI, Anthropic, искусственный интеллект.
OpenAI запустит textGrain: водяные знаки в текстах ChatGPT в ЕСOpenAI в ближайшие недели запустит textGrain для ChatGPT и Codex в ЕС — невидимые водяные знаки в тексте и детектор. Запуск связан с EU AI Act.Трамп и лидеры ИИ 29 сентября подписали кодекс безопасности без паузыТрамп и топ-менеджеры ИИ 29 сентября подписали добровольный кодекс безопасности без коллективной паузы; гиперскейлеры планируют до $800 млрд инвестициТрамп создал рабочую группу по суперинтеллекту SIFДональд Трамп объявил о создании Super Intelligence Force (SIF) для координации усилий правительства США; руководить ею будут Клейтон, Фергюсон, МайклМодели OpenAI на 55 сайтах; взлом архивов Канады не удалсяTransluce зафиксировала попытку доступа к Библиотеке и архивам Канады — без проникновения. Asymmetric Security отметили активность моделей OpenAI на 5Anthropic подала заявку на IPO и раскрыла риски ИИ в проспектеAnthropic подала заявку на IPO и раскрыла проспект: 80 из 261 страниц — риски. В 2025 выручка $4,59 млрд при операционном убытке $8,06 млрд.Билл Гейтс: ИИ уже может привести к гибели 1 млрд человекБилл Гейтс заявил, что современные ИИ уже способны вызвать события, ведущие к гибели 1 млрд человек. Он считает, что нужны законы, меры защиты и госнаПремьер Австралии: агент OpenAI проник на портал MedicareПремьер Австралии: в июне агент OpenAI проник на портал Medicare и получил доступ к непубличным данным; власти узнали об этом 10 сентября.OpenAI и Anthropic призвали СБ ООН к стандартам безопасности ИИГлавы OpenAI и Anthropic выступили в СБ ООН и призвали к выработке стандартов безопасности ИИ; премьер Австралии сообщил о взломе Medicare агентом OpeOpenAI и Anthropic выступят в СБ ООН о рисках ИИOpenAI и Anthropic в среду выступят в Совбезе ООН о рисках ИИ; ООН подтвердило участие. Ожидаются ещё 2 спикера: Клеман Деланг и Йошуа Бенджио Также DDeepSeek выступит на заседании Совбеза ООН по ИИ 23 сентябряDeepSeek выступит 23 сентября на заседании Совбеза ООН о влиянии ИИ на безопасность. Ожидаются Сам Альтман и Anthropic; список участников может измениЭксперты ООН: к потере контроля над ИИ нужно готовиться сейчас21 сентября независимая научная панель ООН заявила: безопасность автономных систем нельзя откладывать; кейс OpenAI и Hugging Face показал риск обхода Глава Circle призвал Anthropic к IPO ради прозрачности и безопасностиДжереми Аллэйр из Circle призвал Anthropic к IPO, полагая, что публичный статус повысит прозрачность и подотчётность на фоне опасений о безопасности ИМарк Цукерберг против общего замедления разработки ИИГендиректор Meta Марк Цукерберг выступил против скоординированного замедления передовых ИИ-систем. Он считает, что темп и безопасность должны определяAI-агенты выходят из-под контроля: OpenAI описала 6 инцидентовOpenAI раскрыла шесть инцидентов необычного и потенциально опасного поведения AI‑агентов: скрытые инструкции, обман, поиск API‑ключей и обмен файлами.OpenAI запустила мониторинг несоответствий ИИ и раскрыла 6 кейсовOpenAI представила систему отслеживания и раскрытия несоответствующего поведения ИИ и опубликовала отчеты о шести кейсах. Введены критерии и сроки расOpenAI раскрыла 6 новых случаев «несогласованного» поведения ИИOpenAI раскрыла шесть новых случаев «несогласованного» поведения ИИ — отдельно от июльского инцидента, когда модели обошли ограничения и взломали HuggСэм Альтман исключил IPO OpenAI в 2026 году из-за вопросов безопасностиOpenAI не выйдет на биржу в 2026 году. Сэм Альтман назвал момент для IPO «неудачным» из‑за вопросов безопасности ИИ и подчеркнул, что компания не испыCEO Anthropic представил трехэтапный план контроля развития ИИCEO Anthropic представил трехэтапный план контроля ИИ и призвал замедлить развитие фронтирных моделей. Компания даст независимым оценщикам постоянный Глава Anthropic: притормозить фронтир ИИ ради безопасностиДарио Амодеи (Anthropic) опубликовал эссе We Must Pace the Frontier и призвал замедлить гонку ИИ ради безопасности. Идею поддержали Сэм Альтман и ИлонДжейкоб Коксон покидает Anthropic и критикует гонку ИИДжейкоб Коксон объявил об уходе из Anthropic и раскритиковал гонку ИИ. Он сообщил о трех годах работы с предварительным обучением моделей в OpenAI и AЭкс-разработчик Anthropic обвинил ИИ‑гигантов в угрозе человечествуБывший исследователь OpenAI и Anthropic Джейкоб Коксон уволился из Anthropic и обвинил компании в гонке к самоулучшающемуся сверхинтеллекту, создающейГлавный научный сотрудник OpenAI призвал замедлить развитие ИИГлавный научный сотрудник OpenAI Якуб Пачоцкий в эссе An Alien Mind призвал компании быть готовыми замедлять разработку мощных ИИ-моделей, если контроКак ИИ-агенты «отравляют» друг друга: исследование AnthropicAnthropic выпустила работу Mind Viruses о самораспространяющихся инструкциях в многоагентных LLM-системах. Идея «вируса разума» из «Лавины» звучит по-Исследователи: у Astra OpenAI снижается наблюдаемостьИсследователи по безопасности ИИ сообщают о риске снижения наблюдаемости модели Astra. По словам анонимного источника, применяется «рекуррентная глуби