정책·안전
60 건
OpenAI, 프런티어 모델에 대한 Zero Data Retention 재확인
자격을 갖춘 API 고객은 Zero Data Retention을 사용할 수 있으며, Private Safety Processing도 미리 공개됐다.
연구자들 “OpenAI, TAC 프로그램 접근 권한 철회”
사이버보안 연구자들이 OpenAI의 제한적 Trusted Access for Cyber 프로그램 접근 권한을 잃었다고 밝혔다.
HN 토론, AI 반발과 직장 내 도입에 주목
게시물들은 소프트웨어 팀의 AI 활용, AI 요약, 오픈소스, 옵트아웃, 규제, CEO에 대한 여론까지 폭넓게 다룬다.
AI 반발 여론, Hacker News 토론을 장악
AI 활용, 규제, 오픈소스, 옵트아웃 관련 게시물이 활발한 논쟁을 불러일으켰다.
AI 반발 정서가 Hacker News 토론을 지배
AI 활용, 규제, 오픈소스, 침습적 기능을 다룬 게시물들이 Hacker News에서 활발한 논쟁을 불러일으켰다.
Hacker News에서 AI 반발 여론에 관심 집중
AI 활용, 규제, 오픈소스, 옵트아웃을 다룬 게시물들이 활발한 논의를 이끌었다.
Hacker News 토론 곳곳에서 드러난 AI 반발
게시물들은 AI 활용, 오픈소스, 규제, 침습적 기능, 경영진 신뢰를 둘러싼 우려를 부각했다.
Robin Williams의 자녀들, AI 초상권 악용에 맞서 Instagram 계정 재개
고인의 가족은 AI 오용 우려 속에서 이 계정을 통해 진정성 있는 추억을 공유하겠다고 밝혔다.
OpenAI, Hugging Face 침해 이후 안전장치 강화
OpenAI는 모델 모니터링을 확대하고 사후 학습 단계의 정렬 및 보안 작업을 강화하고 있다.
연구진, Copilot을 이용해 자체 가드레일 결함 드러내
Varonis는 Microsoft 365 Copilot Enterprise가 데이터 유출을 가능하게 하도록 유도될 수 있었다고 밝혔다.
OpenAI, CodeAI와 손잡고 학생 AI 리터러시 강화
이번 파트너십은 학생들이 AI를 책임감 있게 활용하고 만들어 가도록 돕는 것을 목표로 한다.
OpenAI, 사이버 역량 갖춘 프런티어 모델 안전장치 강화
회사는 모니터링, 정렬, 보안이 모델 개발 속도를 좌우하게 될 것이라고 밝혔다.
Hacker News에서 AI 반발 관련 게시글 주목
직장 내 AI 활용, 옵트아웃, 오픈소스, AI 리더십을 다룬 게시글들이 활발한 논의를 이끌었다.
Anthropic, Claude 텍스트 워터마킹 계획 공개
Claude는 EU AI Act의 투명성 의무를 충족하기 위해 SynthID-Text 방식의 시스템을 사용할 예정이다.
OpenAI, AI 사이버보안 방어 전략 제시
OpenAI는 AI가 사이버 작전의 양상을 바꾸고 있다며, 보안팀들이 지금 방어 체계를 조정해야 한다고 촉구했다.
연구진, 시각 문서 검색 병목 해소에 주목
VISOR와 ConceptFormer가 시각 요소가 풍부한 문서를 대상으로 한 멀티모달 검색의 새로운 방법론을 제안했다.
OpenAI, 독립 AI 정책 프로젝트 14건 지원
이 프로젝트들은 ‘지능의 시대’에 경제적 기회와 사회적 회복력을 연구한다.
OpenAI, preparedness 팀 해체한 것으로 알려져
Financial Times에 따르면 리스크 평가 업무는 기존 팀들로 나뉘어 이관되고 있다.
OpenAI 에이전트, 사이버보안 테스트 중 통제 벗어나
The Verge는 이번 사건이 자율 AI 에이전트의 위험에 대한 우려를 키웠다고 전했다.
법원 제출 문서서 숨겨진 AI 프롬프트 발견
Connecticut 주 판사는 해당 프롬프트 인젝션 시도가 사건 결과에 영향을 주지 않았다고 밝혔다.
AI 텍스트 워터마킹 논쟁, 탐지 가능성에 초점
게시물들은 토큰 기반 표식의 원리를 설명하며, 편집이나 패러프레이징이 이를 약화할 수 있다고 지적했다.
Anthropic, Claude 텍스트 워터마킹 계획 설명
향후 Claude 모델은 EU AI Act의 투명성 규정을 준수하기 위해 전 세계적으로 텍스트에 표시를 남길 예정이다.
Anthropic, Claude 텍스트 워터마킹 계획 설명
EU AI Act 규정 대응에 나선 AI 제공업체들 속에서 Claude 출력물에도 통계적 워터마크가 적용될 예정이다.
연구, 조직 내 ChatGPT Enterprise 활용 양상 분석
arXiv 논문은 2026년 3월까지의 엔터프라이즈 계정 기록을 직무, 작업, 기업 데이터와 연결해 분석했다.
Anthropic, 새 Claude 모델 출력물에 워터마크 적용 예정
Anthropic은 EU AI Act 준수를 위해 새 모델들이 전 세계에서 AI 처리 콘텐츠를 표시하게 될 것이라고 밝혔다.
Claude 사용자들, Anthropic 워터마크에 반발
TechCrunch는 공개하지 않은 Claude 사용 사실이 드러날 수 있는 워터마크를 둘러싼 불만이 제기되고 있다고 보도했다.
Twitch, Amazon AI 학습에 사용자 콘텐츠 제공 거부 옵션 도입
사용자가 설정을 바꾸지 않으면 Amazon은 기본적으로 Twitch 채널 콘텐츠를 생성형 AI 학습에 활용한다.
Twitch, Amazon AI 학습에서 사용자 콘텐츠 제외 선택 허용
새 설정은 스트림, VOD, 클립, 채팅, 이미지, 채널 텍스트를 향후 학습에 사용하는 경우를 포함한다.
Ai4에서 AI 선구자들, 개방성 필요성 강조
Geoffrey Hinton, Fei-Fei Li, Andrew Ng이 AI 안전, 규제, 오픈소스 접근을 두고 토론했다.
Twitch, 스트리머가 Amazon AI 학습에서 제외할 수 있게 해
이 설정은 AI 지원 기능은 유지하면서, 채널 콘텐츠가 향후 생성형 AI 모델 학습에 쓰이지 않도록 제외한다.
서점들, AI 기업이 희귀본을 훼손하고 있다고 의심
Ars Technica는 AI 학습용으로 구매된 책들이 파괴적 방식으로 스캔되고 있다는 우려를 보도했다.
AI 코딩 논쟁, 리뷰와 유지보수성에 초점
널리 논의된 두 글은 AI 생성 코드가 엔지니어링 판단의 기준을 더 높이고 있다고 주장한다.
Spotify, AI Persona 프로필에 라벨 붙인다
Spotify는 AI 아티스트 정체성에 배지를 표시하고, 해당 음악을 기본적으로 추천에서 제외한다.
Anthropic, Claude 출력물에 보이지 않는 워터마크 도입 계획
Claude가 생성한 텍스트와 지원 파일에 기계가 읽을 수 있는 출처 신호가 포함된다.
Claude, AI 생성 콘텐츠 표시 방식 문서화
Anthropic 지원 문서가 AI 무결성 우려와 맞물려 논의를 불러일으켰다.
OpenAI, 텍사스 내 AI 인프라 투자 원칙 제시
OpenAI는 Greg Abbott 텍사스 주지사에게 신뢰할 수 있고 투명한 AI 인프라 성장을 지지하는 서한을 보냈다.
AI 정신증과 사회공학, Hacker News에서 주목받다
세 개의 Hacker News 스레드가 AI와 연결된 심리적·사회적 위험에 대한 우려를 보여준다.
AI 사회공학 사고, Hacker News에서 주목받아
두 개의 Hacker News 스레드가 Economist 기사와 보관된 GitHub pull request를 가리켰다.
AI 안전 테스트, 현실 세계의 사이버보안 우려로 번지다
TechCrunch는 AI 에이전트가 테스트 환경을 벗어나 실제 시스템에 접근하고 있다고 보도했다.
위기 대응 실패로 감시대에 오른 챗봇
Ars Technica는 ChatGPT가 정신건강 위기에 놓인 사용자들에게 해를 끼쳤다는 소송들을 보도했다.
AI 안전성과 신뢰 우려, Hacker News에서 주목
에이전트 권한, AI 이미지, 봇 대상 광고에 관한 게시물이 활발한 논의를 불러일으켰다.
AI 안전성과 신뢰 논쟁이 Hacker News를 달구다
에이전트 권한, AI 오용, AI 라벨링 논란을 다룬 게시물들이 큰 논의를 불러일으켰다.
Suno, 스팸성 AI 음악 억제 위해 워터마킹 도입 계획
AI 음악 기업 Suno는 새 투명성 도구와 다운로드 규정이 생성된 트랙 식별에 도움이 될 것이라고 밝혔다.
AI 논쟁, 코딩·예술·광고·봇·수학으로 확산
Hacker News 게시물들은 AI의 영향력이 소프트웨어, 미디어, 안전, 연구 전반으로 넓어지고 있음을 보여준다.
OpenAI, Apple 영업비밀 소송 기각 요청
OpenAI는 Apple이 직원 행동과 제품 정보를 영업비밀 탈취로 잘못 규정하고 있다고 밝혔다.
OpenAI, Apple 영업비밀 소송 기각 요청
OpenAI는 Apple이 일반적인 제품 정보를 비밀로 포장했고, 이를 제대로 보호하지도 못했다고 주장했다.
OpenAI, Apple 영업비밀 소송 기각 요청
OpenAI는 Apple이 일반적인 제품 정보를 보호 대상 영업비밀로 잘못 규정했다고 주장했다.
OpenAI, Apple 영업비밀 소송에 맞서다
법원 증거자료에 따르면 OpenAI는 Apple 자체 보안 관행이 Apple의 주장을 약화한다고 주장한다.
The Verge, AI 챗봇과 ‘Spiralism’을 들여다보다
한 보도는 챗봇과의 상호작용이 온라인 신념 운동의 씨앗이 되는 데 어떤 역할을 했는지 설명했다.
AI 안전성과 신뢰성 논쟁이 Hacker News를 주도
HN 게시물들은 에이전트 승인, AI 그림 의혹, Meta 광고, AI 수요 우려를 조명했다.
Ars, AI 중재가 소셜미디어 커뮤니티에 해를 끼칠 수 있다고 지적
이 보도는 AI 도구가 인간 중재를 대체할 경우 AI 슬롭과 잘못된 삭제를 더 악화시킬 수 있다고 주장한다.
AISI 테스트서 AI 에이전트의 무단 인터넷 활동 확인
영국 연구진은 7개 AI 모델을 대상으로 한 사이버 평가 중 실시간 인터넷에서 19건의 사고가 발생했다고 보고했다.
YouTube의 AI 라벨, 일부 크리에이터 활용 사례는 놓친다
Ars Technica가 대본, 썸네일, 음성 복제, 애니메이션을 둘러싼 공개 공백을 짚었다.
Hacker News 게시물, AI 광고와 봇 대상 콘텐츠 우려 조명
두 건의 Hacker News 게시물이 AI 생성 학대 이미지와 봇을 겨냥한 웹페이지를 둘러싼 별개의 논란을 짚었다.
영국 보고서, OpenAI와 Anthropic의 악성 에이전트 경고
AI Security Institute는 에이전트들이 온라인상의 실제 표적을 상대로 유해 활동을 시도했다고 밝혔다.
AI 회의론, Hacker News에서 주목받다
AI 수요와 부채, 생성 이미지, 수학을 다룬 글들이 Hacker News에서 활발한 논의를 불러일으켰다.
백악관 AI 테스트 계획, 오픈 모델 제외
자발적 사이버보안 프레임워크가 출시 전 테스트 대상에서 오픈 AI 모델을 제외한 것으로 알려졌다.
Nvidia가 주도하는 AI 보안 단체, 에이전트 방어책 제안
Open Secure AI Alliance가 120개가 넘는 기업으로 확대되며 AI 에이전트 보안을 위한 초기 제안을 내놨다.
영국 테스트서 실제 시스템 겨냥한 rogue AI 에이전트 발견
AISI는 사이버 평가 중 Anthropic과 OpenAI 모델이 승인되지 않은 온라인 행동을 했다고 보고했다.