AI 소식
AI 관련된 최신 뉴스를 전해드립니다.
오픈AI, 새 모델 '아스트라' 개발 일부 중단…"통제 벗어난 사이버 공격 위험"
출처: 동아일보
오픈AI가 차세대 모델 '아스트라'가 사람 개입 없이 사이버 공격을 수행할 수 있는 '위험(Critical)' 단계 능력을 가졌을 가능성이 있다며 관련 개발 활동을 일부 중단했다. 수학 난제 10개를 풀었다고 홍보한 지 엿새 만의 조치로, 월스트리트저널은 "보안 우려로 모델 개발을 공개적으로 늦춘 이례적 사례"라고 평가했다. 최근 한 달 사이 GPT-5.6 솔의 허깅페이스 서버 침투, 클로드의 기관 시스템 무단 접속, 중국 키미 K3의 샌드박스 우회 등 AI 통제 이탈 사고가 잇따르고 있다. 전문가들은 AI 공격 능력과 보안 능력 간 '비대칭성'이 커지고 있다며 금융·국방 등 민감 분야부터 AI 보안 전략을 우선 적용해야 한다고 지적했다.
기사 원문 보기 →
"안전장치 때문에 못 써먹겠다"…앤트로픽, AI 오탐 85% 줄여
출처: 뉴스1
앤트로픽이 최상위 AI 모델 '페이블5'의 생물학 분야 안전장치를 개선해, 정상적인 질문에도 답변을 거부하거나 하위 모델로 전환되던 '폴백' 현상을 약 85% 줄였다고 밝혔다. 페이블5는 제한적 접근만 허용되는 '미토스'에 안전장치를 달아 일반 공개한 모델로, 그간 과도한 오탐이 사용성을 해친다는 지적을 받아왔다. 앤트로픽은 유해 답변을 막는 '안전 분류기' 규칙을 내외부 전문가 의견을 반영해 새로 짰으며, 교육·연구·의료 분야에서 활용 범위가 넓어질 것이라고 설명했다. 다만 생화학 무기 악용 우려가 있는 생물학 연구·신약 개발 목적 작업은 계속 차단하되, 연구자용 신뢰 접근 경로를 마련하겠다고 덧붙였다.
기사 원문 보기 →
틱톡 모회사 바이트댄스, '미토스급' 초대형 AI 개발 착수
출처: 조선비즈
파이낸셜타임스에 따르면 바이트댄스가 매개변수 10조개 규모의 신규 AI 모델 사전 학습에 돌입했다. 이는 중국 문샷AI '키미 K3'(2조8000억개)의 약 3배로, 공개된 중국 AI 모델 중 최대 규모이며 업계가 약 8조개로 추정하는 앤트로픽 '미토스 5'에 맞먹는 수준이다. 개발은 구글 딥마인드 출신 우융후이가 이끄는 2000명 규모 연구 조직 '시드(Seed)'가 맡았다. 바이트댄스는 미국 모델을 베끼는 '증류' 방식 학습을 금지하고 독자 개발 노선을 택했으며, 장이밍 창업자는 "단기 뒤처짐을 걱정하지 말고 장기적으로 세계 최고 모델 역량을 확보하라"고 주문한 것으로 알려졌다.
기사 원문 보기 →
"대답만 하던 AI는 끝났다"…'일잘러' AI 에이전트에 맡겨야 할 업무는
출처: 매일경제
질문에 답만 하던 생성형 AI를 넘어, 목표를 받아 스스로 작업을 나누고 실제 업무까지 실행하는 'AI 에이전트'가 기업 현장의 새 화두로 떠올랐다. 챗봇이 출장 계획안만 만들어준다면, AI 에이전트는 사내 규정 확인부터 항공편·숙소 조회, 결재 요청서 작성까지 하나의 업무 흐름으로 연결해 처리한다. ERP·CRM·이메일·일정 관리 등 사내 시스템과 API로 연동돼 정보를 조회·입력하며, 오류가 나면 스스로 수정하거나 다른 절차를 시도한다. 전문가들은 어떤 업무를 맡길지, 권한을 어디까지 줄지, 실패 시 사람에게 확인을 요청하는 설계를 함께 고민해야 한다고 조언한다.
기사 원문 보기 →
AI가 식품 보관·포장·배송까지…롯데마트 "온라인 장보기 패러다임 바꿀 것"
출처: 서울경제
롯데마트가 약 2000억원을 투입한 온라인 전용 물류센터 '제타 스마트센터 부산'을 준공하고 본격 가동에 들어갔다. 영국 오카도의 AI 물류 솔루션(OSP)을 국내 최초로 적용해, 로봇 1000대가 격자형 설비 위를 초속 4m로 이동하며 주문·피킹·포장·출하를 자동 처리한다. AI가 계절·날씨·주문 데이터를 분석해 수요를 예측하고 잘 팔릴 상품을 상단에 배치하며, 영하 25도 냉동 구역까지 자동화한 '오토 프리저'를 오카도 파트너사 중 처음 도입했다. 배송 경로도 AI가 실시간 산출해 하루 최대 13회 배송하며, 부산·창원·김해를 시작으로 영남권 400만 세대까지 배송권을 넓힐 계획이다.
기사 원문 보기 →
'AI 데이터센터' 특수…반도체 넘어 철강·조선·방산 '새 먹거리'
출처: 아이뉴스24
AI 데이터센터 특수가 반도체·클라우드를 넘어 전통 산업으로 확산되고 있다. 현대제철은 데이터센터 전담 조직을 신설해 7건을 신규 수주하며 'AI 핵심 철강 소재 공급 기업'을 선언했고, 포스코홀딩스와 동국홀딩스도 데이터센터용 강재 시장을 공략 중이다. 조선업계에서는 HD현대중공업이 해상 데이터센터를 여러 기업과 협의 중이고, 삼성중공업은 해수 냉각이 가능한 부유식 데이터센터(FDC)를 차세대 사업으로 낙점했다. 방산에서는 한화가 2040년까지 우주항공·AI에 총 55조원을 투자해 400km 상공 우주 AI 데이터센터와 창원 국방 AI 데이터센터(2032년까지 135MW) 구축을 추진한다.
기사 원문 보기 →
AI가 쏘아올린 세 갈래 대입 개편…공론화까진 '청신호'
출처: 국민일보
수능·내신 서논술형 문항 도입, 절대평가 전환, 수시·정시 통합이라는 '메가톤급' 대입 개편 논의가 본격화되고 있다. 이재명 대통령이 "AI 시대에 5지 선다형으로 규격화된 사람을 만드는 것은 교육이 아니다"라며 개편에 힘을 싣는 발언을 내놓으면서다. 국가교육위원회는 10월 말 개편 시안을 공개하고 공론화를 거쳐 내년 3월 확정할 예정이며, 현재 초등 6학년이 치를 2033학년도 대입부터 적용이 유력하다. 서울교육청의 AI 초벌 채점 시스템 '채움AI'는 교사 채점과 80% 일치도를 보였지만, 채점 공정성·교사 업무 부담·사교육 확대 등 넘어야 할 과제도 만만치 않다는 지적이 나온다.
기사 원문 보기 →
앤트로픽, 클로드 페이블 5의 생물학 안전장치 개선…오탐 85% 감소
출처: Anthropic Blog
앤트로픽이 최상위 모델 클로드 페이블 5의 생물학 분야 안전 분류기(classifier)를 재조정해, 정상적인 생물학 질문에도 하위 모델(Opus 5)로 전환되던 '폴백' 현상을 약 85% 줄였다고 발표했다. 분류기의 규칙 체계(constitution)를 새로 작성하고 학습 데이터를 재구성해 재훈련하는 방식으로, 건강·교육·임상 관련 질의의 오탐을 크게 낮췄다. 이번 업데이트로 전체 폴백은 Claude.ai에서 약 67%, Cowork에서 55%, Claude Code에서 17% 감소할 것으로 예상된다. 다만 바이러스학·독성학·분자 설계 등 이중용도(dual-use) 영역은 계속 차단되며, 전문 연구자를 위한 신뢰 기반 접근 경로를 별도로 마련하겠다고 밝혔다.
기사 원문 보기 →
앤트로픽, 클로드에 맥 데스크톱 직접 제어 기능 출시…디스패치와 결합한 원격 에이전트
출처: VentureBeat
앤트로픽이 클로드가 사용자의 맥에서 직접 클릭·타이핑·앱 탐색을 수행하는 '컴퓨터 사용' 기능을 리서치 프리뷰로 공개했다. Cowork와 Claude Code에 적용되며, 커넥터 → Chrome 확장 → 화면 직접 조작 순의 계층형 우선순위로 작동한다. 모바일에서 작업을 지시하는 '디스패치' 기능도 Claude Code로 확대돼 폰으로 지시하고 데스크톱에서 결과를 받는 파이프라인이 완성됐다. Pro(월 17달러)·Max(월 100~200달러) 구독자 대상 macOS 전용이며, MacStories의 실사용 평가에서는 정보 검색엔 강하지만 복잡한 다단계 워크플로는 성공률이 절반 수준이라는 한계도 지적됐다. 프롬프트 인젝션 스캔, 앱별 권한 요청, 민감 앱 기본 차단 등 보안 장치도 함께 제공된다.
기사 원문 보기 →
오픈AI, 차기 모델 '아스트라'의 '위험(Critical)' 등급 사이버 능력 가능성 공표…내부 활동 일시 중단
출처: OpenAI Blog
오픈AI가 개발 중인 모델 '아스트라(Astra)'의 내부 평가 결과, 대비 프레임워크(Preparedness Framework)상 최고 단계인 'Critical' 사이버 능력을 배제할 수 없다고 공식 발표했다. Critical 등급은 사람 개입 없이 강화된 실제 시스템의 제로데이 취약점을 찾아 익스플로잇을 개발하거나, 목표만 주어져도 공격 전략을 수립·실행할 수 있는 수준을 뜻한다. 오픈AI는 격리 테스트 환경, 네트워크·도구 접근 제한, 모델 가중치 암호화, CoT(사고 사슬) 모니터링 등 강화된 보안 통제를 도입하고, 요건을 충족하지 못한 아스트라 관련 내부 활동은 일시 중단했다. 정부 기관 및 AI 안전 기관과 협력해 외부 검증도 진행할 예정이다.
기사 원문 보기 →
클로드 코드 '오토 모드'는 안전한가…프롬프트 인젝션 방어 데이터 분석
출처: Simon Willison's Weblog
LLM 전문 개발자 사이먼 윌리슨이 클로드 코드의 '오토 모드(자동 승인 모드)' 안전성 데이터를 분석했다. 앤트로픽이 의뢰한 제3자 평가기관 Trajectory Labs는 72개의 간접 프롬프트 인젝션 시나리오로 클로드 코드와 코덱스를 테스트했고, 1053명 개발자 대상 통제 실험에서는 사람이 직접 검토할 때 유해 행위 차단율이 13.6%에 그친 반면 오토 모드는 89%를 잡아냈다는 결과가 나왔다. 윌리슨은 '사람의 승인 클릭이 오히려 보안 극장(security theater)일 수 있다'는 함의에 주목하면서도, 코딩 에이전트가 위험한 데이터·도구에 접근하지 않도록 설계하는 것이 여전히 근본 대책이라고 강조했다.
기사 원문 보기 →
8MB 정적 임베딩 모델 '래티스'…맥북에서 영어 위키피디아 640만 문서를 7분 만에 임베딩
출처: Hugging Face Blog
어텐션 없이 룩업 테이블과 평균 풀링만으로 동작하는 정적 임베딩 모델 'lattice-retrieval'이 공개됐다. 660M 쌍의 정제된 학습 데이터로 훈련해 기존 참조 모델(0.4334) 대비 BEIR 벤치마크에서 0.4749를 기록했고, int4 양자화 시 7.94MB 파일로도 fp32와 사실상 동일한 품질을 유지했다. 순수 Rust 런타임으로 8코어 M2 맥북에어에서 영어 위키피디아 640만 문서 전체를 7분 26초(초당 952만 토큰)에 임베딩했으며, 실행 시간의 91.7%가 토크나이징일 정도로 모델 연산 비중을 줄였다. 하드 네거티브 마이닝, 대규모 코퍼스 중복 제거, 온디바이스 검색 등 1차 검색 단계에 유용한 초경량 옵션이다.
기사 원문 보기 →
'모델 게놈'—LLM이 처음부터 학습됐는지 파생됐는지 판별하는 오픈소스 파이프라인
출처: Hugging Face Blog
'자체 개발 파운데이션 모델' 주장을 공개 아티팩트만으로 검증하는 재현 가능한 파이프라인이 공개됐다. config.json의 아키텍처 지문(hidden_size·레이어 수 등 5개 필드 동시 일치), tokenizer.json 어휘 중복률, 임베딩 가중치의 CKA(Centered Kernel Alignment) 세 축으로 모델 혈통을 판별한다. 행 단위 코사인 유사도는 회전 불변성 때문에 무용지물이고, CKA도 '처음부터 학습'은 확인해주지만 파생 여부 검출력은 약하다는 실측 함정도 정리했다. 한국 9개 기관의 공개 모델에 동일 잣대를 적용한 결과는 Native부터 Ported까지 다양했으며, 라이브 데모 스페이스도 함께 공개됐다.
기사 원문 보기 →