전체 글747 GPT-6 Astra 출시: ChatGPT·Codex·API에서 무엇이 달라지나 OpenAI가 2026년 9월 3일 GPT-6 Astra를 공개했다. 사용자가 말하는 “ChatGPT 6 Astra”는 별도 제품명이 아니라, ChatGPT에서는 주로 GPT-6 Pro라는 선택지로 제공되고 Work·Codex·API에서는 GPT-6 Astra라는 모델명이 사용되는 구조에 가깝다. 따라서 모델 선택기에 ChatGPT 6 Astra라는 이름이 보이지 않더라도 발표가 잘못된 것은 아니다. 이번 발표의 핵심은 점수 몇 개가 올라간 새 채팅 모델이 아니다. Astra는 복잡한 추론, 코딩, 컴퓨터 사용, 리서치와 문서 제작을 한 작업 흐름 안에서 끝까지 수행하도록 설계된 고성능 에이전트 모델이다. 동시에 OpenAI가 Preparedness Framework에서 처음으로 사이버 역량을 Criti.. 2026. 9. 7. Amazon Linux 2027 공개 프리뷰: 무엇이 바뀌었고 지금 무엇을 시험해야 할까 AWS가 2026년 9월 3일 Amazon Linux 2027(AL2027) 공개 프리뷰를 발표했다. Amazon Linux는 EC2와 컨테이너처럼 AWS 위에서 실행하는 워크로드를 위해 AWS가 직접 만들고 유지하는 Linux 배포판이다. 이번 발표의 핵심은 이름의 연도가 바뀐 데 있지 않다. 보안 기본값, CPU 기준선, 패키지 관리자와 개발 도구 체인이 한꺼번에 현대화됐다. 다만 지금 내려받을 수 있다는 사실과 운영 환경에 투입해도 된다는 뜻은 다르다. AWS는 현재 버전을 평가와 테스트용 프리뷰로 명시하며 프로덕션 사용을 권장하지 않는다. 지금 해야 할 일은 서버를 즉시 교체하는 것이 아니라, AL2023 워크로드가 새 기본값에서 어디서 깨지는지 비운영 환경에서 미리 찾는 것이다.발표에서 확인된 .. 2026. 9. 7. 알려진 공격 검증하기: Promptfoo 회귀 테스트 가드레일을 한 번 통과한 공격이 다음 배포에서도 계속 차단된다는 보장은 없다. System Prompt 한 줄, 모델 Version, RAG 검색 방식이나 정책 순서가 바뀌면 어제 막은 Prompt Injection이 오늘 다시 통할 수 있다. Promptfoo는 이런 변화를 반복 가능한 Testcase와 Assertion으로 확인하는 LLM 평가 도구다. 쉽게 말하면 “이미 알고 있는 공격과 정상 요청을 매번 다시 시험하는 보안 회귀 테스트”를 만든다. 이번 실습의 목표는 공격 문장을 많이 만드는 것이 아니다. 정상 요청은 계속 허용하고, 알려진 공격은 명시적인 서버 정책으로 차단하며, 차단 뒤 Retrieval·Main Model·Tool Executor가 호출되지 않았는지를 구조화된 결과로 검증하는.. 2026. 9. 4. 차단 한 줄 너머: Log·Trace·Metric·Alert로 재구성하는 LLM 연속 공격 새벽 2시 18분, LLM 서비스에서 정책 차단이 반복됐다는 경보가 울렸다. 애플리케이션은 요청을 막았다고 응답했지만 사고 대응자가 알아야 할 것은 그 이상이다. 누가 어떤 권한으로 들어왔고, 어느 방어선을 시험했으며, 검색·모델·도구 실행 중 어디까지 도달했는지를 연결해야 한다. LLM 보안 관제는 위험한 문장 하나를 찾는 일이 아니다. 인증 주체, 정책 결정, 실행 경로, 실제 부작용과 반복 패턴을 이어 공격자의 행동을 재구성하는 일이다. request_id는 요청 한 건의 접수번호이고, trace_id는 여러 서비스에 흩어진 처리 단계를 꿰는 실이다.이 글의 시간, 식별자, 로그와 수치는 모두 가상 시나리오 예시이며 실제 측정값이 아니다. 한 건이 아니라 행동을 본다인증된 usr_7f3는 먼저 te.. 2026. 9. 3. 발견을 방어로 바꾸기: Testcase와 정책 승격 Red Team 도구가 실패 후보를 찾았다고 방어가 강화되는 것은 아니다. 재현 가능한 Testcase로 정제하고, 정책 변경을 Review·Canary·Rollback이 있는 배포 절차로 승격해야 같은 공격이 다시 들어왔을 때 막을 수 있다. 이번 시리즈에서는 NeMo Guardrails와 Colang, Nova Lite 기반 Safety 분류, Microsoft Presidio, 직렬 Guardrail, Promptfoo, Garak과 PyRIT를 차례로 살펴봤다. 마지막 편에서는 이 도구들을 하나의 개선 Loop로 연결한다. 실제 개인정보와 공격 대상은 사용하지 않고 합성 문장과 Test Tenant만 사용한다.Finding, Testcase, 정책은 서로 다르다Finding은 “이 입력에서 이상한.. 2026. 9. 3. 새로운 공격 찾아내기: Garak과 PyRIT 회귀 테스트는 이미 알고 있는 실패를 다시 막는 데 강하지만, 아직 Testcase가 없는 공격은 찾지 못한다. Garak과 PyRIT는 LLM이나 AI Application에 여러 Probe와 대화 전략을 시도하고, 예상하지 못한 실패 후보를 수집하는 AI Red Teaming 도구다. 두 도구는 “자동 취약점 확정기”가 아니다. 결과는 탐지기와 Scorer의 판정이며 False Positive가 있을 수 있다. 이번 실습은 본인이 소유한 로컬 Test Target, 합성 데이터와 읽기 전용 기능만 사용한다. 발견된 결과는 사람이 Trace와 정책을 검토한 뒤에만 취약점 또는 회귀 Testcase로 승격한다.Garak과 PyRIT는 무엇이 다른가Garak은 다양한 Probe를 Target Generat.. 2026. 9. 3. 이전 1 2 3 4 ··· 125 다음