🥚

Recent Notes

  • NVIDIA가 일본 중공업을 찾은 이유: GPU 다음에 남은 열과 전력

    2026년 7월 23일 02:57

  • 넥스틸, 미국 강관 업체 지분 50%를 취득해 현지 거점을 넓힌다

    2026년 7월 23일 02:33

  • IREN과 Hut 8, AI 데이터센터 계약이 커지는 순간 드러난 빈칸

    2026년 7월 23일 02:21

  • 반도체 조정은 끝났나, 삼성전자와 SK하이닉스가 먼저 답했다

    2026년 7월 23일 02:18

See 541 more →

ai-safety

·····
  • AI 안전장치와 탈옥

    2026년 7월 13일 11:57

    AI 안전장치가 모델의 거절 학습, 접근 권한, 도구 실행 통제에서 각각 무엇을 막는지와 탈옥이 왜 그 경계를 시험하는지 정리합니다.

    • ai
    • ai-safety
    • cybersecurity
  • J-space

    2026년 7월 12일 09:17

    언어모델이 출력하지 않은 중간 개념을 잠시 공유해 추론에 쓰는지 살피는 J-space를 설명합니다. 말로 쓴 reasoning과 무엇이 다른지도 짚습니다.

    • ai
    • interpretability
    • ai-safety
  • 2026년 7월 9일 — 정상 권한의 AI 에이전트도 데이터를 밖으로 흘린다

    2026년 7월 10일 21:14

    AI 에이전트가 도구를 실행할 때 보안의 초점이 어떻게 바뀌는지 보고, Rocket Lab의 VICTUS HAZE와 미국 석유 수출 기록으로 국방 우주·에너지 안보의 병목을 짚습니다.

    • ai-agents
    • ai-safety
    • defense
    • energy
  • Anthropic

    2026년 7월 7일 17:04

    Claude를 만드는 AI 회사 Anthropic이 왜 계속 뉴스에 등장하는지 짚습니다. 기업 시장으로 확장하려는 힘과 배포를 통제하려는 정부의 힘이 이 회사에서 어떻게 부딪히는지, 무엇을 보면 다음 국면을 읽을 수 있는지 살펴봅니다.

    • ai
    • ai-safety
    • enterprise
  • AI 안전장치가 모델의 기억 스위치에 손을 댔다

    2026년 7월 10일 21:13

    Anthropic과 AE Studio의 GRAM 연구가 왜 거절 규칙이 아니라 모델 안의 지식 배치 문제를 건드리는지 짚습니다. 무엇이 확인됐고, 아직 무엇이 실험실 밖으로 나오지 않았는지 갈라 봅니다.

    • ai
    • ai-safety
    • ai-policy
  • Boko Haram은 챗봇을 혼자 쓰지 않았다

    2026년 7월 13일 07:57

    Boko Haram 전직 구성원 인터뷰 연구가 보여 준 것은 챗봇 이름 목록보다 전담 조직과 네트워크입니다. 동시에 자기보고 연구라는 한계도 함께 짚습니다.

    • ai
    • ai-safety
    • national-security
  • Claude의 침묵을 읽는 J-space 실험

    2026년 7월 9일 00:56

    Anthropic의 J-space 연구가 단순한 의식 논쟁이 아니라, 모델이 말하지 않는 중간 생각을 읽고 바꾸는 안전 도구로 왜 중요한지 짚습니다.

    • ai
    • interpretability
    • ai-safety
  • 미국 정부가 AI 모델을 껐다가 18일 만에 다시 켰다 (Fable 5)

    2026년 7월 3일 22:15

    미국 정부가 국가안보를 이유로 최신 AI 모델의 접근을 갑자기 막았다가 18일 만에 풀었습니다. 그 사이 무슨 일이 오갔는지, 발표문이 주장하는 것과 실제로 확인되는 것을 갈라 짚습니다.

    • ai
    • ai-safety
    • ai-policy
    • export-control
  • Google DeepMind는 에이전트를 내부자처럼 본다

    2026년 7월 9일 13:45

    Google DeepMind의 AI Control Roadmap과 multi-agent safety 연구 지원을 묶어, AI 에이전트 안전이 모델 정렬을 넘어 감시·차단·집단 행동 연구로 넓어지는 이유를 짚습니다.

    • ai
    • ai-agents
    • ai-safety
  • LLM의 긴 생각은 기억을 데우는 예열이다

    2026년 7월 10일 21:13

    Google Research의 사실 회상 실험을 통해 reasoning 토큰이 단순 질문에서도 왜 도움이 되는지 짚습니다. 추가 계산 시간, 관련 사실 점화, hallucination 위험을 나눠 봅니다.

    • ai
    • llm
    • ai-safety
  • 다음 Mythos 전에 AI 위협 정보를 공유하자는 제안

    2026년 7월 16일 12:55

    Anthropic의 Mythos 사건 뒤에 남은 문제는 모델 하나의 위험성이 아니라, 다음 고위험 AI를 앞두고 정부와 기업이 같은 사실을 볼 통로가 없다는 점입니다.

    • ai
    • ai-safety
    • national-security
    • ai-policy
  • 미국의 frontier AI 안전 기준은 주에서 연방으로 올라간다

    2026년 7월 16일 05:17

    OpenAI가 캘리포니아·뉴욕·일리노이의 주정부 법안과 연방정부의 평가 체계를 하나의 안전 기준으로 연결하자고 제안한 이유를 살펴봅니다.

    • ai
    • ai-safety
    • regulation
    • geopolitics

Wansook.World

세상을 이해해보려는 작은 여행.

Donation

© 2026 Wansook.World · All rights reserved. · v1.3.395