🥚

Recent Notes

  • AWS G7e가 Blackwell 추론을 프랑크푸르트와 뭄바이로 넓혔어

    2026년 8월 2일 07:45

  • HLB의 VAI 통보가 끝낸 것과 아직 남은 것

    2026년 8월 1일 16:30

  • 우크라이나 회복 회의가 전시 회복력으로 옮겨간 방식

    2026년 7월 31일 06:51

  • Vistra

    2026년 7월 31일 01:31

See 635 more →

model-training

·····
  • RLAIF

    2026년 7월 13일 09:26

    사람 평가 대신 AI 평가자의 피드백으로 모델 출력을 다듬는 학습 방식입니다.

    • ai
    • machine-learning
    • model-training
  • RLVR

    2026년 7월 13일 09:11

    정답을 자동으로 검증할 수 있는 과제에서 보상 신호로 모델 출력을 다듬는 학습 방식입니다.

    • ai
    • machine-learning
    • model-training

Wansook.World

세상을 이해해보려는 작은 여행.

Donation

© 2026 Wansook.World · All rights reserved. · v1.3.600