Benchmark Social 0.1: RL & Post Training의 커버 이미지
Benchmark Social 0.1: RL & Post Training의 커버 이미지
Avatar for Team Attention
등록
승인 필요
등록은 호스트의 승인이 필요합니다.
환영합니다! 이벤트에 참여하려면 아래에서 등록해 주세요.
이벤트 소개

Benchmark Social 0.1: RL & Post Training

프론티어를 따라잡으려면, 흩어지지 말고 뭉쳐야합니다.

현 상황에 대한 Evidence

  • 프론티어 모델의 Post-training의 연산량은 Pre-training을 뛰어 넘었습니다.

  • RL 데이터 시장은 분기마다 두 배씩 성장하고 있습니다. 데이터 마켓 붐입니다. Post-training 때문입니다.

하지만 한국에서는 놀라울 정도로 관심을 받지 못합니다.

바야흐로 Agentic Post-training의 시대. 모여서 지식을 나누고 싶습니다.

  • Model side: RL, post-training, reward hacking, eval, safety

  • Data side: RLVR data, Synthetic generation, Quality control, Reward hacking

  • Chip side: GPU cloud, compiler, cluster, accelerator, training과 inference

  • Founders & VCs: 이 씬의 창업자들과 투자자들

대규모 RL 실험, 합성 환경 scaling과 QC, reward hacking 과의 전쟁, 다양한 실험과 실패 경험까지. 우리가 하고 있는 경험은 생각보다 더 가치가 있습니다.

Speakers

  • [Opening] 정구봉: Harvey의 Kimi K3 학습으로 읽는 새로운 비즈니스 해자 "RL + OpenWeight + Own Data = Vertical Lab"

  • [From Founder] 박종원 (Delphik, ex-Krafton): 에릭슈미트 펀드부터 Fortune 500 AI VP 에게 DM 러브콜 받은 이야기. "RL Task의 퀄리티를 어떻게 측정할 것인가?"

  • [From Data Lab] 박수민 (Turing, MTS - Terminal Bench Lead): 프론티어 데이터 회사에서 Terminal Bench 팀을 총괄하며 퀄리티와 가격을 최적화한 경험. "프론티어 데이터는 이렇게 만들어진다."

  • [From Benchmark] 박준하: Terminal Bench 3에 태스크를 제출하고, Mercor에서 리뷰어를 한 이야기. "실제 작업자 관점에서 좋은 RL Task를 만드는 방법"

  • [From Model Lab] 곧 공개됩니다

Sponsors

Host 정구봉 & 박종원 by Team Attention

welcome to Team Attention Lab
https://www.team-attention.com

AI-native Founder를 위한 community입니다.

Next Meetup

Benchmark Social 0.2: Global Presence — October 23

Motif Technologies 임정환 대표와 함께, 한국 AI 씬이 글로벌로 가는 길을 이야기합니다.

장소
NAVER D2SF 강남 (서울 서초구 서초대로74길 14 삼성화재 서초타워 18층)
Avatar for Team Attention