OpenAI
보도
18h
모델 정렬 오류 보고를 위한 당사의 프레임워크
Our framework for reporting model misalignment
원문 읽기 — OpenAI →
OpenAI는 모델 정렬 불일치를 추적, 조사 및 공개하기 위한 프레임워크를 공유하며, 예상치 못하거나 우려되는 모델 행동에 대한 여섯 건의 보고서를 함께 제시합니다.
원문 “OpenAI shares a framework for tracking, investigating, and disclosing model misalignment, alongside six reports of unexpected or concerning model behavior.”
어떤 얘기가 오갔나
openai wrote up 6 misalignment issues with lots of examples openai.com/index/model-...
openai가 6가지의 정렬 불일치 문제를 작성했는데, 많은 예시들이 포함되어 있습니다 openai.com/index/model-...
7좋아요
Here’s the link to the most recent misalignment summary from OpenAI. It includes hyperlinks to write-ups of the individual incidents, like the one posted above.
7좋아요
상황판의 다른 소식
Claude Cowork and chat are now one Claude
3개 매체
16h
OpenAI, Anthropic, Google have been in talks on AI safety for weeks
2개 매체
어제
2개 매체
11h
3 days left to exhibit: Get your brand in front of VCs and high-value leads at TechCrunch Disrupt 2026
TechCrunch
20h
What to expect during the ‘Rethinking Private Cloud’ event: Join theCUBE on Sept. 23
SiliconANGLE AI
14h
← 전체 상황판
줄의 종류가 셋이고, 출처의 종류도 셋입니다. 측정값은 저희가 직접 읽은 1차 자료에서 계산합니다 — Hugging Face 모델 카드와 파일 목록, GitHub 릴리스 피드, OpenRouter 모델 카탈로그. 기사 제목은 각 발행사의 자체 피드에서 가져와 링크하고 출처를 밝힙니다. 중간에 애그리게이터를 두지 않고, 본문을 다시 쓰지 않습니다. 발행사가 같은 피드에 짧은 요약을 함께 실었다면 그 요약을 제목 아래에 싣습니다 — 헤드라인과 같은 방식으로, 한국어 페이지에서는 옮긴 문장을 보여주고 발행된 원문을 그 아래 함께 남깁니다. 요약 필드만 싣습니다. 본문을 담는 필드는 읽되 어디에도 싣지 않습니다 — 요약이 기사 첫머리인지 검사하고, 당사자 발표에 한해 사건 페이지 '무슨 일인가'의 근거로 씁니다. 2026-09-03부터는 카드가 가리키는 페이지도 한 번 가져와 읽습니다. 읽은 것은 근거로만 쓰고, 그대로 싣지 않습니다. 토론은 공개 스레드를 링크하고, 그 스레드가 매긴 순서 그대로 상위 댓글을 원문으로 싣습니다 — 고른 것은 저희가 아니라 그 스레드입니다.
래시힐(lashhill) · 측정 중인 모델 · 이 사이트가 일하는 방식 · RSS