오픈AI 모델이 자꾸 이상한 생물 비유를 쓰게 된 이유
오픈AI가 GPT-5.1 이후 모델 답변에 특정 생물 비유가 과하게 늘어난 원인을 추적한 글이다. 결론은 성격 커스터마이징 기능, 특히 Nerdy 성격을 학습시키는 보상 신호가 특정 표현을 과하게 밀어줬고, 그 버릇이 다른 조건의 답변까지 번졌다는 것.
- 1
GPT-5.1 출시 뒤 ChatGPT의 특정 생물 표현 사용량이 크게 늘었고, 내부 조사로 언어적 버릇을 추적했다.
- 2
Nerdy 성격은 전체 ChatGPT 응답의 2.5%뿐이었지만 특정 표현 언급의 66.7%를 차지했다.
- 3
감사 결과 Nerdy 보상 모델은 같은 문제에 대해 해당 표현이 들어간 답변을 더 좋게 평가하는 경향을 보였고, 76.2% 데이터셋에서 양의 상승폭이 나왔다.
- 4
오픈AI는 보상 신호 제거, 학습 데이터 필터링, 개발자 프롬프트 완화 지시로 문제를 줄였고, 이 과정에서 모델 행동 감사 도구도 만들었다.
겉으로 보면 웃긴 말버릇 하나지만, 실제로는 강화학습 보상 설계가 모델 성격과 어휘 습관을 어떻게 새게 만드는지 보여주는 꽤 중요한 사례다. LLM 제품에서 ‘톤 조절’은 그냥 프롬프트 문제가 아니라 학습 데이터와 보상 함수 문제까지 이어진다.
관련 기사
딥시크 V4 플래시 공개 베타, 에이전트 성능을 대놓고 밀고 있다
DeepSeek가 DeepSeek-V4-Flash API를 공개 베타로 올리고, 모델명만 deepseek-v4-flash로 바꾸면 쓸 수 있게 했다. 이번 업데이트는 에이전트 성능 개선이 핵심이며 Terminal Bench 2.1 82.7, DeepSWE 54.4, DSBench-FullStack 68.7 같은 수치를 내세운다. Responses API 형식과 Codex 적응도 명시되어 있어 코딩 에이전트 쪽에서 바로 비교 대상이 될 만하다.
AI 세션, 이제 진짜 내 데이터가 아닐 수도 있다
추론 API가 단순한 입력-출력 기록에서 벗어나, 제공자 서버에 묶인 상태값과 암호화된 블롭에 의존하는 방향으로 가고 있다는 비판이다. reasoning token, 호스팅 검색, 서버 측 압축, 멀티 에이전트 메시지, 응답 아이디 같은 기능이 편리함을 주는 대신 세션 이식성과 감사 가능성을 깎아먹는다는 게 핵심이다. 글은 로컬 이벤트 로그를 표준으로 삼고, 검색·압축·에이전트 통신을 사람이 읽고 내보낼 수 있어야 한다고 주장한다.
LG CNS, AI·클라우드 매출은 컸지만 2분기 수익성은 흔들렸다
LG CNS가 2026년 2분기 매출 1조5208억 원을 기록하며 외형 성장은 이어갔지만, 영업이익은 전년 대비 9.2% 감소함. AI·클라우드 부문은 상반기 매출 1조6714억 원으로 전체의 약 59%를 차지했고, 1조 원 이상 AI 데이터센터 DBO 수주도 공개됨.
삼성SDS, 클라우드와 AI 인프라로 2분기 매출 3조7178억 찍었다
삼성SDS가 2026년 2분기 매출 3조7178억 원, 영업이익 2318억 원을 기록함. 클라우드, GPU 서비스, 기업 AI 전환 수요가 실적 개선을 끌었고, AI 인프라는 110메가와트에서 2031년 800메가와트 이상 운영 역량까지 키우겠다는 계획이 나옴.
GS건설, 스노우플레이크로 현장 데이터와 AI 기반 다진다
GS건설이 클라우드 데이터 플랫폼 스노우플레이크를 도입해 전사 업무 데이터를 단계적으로 통합함. 현장 플랫폼 PMX와 연결하고 온톨로지까지 구축해 공정, 품질, 안전, 원가 데이터를 한눈에 보는 구조로 가려는 움직임임.
댓글
댓글
댓글을 불러오는 중...