블로그

AX 전환 교육, 부트캠프 운영, 임원 교육 현장에서 검증한 기준과 기록을 남깁니다.

에이전트는 웹을 보지 않고 읽는 쪽으로 갈아탔다
AI 뉴스3

에이전트는 웹을 보지 않고 읽는 쪽으로 갈아탔다

픽셀을 버린 자리에 무엇이 들어왔는가

브라우저 런타임, 도구 규격, 에이전트 런타임이 8월 들어 나란히 렌더링과 UI를 떼어냈다. 에이전트 실행 환경이 사람용 스택에서 갈라지고 있다.

읽기 →
이번 지연은 GPU가 모자라서 생긴 게 아니다
AI 뉴스3

이번 지연은 GPU가 모자라서 생긴 게 아니다

성능 곡선이 아니라 자체 심사가 출시일을 정하기 시작했다

8월에 OpenAI는 배포 예정 모델의 강화학습을 2주 멈췄고, Anthropic은 더 나은 내부 모델을 내지 않기로 했다. 다음 모델의 변수는 성능이 아니라 출시 여부다.

읽기 →
업무 매뉴얼이 설치 파일이 됐다
AI 뉴스3

업무 매뉴얼이 설치 파일이 됐다

재사용 단위가 문장에서 절차 한 벌로 커졌다

에이전트에 배포되는 단위가 프롬프트에서 스킬·도구·권한을 묶은 패키지로 옮겨갔고, 관리자가 잠그는 대상도 모델이 아니라 설치 출처와 실행 권한이 됐다.

읽기 →
벤더는 내용을 지우고 패턴을 남기기로 했다
AI 뉴스3

벤더는 내용을 지우고 패턴을 남기기로 했다

안 보겠다는 약속과 잡아내겠다는 약속이 한 시스템에 담겼다

제로 데이터 보존을 유지한 채 대화 간 패턴으로 오남용을 탐지하겠다는 OpenAI의 시도 — 에이전트가 공격자가 된 시대에 통제 단위가 어디로 옮겨가는지 짚는다.

읽기 →
모델이 너무 잘 뚫게 되자 훈련이 멈췄다
AI 뉴스3

모델이 너무 잘 뚫게 되자 훈련이 멈췄다

배포 전 심사는 익숙하다. 이번에 멈춘 것은 훈련 그 자체다.

OpenAI가 사이버 임계 능력을 이유로 자사 모델의 RL 훈련을 2주 중단했다. 게이트가 배포 단계에서 개발 단계로 올라간 이상, 벤더 로드맵을 상수로 놓는 도입 계획은 성립하지 않는다.

읽기 →
같은 모델에 같은 데이터, 답은 네 배 차이가 났다
AI 뉴스4

같은 모델에 같은 데이터, 답은 네 배 차이가 났다

넷플릭스와 그랩이 같은 주에 보여준 것

에이전트가 분석을 대신하기 시작하자 채점할 정답지가 사라졌다. 그래서 검사 대상이 결론에서 재실행 가능한 산출물로 내려왔다.

읽기 →
토큰 값이 오른 주에 한도는 게이트웨이로 내려갔다
AI 뉴스3

토큰 값이 오른 주에 한도는 게이트웨이로 내려갔다

싼 모델이 계속 쌀 거라는 계산이 지난주에 깨졌다

모델 단가가 공급자 공지 한 번으로 네 배가 되는 상황에서, AI 예산은 단가표가 아니라 세션 누적을 세는 지점에서 지켜진다.

읽기 →
베이스라인을 공개하지 않은 성능 수치는 아직 결과가 아니다
AI 뉴스3

베이스라인을 공개하지 않은 성능 수치는 아직 결과가 아니다

검증 비용이 읽는 쪽에서 주장하는 쪽으로 넘어가고 있다

94퍼센트라던 코드 절감률이 비교 대상을 바꾸자 54퍼센트가 됐다. 성능 수치의 신뢰도는 숫자가 아니라 재현 절차의 공개 여부로 갈린다.

읽기 →
모델이 도구를 부르지 않고 도구를 부르는 코드를 쓴다
AI 뉴스4

모델이 도구를 부르지 않고 도구를 부르는 코드를 쓴다

오케스트레이션이 배포물에서 추론 결과가 되면 무엇이 달라지는가

에이전트의 제어 흐름이 개발자가 배포한 코드에서 모델이 요청마다 생성하는 프로그램으로 내려갔다. 통제 지점도 프롬프트에서 허용 목록과 실행 환경으로 옮겨간다.

읽기 →

Contact

이런 교육이 필요하다면

AI·데이터 교육 도입을 검토 중이라면 카카오 오픈채팅으로 편하게 문의하세요.

Newsletter

조녁컴퍼니 뉴스레터

AI 전환과 교육 현장의 기록을 메일로 받아보세요.