Astra를 조기에 테스트해 보았습니다. OpenAI의 이 완전히 새로운 모델에 대해 모든 비즈니스 전문가가 꼭 알았으면… — Bad Onion 나쁜양파 — TG.ME

꿈을 담는 단지https://x.com/alliekmiller/status/2095595935002742975?s=20
Astra를 조기에 테스트해 보았습니다.

OpenAI의 이 완전히 새로운 모델에 대해 모든 비즈니스 전문가가 꼭 알았으면 하는 점들은 다음과 같습니다:

1) 컴퓨터 사용(Computer use)과 브라우저 사용(Browser use) 기능이 그저 놀라울 정도입니다.
컴퓨터로 수행되는 안정적인 업무 워크플로라면 거의 대부분 AI가 최소한 부분적으로라도 대신 처리할 수 있다고 확신합니다(네, 다소 유보적인 표현이 들어갔다는 점은 인정하지만, 제가 미처 확인하지 못한 예외적인 사례들도 분명히 있을 테니까요). 정말이지 너무나 훌륭합니다. 여러분이 꼬장꼬장한 상사가 되어 자신의 화면을 7일 내내 녹화했다고 상상해 보십시오... 지금까지 본인이 해오던 일 중 어떤 작업을 AI에게 시키시겠습니까? 하루 동안 마우스를 전혀 쓰지 않고 작업해보는 도전을 해보실 수 있겠습니까?

2) 복잡한 말장난(Word play) 챌린지는 여전히 통과하지 못했습니다. 아직 이 테스트를 통과한 모델은 없습니다.

3) 나를 화나게 하지 않았습니다. 이 점은 아무리 강조해도 지나치지 않습니다. 최근 몇 주 동안 Claude가 때때로 지나치게 복잡하고 극도로 기술적인 답변을 내놓는 바람에 Claude에게 소리를 지르는 일이 점점 더 많아졌습니다(오죽하면 이에 대처하기 위해 새로운 '/wtf' 스킬까지 만들어 적용했고, 제 전체 AI 작업 비중에서 Codex의 비율이 급증하여 Claude Code 데스크톱 앱 사용 빈도가 점점 줄어들고 있을 정도입니다). 예전에는 Claude가 글을 더 잘 쓴다고 말하곤 했지만, 이제는 더 이상 그렇게 말하지 않습니다.

4) 일상적인 메인 작업 도구(Daily driver)로는 Codex가 더 낫습니다.

5) Fable 계열 모델을 쓸 때처럼 토큰 소모를 걱정하지 않아도 됩니다(단, Opus를 쓸 때도 토큰에 대해 크게 걱정하지 않는다는 점은 짚고 넘어가야겠습니다).

6) 다른 사용자들은 3D와 애니메이션 관련 테스트를 많이 진행했습니다.
저는 직접 해보지 않았지만, 그들은 결과물에 매우 만족해하는 것 같습니다. 저는 그들의 결과물을 보았을 때 아주 크게 놀라지는 않았지만, 그래도 괜찮습니다. 저는 무에서 유를 창조한 세계를 보고 싶은 것이 아니라, 명확한 기준점(Reference points)을 바탕으로 구현된 정확한 세계를 보고 싶기 때문입니다. AI가 무에서 유를 생성할 수 있다는 것은 알지만, 대부분의 실제 업무는 그렇게 시작되지 않습니다.

7 ) "초대형 아키텍트 구축(Mega architect build)" 같은 고난도 요청에는 아마 여전히 Fable 5.1을 찾을 것 같습니다.
❤2
September 4, 2026 378 7