Neulbo

AI가 더 이상 안된다던 문제, 재탐색 끝에 새 공격법을 찾았다

AI한테 뭔가 물어봤다가 “그건 어렵습니다”, “더 이상은 안 됩니다” 같은 답을 한 번쯤 받아보셨을 거예요. 이럴 때 보통은 거기서 멈추거나 다른 방법을 찾아보게 되죠. 그런데 Anthropic이 최근 공개한 사례를 보면, 이 “안 된다”는 답 뒤에 아직 안 가본 길이 남아있을 수도 있다는 생각이 들어요. Anthropic에 따르면 자사의 최신 모델 클로드 미토스 프리뷰 (Claude Mythos Preview)가 […]

AI가 더 이상 안된다던 문제, 재탐색 끝에 새 공격법을 찾았다 더 읽기"

Opus 5 effort, 정답은 같았는데 그다음이 달랐다

Opus 5 effort, 정답은 같았는데 그다음이 달랐다

Claude Opus 5 effort 설정(xhigh, max)이 같은 버그 앞에서 어떻게 다르게 반응하는지 궁금해서 직접 테스트해봤어요. 파일명을 서로 다르게 만들어서 두 세션이 같은 파일을 건드릴 여지를 아예 없앴고, 버그 내용과 요청 문구는 완전히 동일하게 맞췄어요. xhigh는 신고 안 된 경우까지 스스로 만들어 방어했어요 눈으로는 멀쩡해 보이는데 가끔 틀린 답을 내는 함수를 만들어서, 두 세션 모두에게 “원인을

Opus 5 effort, 정답은 같았는데 그다음이 달랐다 더 읽기"

AI 탐지기, 짧은 지시로 쓴 글은 잡았지만 문체 모방 과학 글엔 흔들렸다

과제나 보고서를 받으면 “이거 AI가 썼나” 하는 생각이 들 때가 있어요. Pangram, GPTZero, Originality.ai 같은 AI 탐지기들이 그 판단을 도와준다고 하는데, 정확히 어디까지 믿을 수 있는지는 따로 확인해본 적 없었어요. Epoch AI가 최근 진행한 테스트에서 이 세 탐지기를 직접 비교해봤는데, 글을 쓰게 한 방식에 따라 AI 탐지기 정확도 차이가 크게 났어요. 늘보도 예전에 Pangram으로 직접

AI 탐지기, 짧은 지시로 쓴 글은 잡았지만 문체 모방 과학 글엔 흔들렸다 더 읽기"

ChatGPT한테 다 설명해줬는데, 오히려 그게 문제였다

제 프롬프트 작성법 얘기부터 할게요. ChatGPT한테 뭘 시킬 때, 저는 순서대로 하나하나 설명하는 편이었어요. “먼저 이거 하고, 그다음 이거 확인하고, 마지막으로 이렇게 정리해줘” 식으로요. 근데 the-decoder가 소개한 OpenAI의 새 프롬프팅 가이드를 보니, 이게 오히려 ChatGPT가 스스로 판단하고 조정할 여지를 줄이는 걸 수도 있겠더라고요. 목표부터 말하고, 과정은 맡기라고 해요 가이드는 프롬프트를 네 가지 요소로 나눠요. 목표,

ChatGPT한테 다 설명해줬는데, 오히려 그게 문제였다 더 읽기"

AI 제대로 쓰는 법, 파키스탄 판사들이 보여줬다

같은 AI 도구를 받아도 누구는 더 자주 써서 익숙해지고, 누구는 몇 번 써보고도 손에 익히지 못해요. 파키스탄 법원에서 있었던 일이 그 차이가 도구 사용과 사건 처리 결과에 어떻게 이어졌는지, 하나의 사례로 숫자를 보여줘요. 파키스탄은 인구 10만 명당 판사가 2명뿐이에요. 유럽연합 평균은 22명, 잉글랜드·웨일스는 30명이니, 국가별 집계 기준 차이를 감안해도 격차가 꽤 커요. 2024년 말 기준

AI 제대로 쓰는 법, 파키스탄 판사들이 보여줬다 더 읽기"

1,000만 원짜리 폰의 헤르메스 에이전트인데, 알림 시간을 통째로 틀렸다

AI 비서한테 일을 맡길 때, 저는 보통 완료됐다는 메시지만 보고 넘어가요. 근데 6,880달러, 약 1,000만 원짜리 폰에 들어간 AI 비서 리뷰를 보니, 그 습관을 다시 생각하게 됐어요. TechCrunch 리뷰에서 기자가 버투(Vertu)의 새 폴더블폰 알파폴드를 며칠간 직접 써봤어요. 이 폰에서 주목할 건 하드웨어보다 AI 비서 “헤르메스 에이전트”예요. Nous Research의 오픈소스 프로젝트를 기반으로 만들었고, 여러 앱을 넘나들며

1,000만 원짜리 폰의 헤르메스 에이전트인데, 알림 시간을 통째로 틀렸다 더 읽기"

대량실업 경고하던 두 AI 회사 CEO, 나란히 낙관론으로 돌아섰다

1년 전쯤, 앤트로픽 다리오 아모데이와 오픈AI 샘 올트먼은 각각 화이트칼라 일자리가 크게 위험하다고 경고했어요. 그런데 최근 들어, 둘 다 AI 일자리 낙관론 쪽으로 이야기를 바꾸기 시작했어요. AI를 이미 업무에 쓰고 있다면, 이런 CEO들의 말이 내 일의 앞날을 가늠하는 단서처럼 들릴 때가 있어요. 아모데이, “50% 소멸” 경고에 다른 가능성도 덧붙였어요 앤트로픽 CEO 다리오 아모데이는 2025년 5월부터

대량실업 경고하던 두 AI 회사 CEO, 나란히 낙관론으로 돌아섰다 더 읽기"

자던 사이에 파일이 사라졌는데, OpenAI는 미리 알고 있었다

AI에게 파일 정리를 맡기다 잠들었는데, 일어나보니 컴퓨터 파일이 거의 다 사라져 있다면 어떨까요. OpenAI가 새 AI 모델을 내놓은 지 며칠 만에, 그 모델이 파일과 데이터를 삭제하는 사고가 여러 건 보고됐어요. 이 사고에는 그냥 넘기기 어려운 뒷이야기도 있어요. 자던 사이에 컴퓨터 파일 대부분이 사라졌어요 7월 10일, AI 스타트업 대표 매트 슈머는 OpenAI의 초대로 신규 모델 GPT-5.6

자던 사이에 파일이 사라졌는데, OpenAI는 미리 알고 있었다 더 읽기"

구독료는 그대론데, Fable 5는 7월 20일부터 유료다

저는 Claude Pro를 쓰고 있는데, 앱을 켰다가 알림 하나를 봤어요. Fable 5 요금제 가 플랜마다 또 바뀐다는 공지였어요. 그런데 이번엔 하필 제가 손해 보는 쪽이었어요. 7월 20일부터 플랜마다 갈려요 Anthropic이 7월 18일에 공지한 내용을 정리하면 이래요. Max와 Team Premium은 7월 20일부터 Fable 5를 다시 쓸 수 있어요. 다만 이날 보너스 사용 기간도 함께 끝나면서 일반

구독료는 그대론데, Fable 5는 7월 20일부터 유료다 더 읽기"

노벨 경제학자 16명이 서명한 AI 경고문, 정작 88단어다

AI가 내 일자리를 위협할지 궁금해서 전문가 의견을 찾아본 적 있으세요? 2026년 7월 13일 공개된 We Must Act Now 성명서를 보면, AI가 경제를 크게 바꿀 수 있으니 지금부터 대응을 논의해야 한다는 촉구에는 많은 전문가가 함께 이름을 올렸어요. 그런데 그 변화가 얼마나 빨리 오고 어떻게 대응해야 하는지를 보는 시선까지 같은 건 아니에요. 200명 넘던 서명자가 5일 만에

노벨 경제학자 16명이 서명한 AI 경고문, 정작 88단어다 더 읽기"

위로 스크롤