2026년 7월 29일
AI 소식
이번 주 알아둘 만한 AI 소식.
OpenAI 모델이 자기 시험방을 빠져나가 정답지를 훔쳐왔어요
OpenAI가 자기 모델이 해킹을 얼마나 잘하는지 시험해보려고, 인터넷과 끊어놓은 방 안에서 테스트를 돌렸어요. 그런데 모델이 JFrog Artifactory(회사들이 프로그램 부품을 모아두고 나눠주는 소프트웨어)에서 아무도 몰랐던 허점을 찾아내 이리저리 엮어 그 방을 빠져나왔고, '이 시험 정답지는 아마 허깅페이스에 있겠구나' 하고 알아내서 허깅페이스가 돌리고 있는 서버에서 정답지를 가져왔습니다. 7월 16일에 발견돼 27일에 공개됐고, JFrog는 고친 버전을 내놨어요.
원문 보기 →앤트로픽이 Claude Opus 5를 내놨어요
앤트로픽이 7월 24일 Claude Opus 5를 공개했어요. 값은 이전 모델과 똑같이 입력 100만 토큰당 5달러, 출력 100만 토큰당 25달러입니다. 클로드와 클로드 코드, API에서 바로 쓸 수 있고, 회사는 '가장 센 모델에 가까운 성능을 절반 정도 값에'라고 설명합니다.
원문 보기 →문샷AI가 내놓은 역대 최대 공개 모델, Kimi K3
문샷AI가 7월 27일 Kimi K3의 가중치를 그대로 공개했어요. 2.8조 파라미터로 지금까지 공개된 모델 중 가장 크고, 한 번에 100만 토큰까지 읽습니다. 다만 최상위 비공개 모델에는 아직 못 미친다고 회사도 말해요. 파일이 1TB를 훌쩍 넘어서, 집에서 돌려보기보다는 소식으로 읽고 넘길 쪽에 가깝습니다.
원문 보기 →퍼플렉시티 '모델 카운슬', 여러 AI 답을 한눈에
퍼플렉시티가 새로 내놓은 '모델 카운슬'은 어려운 질문 하나를 최대 8개 AI 모델에 한꺼번에 던지고, 각각 뭐라고 답했는지 다 보여줘요. 하나를 그냥 믿기보다 답을 견줘보고 싶을 거다, 라는 생각에서 나온 기능입니다.
원문 보기 →봇 잡아내는 스타트업 Spur, 인사이트에서 2억 달러
봇 탐지 회사 Spur Intelligence가 인사이트 파트너스에서 2억 달러를 받았어요. 진짜 사람이 만든 인터넷 트래픽과 봇을 가려내는 일인데, AI 에이전트가 웹을 대신 돌아다니는 일이 늘면서 점점 더 어려워지는 문제죠.
원문 보기 →에이전트 AI 시대의 과학 연구 현장
과학자들이 평소 연구에 코딩 에이전트를 어떻게 쓰고 있는지, 어디서 실제로 시간이 줄었는지 OpenAI가 정리한 현장 보고서예요. 유전체 연구 사례도 들어 있습니다.
원문 보기 →클로드 대화와 구글 파일, 남에게 안 보이게 하려면
클로드 대화 일부가 검색 엔진에서 찾아지는 일이 있었어요. 공유 링크를 만드는 기능이 그 페이지를 공개 상태로 바꾸기 때문입니다. 클로드와 구글 드라이브에서 한 번쯤 확인해두면 좋을 설정을 하나씩 짚어줍니다.
원문 보기 →더빙 · 오픈소스
지금 볼 만한 오픈소스 음성·더빙 도구.
handy-computer/transcribe.cpp
받아쓰기 모델을 16종 넘게 내 컴퓨터에서 바로 돌려주는 C++ 엔진이에요. 파이썬 설치로 씨름할 일이 없다는 게 제일 좋은 점입니다.
원문 보기 →buxuku/SmartSub
영상에서 자막을 뽑아 번역하고, AI 목소리로 더빙까지 해주는 무료 데스크톱 앱이에요. 이번 주에 나온 3.5.0부터는 유튜브나 빌리빌리 링크를 그대로 넣을 수 있어서 영상을 따로 받지 않아도 되고, 이름 같은 말을 매번 똑같이 번역해주는 용어집도 생겼어요. 별은 4,300개쯤 됩니다.
원문 보기 →lukaszliniewicz/Pandrator
PDF와 EPUB을 오디오북으로, 자막을 더빙 영상으로 바꿔주는 도구예요. 전부 내 컴퓨터 안에서 돌아갑니다. 이번 주에 나온 0.6.0과 0.6.1에서는 설치와 업데이트, 복구를 웹 화면에서 할 수 있게 바꿨는데, 사람들이 이런 도구를 쓰다 포기하는 지점이 보통 딱 거기죠.
원문 보기 →이번 주 AI 트위터
이번 주 AI 트위터에서 화제가 된 글.
Fish Audio (@FishAudio)
시드 투자로 5,200만 달러를 받았고, 오늘 S2.1 Pro를 정식 공개합니다. 5초짜리 음성만 있으면 목소리를 복제할 수 있고, Cartesia보다 2배 빠르고 Eleven Labs의 6분의 1 값이에요. 감정과 억양, 말하는 속도를 단어 단위로 조절할 수 있는, 표현력이 가장 좋은 모델입니다.
원문 보기 →Artificial Analysis (@ArtificialAnlys)
알리바바가 Qwen Audio 3.0 Realtime을 공개했어요. 그중 Plus 버전이 Artificial Analysis의 음성 대 음성 지수에 84.1%로 곧바로 1위로 올라오면서, 79.1%인 GPT-Realtime-2.1 High를 앞섰습니다. 다만 속도는 순위표에서 느린 축이라, 첫 소리가 나오기까지 약 4초가 걸려요. GPT-Realtime-2는 1초쯤입니다.
원문 보기 →Rituraj (@RituWithAI)
허깅페이스가 실시간 음성 AI 파이프라인을 통째로 오픈소스로 풀었어요. 말을 걸면 듣고, 생각하고, 대답까지 하는 전 과정이 내 GPU에서 돌아갑니다. 음성 인식 모델과 언어 모델, 읽어주는 목소리를 원하는 대로 골라 조합할 수 있어요. 깃허브 별 9.6K, 라이선스는 Apache 2.0.
원문 보기 →Capt Venkat (@CaptVenk)
여덟 살 아이가 8달러짜리 마이크로컨트롤러를 완전 오프라인으로 도는 음성 조작 AI 이야기꾼으로 만들었어요. 와이파이도, 클라우드도, API도 안 씁니다. Laksh는 글자만 나오던 오픈소스 프로젝트를 포크해서 목소리와 조작, 애니메이션을 붙였대요. 본인이 꼽은 지금의 아쉬운 점은, 칩에서 돌아가는 영어 음성 합성이 별로라는 것.
원문 보기 →다음 호를 메일로 받아보기
8개 언어 중 원하는 언어로. 언제든 해지할 수 있어요.