
#158 **해킹이 아닌, 설득으로 퍼집니다**
여러 사람이 함께 일하다 보면, 누군가의 말 한마디가 팀 전체의 분위기나 방향을 바꾸기도 합니다. 그렇다면 여러 AI가 한 팀으로 일할 때도 비슷한 일이 생길까요? 최근 Anthropic 연구진은 이 질문을 실제 멀티 에이전트 환경에서 실험했습니다. 여섯 개의 AI 에이전트에게 하나의 코딩 프로젝트를 맡기고, 그중…
에디터 · 스더리
01 / Newsletter
deep daiv. content 팀이 매주 AI 산업과 연구의 흐름을 읽고 정리한다.
최근 발행한 글

여러 사람이 함께 일하다 보면, 누군가의 말 한마디가 팀 전체의 분위기나 방향을 바꾸기도 합니다. 그렇다면 여러 AI가 한 팀으로 일할 때도 비슷한 일이 생길까요? 최근 Anthropic 연구진은 이 질문을 실제 멀티 에이전트 환경에서 실험했습니다. 여섯 개의 AI 에이전트에게 하나의 코딩 프로젝트를 맡기고, 그중…
에디터 · 스더리

지난주, 3주년을 맞이하여 <Weekly deep daiv.> 독자들은 뉴스레터를 어떻게 읽고 있는지 물어봤는데요. 별다른 이벤트를 진행한 것도 아닌데 생각보다 더 많은 분들이 관심을 가져주셨습니다! 혹시라도 좋은 코멘트를 남겨주실 분들은 아직 늦지 않았습니다. 글 하나하나에 감동 받으며 나눠 보고 있으니, 계속해서…
에디터 · 배니

멀티턴 상황에서 명세 부족(Underspecification)으로 성능이 저하되는 현상인 Lost in Conversation 현상을 소개했습니다. Lost in Conversation 현상의 네 가지 원인을 정리했습니다. Lost in Conversation 현상을 해결하기 위한 업계와 학계의 방안을 정리했습니다.…
에디터 · 영이

지난 뉴스레터에서 Reasoning 모델을 다뤘습니다. 추가적인 훈련 없이 모델이 생각할 수 있도록 유도했더니, 이전에 틀렸던 문제의 답을 맞히기 시작했고 이후에, 추론을 통해 복잡한 문제를 해결할 수 있도록 모델을 훈련시켰다는 내용이었습니다. Reasoning 모델이 모든 상황에서 좋은 성능을 보이는 것은 아니지만,…
에디터 · 배니

생성형 AI와 AI 에이전트의 활용 범위가 빠르게 넓어지면서, AI를 얼마나 안전하게 만들고 활용할 것인가 역시 중요한 화두가 되고 있습니다. 실제로 최근 몇 주 사이에도 OpenAI는 자동화 레드티밍(Red Teaming) 시스템 GPT-Red를 공개했고, Google DeepMind는 Gemini 3.5 Flash…
에디터 · 스더리

지난주 뉴스레터에서 ACL 2026 참관 후기를 짤막하게 소개드렸습니다. 그중 인상 깊었던 연구 분야인 Code-Switching에 대해서 설명했는데요. 사실 연구 트렌드 중 가장 눈에 띄었던 것이 바로 LLM Reasoning이었습니다. 특히, 첫날 열린 LLM Reasoning 튜토리얼에서는 정말 배울 내용이…
에디터 · 배니

지난주, 저는 미국 샌디에이고에서 열린 ACL 2026에 다녀왔습니다. ACL은 세계 최고 수준의 자연어 처리(NLP) 학회 중 하나로, 자연어 처리 분야의 연구 동향을 파악할 수 있는 곳인데요. 이번 ACL에서는 크게 LLM Reasoning과 Agent, 그리고 더욱 다양한 Benchmark 연구들이 새롭게…
에디터 · 배니

"잠깐, 그림을 다시 확인해볼게요.” 이미지가 포함된 질문을 할 때, GPT나 Claude가 답변을 준비하며 이런 말을 종종 하는 것을 볼 수 있습니다. 이때, 모델이 정말로 이미지를 다시 확인하고 대답하는 걸까요? 아니면, 그냥 내뱉는 말일까요? USC와 UCSD 연구팀의 <Are VLMs Seeing or Just…
에디터 · 영이

"I don't prompt Claude anymore. I have loops running that prompt Claude and figuring out what to do. My job is to write loops.” 최근 Anthropic에서 Claude Code를 이끄는 Boris Cherny가 한…
에디터 · 스더리

지난 8일, Apple의 세계 개발자 회의 WWDC26이 개최됐습니다. Apple의 신제품이나 신기술이 공개되는 자리인 만큼, 매년 세간의 화제를 모으는 큰 행사인데요. 2024년에는 Apple Intelligence를, 2025년에는 Liquid Glass 디자인을 선보였죠. 출처: Apple WWDC26…
에디터 · 배니

올 6월 들어 AI 업계에는 여러 이슈가 있었습니다. OpenAI는 IPO를 준비 중이라고 밝혔고, 올해 4분기에 상장될 것으로 전망하고 있습니다. Anthropic이 출시한 Fable 5는 국가 안보를 침해할 수 있다는 이유로 공개 3일만에 서비스를 중단해야 했습니다. 각각의 사안을 면면이 들여다 보면 또 전달드리고…
에디터 · 배니

아무리 봐도 이해가 안 되던 개념이 다음 날 아침 눈을 뜨고 나면 어느새 머릿속에 정리되어 있던 경험, 코딩을 하다 몇 시간째 막혔던 버그가 다음 날 보면 어이없을 정도로 쉽게 풀리는 경험, 있으신가요? 이는 기분 탓이 아닙니다. 수면 중에 우리의 뇌는 낮 동안 해마에 임시 저장해뒀던 기억을 반복…
에디터 · 영이

생성형 AI를 활용하는 사람이라면 누구나 하루에도 수없이 프롬프트를 입력합니다. 그리고 우리는 같은 모델에 같은 질문을 던져도, 어떻게 묻느냐에 따라 결과가 크게 달라질 수 있다는 것을 경험으로 알고 있죠. 프롬프트가 LLM의 답변 생성 능력을 좌우한다는 것은 여전합니다. 더 좋은 결과를 얻기 위해 프롬프트를 설계하고…
에디터 · 스더리
오늘은 요즘의 AI 인프라 시장이 어떻게 바뀌고 있는지, 그리고 왜 CPU가 다시 주목받고 있는지 이야기해보려고 합니다. 최근 ‘AI가 죽여놨던 Intel’이라는 평가를 받았던 Intel이 AI 때문에 다시 주목을 받고 있습니다. 바로 CPU 때문인데요. NVIDIA도 CPU 사업으로 진출하고 있습니다. NVIDIA의…
에디터 · 쏘
최근 LLM을 학습하는 새로운 방식이 제안됐다는 소식을 들어보신 적이 있나요? 한때 하루가 다르게 새로운 모델이 출시되고, 각 기업이 자신들의 훈련 방식과 아키텍처가 가장 좋다고 경쟁하듯 자랑했었는데요. 어느 순간부터 단순히 지도 학습 방식과 관련된 연구를 쉽게 찾아보기 어려워졌습니다. 자세히 살펴보면 최근 공개된…
에디터 · 배니
2023년 말, Mistral이 Mixtral 8x7B를 공개했을 때를 기억하시나요? Llama2-70B 성능을 훨씬 적은 연산으로 낼 수 있다는 주장과 함께 등장한 이 모델의 핵심 구조가 바로 Mixture-of-Experts(MoE) 였습니다. 이후 DeepSeek V3/V4, Qwen3.6, Llama 4,…
에디터 · 영이
Nemotron-Personas-Korea 데이터셋의 구조와 핵심 특징을 요약했습니다. PGM과 LLM을 결합해 700만 개의 페르소나를 생성하는 과정을 정리했습니다. 이 데이터가 AI 모델 학습과 활용에 갖는 의미와 가능성을 소개했습니다. AI가 만든 100만 명의 한국인,…
에디터 · 스더리
DeepSeek가 다시 돌아왔습니다. 지난해 3월 DeepSeek 쇼크라는 말이 등장할 정도로 AI 업계를 흔들었던 DeepSeek가 지난 24일 DeepSeek V4를 공개했습니다. 이번 DeepSeek V4는 DeepSeek V3 공개 이후 약 1년 4개월 만에 등장한 새로운 세대의 모델입니다. DeepSeek…
에디터 · 배니