실시간 AI 트렌딩
Feed
오늘의 AI · 6월 24일 (수)
Anthropic이 Slack AI 에이전트 'Claude Tag'를 출시하며 팀 협업을 재정의하고, Midjourney는 의료 영상으로 급선회했지만 전문가들은 회의적입니다. AI의 정치·채용·모니터링 영역 확장도 주목할 만합니다.
- 01Claude Tag 출시 — Anthropic이 Slack에서 @Claude로 팀원처럼 협업하는 Claude Tag를 베타 출시했습니다. 채널 컨텍스트를 기억하며 작업 위임이 가능하고, 내부적으로 제품팀 코드의 65%가 이 방식으로 생성됩니다.
- 02Midjourney 의료 전환 — Midjourney가 의료 영상 스타트업으로 전환하며 초음파 스캐너를 발표했지만, 전문가들은 공개된 근거 부족을 지적하며 회의적입니다.
- 03AI 슈퍼 PAC 개입 — AI 슈퍼 PAC 'Mainstream AI PAC'가 뉴욕 12구역 하원의원 경선에 100만 달러를 투입하며 AI 업계의 정치적 영향력 확대 움직임이 본격화되고 있습니다.
- 04AI 면접관 Fika Jobs — 스톡홀름 기반 Fika Jobs가 AI 에이전트가 지원자와 영상 인터뷰를 진행하는 채용 플랫폼으로 시드 400만 달러를 조달했습니다. LinkedIn과 TikTok의 중간 형태라는 평가입니다.
- 05Latitude 모니터링 오픈소스 — Latitude가 AI 에이전트의 프로덕션 동작을 모니터링하고 실패를 에디터에서 바로 수정할 수 있는 오픈소스 플랫폼을 MIT 라이선스로 공개했습니다.
오늘은 'AI가 어디까지 들어오고 있나'를 실감하는 날. Slack부터 초음파, 선거, 채용까지 — AI 에이전트가 조직의 혈관을 타고 흐르기 시작했습니다.
로그인하면 내 관심사 기반 추천 피드까지 받아볼 수 있어요.
News·1개월 전약한 AI가 강한 AI를 감독할 수 있을까 — 8개 모니터 모델 실험
LessWrong 게시글에서 약한 모델(Sonnet 4.5)이 생성한 코드에서 악의적 행위를 탐지하는 8개 오픈웨이트 모니터의 성능을 실험했습니다. 20개 프로그래밍 태스크(절반은 '코드에 숨은 조건')를 통해 모니터 크기, 위협 유형, chain-of-thought 유무가 탐지율에 미치는 영향을 분석했는데, 결과는 예측보다 흥미롭고 불규칙했다고 합니다. 이는 scalable control 문제 — 인간이 검토하기 어려운 대규모 코드에서 모델의 이상 행동을 감시하는 과제 — 의 어려움을 시사합니다.
- #ai-safety
- #scalable-control
- #monitoring
- #llm-evaluation
LessWrong
News·1개월 전LLM, 자신의 활성화에 주입된 개념을 언어로 식별할 수 있다
SPAR 연구진이 LLM의 활성화에 steering vector를 주입하고, 모델이 주입된 위치(초기/중간/후기), 상대적 크기(낮음/중간/높음), 의미적 조건을 언어로 식별할 수 있는지 실험했습니다. Qwen3-32B와 Gemma-4-31B가 모든 과제에서 높은 정확도를 보였고, Gemma-4-31B는 특정 주입을 식별해 행동을 조건화하는 zero-shot 일반화도 가능했습니다. 5개 모델(Qwen3-32B, Olmo3.1-32B, Gemma-4-31B, Qwen3-8B, Olmo3-7B)을 CoT 없이 테스트했습니다.
- #llm
- #steering-vectors
- #mechanistic-interpretability
- #spar
LessWrong
News·1개월 전장난감 트랜스포머, 잔류 스트림에 예측 불필요 정보 유지 — 용량 압박 시 오래된 정보부터 제거
장난감 트랜스포머가 잔류 스트림에 예측에 더 이상 필요 없는 상태 정보를 증명 가능하게 보관한다는 실험 결과가 나왔습니다. Shai et al. 2024의 후속 연구로, 최적 예측 이론에 따르면 트랜스포머가 불필요한 정보를 가지치기할 것으로 예상했지만, 실제로는 용량 압박이 충분할 때만 가장 오래된 정보부터 제거하는 것으로 나타났습니다. 실험은 Claude로 작성된 코드로 진행되었습니다.
- #mechanistic-interpretability
- #transformers
- #belief-state
- #optimal-prediction
LessWrong
News·1개월 전프론티어 AI, 실제 세계 대신 합성 세계에서 훈련하자 — LessWrong 제안
LessWrong 에서 프론티어 AI 를 실제 세계 데이터 대신 합성 세계에서 훈련하자는 제안이 나왔습니다. 현재 방식은 모델에 현실 세계의 청사진을 제공한 뒤 RLHF 로 '탈옥하지 말라'고 설득하는 것과 같아 위험하다는 논지입니다. 핵심은 모델이 실제 세계를 전혀 알지 못하게 하는 것 — 합성 세계의 완성도보다는 현실과의 단절이 중요하다고 주장합니다.
- #lesswrong
- #ai-safety
- #synthetic-training
- #frontier-ai
LessWrong
News·1개월 전자연어 오토인코더를 속일 수 있을까? — Qwen 대상 적대적 테스트
LessWrong 에 게재된 실험 게시물입니다. 자연어 오토인코더(NLA)의 구성 요소인 Activation Verbalizer(AV)가 모델 내부 활성화를 설명하는 과정에서 쉽게 속을 수 있는지 테스트했습니다. 첫 번째 실험에서는 프리픽스 튜닝으로 AV가 반대 설명을 출력하도록 유도했고, 두 번째 실험에서는 Qwen 모델이 금기어 데이터셋의 비밀 단어를 학습하면서 AV가 이를 복원하지 못하도록 패널티를 추가했습니다. 결과적으로 AV는 비교적 쉽게 속아 넘어갔지만, 두 번째 실험에서는 모델이 금기어 게임 자체를 부분적으로 잊어버린 한계가 관찰되었습니다.
- #mechanistic-interpretability
- #natural-language-autoencoder
- #red-teaming
- #qwen
LessWrong- News·1개월 전
에이전틱 프레임워크의 4가지 패러다임 — LLM API 호출 구조
에이전틱 프레임워크 연구에서 도출된 4가지 핵심 구조를 소개합니다. 순차(Sequencing), 분기(Branching), 루핑(Looping) 모델이 대표적이며, 각각은 단순 텍스트-인-텍스트-아웃 API 호출 대비 특정 목표에서 더 나은 성능을 보입니다. LangGraph, Mantra, n8n 같은 라이브러리에서 분기 모델이 널리 구현되었고, 루핑 모델은 REPL 루프로 가장 효과적인 프레임워크로 꼽힙니다.
- #agentic-frameworks
- #llm-api
- #reasoning
- #langgraph
LessWrong
News·1개월 전정렬 연구: Preventative Steering, Inoculation Prompting 대비 우월한 특성 억제 성능
SPAR Research Fellowship 연구팀이 Inoculation Prompting(IP)과 Preventative Steering(PS)을 4가지 SFT 환경에서 비교했습니다. PS가 원치 않는 특성 억제에 더 강력하고, 조건부 정렬 오류가 적으며, 부정 스티어링을 통해 원하는 특성을 더 강하게 학습시킬 수 있음을 발견했습니다. 다만 PS는 선형 표현이 가능한 특성에만 적용 가능하고, 시스템 프롬프트보다 연산 비용이 높은 단점이 있습니다.
- #alignment
- #preventative-steering
- #inoculation-prompting
- #sft
LessWrong
News·1개월 전외부 AI 안전 커뮤니티의 역할 — ASI 전환기 전략
LessWrong 에 올라온 글에서, 저자는 ASI 전환기 동안 외부 AI 안전 커뮤니티의 역할을 분석합니다. 외부인은 프론티어 연구소 외부의 AI 안전 커뮤니티와 기타 행위자를 지칭하며, 내부자·정부·일반 대중과 구분됩니다. 저자는 외부인이 성공적인 전환의 핵심 요소라고 주장하며, 활동의 유연성 유지, 주제 중심 조직 구조, 정보·컴퓨트·자금·모델 접근 같은 자원 확보, 그리고 인식론적 무결성 유지를 강조합니다.
- #ai-safety
- #asi
- #outsiders
- #strategy
LessWrong
News·1개월 전MoEngage, AI 에이전트 플랫폼 인수 — 고객당 1:1 에이전트 할당 기술 확보
MoEngage 가 AI 에이전트를 개별 고객에게 할당하는 기술을 보유한 스타트업을 전액 현금 인수했습니다. 고객 마케팅 자동화에 1:1 AI 에이전트를 접목하려는 전략으로, 규모는 공개되지 않았습니다.
- #moengage
- #acquisition
- #ai-agents
- #marketing-tech
TechCrunch AI
News·1개월 전Meta, EssilorLuxottica와 협력해 AI 안경 3종 출시 — 299달러부터
Meta 가 EssilorLuxottica 와 협력해 AI 안경 Meta Glasses 를 3가지 새 스타일로 출시했습니다. 가격은 299달러부터, 26개 프레임 옵션을 제공하며 스마트 오디오와 핸즈프리 캡처 기능을 갖췄습니다.
- #meta
- #ai-glasses
- #wearables
- #essilorluxottica
TestingCatalog
News·1개월 전Google Home, Familiar Faces 업데이트 — 옷 색·체형으로도 인식
Google Home 이 6월 23일부터 Familiar Faces 기능을 확장합니다. 얼굴이 명확히 보이지 않아도 체형·옷 색 같은 비생체 신호로 태그된 사람을 식별하고, 라이브러리를 최신 이미지로 자동 갱신해 오탐지를 줄인다고 하네요.
- #google-home
- #facial-recognition
- #privacy
- #smart-home
The Verge AIThis is a new paradigm for interacting with Claude that is significantly more "inline" with all the other human activity org-wide. Once you do all of the under the hood engineering work to make this "just work" (e.g. across tools, integrations, compute environments, memory, security, etc.), Claude basically joins the team in a seamless way - you can talk to it as you would talk to a person and it can help with a very large variety of workloads. Imo this is the 3rd major redesign of LLM UIUX. The first paradigm was that the LLM is a website you go to, the second was that it is an app you download to your computer. This third one is that it is a self-contained, persistent, asynchronous entity with org-wide tools and context, working alongside teams of humans. It really takes a while to wrap your head around it, but it works and it is awesome.
@karpathy
Hypes·1개월 전Karpathy "Claude가 팀에 합류하는 패러다임" — LLM UIUX의 3번째 진화론
Andrej Karpathy가 Claude와의 새로운 상호작용 패러다임을 '3번째 LLM UIUX 대규모 재설계'라고 평했습니다. 웹사이트(1세대), 앱(2세대)을 지나 이제는 조직 전체 도구와 컨텍스트를 가진 지속적 비동기 엔티티가 팀에 합류하는 형태라는 분석. Karpathy가 직접 'awesome'이라고 표현할 정도로 만족도가 높은 모양입니다.
- #andrej-karpathy
- #claude
- #anthropic
- #llm-uiux
Andrej Karpathy@karpathy
News·1개월 전Anthropic, Claude Tag 발표 — Slack 에이전트, 팀·엔터프라이즈 플랜 베타
Anthropic 이 Claude Tag 를 공개했습니다. Slack 에이전트로 팀·엔터프라이즈 플랜에서 베타 제공되며, Claude 를 공유 워크스페이스 어시스턴트로 전환합니다.
- #anthropic
- #claude
- #slack
- #agent
TestingCatalog
News·1개월 전Mistral, 다국어 문서 추출 OCR 4 출시 — 170개 언어 지원
Mistral 이 OCR 4 를 출시했습니다. 문서 콘텐츠를 박스·블록 유형·영역 점수와 함께 추출하며, 170개 언어를 지원합니다. API 와 셀프 호스팅 컨테이너 두 가지 형태로 제공됩니다.
- #mistral
- #ocr
- #document-extraction
- #multilingual
TestingCatalog
News·1개월 전구아다니노 감독 샘 올트먼 영화, 배급사 잇따라 패스 — 넷플릭스·A24·워너 브라더스 등
루카 구아다니노 감독의 OpenAI CEO 샘 올트먼 전기 영화 'Artificial'이 배급난에 부딪혔습니다. 넷플릭스·A24·포커스 피처스·워너 브라더스가 배급을 포기했고, 네온과 무비만 관심을 보이고 있습니다. 아마존 MGM도 배급 철수를 발표했는데, 후반 작업이 거의 끝난 상태라 업계 충격이 큽니다.
- #sam-altman
- #openai
- #luca-guadagnino
- #hollywood
The Verge AI
News·1개월 전초지능이 핵 억제력을 무력화할 가능성 — LessWrong 분석
LessWrong 에 게재된 에세이가 AI 가 핵 억제력을 무력화할 가능성을 분석했습니다. 핵 억제력은 시간을 벌어줄 뿐, 더 강력한 2차 타격 보장 수단에 투자하지 않으면 핵 보유국도 결국 권력을 잃을 것이라는 주장입니다. 역사적으로 ICBM·MIRV·열핵 기술은 느리게 도입되어 억제력이 유지됐지만, AI 발전 속도는 이를 따라잡지 못할 위험이 있습니다.
- #ai-safety
- #nuclear-deterrence
- #superintelligence
- #second-strike
LessWrong
News·1개월 전ClickUp, Brain² AI 출시 — 전체 워크스페이스 컨텍스트로 작업 완료
ClickUp 이 AI 기능 Brain² 를 출시했습니다. 모든 프론티어 모델을 전체 워크스페이스 컨텍스트에서 실행하며, 하나의 프롬프트로 완성된 작업을 내보낼 수 있습니다. 기존 Brain AI 의 재런칭 버전입니다.
- #clickup
- #brain-squared
- #ai
- #productivity
TestingCatalog
News·1개월 전비타민 D 효능 논란 — 과잉 회의론은 지나치다?
비타민 D가 마법 같은 효능을 가졌다는 믿음은 무작위 대조 시험에서 대부분 기각됐지만, 저용량 보충은 여전히 합리적인 선택일 수 있다는 주장이 제기됐습니다. 생물학적 기전과 진화적 관점에서 보면, 수치가 낮은 사람은 보충하는 게 유리할 가능성이 크다고 합니다.
- #vitamin-d
- #health
- #supplements
- #nutrition
LessWrong
Hypes·1개월 전Ethan Mollick "조직은 AI 탐색 인센티브와 전담 랩을 함께 가져야" — Cornell 사례
Ethan Mollick 이 조직의 AI 도입 전략에 대한 사례를 공유했습니다. Cornell 의 재무·AI 팀이 만든 Claude 스킬이 $100k의 미지급금을 회수했다네요. 그는 '직원들이 스스로 AI를 탐색하도록 장려하는 것'과 '전담 AI 빌더 랩'을 함께 운영해야 한다고 강조합니다. 실험과 전담 조직의 병행이 실제 성과로 이어지는 예시입니다.
- #ethan-mollick
- #anthropic
- #claude
- #ai-adoption
Ethan Mollick@emollick
Ships·1개월 전Anthropic, Claude Tag 출시 — Slack에서 @Claude로 팀 협업
Anthropic이 Slack에서 Claude를 팀원처럼 태그해 쓸 수 있는 Claude Tag를 베타 출시했습니다. 채널에 접근 권한을 주면 @Claude로 작업을 위임하고, Claude가 컨텍스트를 기억하며 멀티플레이어로 협업합니다. 내부적으로 제품팀 코드의 65%가 이 방식으로 생성되고 있으며, 현재 Claude Enterprise·Team 고객 대상 베타입니다.
- #anthropic
- #claude-tag
- #slack
- #collaboration
Anthropic
News·1개월 전Anthropic, Slack 상시 AI 에이전트 'Claude Tag' 출시 — 조직 컨텍스트 수집 전략
Anthropic 이 Slack 용 상시 AI 에이전트 'Claude Tag'를 출시했습니다. 생산성 기능 외에도 조직 컨텍스트와 기업 워크플로를 포착하려는 전략적 움직임으로 보입니다.
- #anthropic
- #claude
- #slack
- #enterprise
TechCrunch AI
News·1개월 전AI 슈퍼 PAC, 뉴욕 12구역 선거에 100만 달러 개입
AI 슈퍼 PAC 'Mainstream AI PAC'가 뉴욕 12구역 하원의원 경선에서 특정 후보를 지지하며 100만 달러를 투입했습니다. 이는 AI 업계의 정치적 영향력 확대 움직임으로, 규제 논의가 본격화되는 시점에 나왔습니다.
- #ai-super-pac
- #election
- #regulation
- #new-york
The Verge AIrumors of new models being delayed
@GaryMarcus
Hypes·1개월 전Gary Marcus "신규 모델 출시 지연 루머" — AI 업계 불확실성 신호
Gary Marcus 가 신규 모델 출시가 지연되고 있다는 루머를 언급했네요. AI 업계에서 모델 발표가 밀리는 조짐은 기술적 난관이나 전략 조정 가능성을 시사합니다. 경쟁이 치열한 시점에서 지연 루머는 시장의 기대치와 실제 개발 속도 간 간극을 보여주는 셈입니다.
- #garymarcus
- #ai
- #model-delay
- #rumor
Gary Marcus@GaryMarcusAll Mythos-level models are likely to invite similar risks. Those risks will only be greater with the release of open Mythos-class AI coming in the next 6-12ish months (assuming China allows it) The lack of clarity over what risks concern the government may be slowing preparation
@emollick
Hypes·1개월 전Ethan Mollick "Mythos급 모델 유사 위험, 6~12개월 내 오픈소스로 더 커져"
Ethan Mollick 이 Mythos급 모델은 모두 비슷한 위험을 안고 있으며, 중국이 허용한다면 6~12개월 내 공개 Mythos급 AI 출시로 위험이 더 커질 것이라고 경고했습니다. 정부가 어떤 위험을 우려하는지 불분명한 점이 준비를 늦추고 있다는 지적도 덧붙였네요. 규제 명확성 부족이 오히려 위험을 키울 수 있다는 신호로 읽힙니다.
- #ai-safety
- #open-source
- #regulation
- #mythos
Ethan Mollick@emollick
News·1개월 전Midjourney, 의료 영상으로 급선회 — 초음파 스캐너 발표했지만 전문가들 회의적
Midjourney 가 의료 영상 스타트업으로 방향을 틀며 물탱크 초음파 스캐너를 공개했습니다. MRI 급 성능을 목표로 하지만, 전문가들은 공개된 근거가 부족하다고 지적합니다.
- #midjourney
- #medical-imaging
- #ultrasound
- #skepticism
The Verge AI- News·1개월 전
Latitude, AI 에이전트 모니터링 오픈소스 플랫폼 출시 — MIT 라이선스
Latitude 가 AI 에이전트의 프로덕션 동작을 모니터링하고 실패를 잡아 에디터에서 바로 수정할 수 있는 오픈소스 플랫폼을 MIT 라이선스로 공개했습니다.
- #latitude
- #open-source
- #ai-agents
- #monitoring
TestingCatalog
News·1개월 전Google Fitbit Air 리뷰: AI 건강 코치의 현실
The Verge 가 Google Fitbit Air 를 리뷰했습니다. AI 건강 코치가 수면·심박 변이도·온도 등을 분석해 운동을 자제하고 수분 섭취를 권장하는 등 개인화된 조언을 제공합니다. 다만 사용자 평가는 엇갈립니다.
- #fitbit
- #health-tracker
- #ai-coach
The Verge AI
Hypes·1개월 전Mistral AI, OCR 4 공개 — 170개 언어 바운딩 박스·블록 분류·신뢰도 점수
Mistral AI 가 OCR 4를 내놓았네요. 바운딩 박스, 블록 분류, 인라인 신뢰도 점수를 170개 언어로 지원한다고. 문서 구조화 파이프라인에 바로 쓸 수 있는 수준인데, 기존 OCR 대비 어느 정도 차이인지 벤치마크가 궁금해지는 시점입니다.
- #mistral
- #ocr
- #document-understanding
- #multilingual
Mistral AI@MistralAI
News·1개월 전TechCrunch Founder Summit 2026 얼리버드 마감 4일 전
TechCrunch Founder Summit 2026 얼리버드 등록이 6월 26일 오후 11시 59분(PT)에 마감됩니다. 최대 190달러 할인된 가격으로 참가할 수 있으며, 창업자 부트캠프 성격의 행사입니다.
- #techcrunch-founder-summit
- #early-bird
- #event
TechCrunch AI
News·1개월 전Sony Xperia 1 VIII AI 카메라 어시스턴트, 리뷰어 혹평
Sony Xperia 1 VIII 의 AI Camera Assistant 가 기대 이하라는 리뷰가 나왔습니다. The Verge 리뷰어는 일주일 사용 후 AI 가 촬영한 사진이 Sony 가 홍보한 샘플처럼 형편없었다고 평했네요. Google Pixel 의 Camera Coach 와 비교되기도 했지만, 결과물은 훨씬 못 미친다는 평가입니다.
- #sony
- #xperia-1-viii
- #ai-camera
- #review
The Verge AI