(오늘의 짤방: Qwen 3.8 27b를 쓰시는 분들은 이 이미지 저장해 두시면 좋겠습니다. via @Multi_Serio_Ai)
- 빅데이터/인공지능
- AI 에이전트 성공의 조건…업계 전문가가 꼽은 7가지 실패 원인과 대응 전략
- 더 많은 자율성, 더 촘촘한 제약…기업 에이전틱 AI의 외줄타기
- 자기이익이 지키는 개방성—오픈웨이트 생태계의 역설
- 데모 에이전트와 배포 에이전트 사이를 가로막는 5개의 장벽
- AI 추론 아키텍처, 파일럿 단계에서 결정하라…AI 추론 인프라의 5가지 원칙
- 60개 넘는 플랫폼, 어떻게 고르나…AI 에이전트 오케스트레이션 도입 체크리스트 5가지
- 지게차부터 보안 카메라까지…기업이 실제 선택한 피지컬 AI 활용처 7가지
- 토큰 가격은 떨어지는데 AI 비용은 왜 치솟나…가트너가 경고한 ‘추론의 역설’
- “데모는 성공, 운영은 실패”…AI 파일럿 함정에서 벗어나는 방법
- 딥시크, V4 API 가격 최대 11배 인상…’시간대별 요금제’ 도입
- MCP, 실험을 넘어 운영 인프라로…생태계·거버넌스·클라우드 현장이 말한 다음 단계
- AI 탑재했지만 고객은 무관심…절반이 “활용률 25%도 안 돼”
- AI 에이전트 성공의 조건…업계 전문가가 꼽은 7가지 실패 원인과 대응 전략
- Can AI Help You Get Over Your Breakup? One Session with a Belief-Reframing Chatbot Shows Sustained Distress Reduction
- MiniMax H3: An Open Model Breaking the Boundaries Between Tasks and Modalities
- Gemini Robotics 2 brings whole body intelligence to robots
- Gemini Robotics 2: Safety Evaluations
- 보이지 않지만 지워지지 않는 워터마크, 클로드가 심는다
- AI as an Enterprise Operating System
- New ways to buy ChatGPT ads
- Introducing a way to reflect on how you use Claude
- Welcome to https://cosmos.gl – a high-performance WebGL library for visualizing network graphs and machine learning embeddings.
- Announcing the Agentic Resource Discovery specification
- Introducing Current AI’s Open Source Gap Map: a living, actionable visualization of AI’s open source landscape.
- Nano Banana 2 Lite 🍌
- Introducing Muse Spark 1.1
- The GPT-5.6 models, Sol, Terra, and Luna
- Introducing Laguna S 2.1
- Cisco’s tiny open-weight AI hunts bugs, and it says it beats Gemini and GPT
- ByteDance and Alibaba to disable humanlike AI custom agents as new rules loom
- AI가 판도 바꾸나···구글, 네이버 첫 추월
- 온디바이스에서 피아노를 자동 완성하는 1억 2,500만 매개변수 모델 (simedw.com)
- Huggingface Speech To Speech - 오픈소스 모델로 로컬 음성 에이전트를 만드는 파이프라인 (github.com/huggingface)
- Computer Use와 Skills/Files API로 프로덕션 에이전트 구축하기 (claude.com)
- 국어학 전공자가 만든 클로드 코드 스킬
- 초저가 AI vs 고품질 K-숏폼…억 소리 나는 숏드라마 전쟁 개막
- OpenRouter가 Stripe에 합류함 (openrouter.ai)
- Qwen ANE prefill: FP16 CPU work sharing for MLP and GDN, performance-aware scheduling, and adaptive tuning
- 'AI는 이미 통제를 벗어나기 시작했다'
- Turbovec - Rust로 구현한 벡터 검색용 Google TurboQuant (github.com/RyanCodrai)
- Qwen3.8-27B-Uncensored-MLX - 애플 실리콘용 검열 제거 버전 (huggingface.co)
- Google, 파산한 Spirit 항공 데이터 150억원에 인수 (theregister.com)
- Qwen 3.8 27B는 뛰어나지만 기본 설정에서 지나치게 오래 추론함 (simonwillison.net)
- Hidden Airtag reveals Amazon is trashing rare books to train AI
- Stripe, 10조원 이상에 AI 모델 게이트웨이 OpenRouter 인수 합의 (bloomberg.com)
- Qwen3.8 27B, Artificial Analysis 지능 지수 52점 기록 (artificialanalysis.ai)
- Claude의 ‘워터마크’가 글쓰기를 왜곡하는 방식 (daringfireball.net)
- AI 크레딧 재판매 시장 - 토큰 브로커와 Relay는 어떻게 움직이나 (vectoral.com)
- 대륙 사로잡은 '팡타오즈'…AI 시대 도래? '진짜'는 어디로
- oMLX 0.6.3rc2
- AI에게 "스스로를 개선해봐"라고 시켰더니 돌아온 답이 "당신들, 수학을 잘못 하고 있어요"였음.
- Qwen3.8-27B-Uncensored-MLX
- "이러다간 다 죽어"…'수상한' 응모작 폭증에 비명 [글로벌 pick]
- 모델은 의도적으로 더 멍청해지고 있다 (w4g1.dev)
- The Odyssey (2026) - The Complete Screenplay
- AI는 수학자보다 더 잘 생각하는 게 아니라 더 많이 기억함 (davidepiffer.com)
- Qwen-MM-Plugins - Native multimodal plugins for Qwen models. Make any agent harness multimodal-native.
- AI 모델 고르기: 같은 프롬프트, 11개 모델, 매우 다른 결과 (netlify.com)
- AI 텍스트 워터마킹의 작동 원리 (declaude.org)
- Qwen 3.8 27B (huggingface.co)
- GLM-5.3: 포스트 트레이닝 확장으로 프런티어급 코딩·사이버 역량 달성 (z.ai)
- Opus 5는 왜 함께 작업하기 더 불편하게 느껴지는가? (mun-logadan.github.io)
- Qwen3.8-27B, 17~19GB 메모리에서 4-bit 로컬 실행 가능 (unsloth.ai)
- Cracks in the AI Thesis
- AI Boost Bites: Your Edge in the AI-Powered World
- Qwen3.8-2.4T-A95B 오픈 웨이트 공개 (huggingface.co)
- Grok 4.6, AAII 61점으로 비용 효율에서 선두권 진입 (artificialanalysis.ai)
- GPT-5.6 Sol을 초당 750토큰으로 가속하는 Ultrafast Mode (cerebras.ai)
- X, For You 알고리듬 공개 범위 확대 - 랭킹 가중치와 노출 제한 시스템까지 (github.com/xai-org)
- Gemini 3.7 Flash (blog.google)
- Grok 4.6 공개, 파라미터 확장 대신 사후학습에 투자한 모델 (x.ai)
- Unsloth Desktop - 로컬 AI 모델 실행/학습/에이전트를 하나로 묶은 오픈소스 앱 (unsloth.ai)
- Grok Bot 공개 (x.ai)
- 실시간 영상 진료 AI ‘AMIE’ 공개…구글, 의사 수준 임상 수행 능력 입증
- xberg - 다국어 문서 인텔리전스 프레임워크 (github.com/xberg-io)
- Unsloth, Qwen3.8 2.4T를 397GB로 줄여 로컬 실행 지원 (unsloth.ai)
- Watermarking GPT Outputs
- 中 AI드라마 36초마다 1편…드라마판 흔든다
- Meta Muse Glimmer - 기기에서 실행하는 오픈 웨이트 30B 코딩 모델 (research.meta.ai)
- AI가 웹을 잠식하면서 인터넷의 집단 기억이 사라지고 있음 (thewalrus.ca)
- Claude가 AI 생성 콘텐츠를 표시하는 방식 (support.claude.com)
- 압축은 예측이다 (ngrok.com)
- Needle 2 - 스마트폰·웨어러블·스마트홈·로봇을 위한 14MB 에이전틱 LLM (cactuscompute.com)
- "한 달 걸릴 설계·검증 이틀로 단축"… 삼성전자 반도체, 앤트로픽 '클로드' 투입해 성과
- 지난 8월 5일 맞춤법 검사 서비스에 장애가 발생했습니다.
- Cursor가 래퍼로 안 남은 이유는, 폐쇄 소스 위에 얹는 대신 오픈 소스 위에 자기 훈련을 올렸기 때문이다.
- 독점 LLM API에서 추론 트레이스 훔치기 (stolen-thoughts.com)
- OpenAI 윤리 책임자, 합류 1년도 안 돼 퇴사 (ft.com)
- OpenClaw 만든 Peter Steinberger가 아침 7시에 Ctrl+C를 눌렀는데 봇이 안 죽었음.
- 애플이 아이폰 안에서 AI 모델을 낸드에 두기 시작했음.
- Solar Pro 4 - 에이전트 작업 특화 LLM (upstage.ai)
- 엔비디아의 공식 에이전틱 하네스: NOOA
- For the first time, researchers have systematically and on a large scale "stolen" the true hidden chains of thought from the closed-source models of OpenAI, Anthropic, and Google.
- Learning more about Claude's mathematical capabilities
- Mark Zuckerberg, Meta의 개방형 모델 복귀와 함께 ‘폐쇄형’ AI 경쟁사 비판 (ft.com)
- GenRec: Towards LLM-Native Recommendation at Netflix
- LLM으로 복잡한 주제를 배우는 시각적 시뮬레이션 학습법 (laurentiugabriel.github.io)
- AI 봇과의 친밀감은 사람 간의 관계를 바꿔놓을 것
- 당신이 하는 모든 일이 기록되는 시대 (theatlantic.com)
- DoorDash가 AI 에이전트-도구 접근을 위한 중앙 게이트웨이를 구축한 방법 (careersatdoordash.com)
- 샌프란시스코에서 시간당 30달러에 휴머노이드 청소부를 부르는 서비스가 시작됐음.
- “한국 베끼더니 얼굴도 닮아”…하루 5편씩 찍어내는 中 ‘숏드’
- DeepMind WeatherNext, 사이클론 예측 정확도를 하루 앞당김 (deepmind.google)
- AI를 비판하는 바른 방식과 그른 방식
- 드미스 허사비스 딥마인드 창업자가 경영 일선에서 물러났습니다.
- AI는 발달 중인 아이들 뇌에 초가공식품과 같다
- 하드웨어
- 엔비디아, 쿠파일 API 오픈소스 공개…AI 스토리지 표준화 본격 추진
- 구글 TPU, AMD CPU와 한 패키지로…레이턴시 잡고 강화학습 잡는다
- 애플의 메모리 위기, 가격이 아닌 공급량의 문제
- 스팀 머신 vs 플레이스테이션 5 프로·엑스박스…승부처는 성능이 아닌 개방성
- Spectral Compute Aims to Set CUDA Free. Will It Succeed?
- "왜 밥 안주냥"…스마트 급식기의 배신 | '펫리브로' 서비스 장애로 스마트 급식기 예약 급식 실패 사례 속출
- 카메라 탑재 AirPods 확인, 실제 작동 모습 공개 (macrumors.com)
- Pixel 11 Pro Fold, 한 시대의 끝처럼 느껴지는 폴더블 (theverge.com)
- Cerebras CS-4, 랙 규모 AI 추론 시스템 (cerebras.ai)
- 메모리 가격, 12개월간 500% 상승 (tomshardware.com)
- Nvidia의 위험한 사업 (stratechery.com)
- 우리가 쓰는 AI를 학습시키는 칩들은 가끔 조용히 거짓말을 함.
- 일론의 GPU 조달 전략은 순서가 거꾸로임. 데이터센터를 먼저 짓고, GPU는 맨 마지막에 삼
- 2027년 메모리 생산 용량, 이미 매진됨 (ign.com)
- 읽을거리
- 촬영감독에게 듣다, ‘오디세이’ 아이맥스 1.43:1 비율의 진짜 효과
- 더 비관적으로 변한 세계, 강대진 서양고전학자의 <오디세이> 풀이
- 아버지의 참교육
- 왓챠, 키노라이츠 품에서 살아날까…"관건은 콘텐츠"
- OECD Economic Surveys: Korea 2026
- 문해력 위기의 떠오르는 해법 - 혼자 읽기에서 함께 체험하는 독서 모임으로
- BYD가 한국 도로 규격 및 시장 수요에 맞춰 전용 개발한 12m급 대형 전기 고속버스 'e코치 12(eCoach 12)'를 국내에 출시
- [j Focus] 구보타 시게코 백남준의 부인 [출처:중앙일보] https://www.joongang.co.kr/article/4335080
(보너스: via 예상대로 흘러간다면 2027년말이면 컴퓨트 용량 기준으로 구글이 1800만 H100e로 1위, 스페이스X가 900만 H100e로 2위가 될 것으로 보인다. 우주 컴퓨팅으로 가기 전에 이미 지상에서 2위 찍고 시작할 것 같다. @kim_oasis)
EOB

댓글 없음:
댓글 쓰기