(오늘의 짤방: GPT-5.6 gets an initial IQ score of 136, which is smarter than 99% of humans. via @davidpattersonx)
- 빅데이터/인공지능
- ChatGPT, 무료 사용자에게도 GPT‑5.6 Luna 제공 시작 (openai.com)
- Unsloth DeepSeek V4는 정말 2배 빠를까? DGX Spark 두 대에서 확인해봤다
- AI 에이전트의 IT 업무 자동화, 인간 감독이 결정적 변수
- AI 회의록 앱의 ‘동의 없는 녹음’ 법정 공방
- AI에 맡겨도 되는 것과 사람이 직접 해야 하는 것의 차이에 관하여
- 크래프톤, 21B 한영 이중언어 음성 AI 모델 'A.X K2 Raon-Speech' 공개 (huggingface.co)
- 구글 서치 콘솔, X/인스타그램/틱톡/유튜브를 통한 유입 트래픽도 지원 시작 (developers.google.com)
- 자기 개선을 위한 하네스 엔지니어링 (lilianweng.github.io)
- Cloudflare OS: 에이전트·앱·업무를 위한 개방형 플랫폼 (blog.cloudflare.com)
- Google DeepMind 리더십 개편: Demis Hassabis는 의장으로, Jeff Dean은 퇴사 (blog.google)
- Qwen3.8 Max, Agentic Index 종합 1위 (artificialanalysis.ai)
- 🥞 The Stack v3 is out: the largest open code dataset ever released: 114 TB, 770 languages, 224M repositories, ~5T tokens of deduplicated and filtered source code.
- 데이터 사이언티스트는 죽었다…그 자리에 남은 건 판단력과 지휘봉
- 재무·HR까지 파고든 AI 에이전트…기업 53% “활동 검증 못 해”
- MS, 코파일럿 슈퍼앱 승부수…’모델 독립성’ 앞세워 AI 업무 플랫폼 통합
- AI 거버넌스, 왜 실패하나…정책보다 중요한 것은 ‘실행력’
- "롱호라이즌(장기) 작업은 아직도 농담 수준이다. 멍청한 평가점수 보여주지 마라. 48시간 돌렸다는 스크립트 얘기도 꺼내지 마라. 전부 헛소리다. 그냥 안 된다."
- 정렬 문제 해소되지 않은 AI 어디까지 믿을 수 있을까?
- 100배 저렴한 오픈 모델로 검색에서 GPT-5.6 Sol 능가하기 (neon.com)
- 알리바바, 초거대 AI ‘큐웬 3.8-맥스’ 공개…”16일간 자율 코딩 수행”
- LLM-Wiki: 지식이 축적되는 AI 작업 환경 만들기
- 마리오가 파레토를 만나다 (mayerowitz.io)
- "진짜야 가짜야" 기괴한 세계관에 빠져들더니…'폭발적 반응'
- 앤트로픽 '클로드 헌장'에 대한 테드 창의 감상기
- Skill Recorder - Record yourself doing a task once, then turn it into a skill your AI agent can repeat.
- 구글이 시세 두 배를 주고 GPU 11만 장을 빌리고 있음. 매달 9억 달러씩임.
- LLM은 전문성을 보상함 (seangoedecke.com)
- 카카오, '카나나-2'의 경량 모델 4종 오픈소스로 공개 (huggingface.co)
- 더 작고 강해진 Kanana SLM 개발
- MiniMax H3, ComfyUI 출시 당일 지원 — 오픈 가중치·네이티브 오디오·2K 영상 (blog.comfy.org)
- 이제 모델 선택 기준은 지능보다 속도 (martinalderson.com)
- 크래프톤, 21B 한영 이중언어 음성 AI 모델 'A.X K2 Raon-Speech' 공개 (huggingface.co)
- Qwen3.8-Max: 코딩과 협업의 새로운 기준 (qwen.ai)
- Seedance 2.5 - 30초 원테이크 생성과 유연한 참조 (seed.bytedance.com)
- 데이터 감시 자본주의의 확장: 영유아 모니터 기기 앱 시장 빠르게 성장
- 세르게이 브린이 올인 팟에서 모델 구조 전망을 이렇게 말함. 빠른·싼 특화 모델에 거는 건 지는 베팅에 가깝다는 쪽이다.
- 미국의 오픈 모델 패러독스 (sequoiacap.com)
- MiniMax H3
- 수학과 이론 컴퓨터 과학의 10가지 진전 (openai.com)
- 29GB RAM에서 Kimi K3를 0.50 tok/s로 실행하기 (github.com/sqliteai)
- 한 시대의 종말 (hughhowey.com)
- 허깅페이스가 오픈AI에 내민 청구서 “로그 공개와 컴퓨팅 자원 지원”
- CFO의 질문에 답하지 못하는 AI 지출 관리의 구조적 한계
- AI 모델 선택에 매몰되면 안 되는 이유
- “오픈·효율·최신 기술, 3개 축으로 간다”…엔비디아 생성형 AI 부사장 인터뷰
- SITUATIONAL AWARENESS: The Decade Ahead(Leopold Aschenbrenner)(한국어 번역 있음)
- AI는 클수록 좋을까…기업이 SLM으로 눈을 돌리는 이유
- DeepSeek-V4-Flash 모델 공개 (api-docs.deepseek.com)
- qm - 협업을 위한 멀티플레이어 에이전트 하네스 (github.com/yc-software)
- DeepSeek V4 Flash 0731의 지능·성능·가격 분석 (artificialanalysis.ai)
- Introducing Qwen-Audio-3.0-ASR-Flash: More context-aware. Stronger domain-term recognition.
- Kimi K3 로컬 실행 가이드 (unsloth.ai)
- GPT‑5.6, 가격 대비 성능의 한계를 확장 (openai.com)
- Medical Research Agent Skills
- 오픈AI, ‘프레즌스’로 콜센터 시장 진입…”AI가 일상 요청 처리, 판단·공감은 여전히 사람 몫”
- Understand Kimi K3 architecture in one image,
- AngelSpec is developed by the Tencent Hunyuan AI Infra team, which is a torch-native framework for training speculative-decoding draft models, covering both autoregressive MTP drafting and the block-parallel DFlash family.
- ai-agent-booK:
- 사람의 사고를 둘러싼 새로운 AI 냉전의 시작
- 봇에 의해 점령되어 가는 인터넷
- Evaluating Commercial AI Chatbots as News Intermediaries
- 송재경, AI와 게임 (inven.co.kr)
- 업무별로 고르는 AI 도구 가이드 (oneusefulthing.org)
- TurboFieldfare - 모든 M 시리즈 Mac에서 Gemma 4 26B를 2GB RAM으로 실행하는 오픈소스 엔진 (github.com/drumih)
- 카카오, 온디바이스 AI 겨냥한 ‘카나나-2’ 경량 언어모델 4종 오픈소스 공개
- 500달러로 미세조정한 9B 오픈 모델, 카탈로그 검수에서 프런티어 모델 능가 (fermisense.com)
- Neutrino-1 8B, 0.6B, and 0.6B-Chat use the same file format and local runtime across CUDA, Apple silicon, and x86.
- 세계에서 가장 작은 나라가 AI 논쟁에 어떤 영향을 미치고 있는가 (profgmedia.com)
- 오픈 웨이트 모델에 대한 Anthropic의 입장 (anthropic.com)
- Hugging Face에 공개된 Kimi-K3 (huggingface.co)
- Cerebras가 사내 지식 베이스를 구축한 방법 (x.com/cerebras)
- DeepSeek, 미중 AI 격차 관련 발언 유출후 투자 유치 중단 (녹취록) (bloomberg.com)
- Netflix의 사내 LLM 서빙 플랫폼 (netflixtechblog.com)
- 생성형 AI는 왜 공학적 재앙인가
- Claude Opus 5, Artificial Analysis 지능 리더보드 1위 (artificialanalysis.ai)
- 오픈 웨이트 AI가 Kubernetes의 순간을 맞고 있음 (tobi.knaup.me)
- Opus 5 시스템 카드 속 Behind Cut
- Anthropic Opus 5 출시 (anthropic.com)
- Claude 5 모델을 위한 새로운 컨텍스트 엔지니어링 규칙 (x.com/trq212)
- OpenAI와 Anthropic, 자사 수익을 위협하는 오픈 웨이트 AI에 공동 대응 (axios.com
- 하드웨어
- 빅3 중 컴퓨팅 용량은 구글이 제일 크다.
- Google Cloud is aggressively monetizing its TPU capacity.
- “제때 살 수 있을까” 올가을 아이폰 18, 품귀 현상 예고
- AMD, 모델을 실리콘에 새기는 AI 칩 스타트업 Taalas 인수 (theregister.com)
- 엔비디아, AI 장비 넘어 ‘AI 금융’까지…인프라 투자 보증 나선다
- 사재기 안 하면 위기?…FCC 중국산 광트랜시버 금지 임박, AI 데이터센터 공급망 비상
- AMD, 엔비디아 1위 자리 흔들 수 있을까?
- AMD MI355X에서 Kimi K3를 실행해 B300보다 높은 달러당 성능 달성 (wafer.ai)
- club-3090 - Recipes for serving LLMs locally on RTX 3090s.
- TPU 8i and TPU 8t deliver sustainable economics—offering up to 80% better performance-per-dollar for low-latency serving while seamlessly scaling to 1M+ chips!
- TV 스트리밍 스틱을 구매하기 전에 확인할 것 (krebsonsecurity.com)
- 읽을거리

댓글 없음:
댓글 쓰기