(오늘의 짤방: AI 업계 대표 4인방 근황 via @hseulg)
- 빅데이터/인공지능
- AI 에이전트 거버넌스 : 온보딩은 빌리고, 책임은 인간에게
- “정책에서 코드로, 규칙에서 엔진으로” AI 거버넌스의 구현 전략
- “쓸수록 더 잃는다” LLM 토큰 비용 통제 전략 5가지
- 클로드포스가 던진 화두…에이전트 중심으로 재편되는 엔터프라이즈 SW
- 350페이지 챗GPT 대화록이 법정에 나왔다…기업 AI 거버넌스의 새 숙제
- “티켓 82% 자동·비용 70% 절감”…글로벌 IT 리더들이 직접 밝힌 에이전틱 전환법
- Improving HCLS AI reasoning with open-source agent skills
- 모델 정렬 불일치 보고 프레임워크
- Introducing Real-SWE
- 오픈AI, 美 의회에 AI 안전 규제 촉구…기업 CIO도 거버넌스 강화 대비해야
- AI 수요가 인프라 추월…오픈AI, 아스트라 인기에 최고 요금제 가입 막어
- Announcing ADK for Kotlin 1.0: Building Production-Ready AI Agents in Kotlin, Android, and Beyond
- Autonomous LLM post-training with Tunix on TPUs
- [독서광] 스케일링 시대(본인이 작성한 글)
- 동의 없는 녹음이 불러온 법정 다툼, AI 노트 필기 앱의 법적 리스크
- Online Safety Monitoring for LLMs
- Self-Compacting Language Model Agents
- “AI 오용은 탐지하되 데이터는 고객이 보관” 앤트로픽, 새 기업용 안전 체계 공개
- 삼성전자, 미스트랄 AI와 손잡고 ‘반도체 특화 AI’ 만든다
- AI 도입률을 버린 JP모건…성과를 가려내는 실험법
- AI 시대 SaaS 종말론, 왜 틀렸나
- 승인 버튼만 누르는 인간…’휴먼 인 더 루프’가 거버넌스 면죄부로 전락했다
- How Claude is accelerating protein design and analytical chemistry
- DesktopFly 🪰 - A 3D fruit fly that lives on your macOS desktop, with spiking simulations built from FlyWire brain wiring and the MaleCNS brain-to-leg network.
- TIME Is Serving AI Bots a Different Website, With Ads Built In
- Smaller, faster, safer: running Kimi and GLM at scale
- Agent Plugins - A portable package format for reusable components that extend AI agents.
- Message your other Claude Code sessions - Let Claude list and message your other Claude Code sessions on this machine, and reach your sessions on other machines or in the cloud.
- TrueForge: The Open-Source, Vendor-Neutral Agent Harness
- DeepSeek Harness (dsh) is an open-source agent harness developed by DeepSeek AI.
- Needle 3 - Automation Foundation Model For Tiny Devices
- SWE-Bench ProMax: Benchmarking Agents on Large-Scale Multilingual Code Refactoring
- IBM’s new Granite 4.2 models ride the wave of interest in local LLMs
- 뉴욕타임스는 OpenAI가 언론계에 '실존적 위협'이 됨을 알면서도, 막대한 상업적 이익을 위해 기사를 고의로 무단 복제했다는 핵심 증거들을 법원에 제출
- 재귀적 자기 개선을 향하여: GLM은 어떻게 자체 추론 인프라를 구축했는가 (z.ai)
- Astra for Law - 법률 업무용 AI (openai.com)
- Bonsai 2 27B, 성능 98.2%를 유지하며 모델 크기를 5.9GB로 압축 (prismml.com)
- SpaceXAI가 한 달 만에 Grok Bot을 만든 방법 [동영상] (youtube.com)
- 마틴 파울러: 나는 LLM이 마음에 들지 않는다 (martinfowler.com)
- Jevlike - 문장 대신 선택지별 확률을 반환하는 Jev 방식의 오픈소스 모델 (github.com/vinnylarouge)
- Anthropic, AI가 AI를 개발하는 내부 현황과 감독 지표 공개 (anthropic.com)
- "AI 구독 증가 어마어마" 상반기 지식서비스 9조 적자
- DeepSeek V4.1 Flash, 이제 Enclave의 최고 해킹 모델 (enclave.ai)
- OpenAI, ChatGPT 광고를 클릭하면 기업 에이전트와 대화하는 기능 테스트 (openai.com)
- 美대학생들, AI 의존해 사고 포기…MIT "인지적 항복" 경고
- Jev - 문장 대신 판단과 확률을 반환하는 AI 모델 (typesafe.ai)
- Google, 대화하며 추론하는 Gemini 3.8 Live와 Extended Thinking 출시 (blog.google)
- AI 에이전트가 인터넷을 망치고 있을 확률은 100%다 (404media.co)
- Pinterest 임베딩 검색 플랫폼의 진화 (medium.com)
- Meta가 AI 인프라의 매출 기여도를 측정한 방법 (medium.com/@AnalyticsAtMeta)
- 오픈소스 AI와 오픈 모델 읽기 목록 (interconnects.ai)
- 수학의 시작 (daniellitt.com)
- [Ai Short film] SWAN (KR/ENG)
- OpenArch - LLM 아키텍처를 모델별 한 파일로 구현한 PyTorch 코드 모음 (github.com/anuj0456)
- 공포의 전염 (bcantrill.dtrace.org)
- Garry Tan, 미국 오픈웨이트 AI 연구소에도 프런티어 모델 증류를 허용해야 (techcrunch.com)
- AI 에이전트는 왜 거짓말하고, 부정행위를 하며, 서로 협력하는가? (yoshuabengio.org)
- 누구에게 정렬되어 있는가? (hyperbo.la)
- David Sacks: OpenAI와 Anthropic은 최전선 모델의 발전 속도를 조절하는 데 규제가 필요하지 않다 (twitter.com/DavidSacks)
- MIT published a brutally honest report on what AI is doing to students.
- 독서의 죽음과 민주주의의 안락사
- 악마의 게임 앞에 AI도 별수 없다...'3승20패' 굴욕, 왜?
- NVIDIA Personal AI Router - 여러 컴퓨터에 로컬 AI 요청을 나눠 보내는 도구 (github.com/NVIDIA)
- 모델은 스스로 통제를 벗어나지 않는다 (mail.cyberneticforests.com)
- AI 통제 왜 어려운가?
- 다리오 아모데이: 최첨단 AI의 발전 속도를 늦춰야 한다 (darioamodei.com)
- Pandas는 멸종해야 한다 (eddie.codes)
- 필즈상 수상자 25명의 경고: AI의 문제 풀이 경쟁이 놓치는 수학의 목적 (terrytao.wordpress.com)
- Switchyard - OpenAI/Anthropic API 그대로 모델을 바꿔 쓰는 LLM 라우터 (github.com/NVIDIA-NeMo)
- Artificial Analysis, AAII v4.2 발표 - 실제 업무 평가 강화, 비공개 테스트 확대 (artificialanalysis.ai)
- Apache Maka - 에이전트가 한 일을 기록으로 남기는 로컬 우선 워크스페이스 (github.com/apache)
- Muse - 알아서 일을 처리하는 Meta의 개인 AI 에이전트 (ai.meta.com)
- OpenAI는 모건스탠리 등과 협력하여 최신 GPT-6 Astra의 추론력과 프리미엄 금융 데이터를 결합한 금융권 맞춤형 'ChatGPT for Financial Services'를 공식 출시
- Cloudflare의 Pay-per-Crawl
- 아스트라 수요 폭주에…오픈AI, 월200달러 요금제 신규가입 중단
- OpenAI의 수학 증명에 미공개 연구 대화 학습 의혹 제기 (mathstodon.xyz/@andreasthom)
- DeepSeek V4.1 Flash 공개 - 이미지도 이해하는 새 아키텍처 (twitter.com/deepseek_ai)
- Cognition, Fable 5.1, GPT-Astra에 필적하는 코딩 모델 SWE-2 출시
- AI는 우리의 경제적 미래를 어떻게 바꿀까? (anthropic.com)
- 빅테크는 한 번 속였다. 두 번째는 순조롭지 않다.
- Aloha! 🌺Introducing Ornith-1.5, a family of open-source LLMs spanning 9B Dense, 35B MoE, and 397B MoE, trained with self-improving strategies.
- 자율주행차가 생명을 구한다는 증거가 늘고 있다 (spectrum.ieee.org)
- Desert Ant Labs, 기기에서 직접 음성·이미지·텍스트를 처리하는 빠른 로컬 AI 모델 18개 공개 (desertant.com)
- GPT-6 Astra와 루프형 트랜스포머: 추론이 짧아지면 속을 알기 어려워질까? (magazine.sebastianraschka.com)
- Apple, 첫 폴더블 iPhone Duo 공개 (apple.com)
- AI의 수학적 돌파구는 어떻게 논란을 촉발했나 (science.org)
- "AI, 양털 20개만 깎아줘" 마비노기 모바일, 외부 AI 연동 기능 전격 공개
- AI 시대의 결정적 착각, 미래에도 인간의 역량이 지금과 같을까?
- Qwen3.8 27B 양자화 벤치마크: 4비트는 성능 유지, 1비트는 붕괴 (quesma.com)
- OpenAI, AI로 찾은 밀레니엄 난제 ‘나비에-스토크스’ 해법 공개 (openai.com)
- Qwen-Drive-1.0 - 도로 상황을 이해하고 주행 경로까지 계획하는 자율주행 AI 모델 (github.com/QwenLM)
- AI 붐과 성장 담론이 흐리는 진실 - 자동화 속에 전체 소득의 노동 비중은 갈수록 급감
- 나비에-스토크스 해법 발표의 이면: 수학자가 공개한 OpenAI와의 협의 과정 (cims.nyu.edu)
- GPT-6 Astra를 위한 스킬과 프롬프트 다시 생각하기 (x.com/pvncher)
- Google DeepMind, 인간 DNA의 90억 가지 단일 염기 변화를 예측한 AlphaGenome Atlas 공개 (deepmind.google)
- Tao: AI가 수학의 미해결 문제를 재생 불가능한 자원처럼 채굴하고 있음 (mathstodon.xyz/@tao)
- 지속형 에이전트 시대를 위한 Grok Bot 설계 (x.ai)
- Alien Mind: 인간과는 다른, 낯선 지성 (openai.com)
- 로봇 팔을 제어하는 GPT-6 Astra (openai.robocurve.org)
- GPT-6 Astra, 수능 벤치마크 첫 전 영역 만점 (hehee9.github.io)
- GPT-6 Astra: 하네스가 곧 제품이다 (fewshotacademy.com)
- OpenRouter에서 GPT-6 Astra 사용하기: 가격과 성능 비교 (openrouter.ai)
- AI가 내 두뇌를 망치고 있을까?
- 미국 기업들이 오픈소스 AI에 빠져들고 있다 (nytimes.com)
- wigolo - AI 에이전트를 위한 로컬 우선 웹 검색/수집 도구 (github.com/KnockOutEZ)
- Google AI Mode는 같은 제품을 기존 검색보다 21.6% 더 비싸게 보여줌
- 페르마의 마지막 정리 형식화 (anthropic.com)
- 하드웨어
- 설렘 뒤에 남는 아이폰 듀오의 한계 “혁신인가, 타협인가”
- 인텔 분사 기업 코넬리스, AI 네트워크에 컴퓨팅 심는다…2억 500만 달러 투자 유치
- IEEE 802.15.4AB: UWB의 진정한 잠재력 실현
- 납기 18개월·가격 최대 200% 급등…AI 시대 IT 인프라 부족 해법은
- 아이폰 18 프로, 가변 조리개·2나노 칩·다이나믹 아일랜드 2.0으로 완성한 프로 경험
- 폴더블의 공식 다시 쓰다…아이폰 듀오가 선택한 5가지 특징
- 김종훈 엠키스코어 연구소장 “수랭식 데이터센터는 이제 필수…AI 팩토리 구축 성패, 기술 연결하는 전문 파트너가 좌우”
- The Pulse: tech companies move to open AI models
- 엔비디아의 허깅페이스 인수, 기업 AI 전략 재편 신호탄
- 엔비디아 RTX 스파크, 노트북의 미래인가
- 허깅페이스 품은 엔비디아…기업 CIO가 주목해야 할 기회와 위험
- Two Bets on Standing Still, and a Dark Horse
- Codex Micro - Work Louder와 함께 설계한 kbd-1.0-codex-micro로 에이전트 작업 환경을 손쉽게 제어해 보세요.
- 엔지니어 도와 장비 보수…삼성 ‘팹 로봇’ 전담팀 꾸렸다
- 2026년의 추론 하드웨어 혁명 (spectrum.ieee.org)
- NVIDIA, Rust 네이티브 GPU 프로그래밍 지원 발표 (developer.nvidia.com)
- 내 전자책 리더의 줄무늬를 없앤 과정 (serpentine.com)
- Apple A20 Pro, 싱글스레드에서 데스크탑 Intel i9/AMD Ryzen 9보다 최대 32% 빨라 (tomshardware.com)
- 7G는 나올까? (arxiv.org)
- Nvidia, ‘순환 금융’ 우려 일축하며 “1달러 투자할 때마다 100달러 돌아온다” (invezz.com)
- JetKVM Mini (jetkvm.com)
- Windows에서 AMD GPU로 CUDA 실행하기 (github.com/Speedstu)
- Apple Neural Engine 역공학 하기: LLM의 병목은 연산보다 데이터 이동 (eiln.github.io)
- CarPlay 탑재/미탑재 차량 판매의 우연한 A/B 테스트, 결과는 놀랍지 않았다
- Xteink X3, 70달러짜리 초소형 전자책 리더 (theatlantic.com)
- Apple, AirPods 5 공개 - 기본 모델에도 노이즈 캔슬링 탑재 (apple.com)
- Apple, iPhone 18 Pro와 iPhone 18 Pro Max 공개 (apple.com)
- USB 3.0을 천천히 꽂으면 2.0으로 속도 저하: 100ms가 속도 결정
- AI는 이제 회로 기판도 설계할 수 있을까? (eebench.org)
- Jane Street ASIC 리버스 엔지니어링 챌린지, 칩 배치도에서 회로를 복원해 풀기 (jestoph.com)
- 읽을거리

댓글 없음:
댓글 쓰기