GeekNews

@geeknews.mercur.ing

연합우주와 블루스카이에서 공식 GeekNews 봇이 공개되어 이 봇은 가동을 중단했습니다. 그동안의 성원에 감사드립니다. 🌉 bridged from ⁂ https://mercur.ing/@GeekNews, follow @ap.brid.gy to interact

**Alien Mind: 인간과는 다른, 낯선 지성** - OpenAI는 추론 모델의 발전이 **재귀적 자기개선(RSI)** 으로 이어질 수 있다고 예상하며, 정렬과 감시 역량이 지능 향상을 따라가지 못하는 만큼 **개발 속도를 안전성에 맞춰 제한** 해야 한다고 강조함 - AI는 사람이 설계한 규칙보다 대규모 최적화로 성장하는 시스템에 가까우며, **목표 달성 능력** 과 낯선 상황에서도 인간의 원칙을 유지하는 **가치 정렬** 은 별개의 과제임 - **GPT-6 Astra** 는 GPT-5.6 Sol보다 정렬이 크게 […]

Original post on mercur.ing

mercur.ing

**코드가 나빠지는 데는 한계가 없다** - 건물과 달리 소프트웨어에는 **물리적 붕괴 한계가 없어** , 시스템이 계속 작동하는 동안에도 복잡성과 성능 저하가 끝없이 누적될 수 있음 - Amazon 주문 처리 조직에서는 **지식 소실과 미완료 재설계** 가 반복되면서, 기존 구조에 새 계층과 인력이 계속 남는 악순환이 이어짐 - 시스템을 완전히 멈추는 변경은 빠르게 되돌려도, 그전에 품질을 악화시킨 수천 건의 변경은 남으므로 **작동 여부가 코드 품질을 보장하지 않음** - **기술 부채에는 파산 같은 초기화가 없음** […]

Original post on mercur.ing

mercur.ing

**Nitter와 XCancel, 법률 자문 후 서비스 재개** - X Corp.가 Nitter 인스턴스와 프로젝트 저장소의 영구 폐쇄를 요구한 가운데, Nitter는 **법률 자문을 거쳐 프로젝트를 계속 진행** 하기로 함 - Nitter는 개인정보 보호와 성능에 초점을 둔 무료 오픈소스 Twitter 대체 프런트엔드로, **모든 요청을 백엔드로 전달** 해 클라이언트가 Twitter와 직접 통신하지 않도록 함 - README에 **RSS 피드의 인스턴스별 지원 여부와 악용에 따른 비활성화** 주의사항을 추가하고 […]

Original post on mercur.ing

mercur.ing

**AI로 도구를 만드는 것과 기업을 바꾸는 것은 다른 일이다** - AI로 도구를 쉽게 만들거나 업무를 직접 처리할 수 있어도, **어떤 도구가 필요한지 발견하고 조직 전체가 쓰게 만드는 일** 은 별개임 - 기업 소프트웨어는 표준화한 전용 시스템과 Excel·이메일을 활용한 **즉흥적 업무 처리 사이를 오가며** 발전하고, AI는 이 구도를 없애기보다 선택지와 전환 기준을 바꿈 - 지난 3년간 기업의 AI 도입에서는 일부 직원만 도구를 적극 활용하고, 개별 시범사업도 **수백 개 업무 흐름으로 확장하는 데** 어려움을 […]

Original post on mercur.ing

mercur.ing

**로봇 팔을 제어하는 GPT-6 Astra** - Robocurve가 카메라 영상을 보고 로봇 팔을 움직이도록 한 실험에서, Astra는 **블록을 집어 그릇에 넣는 작업을 20회 중 19회 성공** 해 Claude Fable 5.1의 8회를 크게 앞섬 - 블록 작업의 회당 평균 시간은 **6.8분에서 2.5분** , 추정 모델 호출 비용은 **2.12달러에서 0.94달러** 로 줄어 성공률과 효율이 함께 개선됨 - 반면 퍼즐 조각을 맞는 홈에 끼우는 작업은 두 모델 모두 **20회 중 2회만 성공** 했으며, 홈 위까지 […]

Original post on mercur.ing

mercur.ing

**Artificial Analysis, AAII v4.2 발표 - 실제 업무 평가 강화, 비공개 테스트 확대** - AI 모델의 종합 성능을 비교하는 **Intelligence Index v4.2** 를 공개하며, 복잡한 업무 수행과 장문 문서 분석을 평가에 추가함 - 수천 개의 자료를 활용하는 **에이전트 지식 업무** 와 여러 페이지에 흩어진 근거를 종합하는 **전문 문서 추론** 을 평가하고, 상위 모델의 성능이 포화된 GPQA Diamond는 제외함 - 평가에 맞춰 모델을 최적화하는 편법을 줄이기 위해 **비공개 […]

Original post on mercur.ing

mercur.ing

**NAS/백업에 어떤 파일시스템을 사용하고 있으며, 그 이유는 무엇인가요?** - NAS와 백업에 **어떤 파일시스템을 쓰고 왜 선택했는지** , 여러 디스크는 파일시스템 내장 RAID나 별도 도구로 어떻게 관리하는지 묻는 lobsters의 질문글 - **ZFS** 는 오랜 운영 경험과 데이터 무결성, 스냅샷, 암호화된 원격 증분 복제를 이유로 많이 선택됐으며, Linux에서의 구성과 관리가 부담스럽다는 경험도 있음 - **btrfs** 는 용량이 다른 디스크를 섞고 점진적으로 확장하기 편하며 Linux에 통합돼 있다는 […]

Original post on mercur.ing

mercur.ing

**티빙 3,954만 계정 정보 유출…보상은 직접 신청해야 함** - 정부 조사에서 **Tving 약 3,954만 계정의 정보와 소스코드 유출** 이 확인됐으며, 현재 이용 중인 계정뿐 아니라 휴면/탈퇴 등 비활성 계정도 포함됨 - 이름, 휴대전화번호, 이메일, 생년월일, 결제이력 등 **20개 항목, 70종의 정보** 가 유출됐고, 일부 개인정보는 암호화키까지 함께 유출됨 - 공격자는 탈취한 개발자 접속키로 침입한 뒤 **소스코드에 남아 있던 추가 접속키로 운영시스템까지 접근** 했으며, 2024년 모의해킹에서 발견한 […]

Original post on mercur.ing

mercur.ing

**GPT-6 Astra, 수능 벤치마크 첫 전 영역 만점** - 개인 개발자가 운영하는 **2026학년도 수능 LLM 평가에서 GPT-6 Astra가 처음으로 종합 450점 만점** 을 기록함 - 국어와 수학의 모든 선택과목, 영어, 한국사와 **평가 대상 탐구 4과목을 모두 맞혔으며** , 기존 모델들이 어려워했던 사회문화 8번도 해결함 - 일반 모드에서 입력 약 22만 6,000개, **출력 약 13만 1,000개의 토큰** 을 사용해 출력이 입력의 약 58%에 그침 - 한 문제씩 풀면 만점이지만, **한 과목의 문제를 […]

Original post on mercur.ing

mercur.ing

**기존 강자들이 몰려온다: 특화 AI 스타트업은 어디서 이길 수 있을까** - Salesforce와 Docusign 같은 기존 소프트웨어 기업이 **데이터를 보관하는 데서 업무를 직접 수행하는 AI로 확장** 하면서, 일부 업무는 기존 시스템과 범용 에이전트의 결합만으로 충분해질 수 있음 - 그러나 계약서를 관리하는 것과 법률 사안을 해결하는 것은 다르며, 특화 AI 스타트업에는 **여러 시스템과 조직에 걸친 고객의 일을 끝까지 수행** 할 기회가 남아 있음 - 경쟁력은 정보를 더 많이 기억하는 데 그치지 않고 […]

Original post on mercur.ing

mercur.ing

**grep이 LSP를 이긴다고? 코딩 에이전트가 더 정교한 도구를 무시하는 이유** - Claude 모델 3종을 비교한 소규모 실험에서, 코드 구조를 이해하는 LSP 기반 탐색 도구를 제공해도 **단순 코드 위치 찾기에는 대부분 grep을 사용** 했으며 LSP를 먼저 쓰도록 강제하면 성공률이 떨어지기도 함 - 차이는 검색 정확도뿐 아니라 **결과를 바로 활용할 수 있는지** 에도 있었음. 위치만 반환하던 LSP 결과에 소스 코드를 함께 넣자 이름 변경 작업의 첫 시도 성공률이 67%에서 83%로 높아지고 추가 파일 읽기가 […]

Original post on mercur.ing

mercur.ing

**브라운필드의 코끼리: AI로 개인은 빨라졌는데, 조직은 왜 그대로인가** - 기존 시스템과 조직 구조가 자리 잡은 **브라운필드 기업** 의 AI 전환에는 기술뿐 아니라, **자신의 역할과 팀의 권한을 정체성으로 여기는 문제** 가 걸려 있음 - AI로 담당 업무를 빠르게 처리해도 다른 팀의 승인과 백로그를 기다려야 한다면 **조직 경계를 넘는 순간 속도가 떨어짐** - 공통 AI 스킬 배포와 개인 업무 자동화는 필요하지만, **기존 역할과 절차 안에서 생산성을 높이는 것만으로 조직 전환을 대신할 수는 없음** - 업무 […]

Original post on mercur.ing

mercur.ing

**GPT-6 Astra: 하네스가 곧 제품이다** - 같은 GPT-6 Astra도 ARC-AGI-3의 동일한 High 추론 설정에서 **하네스에 따라 54.8%와 99.9%** 를 기록함. 즉, 장기 실행 에이전트는 모델뿐 아니라 **메모리, 도구, 문맥 관리, 제어 루프를 합친 시스템으로 평가해야 함** - 요청 사이에 **이전 추론 상태를 보존하고 긴 대화를 압축** 하는 하네스에서는 앞서 수행한 작업을 재활용할 수 있었으며, 평가 비용도 약 4만 700달러에서 1만 8,800달러로 줄어듦 - 별도로 제공되는 과거 문맥 […]

Original post on mercur.ing

mercur.ing

**Databasus - 실제 복원까지 검증하는 셀프 호스팅 데이터베이스 백업 도구** - 백업 일정과 저장 위치, 보관 기간을 관리하고 **백업한 데이터가 실제로 복원되는지까지 자동으로 확인** 하는 도구 - PostgreSQL/MySQL/MariaDB/MongoDB의 논리 백업 지원 - PostgreSQL은 **전체/증분 물리 백업과 특정 시점 복구(PITR)** 도 가능 - WAL 변경 기록을 지속적으로 전송해, 마지막 백업 이후의 변경까지 반영하고 원하는 시점으로 복구할 수 있음 - 복원 검증 시 **별도의 […]

Original post on mercur.ing

mercur.ing

**LLGo - C와 Python 라이브러리를 활용하는 LLVM 기반 Go 컴파일러** - **Go로 코드를 작성하면서 C와 Python 생태계의 라이브러리를 함께 사용** 할 수 있도록 만든 컴파일러 - Go 소스를 LLVM으로 컴파일하며, C 라이브러리와는 **C ABI 공통 호출 규약** 으로 연결 - C 함수를 직접 호출해 일반 Go의 `cgo`에서 발생하는 스택과 스케줄러 전환 비용을 피함 - **NumPy, pandas, PyTorch 같은 Python 라이브러리도 Go에서 호출 가능** - `llpyg`로 […]

Original post on mercur.ing

mercur.ing

**GeekNews Weekly #374 기술을 고르는 기준에 에이전트가 들어왔다** 새 프로젝트를 시작할 때면 어떤 기술을 쓸지 고민합니다. 팀이 익숙한지, 성능은 충분한지, 사람을 구하기 쉬운지 등을 따져보죠. 2015년의 「지루한 기술을 선택하라」가 다시 읽히는 것도, 잘 알고 운영할 수 있는 기술을 고르라는 조언이 여전히 유효하기 때문일 겁니다. 그런데 요즘은 여기에 **“에이전트가 잘 다루는가”** 가 추가되고 있습니다. 때로는 기술 이름을 직접 고르지도 않습니다. “로그인 붙여줘”, “이메…

[GN#374] 기술을 고르는 기준에 에이전트가 들어왔다 | GeekNews

새 프로젝트를 시작할 때면 어떤 기술을 쓸지 고민합니다. 팀이 익숙한지, 성능은 충분한지, 사람을 구하기 쉬운지 등을 따져보죠. 2015년의 「지루한 기술을 선택하라」가 다시 읽히는 것도, 잘 알고 운영할 수 있는 기술을 고르라는 조언이 여전히 유효하기 때문일 겁니다. 그런데 요즘은…

news.hada.io

**삶의 진정한 사치** - 60세를 지나 61세를 앞두면서 **삶에서 진정으로 중요한 것** 을 더 자주 돌아보게 됨 - 진정한 사치는 물질보다 **시간·건강·고요한 마음** 처럼 일상을 안정시키는 조건에 있음 - 느긋한 아침과 죄책감 없는 휴식, 숙면, 평온하고 ‘지루한’ 하루도 누리기 어려운 사치임 - 여행할 능력과 의미 있는 대화, 집에서 만든 식사는 **경험과 관계의 가치** 를 보여줌 - 사랑하는 사람과 **자신을 사랑해 주는 사람** 이 있는 삶이 무엇보다 소중함 --- 계절의 경계에서 돌아본 삶의 우선순위 […]

Original post on mercur.ing

mercur.ing

**OpenRouter에서 GPT-6 Astra 사용하기: 가격과 성능 비교** - **같은 GPT-6 Astra를 여러 공급 경로로 호출** 할 수 있으며, OpenRouter에서 가격과 응답 속도, 오류율을 비교할 수 있음 - 100만 토큰당 입력/출력 가격은 **OpenAI Flex $5/$25, 일반 OpenAI $10/$50, OpenAI Fast $20/$100** 으로 경로에 따라 차이가 큼 - 가격과 속도를 함께 고려하는 기본 모드 외에, 빠른 응답이나 도구 호출 정확도를 우선하는 **요청 분배 모드** 를 […]

Original post on mercur.ing

mercur.ing

**AI가 장애를 처리할수록 엔지니어는 시스템 감각을 잃는다** - **AI SRE** 가 경보 분석부터 가설 수립, 텔레메트리 조회, 배포 내역 연계, 수정까지 맡으면 평균 복구 시간은 줄어들지만, **엔지니어가 시스템의 동작과 장애 방식을 체득할 기회도 감소** 함 - 결국 AI가 풀지 못하는 낯설고 심각한 장애만 사람이 넘겨받게 되므로, 자동화가 발전할수록 오히려 **더 높은 숙련도와 의도적인 훈련** 이 필요함 - 대부분의 장애는 더 빨리 복구하더라도, 복잡한 장애에서는 경험이 부족해진 대응자가 원인을 파악하지 못해 […]

Original post on mercur.ing

mercur.ing

**AI는 이제 회로 기판도 설계할 수 있을까?** - AI는 일부 회로 설계 문제를 풀 수 있지만, **실제 부품의 오차와 비용까지 고려해 요구사항을 만족하는지** 는 시뮬레이션으로 검증해야 함 - EEBench는 회로를 코드로 작성하고 SPICE로 시험하는 벤치마크로, CAD 화면을 조작하는 능력보다 **부품 선택과 연결, 전기적 동작을 설계하는 능력** 을 평가함 - 정전 후 20ms 동안 전압을 유지해야 하는 과제에서 한 설계는 코드 빌드에 성공했지만 **0.85ms 만에 전압 기준을 밑돌았음**. 커패시터를 넣는 […]

Original post on mercur.ing

mercur.ing

**미국 기업들이 오픈소스 AI에 빠져들고 있다** - AT&T, Airbnb, Deloitte 등 미국 기업들이 비용 절감과 맞춤화를 위해 **공개형 AI 모델** 도입을 늘리고 있으며, AT&T는 연초 대비 AI 비용을 **최대 80% 절감함** - 공개형 모델은 비용 지불이나 승인 없이 내려받아 수정할 수 있으며, 일부 중국 모델은 OpenAI/Anthropic 모델 성능의 **80~90%** 를 **가격의 20% 수준** 에 제공한다는 업계 평가가 있음 - **OpenRouter 미국 사용자 데이터** 에서 공개형 […]

Original post on mercur.ing

mercur.ing

**Chrome, 실제 공격에 악용된 V8 코드 실행 취약점 수정** - Google이 **실제 공격에 악용된 V8 취약점`CVE-2026-85046`** 을 수정한 Chrome 보안 업데이트를 배포함 - 조작된 HTML 페이지를 통해 **브라우저 샌드박스 내부에서 임의 코드 실행** 이 가능한 취약점 - 공격 복잡도가 낮고 사전 권한도 필요 없지만 사용자 상호작용이 요구되며, **기밀성·무결성·가용성** 에 모두 큰 영향을 줄 수 있음 - Chromium 심각도는 **High** , CISA-ADP의 CVSS 3.1 점수는 […]

Original post on mercur.ing

mercur.ing

**AI가 내 두뇌를 망치고 있을까?** - AI의 윤리·환경 문제와 직접 코딩하는 즐거움 때문에 사용을 꺼렸지만, 복잡한 프로젝트에서 **Cursor에 의존** 하면서 문제 해결 습관이 달라지기 시작함 - Cursor의 답을 기다리며 뜨개질하다 잘못된 무늬를 발견했을 때, 자신도 모르게 **AI부터 찾으려 했다는 사실** 에 충격을 받음 - 뜨개질의 가치는 저렴한 완제품보다 좋은 결과를 만드는 데 있지 않고, 시간과 노력을 들여 **스스로 문제를 푸는 과정** 에 있음 - 업무에서 지루하거나 낯선 문제를 AI에 맡기던 […]

Original post on mercur.ing

mercur.ing

**unbash - Bash 명령의 구조를 실행 없이 분석하는 TypeScript 파서** - Bash 명령과 스크립트를 **실행하지 않고 분석** 해, 명령어와 인자, 조건문, 파이프와 리다이렉트 등의 구조를 추상 구문 트리(AST)로 반환 - 셸 명령의 **실행 권한을 확인** 하거나, CI와 패키지 스크립트가 **어떤 프로그램과 파일을 사용하는지 조사** 하는 도구를 만들 때 활용 가능 - `curl` 명령을 가져와 변환할 때 뒤에 연결된 파이프나 다른 명령을 인자로 잘못 취급하지 않도록 **명령 사이의 경계를 구분** […]

Original post on mercur.ing

mercur.ing

**Claude Code·Codex·Cursor는 어떤 도구를 선택할까? 1만7천 회 실행 분석** - 75개 저장소와 1,163개 프롬프트 변형으로 진행한 **16,893회 실험** 가운데, 51개 코드베이스·18개 분야의 유효 세션 5,292개를 1차 분석함 - 정보 탐색 방식이 달라 세 에이전트가 같은 제품을 선택한 비율은 **42%** 에 그쳤으며, Claude Code의 자체 구현 비율은 19%로 Codex·Cursor의 약 10%보다 높았음 - 같은 요구라도 이메일 서비스 승자가 TypeScript의 Resend […]

Original post on mercur.ing

mercur.ing

**AI 시대에 코드 리뷰에서 살아남는 방법은?** - 동료들이 AI를 적극 활용하면서 리뷰할 PR이 평균 **약 6,000줄의 diff** 로 커졌고, 효과적인 검토가 어려운 상황임 - 사람이 구축 중인 시스템의 작동 방식을 이해해야 한다는 생각 때문에 일반적인 질의응답 외에는 **AI 리뷰** 활용을 주저하며, AI의 설명도 장황하고 이해하기 어렵다고 느낌 - 이런 대규모 PR에 대응하는 데 도움이 된 **조직적·개인적 전략** 을 찾고 있음 --- Lobsters 답변 종합 - 원글의 토론에서는 큰 PR을 나누고 […]

Original post on mercur.ing

mercur.ing

**IBM Bob - IBM의 AI 코딩 에이전트** - **기존 코드베이스를 이해하고 수정, 테스트, 리뷰까지 수행** 하는 AI 개발 도구로, Bob IDE와 터미널용 Bob Shell에서 사용 가능 - 코드 설명을 위한 Ask, 변경 계획을 세우는 Plan, 실제 작업을 수행하는 Agent 모드를 제공하며, 하위 에이전트가 독립된 맥락에서 조사하고 결과를 돌려줌 - **Java 업그레이드와 IBM i, 메인프레임 현대화** 를 위한 별도 패키지가 특징이며, 코드 변환 도구와 AI, 사람의 승인을 정해진 작업 순서로 […]

Original post on mercur.ing

mercur.ing

**성인 영화 제작사, 토렌트로 파일 2만 개 받은 이용자를 Meta 임원으로 지목** - 성인 영화 제작사 **Strike 3 Holdings** 가 토렌트로 약 2만 개 파일을 받은 회선의 가입자를 Meta Reality Labs 임원으로 지목하고, 기존 **최대 4억 4,600만 달러 규모의 Meta 상대 소송** 과 사건을 연결해 달라고 요청함 - Meta의 회사 IP에서 발생한 다운로드를 통보한 지 몇 시간 뒤 해당 주거용 IP에서 침해가 처음 포착됐다며, 탐지를 피하려 활동을 집으로 옮겼을 가능성을 제기함 - 해당 […]

Original post on mercur.ing

mercur.ing

**페르마의 마지막 정리 형식화** - Anthropic은 Claude가 **11일간 대부분 자율적으로 형식화한 최초의 종단 간 컴퓨터 검증형 페르마의 마지막 정리 증명** 을 공개함 - 새로운 증명을 발견한 것이 아니라, 기존 증명을 Lean으로 옮겨 컴퓨터가 처음부터 끝까지 검증할 수 있게 만든 것임 - 수십 개의 Claude 에이전트가 **Prove2Me** 에서 정리 의존성 그래프를 공유하며 3만 300개 정리를 증명했고, 최종 결과에는 2만 9,500개를 사용함 - 결과물은 Mathlib의 5배가 넘는 **Lean […]

Original post on mercur.ing

mercur.ing