본문 바로가기

728x90

gemini

(19)
원치 않는 AI 기능, 한 번 껐다고 끝나지 않아요 원치 않는 AI 기능, 한 번 껐다고 끝나지 않아요AI 뉴스 썸네일운영체제와 브라우저, 업무 앱에 AI 기능이 빠르게 늘고 있어요. 쓰지 않는 기능을 끄려 해도 하나의 스위치로 끝나지 않는 경우가 많아요. 같은 제품 안에서도 요약, 추천, 학습, 사이드바 설정이 서로 떨어져 있기 때문이에요. 1핵심 요약구분핵심왜 볼 만한가요설정 구조AI 기능이 앱과 계정, 운영체제 설정에 나뉘어 있어요대표 스위치만 끄면 일부 기능이 남을 수 있어요브라우저Chrome과 Edge는 실험 기능과 사이드바를 따로 확인해요업데이트 뒤 새 옵션이 추가됐는지 다시 볼 필요가 있어요모바일Gemini와 Apple Intelligence는 앱 연결과 학습 설정이 별개예요AI 본체를 꺼도 앱별 접근이나 학습 옵션이 남을 수 있어요업무 도구..
AI 텍스트 워터마크는 단어 선택 확률에 숨어요 AI 텍스트 워터마크는 단어 선택 확률에 숨어요AI 뉴스 썸네일AI가 만든 글에는 눈에 보이는 표식이 없어도 통계적인 흔적을 남길 수 있어요. 언어 모델이 다음 단어를 고를 때 특정 후보가 조금 더 자주 선택되도록 확률을 조정하는 방식이에요. 긴 글에서는 작은 편향이 쌓이지만, 짧은 문장이나 크게 고친 글은 판별하기 어려워요. 1핵심 요약구분확인된 내용읽을 때 볼 점삽입 방식비밀 키가 문맥마다 단어 후보를 나누고 일부 후보의 선택 확률을 조금 높여요문장 안에 별도 문자나 메타데이터를 넣지 않아요탐지 방식같은 키로 후보 분류를 재현한 뒤 특정 후보가 나온 비율을 통계적으로 계산해요제공자의 비밀 키나 공식 검사 서비스가 필요해요길이 조건작은 확률 편향은 선택 지점이 많은 긴 글에서 더 분명해져요짧은 글과 코..
AI 코딩 모델 11개를 같은 조건으로 돌려보니 비용과 결과가 달랐어요 AI 코딩 모델 11개를 같은 조건으로 돌려보니 비용과 결과가 달랐어요AI 뉴스 썸네일Netlify가 AI 코딩 모델 11개에 같은 커피숍 웹사이트 제작 지시를 주고, 모델마다 3번씩 실행했어요. 가장 비싼 실행이 늘 가장 나은 결과를 내지는 않았고, 같은 모델 안에서도 비용과 디자인 편차가 컸어요. 1핵심 요약구분확인된 결과실무에서 볼 점비용실행당 2.4~1,055 크레딧으로 차이가 컸어요모델 이름보다 작업별 예산 범위를 먼저 정해야 해요결과물같은 모델을 3번 실행해도 디자인과 콘텐츠가 달라졌어요한 번의 결과만으로 모델을 평가하기 어려워요고가 모델Claude Opus 5가 풍부한 화면을 만들었지만 비용 변동도 컸어요높은 비용이 같은 비율의 품질 향상을 보장하지 않아요저가 모델GLM 5.2, Kimi K..
암호화된 LLM 추론이 다른 모델에서 풀렸다 암호화된 LLM 추론이 다른 모델에서 풀렸다AI 뉴스 썸네일OpenAI, Anthropic, Google의 추론 API가 돌려주는 암호화 블록에서 내부 추론을 복원한 연구가 나왔어요. 연구진은 강한 모델의 블록을 같은 업체의 방어가 약한 모델에게 넘긴 뒤 탈옥해 평문을 얻었어요. 공개된 에이전트 로그에는 API 키와 비밀번호 같은 정보도 남아 있었어요. 2핵심 요약구분핵심왜 볼 만한가요공격 방식강한 모델의 암호화된 추론 블록을 같은 업체의 약한 모델이 읽게 했어요암호문 자체보다 블록을 다른 문맥에서 재사용할 수 있었던 설계가 공격 경로가 됐어요확인 범위공개 로그 6,708개에서 추론 블록 315,320개를 복원했어요화면에 보이는 대화만 지워서는 민감정보가 남을 수 있어요현재 상태공급자에게 사전 신고한 뒤..
Xirp가 AI 코딩에 조직의 기억을 연결하는 방법 Xirp가 AI 코딩에 조직의 기억을 연결하는 방법Xirp AI 코딩 환경 썸네일AI 코딩 도구는 저장소 안의 파일을 빠르게 읽어요. 하지만 서비스 담당자, 의존 관계, 과거의 기술 결정까지 저절로 알지는 못해요. Spotify가 공개한 Xirp는 이 빈칸을 조직 컨텍스트로 채우려는 macOS용 개발 환경이에요. 1핵심 요약구분내용제품Claude Code, Codex, Gemini 세션을 여러 프로젝트에서 실행하고 관리해요.작업 격리작업마다 Git worktree를 만들 수 있어 같은 저장소의 여러 작업이 서로 섞이지 않아요.조직 컨텍스트Spotify Portal을 연결하면 서비스 소유권, 의존 관계, 문서, 기술 기록과 이전 세션을 불러올 수 있어요.제공 범위현재 베타는 macOS에서 로컬 코딩 세션을..
구글 딥마인드 운영권은 코레이에게, 하사비스는 AGI 전략에 집중해요 구글 딥마인드 운영권은 코레이에게, 하사비스는 AGI 전략에 집중해요AI 뉴스 썸네일구글이 딥마인드의 연구 전략과 제품 운영을 더 분명하게 나눴어요. 데미스 하사비스는 일상 운영에서 물러나 AGI와 과학 전략에 집중하고, 코레이 카부크추오울루가 제미나이 모델부터 앱과 개발자 조직까지 맡아요. 1핵심 요약구분핵심왜 볼 만한가요딥마인드 지휘 체계하사비스는 의장과 알파벳 수석과학자를 맡고, 카부크추오울루가 운영을 총괄해요장기 AGI 전략과 제미나이 제품 실행을 서로 다른 리더가 책임지는 구조예요제미나이 조직모델 개발, 최전선 AI 연구, 제미나이 앱과 개발자 조직이 한 책임자 아래 모여요연구 결과를 제품과 개발자 생태계로 옮기는 속도를 높이려는 인사로 읽혀요제프 딘의 퇴사제프 딘과 산제이 게마왓이 독립 공익법..
Chrome 보안 버그 1,072개, AI가 바꾼 취약점 대응 속도 Chrome 보안 버그 1,072개, AI가 바꾼 취약점 대응 속도AI 뉴스 썸네일Google이 Chrome 149와 150에서 보안 버그 1,072개를 고쳤다고 밝혔어요. 앞선 23개 버전에서 수정한 보안 버그를 모두 합친 것보다 많은 수치예요. Gemini 기반 도구는 취약점 탐색에 머물지 않고 신고 분류, 후보 패치 작성, 테스트, 배포 준비까지 들어갔어요. 1 2핵심 요약구분핵심왜 볼 만한가요수정 규모Chrome 149·150에서 보안 버그 1,072개를 수정했어요이전 23개 버전의 합계를 넘어섰어요취약점 탐지여러 AI 모델과 Chrome의 CVE·Git 이력을 함께 활용해요13년 넘게 숨어 있던 샌드박스 탈출 결함도 찾았어요신고 분류스팸·중복 제거부터 재현, 심각도 판단, 담당자 배정까지 자동화..
Claude Opus 5가 지능 지수 1위, 모델 선택은 순위보다 복잡해졌어요 Claude Opus 5가 지능 지수 1위, 모델 선택은 순위보다 복잡해졌어요IT & AI 뉴스 썸네일Claude Opus 5의 최대 추론 설정이 Artificial Analysis Intelligence Index에서 61점을 받아 선두에 올랐어요. 170개 모델을 비교한 종합 순위라는 점은 눈에 띄지만, 실제 서비스를 고를 때는 점수 하나만 보면 부족해요. 같은 비교표에서 속도, 지연 시간, 작업당 비용, 문맥 창의 선두 모델이 모두 달라요. 1핵심 요약구분핵심왜 볼만한가요종합 지능Claude Opus 5 최대 추론 설정이 61점으로 1위에 올랐어요에이전트 업무와 코딩, 과학 추론, 지식 신뢰성, 장문맥 추론을 한 점수로 비교해요평가 구성Intelligence Index v4.1은 9개 평가를 가중 ..
AI 연구소가 자전거 타는 펠리컨에 맞춰 모델을 훈련했을까요 AI 연구소가 자전거 타는 펠리컨에 맞춰 모델을 훈련했을까요자전거 타는 펠리컨 AI 벤치마크 분석유명한 SVG 과제만 잘 풀도록 AI 모델을 따로 조정했다는 의심을 검증한 실험이 나왔어요. 7개 모델이 만든 SVG 1,008개를 비교했지만, 자전거를 타는 펠리컨 조합에서만 성능이 높아진 흔적은 찾지 못했어요. 1핵심 요약구분핵심왜 볼 만한가요실험 규모8종의 동물과 6종의 탈것을 조합해 48개 과제를 만들고, 7개 모델에서 3회씩 실행했어요특정 과제 하나가 아니라 비슷한 과제 47개와 나란히 비교했어요결과펠리컨은 동물 8종 중 6위, 자전거는 탈것 6종 중 5위였어요유명한 조합만 유난히 잘 그렸다는 설명과 맞지 않았어요조합 순위펠리컨과 자전거 조합은 전체 48개 중 42위였어요개별 요소의 난이도를 고려해도..
제미나이 Flash 3종 공개, 속도·비용·보안으로 역할을 나눴어요 제미나이 Flash 3종 공개, 속도·비용·보안으로 역할을 나눴어요AI 뉴스 썸네일구글이 Gemini 3.6 Flash, 3.5 Flash-Lite, 3.5 Flash Cyber를 함께 공개했어요. 하나의 모델로 모든 작업을 처리하기보다 품질과 처리량, 보안 작업에 맞는 모델을 골라 쓰는 구성이에요. 1핵심 요약모델맡은 역할확인할 점Gemini 3.6 Flash코딩·지식 작업·멀티모달 처리3.5 Flash보다 출력 토큰을 17% 적게 썼다는 구글 측 측정치가 나왔어요Gemini 3.5 Flash-Lite검색·문서 처리 같은 대량 작업초당 출력 토큰 350개와 낮은 단가를 앞세웠어요Gemini 3.5 Flash Cyber취약점 탐지·검증·패치CodeMender 안에서 정부와 신뢰할 수 있는 파트너에게만 제..

728x90