2026년 9월 5일 (토)
광고 문의
개발
AI
보안
정부·산업
스타트업
행사·커뮤니티
디지털 서비스
AI
전체
기업·모델
제품·서비스
에이전트·코딩도구
정책·규제
활용사례
가장 많이 본
AI
뉴스
1
앤트로픽, AI 보안 평가 환경 강화 조치 공개
2
앤트로픽, AI 네이티브 SDLC 플레이북 공개…코드 밖 병목 겨냥
3
GitHub, Copilot 정책·과금 변경 예고…채팅 보존 기간은 계정 수명까지
4
Cursor, 코드 호스팅 플랫폼 'Origin' 얼리 베타 공개…유료 이용자 대상 제공
5
앤스로픽, 연구기관 과학자 1만 명에 Claude Team 무상 지원 시작
GitHub Copilot CLI, 새 터미널 인터페이스 정식 출시…이슈·PR 탭 내장
GitHub가 Copilot CLI의 새 터미널 인터페이스를 정식 출시했다. 개발자는 터미널 안에서 이슈와 풀 리퀘스트, MCP 서버, 스킬, 플러그인 설정을 더 직접적으로 다룰 수 있게 됐다.
Cognition, AI 코딩 품질 벤치마크 FrontierCode 공개…“병합 가능한 코드” 평가
OpenAI, SEC에 S-1 초안 비공개 제출…상장 선택지 확보
OpenAI, Codex GPT-5.6 컨텍스트 창 27만2000토큰으로 정정
OpenAI가 Codex CLI 0.144.6에서 GPT-5.6 Sol·Terra·Luna의 컨텍스트 창 메타데이터를 기존 37만2000토큰에서 27만2000토큰으로 정정했다. 이번 변경은 세 모델의 번들 지침을 함께 갱신한 버그 수정이다.
2026.07.19.17:08
단일 토큰 응답 분포로 LLM API 검증…165개 모델 실험
프라하경제대학교 연구자가 짧은 단어 답변을 반복 수집해 API 뒤에서 작동하는 대규모언어모델의 정체를 검증하는 행동 지문 기법을 제시했다. 165개 모델을 대상으로 한 자체 실험에서 전체 질문 묶음의 동등오류율은 7.3%였지만, 연구는 아직 동료평가를 거치지 않았다.
2026.07.19.10:56
뉴욕시, AI 보정 임대 매물 공개 의무 추진…23개 주거정책 발표
미국 뉴욕시가 인공지능이나 디지털 도구로 수정한 임대 매물 사진·영상에 보정 사실을 밝히도록 하는 방안을 추진한다. 시는 기만적인 매물 정보로부터 임차인을 보호하기 위한 23개 정책 과제 가운데 하나로 이 조치를 제시했다.
2026.07.19.09:20
Perplexity, 대규모 조사 에이전트 벤치마크 공개…최고 하드 F1 0.133
Perplexity가 대규모 대상을 찾고 각 주장을 근거로 검증하는 조사 에이전트 공개 벤치마크 ‘WANDR’를 내놨다. 회사 자체 평가에서 최고 하드 F1도 0.133에 그쳐, 광범위한 탐색과 근거 검증을 함께 수행하는 능력은 아직 제한적인 것으로 나타났다.
2026.07.19.06:09
30년 미해결 계산복잡도 논문 공개…저자 "핵심 증명은 GPT-5.6 Pro"
계산복잡도 연구자 미하일 바빈이 혼 논리와 폐쇄 시스템의 정준 표현 완전성 판정이 coNP-완전하다는 증명을 공개했다. 저자는 핵심 증명을 GPT-5.6 Pro가 도출했다고 밝혔지만, 원고는 아직 동료평가를 거치지 않았다.
2026.07.19.05:10
GitHub Copilot 코드 리뷰, AGENTS.md·CLAUDE.md 지원…방화벽 기본 적용
GitHub가 Copilot 코드 리뷰의 맞춤 지침 지원 범위를 넓히고 실행 환경에 기본 방화벽과 독립적인 러너 설정을 도입했다. 기능 브랜치에서 지침을 시험할 수 있고 AGENTS.md, REVIEW.md, GEMINI.md, CLAUDE.md 등을 자동으로 읽는다.
2026.07.19.01:10
Anthropic, Fable 5를 Claude Max·Team Premium 요금제에 포함
Anthropic이 7월 20일부터 Claude Fable 5를 Max와 Team Premium 요금제의 기본 사용 범위에 포함한다. Pro와 Team Standard 이용자는 사용 크레딧 방식으로 접근하며 일회성 100달러 크레딧을 받는다.
2026.07.18.13:11
연구진, LLM ‘점 토큰’ 속 계산 80~95% 복원
하버드대·MIT·Anthropic 등 연구진이 의미 없는 점·숫자 토큰 사이에서 DeepSeek V3와 Kimi K2가 수행한 중간 계산을 숨은 상태만으로 80~95% 복원했다고 밝혔다. 사고과정 문장이 없어도 모델 내부 계산의 일부를 추적할 수 있다는 결과다.
2026.07.18.12:10
Moonshot AI, 시각 인식 벤치마크 공개…평가 대상 모두 60% 미만
Moonshot AI 공식 연구 페이지에 따르면 Kimi 팀이 멀티모달 모델의 원자적 시각 인식 능력을 따로 측정하는 PerceptionBench를 공개했다. 회사 자체 평가에서는 3,000개 검증 문항으로 시험한 모델 가운데 정확도 60%를 넘긴 사례가 없었다.
2026.07.18.11:10
GitHub Copilot, 저장소별 코딩 에이전트·코드 리뷰 활동 지표 GA
GitHub 공식 변경 로그에 따르면 Copilot 사용 지표 API가 저장소 단위의 코딩 에이전트와 코드 리뷰 pull request 활동을 제공하도록 확대됐다. 기업·조직 관리자는 두 신규 엔드포인트로 하루 단위 저장소별 활동을 확인할 수 있다.
2026.07.18.09:09
OpenAI, AI 투자 성과지표 제안…‘유용한 지능/달러’로 비용·신뢰성 측정
OpenAI가 기업의 AI 투자 성과를 토큰 가격이나 도입 인원 대신 실제로 끝낸 업무와 성공 비용, 결과 신뢰성으로 측정하는 ‘유용한 지능/달러’ 지표를 제안했다.
2026.07.18.08:10
DeepMind·Isomorphic Labs, AI 생물안보 전략 공개…SynthID DNA 적용 검토
Google DeepMind와 Isomorphic Labs가 AI의 생물학적 오용을 막고 감염병 예방·탐지·대응에 활용하는 공동 전략을 공개했다. DNA 합성 심사를 위해 SynthID를 생물학 데이터에 적용하는 방안도 검토한다.
2026.07.18.05:10
11
12
13
14
15