
GitHub 공식 변경 로그에 따르면 Copilot vision이 정식 제공을 시작했다. 개발자는 이미지와 PDF를 Copilot Chat 프롬프트에 첨부해 Copilot이 코드와 시각 자료를 함께 해석하도록 요청할 수 있다.
이번 기능은 코드 보조 도구가 텍스트 중심 입력을 넘어 화면, 문서, 시각 설계 자료까지 다루는 방향으로 확장되고 있음을 보여준다. GitHub는 Copilot vision이 이미지와 PDF를 직접 프롬프트에 붙일 수 있게 하며, Copilot이 첨부된 자료에서 보이는 내용을 코드 맥락과 함께 추론한다고 설명했다.
지원 파일 형식은 JPEG, PNG, GIF, WebP 이미지와 PDF 문서다. GitHub는 이 기능이 VS Code의 Copilot Chat과 github.com의 Copilot Chat에서 제공된다고 밝혔다. VS Code에서는 채팅 패널에 이미지를 붙여넣거나 끌어다 놓거나, 우클릭으로 첨부할 수 있으며 ask, plan, agent 모드에서 사용할 수 있다.
GitHub는 Copilot vision을 모든 Copilot 플랜에서 사용할 수 있다고 안내했다. 이는 개별 개발자뿐 아니라 조직 단위 사용자에게도 시각 자료 기반 질의가 일반 기능으로 들어왔다는 의미다. 화면 캡처, 오류 메시지 이미지, UI 시안, 문서형 요구사항처럼 개발 과정에서 자주 오가는 비정형 자료를 같은 대화 흐름 안에서 다룰 수 있게 된다.
다만 시각 자료를 개발 워크플로에 넣는 일은 보안과 데이터 관리 기준도 함께 요구한다. 제품 화면, 내부 문서, 고객 자료가 첨부될 수 있는 만큼 조직은 Copilot 사용 정책과 자료 반출 기준을 함께 점검할 필요가 있다. 기능 자체는 개발 생산성을 높일 수 있지만, 첨부되는 데이터의 성격에 따라 관리 책임이 달라질 수 있기 때문이다.
Copilot vision의 정식 제공은 AI 코딩 도구 경쟁이 단순 코드 완성에서 멀티모달 이해와 에이전트형 작업 흐름으로 옮겨가고 있음을 보여준다. 최근 Copilot은 브라우저 도구, 자동 모델 선택, CLI와 SDK 기능을 잇달아 확장하고 있다. 이번 변화는 개발자가 보는 자료와 작성하는 코드를 같은 작업 공간 안에서 연결하려는 흐름의 연장선에 있다.
출처: GitHub Changelog https://github.blog/changelog/2026-07-01-copilot-vision-is-generally-available/ · GitHub Docs https://docs.github.com/copilot









