LLM에게 “1~5점으로 평가해줘”를 그만해야 하는 이유: 신뢰할 수 있는 채점 설계법
LLM에게 1~5점을 매기게 하면 숫자는 그럴듯하지만 근거가 없습니다. Copilot Studio CAT 팀이 제안하는 해법은 ‘결정 먼저, 작은 검사로 분해, 조합 규칙은 모델 밖에서’입니다. 에이전트 품질 평가를 신뢰 가능하게 만드는 7단계를 정리했습니다.
LLM에게 1~5점을 매기게 하면 숫자는 그럴듯하지만 근거가 없습니다. Copilot Studio CAT 팀이 제안하는 해법은 ‘결정 먼저, 작은 검사로 분해, 조합 규칙은 모델 밖에서’입니다. 에이전트 품질 평가를 신뢰 가능하게 만드는 7단계를 정리했습니다.
Viva Insights에 GitHub Copilot의 AI 지출·사용 인사이트가 추가됩니다. 직속 부하 5명 이상 관리자(범위 제한 접근), 글로벌 분석가, Microsoft 글로벌 관리자가 대시보드에서 지출을 추적하고 데이터 기반 의사결정을 내릴 수 있으며, 기본적으로 활성화되...
Microsoft 365 Copilot 앱(웹·데스크톱)의 Copilot Search에서 Copilot Answers가 더 간결한 답변을 제공하고, 오른쪽 사이드바의 Copilot 채팅으로 대화를 이어가는 흐름을 더 눈에 띄게 안내합니다. 2026년 7월 정식 출시 예정입니다.
Copilot은 언어를 다루는 데 뛰어나지만, 업무는 말만으로 끝나지 않습니다. SharePoint Copilot Apps는 SPFx로 만든 풍부한 인터랙티브 UX 컴포넌트를 Copilot 캔버스 안으로 직접 가져와, 채팅을 떠나지 않고 결재·조회·예약 같은 일을 바로 처리하게 해...
노트북에서 잘 돌아가던 에이전트를 실제 업무에 투입하려면 신원·관측성·거버넌스·메시징·M365 데이터 연결이라는 ‘마지막 1마일’을 넘어야 합니다. Agent 365 Skills는 이 과정을 코드 어시스턴트 안에서 자연어 한 문장으로 끝낼 수 있게 해 주는 6개의 스킬 묶음입니다.