AI 성적표의 반전, 왜 대형 모델이 스타트업에 밀렸을까?

국내 AI 모델 성능 평가에서 스타트업의 모델이 대기업의 거대 AI 모델을 앞서는 결과가 나왔습니다. 이는 단순히 체급이 전부가 아니라는 점을 시사하며, AI의 실질적인 업무 수행 능력인 ‘에이전트’ 최적화가 중요해졌음을 보여줍니다. 특정 시험 점수에만 치중하는 ‘벤치맥싱’ 논란까지 더해진 상황에서 모델의 진정한 경쟁력을 판단하는 기준을 짚어봅니다.

제조업의 AI ‘빗장’ 풀렸다, 단순 챗봇에서 에이전트로의 진화

[비즈톡톡] 자체 개발 ‘챗봇’으로는 한계… AI 에이전트 전환에 빗장 푸는 제조사들

국내 주요 제조사들이 보안을 이유로 멀리했던 외부 생성형 AI를 사내 업무에 본격적으로 도입하고 있습니다. 단순 정보를 검색하던 챗봇을 넘어 복잡한 작업을 수행하는 ‘AI 에이전트’로 성능이 진화하면서, 변화를 받아들이지 않을 경우 얻게 될 효율성 격차를 더 이상 간과할 수 없게 됐기 때문입니다.