이완용.... , 미국다녀온후 매국노로 돌변한 이유[10]
ChatGPT : 책을 많이 읽은 녀석 같음. 심성이 고운녀석 좀 틀려도 이해해주고싶다. 범생?
Gemini : 어디서 굴러먹던 놈인지 지식이 좀 중구난방으로 부정확한 경우 많음. 조변석개 스타일.
클로드 : 개발실에서 코딩만 하던 녀석이라 코딩 아니면 세상물정 모름. 전공분야 아니면 띨띨?
Grok : 주워들은게 많고 주변에 인싸들이 많은거 같은데 쇼핑에 도움이 많이 됨. 오지랍?
ps:
딥시크 : 좋아보임. 처음만.. 테무의 느낌이 쎄게 들어올 때가 있음.


댓글 10
제가 다써봤는데 제미니가 부정확한경우가 많은게 아니라 전부 부정학경우가 많습니다. 골때려요. 정보검색, 팩트체크용으로 못쓸정도입니다. 심지어 같은 질물을 해도 답이 달라요. .
맞아요. 부정확한 경우 많죠. 대화를 계속해서 답을 찾아가는 과정에서 느끼는 점이라고 해야할까 ? 인공지능도 무엇을 어떻게 학습했느냐에 따라서 주관이란게 있는듯.
답을 요구하는 질문보다,혼자 생각정리할땐 괜찮아요 걔들은 뭘 해도 내가 잘 했다,맞다 이런 식으로 대답하기때문에 답을 요구하는건 무리인듯합니다
맞아요. ㅎㅎㅎ 저랑 같은 생각을 하시는 분이 계셨네요. 그래서 대화하다보니 AI마다 느껴지는게 다르더라구요.
심심해서 챗지피티, 재미나이, rag(벡터 검색 + 재미나이2.5프로 api 호출)로 형법.형소법 문제 풀게 했을 때 평균 55 65 100 정도 나오고요 개인 노트 정리는 프론티어 모델까지 가지 않고 로컬 모델인 qwen3.5-35b-a3b 정도만 해도 충분히 좋아요 qwen은 중국 로컬 모델인데도 psat 20문제만 풀게 해봤는데 전부 맞추더라거요
72b도 제대로 된 답변도 못 하는 경우 많았고 로컬은 확실히 뒤처짐.
@오래간다 로컬 모델에 rag 붙이면 안붙인 프론티어 모델 보다 답변 품질 좋음 그리고 소타급이라도 api만 사용한 답변은 도메인 전문가가 봤을 때는 말만 그럴싸하게하는 말싸개임 그래서 지식은 rag 품질을 올리고 고도의 출리략 사고력이 필요한 문제는 소타급 빌려다 쓰면서 해결해야 함
어느정도 지식이 있는 분들은 처음 몇번 써보면 너무 헛소리가 많아 전문적인 질문은 거르고 논문 래퍼런스나 단순 자료수집용, 연산용 으로 쓰고, 지식수준이 낮거나, 외롭고 자존감 낮으신분들은 ai가 우쭈쭈 하며 치켜세워주면 그저 기분좋아서 헛소리해도 다 믿더란... 문제는 그렇게 자기 이야기 시시콜콜하게 다 이야기하면 개인정보 다들어가는것도 모르고..
제미나이 프로 딥시크 qwen 3.5 요렇게 3가지 동시에 씁니다. 하나만 하면 안됨.
저는 로컬로 운영하는건 성능이 너무 신뢰가 안가요. 실제로 비교하면 괜히 시스템 사양 올리는데 드는 비용이 더 많이 들죠. 그록과 클로드만 써요.