블로그
- llm-d now runs anywhere: No Kubernetes? No Problem With the llm-d router’s new file-discovery plugin, that changes. llm-d can now run as a plain process or container in any environment, with no dependency on Kubernetes or any oth.......
- 글로벌 기업 WP Semantix사의 "온톨로지 기반의 데이터 분석예측 플랫폼"인 “Timbr.ai”가 필요한 경우?? . - 온톨로지 기반으로 데이터 맥락을 이해하는 분석과 예측이 필요한 업무(단순 분석 X) - LLM/RAG/그래프RAG에 대한 ROI나 효능감이 떨어질 경우(RAG 정확도에 실망한 경우) - 팰런티어같은 기능과 성능을 원하지만 예산이 충분치 않을 경우(팰런티어에 비해 1/50의 고객 공급가격입니다..) - NL2SQL or Txt2SQL에 분석 결과와 정확도에
- NVIDIA GTC 정리- 5편 Anouncing NVIDIA Agent Toolkit for Enterprise AI Agent Toolkit for Enterprise AI 설명 - Agent: application - LLM: code로 만들어진 뇌(Brain) - HARNESS: operation 엔비디아 네오트론 - 우리가 일반적으로 얘기하는 world model(or 엄마 모델)의 한 종류 - 텍스트, 코드, 논리에 특화 되.......
- 테슬라 HW4 -> HW4.1은 생각보다 큰 차이를 만들어내는 변화같습니다. 야후 파이낸스에 올라온 콜 트랜스크립트에도 “AI4.1 or AI4+” 및 약 10% 컴퓨트 증가, 메모리 대역폭 증가 취지의 발언이 정리되어 있습니다. FSD는 큰 틀에서는 “LLM 계열 사고방식으로.......
- 알약 xLLM, LLM 사용시 데이터 유출 등 탐지하고 차단 기존에 DLP 데이터유출장비가 파일 or 이메일 중심이었다면, LLM 환경에서는 프로프트(입력값)라는 비정형 데이터를 통해 기밀이 유출될수 있습니다.
- 고객대응 Agent 구축 그러면서도 구조화 해서 커스터마이징 할 수있도록 LLM API만 로컬 LLM으로 교체하면 온프레미스 환경에서 동작하는 것도 고려한다. 파인튜닝은 비용과 속도 측면에서 배제. Curl API등록관리 기능(Oauth2 인증관리 or 토큰관리 포함) + LLM API 등록관리기능 + RAG.md 등록관리.......