tag: Benchmarking · 2건
- 근거: AI/LLM 파인튜닝 최적화 영역 — LoRA 스피드런 대회 형식으로 최적화 기법 벤치마킹
- 액션: git clone https://github.com/Saivineeth147/lora-speedrun 후 submissions/ 및 harness/ 구조 확인해 상위 제출물의 LoRA 최적화 기법 파악
- 근거: AI 에이전트 평가 방법론 — AI/LLM 관심 분야의 트렌드/아키텍처 파악에 해당
- 액션: AI 에이전트 벤치마크 기준(GAIA, AgentBench 등) 비교 정리 및 자체 평가 체크리스트 초안 작성