xiaowei-system/scripts/test_ollama.sh

13 lines
559 B
Bash

#!/bin/bash
# 测试 ollama 本地模型的响应质量和速度
echo "=== 测试 llama3.2:1b ==="
time ollama run llama3.2:1b "用一句话解释什么是过拟合" 2>/dev/null
echo ""
echo "=== 测试 API 调用 ==="
curl -s http://localhost:11434/api/generate -d '{"model":"llama3.2:1b","prompt":"用一句话解释什么是过拟合","stream":false}' | python3 -c "
import sys, json
d = json.load(sys.stdin)
print('响应:', d.get('response','')[:200])
print('耗时:', d.get('eval_count', 0), 'tokens,', d.get('eval_duration', 0)/1e9, 's')
" 2>/dev/null