Moonshot AI/kimi-2.7-image-to-text
kimi-2.7-image-to-text
استخدم Kimi 2.7 Image-to-Text API لفهم الصور، والأسئلة البصرية، والاستخراج بأسلوب OCR، والاستدلال متعدد الوسائط داخل سير عمل إنتاجي مستقر.
Image Chat
نماذج Kimi 2.7 ذات الصلة
أمثلة API
مثال الإرسال
const response = await fetch('https://api.flaq.ai/api/v1/chat/completions', {
method: 'POST',
headers: {
Authorization: 'Bearer YOUR_API_KEY',
Accept: 'text/event-stream',
'Content-Type': 'application/json'
},
body: JSON.stringify({
model: 'kimi-2.7-image-to-text',
messages: [
{
role: 'user',
content: [
{
type: 'text',
text: 'What is roughly shown in this image?'
},
{
type: 'image_url',
image_url: {
url: 'https://example.com/sample-image.jpg'
}
}
]
}
],
stream: true,
max_tokens: 300
})
});
const reader = response.body.getReader();
const decoder = new TextDecoder();
let buffer = '';
let assistantText = '';
while (true) {
const { done, value } = await reader.read();
if (done) break;
buffer += decoder.decode(value, { stream: true });
const frames = buffer.split('\n\n');
buffer = frames.pop() || '';
for (const frame of frames) {
const lines = frame.split('\n').filter(Boolean);
let eventName = 'message';
const dataLines = [];
for (const line of lines) {
if (line.startsWith('event:')) {
eventName = line.slice(6).trim();
} else if (line.startsWith('data:')) {
dataLines.push(line.replace(/^data:\s*/, ''));
}
}
const raw = dataLines.join('\n').trim();
if (raw === '[DONE]') {
console.log('\nFinal text:', assistantText);
continue;
}
let payload;
try {
payload = JSON.parse(raw);
} catch {
continue;
}
if (eventName === 'error' || payload.error) {
const msg = payload.error?.message ?? payload.message ?? 'Chat request failed';
throw new Error(msg);
}
const delta = payload.choices?.[0]?.delta;
if (delta?.content) {
assistantText += delta.content;
console.log(assistantText);
}
}
}
مثال الإرسال
import json
import requests
response = requests.post(
'https://api.flaq.ai/api/v1/chat/completions',
headers={
'Authorization': 'Bearer YOUR_API_KEY',
'Accept': 'text/event-stream',
'Content-Type': 'application/json',
},
json={
'model': 'kimi-2.7-image-to-text',
'messages': [
{
'role': 'user',
'content': [
{
'type': 'text',
'text': 'What is roughly shown in this image?',
},
{
'type': 'image_url',
'image_url': {
'url': 'https://example.com/sample-image.jpg',
},
},
],
}
],
'stream': True,
'max_tokens': 300,
},
stream=True,
)
response.raise_for_status()
event_name = 'message'
assistant_text = ''
for raw_line in response.iter_lines(decode_unicode=True):
if not raw_line:
event_name = 'message'
continue
if raw_line.startswith('event:'):
event_name = raw_line.replace('event:', '', 1).strip()
continue
if raw_line.startswith('data:'):
raw_data = raw_line.replace('data:', '', 1).strip()
if raw_data == '[DONE]':
print('\nFinal text:', assistant_text)
continue
payload = json.loads(raw_data)
if event_name == 'error' or payload.get('error'):
error = payload.get('error') or payload
raise RuntimeError(error.get('message', 'Chat request failed'))
choices = payload.get('choices') or []
if choices:
delta = choices[0].get('delta') or {}
content = delta.get('content')
if content:
assistant_text += content
print(content, end='', flush=True)
مثال الإرسال
curl -N -X POST "https://api.flaq.ai/api/v1/chat/completions" \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Accept: text/event-stream" \
-H "Content-Type: application/json" \
-d '{
"model": "kimi-2.7-image-to-text",
"messages": [
{
"role": "user",
"content": [
{
"type": "text",
"text": "What is roughly shown in this image?"
},
{
"type": "image_url",
"image_url": {
"url": "https://example.com/sample-image.jpg"
}
}
]
}
],
"stream": true,
"max_tokens": 300
}'
أسعار Kimi 2.7 Image to Text
| المعلمات | السعر | السعر الأصلي | الخصم |
|---|
README
واجهة Kimi 2.7 Image-to-Text API مستقرة وميسورة التكلفة (فهم الرؤية من Moonshot AI)
توفر Kimi 2.7 Image-to-Text API على Flaq AI وصولا إلى نموذج Moonshot AI متعدد الوسائط لفهم الصور، والأسئلة والأجوبة على الصور، والاستخراج بأسلوب OCR، وسير عمل الاستدلال المرتكز على الصورة. تساعد هذه التكاملة الميسورة مع Kimi vision API المطورين على تحويل مدخلات الصور إلى أوصاف نصية مفيدة وإجابات وملخصات ورؤى منظمة. وهي مصممة للفرق التي تحتاج إلى تحليل صور مستقر من دون صيانة بنية رؤية منفصلة.
الميزات الرئيسية في Kimi 2.7 Image-to-Text API
- فهم بصري: حلل مدخلات الصور وأرجع أوصافا نصية واضحة وشروحا وإجابات عبر تكامل Kimi 2.7 API.
- استدلال مرتكز على الصورة: اجمع التفاصيل البصرية مع أسئلة المستخدم لدعم تحليل المنتجات، ومراجعة المستندات، والملاحظات الإبداعية، وسير العمل متعدد الوسائط.
- استخراج بأسلوب OCR: استخرج النصوص المرئية والتسميات ومحتوى الواجهات وتفاصيل الصور للأتمتة اللاحقة ومعالجة البيانات.
- وصول API مناسب للمطورين: أضف قدرات image-to-text إلى التطبيقات عبر مسار Flaq AI مستقر ومصمم لسير عمل الإنتاج.
- توجيه مرن للمطالبات: استخدم تعليمات باللغة الطبيعية لطلب تسميات قصيرة، أو تحليل مفصل، أو ملخصات منظمة، أو مخرجات خاصة بالمهمة.
- سير عمل رؤية ميسور التكلفة: ابن ميزات تحليل بصري قابلة للتوسع مع وصول اقتصادي إلى نماذج Moonshot AI.
كيفية استخدام Kimi 2.7 Image-to-Text API للتحليل البصري على Flaq AI
- الإدخال: إدخال صورة مع أسئلة باللغة الطبيعية أو تعليمات تحليل.
- الإخراج: ردود نصية تصف المحتوى البصري، أو تستخرج المعلومات، أو تجيب عن الأسئلة، أو تلخص تفاصيل الصورة.
- دعم الصور: يعمل مع سير عمل مدخلات الصور الشائعة لمرئيات المنتجات ولقطات الشاشة والمستندات والأصول الإبداعية.
- القدرات: وصف الصور، وQA بصري، وقراءة بأسلوب OCR، واستدلال متعدد الوسائط، وتحليل لقطات الشاشة، وملخصات بصرية منظمة عبر تكامل Kimi 2.7 API.
أفضل حالات استخدام تكامل Kimi 2.7 Image-to-Text API
- تحليل لقطات الشاشة وواجهات UI: حول لقطات شاشة التطبيقات إلى شروح، وملاحظات أخطاء، وملاحظات إمكانية الوصول، ومخرجات مراجعة منظمة.
- مراجعة المستندات والنماذج: استخرج الحقول والتسميات والجداول وتفاصيل المستندات المرئية من الصور للأدوات الداخلية والأتمتة.
- فهم صور التجارة الإلكترونية: صف المنتجات، وحدد السمات، ولخص مرئيات الكتالوج، وادعم سير عمل الإشراف أو التجارة.
- ملاحظات على الأصول الإبداعية: حلل التكوينات والأنماط البصرية واتساق العلامة التجارية وإبداعات الحملات بمخرجات موجهة بالمطالبة.
- مساعدو AI متعدد الوسائط: اسمح للمستخدمين برفع الصور وطرح أسئلة باللغة الطبيعية داخل منتجات الدعم والتعليم والإنتاجية.
ملاحظة يرجى التأكد من امتثال مدخلات الصور والمطالبات لمتطلبات السلامة لدى Moonshot AI وFlaq AI. إذا حدث خطأ، فعدّل مدخل الصورة أو المطالبة ثم حاول مرة أخرى.
Kimi 2.7 Image-to-Text مقابل المنافسين: تحليل مقارن
- Kimi 2.7 Image-to-Text vs. GPT Image-to-Text
يوفر فهم الصور في GPT تغطية واسعة متعددة الوسائط. تقدم Kimi 2.7 Image-to-Text API بديلا من Moonshot AI للفرق التي تريد تحليلا بصريا ميسور التكلفة عبر Flaq AI. - Kimi 2.7 Image-to-Text vs. Gemini Image-to-Text
يتميز Gemini في الاستدلال البصري داخل منظومة Google. يمنح Kimi 2.7 المطورين مسارا مستقرا آخر لأوصاف الصور، والاستخراج بأسلوب OCR، والأسئلة والأجوبة على الصور. - Kimi 2.7 Image-to-Text vs. Claude Vision
يفيد Claude Vision في التفسير الدقيق للصور والمستندات. يركز Kimi 2.7 على سير عمل image-to-text العملية لتكاملات المنتجات القابلة للتوسع. - Kimi 2.7 Image-to-Text vs. Grok Image-to-Text
يوفر Grok Image-to-Text سلوك نموذج xAI للتحليل البصري. يقدم Kimi 2.7 وصولا متعدد الوسائط من Moonshot AI للفرق التي تقارن سلوك المزودين وأسلوب الاستجابة. - Kimi 2.7 Image-to-Text vs. Qwen Vision Models
تعد Qwen vision models خيارات قوية من Alibaba. تمنح Kimi 2.7 Image-to-Text API المطورين بديلا مدعوما من Moonshot لفهم بصري في الإنتاج.
