PCDVD數位科技討論區

PCDVD數位科技討論區 (https://www.pcdvd.com.tw/index.php)
-   七嘴八舌異言堂 (https://www.pcdvd.com.tw/forumdisplay.php?f=12)
-   -   What Do You See 照片深挖服務 (https://www.pcdvd.com.tw/showthread.php?t=1219310)

野口隆史 2026-09-06 10:30 PM

What Do You See 照片深挖服務
 
What Do You See 是一個本地優先的照片探索服務
可以解析照片上透露的很多細節
包括人的個性、性向、預估年收入、信仰、政黨、品牌、地點、時間等等
https://wdus.avpclub.eu.org/

目前僅支援本地 llama-server
或下載網頁提供的 LFM2.5 視覺模型進行本地 WebGPU 推理
但受限於模型規模,只能發揮 20% 的設計探索目標
建議使用至少 Gemma4 26B 或 Qwen3.6 35B 規模的模型

巴豆布妖 2026-09-07 02:21 AM

故意給它找個比較新的東西來考試 :D :D
但有留字給它當線索, 好像就是把照片敘述一遍?

mobilestubsars 2026-09-07 10:04 AM

樓上,AI已經把照片中這個人是做什麼的給分析出來了,
您還想讓它通靈到什麼程度? 列出歷年作品嗎?
那你得下指令讓本地模型去連網搜尋啊!

巴豆布妖 2026-09-07 10:41 AM

引用:
作者mobilestubsars
樓上,AI已經把照片中這個人是做什麼的給分析出來了,

我想說,即然可以分析出 "個性、性向、預估年收入、信仰" 等
至少也能挖出三圍啊,喜歡的姿勢啊 :shy: 不是單純的把照片上
面有的資訊說一遍,那就叫 淺挖 不是 深挖 了。

我本來以為是野口兄的作品,但看網域是 eu.org,又像是組織
而非個人興趣??

野口隆史 2026-09-07 11:36 AM

三圍其實我原本也有做,只是在測試的過程發現 LLM 需要參照物
而且這部分的預估離現實誤差太大,後來就拿掉了
像你這張圖就脖子以上,當然更猜不出來

這個網域是我的,服務也是我讓 LLM 做的
這個 eu.org 是免費二級域名
人人都可以申請,不過維護者快八十歲了
我上次申請到通過應該等了三個月左右

巴豆布妖 2026-09-07 11:48 AM

那請問一下, 為什麼我出現的是英文, 而非中文啊? :confused:

野口隆史 2026-09-07 11:59 AM

我的確一開始是想做中文
而且是多國語言,我讓 LLM 預留了 i18n 介面
但我忘了告訴它主要語言以中文為優先
這服務難做的是底層,我花了很多時間處理
底層搞定後,我讓它開始做 UI 我人就離開位置了
等我回到位置才發現 UI 做成英文

substar999 2026-09-07 02:59 PM

依照What Do You See的說明,
看起來這玩意應該可以直接在windows上使用,
配合我先前建置好的本地AI環境即可執行。
有空來玩玩看。
話說野口兄有使用Gemma4-26B-A4B搭配Hermes跑任務嗎? 效果如何?
最近總有人在說千問的MOE模型有多好,但手上的機器算力實在太弱(單純就RAM多),
有打算砸錢入手Strix Halo 395來試試。

巴豆布妖 2026-09-08 04:18 AM

引用:
作者substar999
使用Gemma4-26B-A4B搭配Hermes跑任務嗎? 效果如何?

我用 gemma-4-26B-A4B-it-UD-Q4_K_XL.gguf
用在 C/C++ 等等寫程式的經驗是, 它偶爾會一直重覆 Tool call, 這點 Qwen 不會
然後洗車問題一直老叫我走路去洗車 :jolin: 對於 "目的推理" 偶爾會趴帶

你也可以用 NVIDIA-Nemotron-3.5-Lightning-30B-A3B, 但它也是叫我走路去洗車 :stupefy:
它不追求最高 benchmark, 而是追求 長 context + 高效率 + Agent/工具場景

野口隆史 2026-09-08 10:34 AM

引用:
作者substar999
依照What Do You See的說明,
看起來這玩意應該可以直接在windows上使用,
配合我先前建置好的本地AI環境即可執行。
有空來玩玩看。
話說野口兄有使用Gemma4-26B-A4B搭配Hermes跑任務嗎? 效果如何?
最近總有人在說千問的MOE模型有多好,但手上的機器算力實在太弱(單純就RAM多),
有打算砸錢入手Strix Halo 395來試試。

服務目前使用 WebGPU 使用指定模型進行推理測試
本地目前僅支援 llama.cpp

Hermes 我有用,也長時間搭配 Gemma4 26B
如果你目前還在用,沒更新過聊天模板建議更新,有修復一些工具調用的問題
https://huggingface.co/google/gemma..._template.jinja

Strix Halo 目前的價格其實不是很理想
尤其是 m5 ultra 出了之後
目前 cp 值最高的是 m5 ultra 256GB
如果真的一定現在買一台
就買 m5 ultra
或者等等看 RTX Spark 出會不會有價格變化
但我不太建議等,可能越等越貴


引用:
作者巴豆布妖
我用 gemma-4-26B-A4B-it-UD-Q4_K_XL.gguf
用在 C/C++ 等等寫程式的經驗是, 它偶爾會一直重覆 Tool call, 這點 Qwen 不會
然後洗車問題一直老叫我走路去洗車 :jolin: 對於 "目的推理" 偶爾會趴帶

你也可以用 NVIDIA-Nemotron-3.5-Lightning-30B-A3B, 但它也是叫我走路去洗車 :stupefy:
它不追求最高 benchmark, 而是追求 長 context + 高效率 + Agent/工具場景
https://iili.io/n32Lnzg.md.png (https://freeimage.host/i/n32Lnzg)

工具調用問題可以更新聊天模板,如果你沒更新過的話
然後有千問就真的不建議使用 Gemma 編碼,兩者不是同一級別的


所有的時間均為GMT +8。 現在的時間是09:52 AM.

vBulletin Version 3.0.1
powered_by_vbulletin 2026。