解析、提取、分類——現在各自擁有自己的MCP | 每週通訊
LlamaIndex團隊規模翻倍,推出多項更新:提取支援對話模式、快速層級輸出Markdown、Agentic Plus改進表格處理、所有方案支援100使用者。同時,AI新聞包括GPT-5.6效能分析、Bun用Rust重寫Zig程式碼、蘋果起訴OpenAI等。
本週,LlamaIndex團隊在舊金山總部聚會,慶祝過去一年團隊規模翻倍,併發布了一系列重要產品更新。首先,提取(Extract)功能現在支援對話模式:使用者無需手動編寫JSON Schema,只需透過自然語言對話即可定義提取結構,極大降低了使用門檻。其次,快速層級(Fast Tier)現在預設輸出Markdown格式,只需設定引數 tier="fast", version="latest" 即可在API和UI中獲得乾淨整潔的Markdown輸出。這一改進得益於底層的LiteParse引擎,它提供了更好的OCR能力和PDF字型處理。此外,Agentic Plus模組在處理表格方面取得了顯著進步,能夠更準確地解析複雜表格資料。更重要的是,所有方案(包括免費版)現在都支援100個使用者,使得團隊協作更加便捷。解析使用者介面也進行了最佳化,包括更清晰的設定選項、更簡單的模式選擇,以及在意外解析大型PDF(如400頁文件)前的確認提示。新增的暗黑模式也讓長時間工作的開發者眼睛更舒適。
社群活動方面,7月16日在舊金山855 Brannan Street將舉辦“Swap and Pitch”活動,展示專案並尋找合作。7月24日有兩場活動:在紐約華盛頓廣場公園南側舉行的AWS AI Builder Lab,以及同日在舊金山525 Market Street的AWS Builder Loft舉辦的You.com Agentic Hackathon,參與者可以親手構建AI智慧體。
AI新聞方面,GPT-5.6首次登上ParseBench基準測試,在文本和表格處理上表現強勁,但在圖表和佈局方面仍然存在困難。最值得注意的是,Luna模型比Sol模型便宜約6倍,但在所有ParseBench指標上僅有輕微下降,這表明更多推理token並不能有效提升視覺理解能力。Bun團隊使用64個Claude例項,在11天內花費16.5萬美元的token,將53.5萬行Zig程式碼重寫為Rust。這一舉動引發了Zig語言建立者的尖銳反駁,成為本週最具爭議的話題。蘋果公司因商業秘密問題起訴OpenAI,這兩家公司在不到兩年內從ChatGPT-on-iPhone的合作伙伴關係轉變為聯邦法庭的對立雙方。TypeScript 7正式釋出,包含Go編譯器,編譯速度提升約10倍。最後,圖表顯示美國IPO市場在AI浪潮推動下有望創下新高。